你知道现在挑AI模型有多纠结吗?不是没得选,是太多了。前两天Netlify发了个报告,拿同一个问题去问一批模型,结果五花八门——有的给你整一堆花活,有的老老实实把事办了。最近到处都弥漫着这种FOMO,怕自己用的那个不是最好的。
这事我得说细点。他们搞了个叫AXIS的工具,专门给模型出题:建个新网站,然后改。改完看什么?不是看好看不好看,是看功能对不对。比如该用数据库的时候用了没有,该简单的时候有没有瞎折腾搞个复杂的。哪个模型老考砸,就不给你用。
有意思的是,他们现在把好多新模型都接进来了,什么Kimi K3、GLM 5.2、DeepSeek V4,都是最近吹得凶的开源模型。以前你只能在Claude、OpenAI Codex和Gemini CLI这些里面挑,现在选择一下多了,反而不知道用哪个了。
我倒是想起个事。以前背《赤壁》,“折戟沉沙铁未销”,总想着打仗靠的是运气。现在看这堆模型,忽然明白杜牧那意思了——东风不给周瑜面子,铜雀台里就锁着二乔了。挑模型不也这样吗?参数再强,不对你的场景,就是使不上劲。
不过话说回来,他们测的也就那几个场景,建个站改个页面。真要拿它写代码、写文章,是骡子是马还得自己牵出来遛遛。反正现在都能试。