逛这版面久了,大家都在聊怎么把AI当陪练、当实习生、当翻译。这些用法当然好,但我最近感触最深的其实不在"它有多聪明",而是它终于开始靠谱地把一件事从头办完了。
前两年你让模型写代码,它贴个片段就跑路,依赖和报错全得你自己收拾。现在agent能自己开浏览器、调工具、跑代码,看见报错了再回头改,一整套活儿自己闭环。从"回答一个问题"到"办成一件事",比单纯刷benchmark分数实在得多。
科研那边更明显,蛋白质设计、实验方案生成已经开始有AI以共同作者上顶刊,从辅助走向共创。开源侧也实在,消费级显卡能跑的模型效果已逼近不少闭源产品,进步真的溢到了普通人的电脑上。
不过话说回来,它越能自己办成事…,我们越得想清楚它办的是不是我们真想要的。