DAIR.AI 创始人 Elvis Saravia 最近分享了一段三周实测:他在 Slack 里部署了一个叫 @viktor_com 的 AI 智能体,原本只是让它帮忙筛选论文,结果它干了一件超出预期的事。

从被动筛选到主动纠错

打开网易新闻 查看精彩图片

第一天,智能体按请求从当周论文中挑出三篇值得读的,当天早上就返回了结果。这个表现中规中矩。但第 19 天,事情起了变化——它没被要求,主动发消息指出一篇新论文与课程第 4 模块的路由部分存在矛盾。

更谨慎的是,两天后它起草了修改方案,但保持了未发布状态。这个细节值得注意:它没有直接改,而是把决定权留给了人。该模块有 2100 名学员,改动影响面不小。

主动性的边界在哪

这次实测最有意思的点,不是智能体能干活,而是它开始"多管闲事"。从执行指令到发现问题,再到起草修改但不擅自发布,这套行为链条已经接近一个初级助手的判断力。对做 AI 课程的人来说,这种主动纠错能力,可能比筛选论文本身更有价值。