AB
AiBoss
ニュース

研究:AI智能体承担更多模型开发工作,但决策权仍在人类手中

一项针对自研模型项目的观察研究显示,AI智能体在开发任务中承担了越来越多执行工作,但方法、参数与目标等关键决策仍主要由人类做出。研究者提醒,不应把智能体动作增多直接理解为自主性提升。

核心事实

据 the-decoder.com 报道,一支包含中国复旦大学研究人员的团队对自身参与的模型开发项目做了观察性分析,覆盖 56 名参与者的 700 多条任务日志以及所用智能体的日志。该项目围绕一个名为 Atria Dawn Preview 的智能体语言模型展开,据称采用混合专家架构、参数规模为 7440 亿,面向研究与工程任务。

研究称,被审查的任务中有 96.5% 用到了 AI。四周内,智能体动作与人类输入的比值中位数从 11 升至 28.5。但团队强调,这并不等于自主性提高:人类每做一次决策,会引出更多智能体步骤。在方法与参数上,人类做出 85.5% 的决策,AI 仅 9.2%;目标与范围上,人类在 93.4% 的情况下做最终决定。

背景与影响

研究还发现,在 455 个已完成且由 AI 辅助的任务中,有 151 个被参与者评为「没有 AI 就无法完成」,约占三分之一,且分布在 56 名参与者中的 27 人身上,并非集中在少数重度用户。遇到困难时,76% 的任务靠人类介入推进,其中人类帮助多为补充上下文、澄清需求或诊断问题并更换方法,亲自接手工作的比例很低。

团队据此把 AI 的角色描述为从研究对象、个人任务工具,演变为「项目伙伴」:AI 在人类设定的目标内起草和调整方案。研究者同时提出风险——当每个决策都建立在人类难以逐条复核的智能体链条之上,监督可能退化为「盖章式」审核。

限制与来源

需要说明的是,上述内容来自单一来源的报道,属于对特定项目的观察性研究,样本与场景有限,不能直接外推到其他团队或模型。文中涉及的模型能力、基准表现等说法尚未获官方独立确认,具体信息请以相关团队与官网当前披露为准。本文不构成任何投资或采购建议。