从零到26%:Claude已主导公司下一代模型的部分研发,尚未完全脱离人工介入

从零到26%:Claude已主导公司下一代模型的部分研发,尚未完全脱离人工介入

近日,美国人工智能公司Anthropic表示,其大模型聊天机器人Claude已“主导”公司超过四分之一的人工智能研发工作。

这是该公司计划定期公Anthropic的一组新指标之一,用来向外界展示AI正以多快的速度参与下一代模型的开发。

▲9月17日,DreamForce2026科技峰会上的Anthropic展台

据公司内部评估,Claude目前能在约26%的研发任务中起主导作用:它将根据高层提示完成大部分端到端工作,人类则主要负责监督。

不过,直到今年2月,这一比例还几乎为零。Anthropic同时称,逾90%的研发已达到“人机协作”及以上水平,但尚未完全脱离人工介入。

这一占比在短短数月内从零升至约四分之一,标志着公司正朝着“无需人类介入即可自我构建”的人工智能再进一步。

与此同时,为防止代理失控,Anthropic公司9月17日表示已部署多套内部自动监控系统,一旦发现可疑操作便通知人工复核。

据报道,8月,公司内部平台上约有3万个AI代理同时从事研究与工程工作,每项操作执行前都要过审;当月逾10亿次决策中,约每4.7万次就有1次被拦截。

Anthropic解释,公布这些指标是为了衡量世界距离实现“递归自我改进”(即AI自主设计、训练更强继任模型)还有多远。

红星新闻记者 周月潇

编辑 邓旆光 审核 任志江