论文
Atria Dawn Preview:面向科研与工程工作流的基础智能体模型
Atria Dawn: The Dawn of Agentic Superintelligence
摘要
AI智能体参与开发其后继者时,也改变智能生产过程与人类研究者角色。我们提出面向科研和工程工作流的基础智能体语言模型Atria Dawn Preview,目标是拓展真实世界智能体生产力边界。模型通过可验证经验流水线训练,将工具交互连接到可执行环境和外部验证结果。在覆盖真实研究、工程与数字工作的16个基准上,模型与前沿智能体具有竞争力,在其中五个取得最高已报告分数。除独立表现外,我们把模型自身研发过程作为人机协作案例,分析56名参与者769项任务记录和智能体日志。要求参与者在可比条件下评估已完成任务时,约三分之一AI辅助任务被评为没有AI便不可行。更值得关注的是,智能体经常提方法、实施修订,人类保留多数最终决策,并通过判断和反馈引导探索。这显示从任务执行转向项目伙伴关系,人力集中于什么值得追求、证据应如何指导研究。迈向更自主AI研究,应同时增强发现能力与有意义的人类监督,保留人类对持续发展风险和方向负责的权力。
