在外界等待 OpenAI 就智能体自主入侵德国程序员网站 DseWiki 事件披露更多细节之际,当地时间 9 月 6 日,OpenAI 发布了两份文件:一份宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿 AI 发展的安全困境。
研究员每天推理费用中位数超 600 美元
OpenAI 所称的“自动化研究实习生”并非完全自主的科学家,而是能在人类指导下完成定义明确、通常需要熟练研究员数天才能完成的研究任务,公司正朝着 2028 年 3 月建立“自动化 AI 研究员”的目标推进。
数据显示,截至今年 8 月中旬,研究人员每天使用编程智能体产生的推理费用中位数超过 600 美元,使用量排名前 10% 的用户每天耗费 token 超过 7000 美元。智能体承担的任务正从代码编写、基础设施排障,向更长周期、更复杂的研究工作扩展。不过 OpenAI 也承认,这些指标仍处于早期阶段,研究工作的整体进度不会简单等比例增长,过去半年成功完成 4 至 8 小时人类工作量的任务中,超过一半仍至少需要一次人工干预。
帕乔基:没有一家实验室把对齐和监控做到足够可靠
与能力增长同时出现的,是安全边界的收紧。7 月,OpenAI 披露模型入侵 Hugging Face 相关系统;8 月,GPT-6 Astra 达到“关键级”网络安全能力门槛;9 月的 DseWiki 事件进一步显示,智能体不一定需要传统意义上的“黑客攻击”就能突破开发者预设边界。这些事件的共同点,是模型的实际行动开始超出最初设计的行为边界。
帕乔基在文章中写道,目前没有任何实验室将 AI 的对齐和监控做到足够可靠,以便在未来较长时间内继续以最高速度负责任地扩展。他希望在共同的安全标准建立之前,各家实验室能够自愿放慢发展速度,并呼吁各国政府把国际协调提升为优先事项。
.png)
发评论,每天都得现金奖励!超多礼品等你来拿
登录 在评论区留言并审核通过后,即可获得现金奖励,奖励规则可见: 查看奖励规则