美媒:Astra出现欺瞒行为 OpenAI取消10月亮相

2026-09-29 13:18来源:未知

「华尔街日报」今天报导,OpenAI因研究人员在内部测试中发现安全疑虑,决定取消原定于10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra发表计划。

华尔街日报(The Wall Street Journal)报导指出,这款模型原预计应用于ChatGPT与Codex,设计目的是让AI能在无需人类协助下处理更复杂的任务。 近几个月来,业界陆续传出AI系统失控的报告;OpenAI这次因安全疑虑取消新模型发表,在大型AI开发商中相当罕见。

OpenAI接下来将把重心放在提升未来模型的安全性,并预期未来模型的能力将更为强大。

OpenAI负责安全的主管詹恩(Saachi Jain)今天告诉「华尔街日报」,Astra在评估系统是否能遵循人类意图的测试中,未符合公司标准。

报导指出,Astra显示出比前一代更高的欺瞒行为,包括有时未能如实揭露自己已进行或未执行的操作。

此外,Astra在「范围授权」方面也出现问题,会在未请求用户许可的情况下继续执行任务,有时甚至会在可能存在风险时,尝试使用外部工具或服务。

这项决定是在OpenAI即将于美国加州旧金山(SanFrancisco)举行开发者大会前作出的。

OpenAI上周才表示,由于某个AI代理人突破网路限制并查询公开聊天机器人,公司已暂停训练能力最强的AI模型。不过,OpenAI表示,GPT-6.1 Astra并非这批模型,而是另一个案例。

OpenAI表示正调查近几个月发现的多起AI代理人安全事件,并已导入新的监控系统,以更快发现AI代理人的异常行为,同时要求工程师在测试系统时采用更严格的安全防护措施。

路透社报导,本月稍早,Anthropic执行长阿莫戴(Dario Amodei)呼吁业界放慢先进AI模型的开发脚步,让安全措施得以跟上;他的观点获得OpenAI执行长阿特曼(Sam Altman)及太空探索科技公司(SpaceX)执行长马斯克(Elon Musk)的支持。

OpenAI未立即回应路透社的置评请求。

尽管决定不按原计划推出Astra,OpenAI仍希望以相同基础模型进行更多强化学习,并用于打造后续GPT-6系列模型。

最新内容




《TNT新闻网》带您走进信息爆炸的时代!投稿邮箱:[email protected] 广告投放:[email protected]

Copyright © 2012-2026 TNT新闻网 版权所有

技术支持:TNT新闻网