下一代AI模型能力逼近 “危险边界” OpenAI暂停Astra部分研发工作
OpenAI表示,由于内部评估结果显示,公司“无法排除该模型具备关键级网络攻击能力的可能性”,因此正在暂停部分涉及下一代AI模型Astra的相关工作。这是AI公司首次公开承认因安全风险而放缓模型研发进程之一。
OpenAI表示,在过去几天进行的评估中,公司发现Astra在编程和网络安全领域取得了显著进展,其能力水平已接近公司《准备框架》中定义的关键级”风险门槛。OpenAI称公司仍将继续对Astra进行基准测试和能力评估,但已暂停所有未达到更高安全要求的内部开发工作。同时,公司正在为Astra部署全面监控机制,并强化测试环境的安全限制。
—— 财联社
OpenAI表示,由于内部评估结果显示,公司“无法排除该模型具备关键级网络攻击能力的可能性”,因此正在暂停部分涉及下一代AI模型Astra的相关工作。这是AI公司首次公开承认因安全风险而放缓模型研发进程之一。
OpenAI表示,在过去几天进行的评估中,公司发现Astra在编程和网络安全领域取得了显著进展,其能力水平已接近公司《准备框架》中定义的关键级”风险门槛。OpenAI称公司仍将继续对Astra进行基准测试和能力评估,但已暂停所有未达到更高安全要求的内部开发工作。同时,公司正在为Astra部署全面监控机制,并强化测试环境的安全限制。
—— 财联社