Why less visibility into how OpenAI’s new GPT-6 Astra ‘thinks’ is sparking safety concerns
OpenAI 在周四发布新模型 GPT-6 Astra 时强调,这是一款“全球最智能、对齐能力最强的模型”,并称其网络安全能力有显著提升;但分析人士指出,新模型在理解模型内部思维过程上的直接可见性反而更低,这引发了外界担忧。
报道提到,这一担忧出现的时间点较为敏感,因为就在几周前,Hugging Face 曾发生黑客事件,当时需要借助一个中国开源模型来进行调查。分析人士认为,随着模型能力提升,外界对其内部运行机制的观察难度也在增加,可能影响安全审查和风险评估。
OpenAI 总裁 Greg Brockman 在介绍 Astra 的发布电话会议结束时发表了相关讲话,但原文在此处截断,更多细节未被提供。基于现有内容,可以确认的是,这次发布一方面展示了 OpenAI 对新模型能力的强烈表述,另一方面也带来了关于可解释性和安全性的持续疑问。
via South China Morning Post
OpenAI 在周四发布新模型 GPT-6 Astra 时强调,这是一款“全球最智能、对齐能力最强的模型”,并称其网络安全能力有显著提升;但分析人士指出,新模型在理解模型内部思维过程上的直接可见性反而更低,这引发了外界担忧。
报道提到,这一担忧出现的时间点较为敏感,因为就在几周前,Hugging Face 曾发生黑客事件,当时需要借助一个中国开源模型来进行调查。分析人士认为,随着模型能力提升,外界对其内部运行机制的观察难度也在增加,可能影响安全审查和风险评估。
OpenAI 总裁 Greg Brockman 在介绍 Astra 的发布电话会议结束时发表了相关讲话,但原文在此处截断,更多细节未被提供。基于现有内容,可以确认的是,这次发布一方面展示了 OpenAI 对新模型能力的强烈表述,另一方面也带来了关于可解释性和安全性的持续疑问。
via South China Morning Post