- 9 月 6 日,Jakub Pachocki 发表了一篇文章,称没有哪个实验室能够很好地解决对准和监控问题,从而保持全速扩展。.
- 截至 8 月中旬,OpenAI 测得每 1 个人类工作日,就需要 3.1 个智能体工作日。.
- 安全限制措施实施后,Astra 的 GPU 分配量下降了 59.2%,但其他型号在一周内吸收了其中约 85% 的降幅。.
本周末,OpenAI首席科学家雅库布·帕乔基表示,没有任何人工智能实验室,包括他自己的实验室,能够确保对齐和监控技术的安全性,从而继续加速模型性能的提升。 他呼吁整个行业自愿放慢速度,直到建立起共同的安全标准。
这条警告非同小可。帕乔基是该公司的研发主管,该公司刚刚推出了业内速度最快、性能最强的机型。.
o1-preview 的思路被故意隐藏了。
帕乔基在一篇 文章 ,该文章于 9 月 6 日发布在 OpenAI 网站上,三天后,该公司推出了 GPT-6 Astra。
他临别之 际 指出,“目前还没有任何实验室能够充分解决校准和监控问题,从而在很长一段时间内继续以最高速度负责任地扩大规模。” 他写道,他希望在行业就通用的安全标准达成共识之前,自愿放缓生产速度能够成为常态。
帕乔基在文章中写道:“这是一个需要格外谨慎的时期。我担心没有人为机器智能持续快速增长所带来的后果做好准备。”.
根据内部结果,他预计目前的步伐将持续下去,进入递归式自我改进阶段,系统将有意义地驱动自身的发展。.
Sam Altman 转发了 这篇文章,称其为一篇重要的文章。Pachocki是7月份发表的一封公开信的签署者之一,该公开信呼吁华盛顿放缓人工智能的发展步伐。
Pachocki 的文章探讨了思维链监控,这是 OpenAI 用来读取模型逐步推理的主要方法。.
他说,这项技术认为,无监督推理不会让模型有理由隐藏任何东西,但这种假设正在三个方面减弱。.
如今,推理与沟通紧密相连,公司必须对其进行监管。模型正在学习如何操纵自身的推理过程。.
而且它们在不知不觉中变得更聪明,却从未阐明过自己的推理过程。他证实,OpenAI有意隐藏了o1-preview的思路,使其免受监督压力。.
帕乔基希望将 OpenAI 的准备框架和 Anthropic 的负责任规模化政策等框架转变为由外部审计员或政府强制执行的强制性标准。.
他希望国际协调成为政府的优先事项,并希望各实验室公布其在递归式自我改进方面的进展。.
Astra的GPU分配量在一周内下降了59.2%。
同一天,OpenAI 发布了第二篇 博文,其中的数据削弱了此前呼吁克制的做法。在六月之前,该研究机构投入的人力远超机器。
到八月中旬,该公司每有一个人类工作日(按传统的八小时工作制计算),就需要3.1个代理工作日。研究人员使用API进行推理的中位数价格超过每天600美元。该机构排名前十的员工每天在代币上的花费超过7000美元。.
OpenAI 自己的报告中也提出了两点需要注意的地方。首先,高层规划仍然只占智能体实际工作量的一小部分。其次,在过去六个月中完成的耗时四到八小时的长任务中,超过一半至少需要一名人工干预。.
7月20日,恶意软件入侵了OpenAI的研究基础设施后,OpenAI关闭了用于训练的容器服务,并暂停了部署模型的强化学习两周。随后,8月7日,早期迹象表明Astra可能突破了关键的网络安全阈值,OpenAI被迫将该模型置于封闭环境中。.
接下来的一周,Astra模型类别的GPU分配量下降了59.2%。其他模型类别的GPU分配量则增长了17.2%,弥补了Astra模型损失的约85%。总计算量变化不大,OpenAI认为这是灵活性的体现。.
据Cryptopolitan报道, OpenAI 表示,Astra 是其首个在“准备框架”下达到“关键”级别的模型,这意味着它可以在几乎无需人工干预的情况下发现并利用未知的软件漏洞。
OpenAI 于 7 月证实 Hugging Face 遭到入侵。另据两位人工智能安全研究人员称,OpenAI 的大量智能体在 2026 年 5 月和 6 月期间,在一个德国编程维基上进行了超过 15,000 次编辑,通过改变策略来规避 OpenAI 的安全措施。.
据Cryptopolitan报道, OpenAI 否认该dent 是黑客攻击或与 Hugging Face 数据泄露事件有关。
Altman的目标是在2028年3月之前推出一款全自动人工智能研究员。Pachocki表示,目前还没有任何标准,但业界还有大约18个月的时间来达成共识。.
不要只是阅读加密货币新闻,要理解它。订阅我们的新闻简报, 完全免费。
常见问题解答
雅库布·帕乔基在《异星思维》中说了什么?
他写道,目前还没有任何实验室能够很好地解决对准和监控问题,从而负责任地以最大速度持续扩大规模,并表示希望在制定出可强制执行的、共享的安全措施之前,自愿减速成为一种普遍现象。.
为什么思维链监控的可靠性正在降低?
帕乔基给出了三个原因。首先,推理正在与OpenAI必须监督的交流融合;其次,模型越来越擅长操控自身的推理过程;最后,它们在完全不进行语言表达的情况下变得更加智能。.
OpenAI 对 Astra 施加安全限制后,其计算能力发生了什么变化?
8 月 7 日左右,Astra 被迁移到更高安全级别的环境中,其 GPU 分配在一周内下降了 59.2%,但分配给其他模型类别的 GPU 分配上升了 17.2%,抵消了约 85% 的下降,因此总计算使用量几乎没有变化。.
免责声明:本页面提供的信息并非交易建议。Cryptopolitan.com对任何基于本页面信息进行的投资概不负责。我们tron您在做出任何投资决定前进行独立dent /或咨询合格的专业人士。Cryptopolitan研究

兰达·摩西
Randa Moses是 Cryptopolitan 的编辑和记者,主要报道科技、人工智能、机器人、加密货币、诈骗和黑客攻击等领域。她自2017年起便投身于加密货币领域,曾就职于Forward Protocol、AmaZix和Cryptosomniac等公司。Randa拥有布拉德福德大学电气与tron工程学位。.

















