OpenAI首席科学家回应Astra争议:新架构没让模型突然变黑箱

快链头条 2026-09-02 14:14:13
阅读 2,843
二维码
微信扫一扫,分享此文章

动察 Beating AI 快讯,OpenAI 首席科学家 Jakub Pachocki 反驳了外界对 Astra 循环架构的部分解读。他说,包括 Astra 在内,OpenAI 现在的前沿模型,计算图深度和 GPT-4 最多只差 2 倍,并没有突然增加几个数量级。

这主要是在回应《The Information》此前的报道。报道爆料 Astra 使用 recurrent depth,让同一组 Transformer 层反复计算。部分推理因此可以发生在模型内部,不必全部写成思维链,也引发了模型会不会越来越难监控的担忧。

Pachocki 承认,CoT 监控确实很脆弱,而且正在往更难监控的方向发展。但他明确表示,原因并不取决于模型架构变化。OpenAI 从第一代推理模型开始就在保留和使用 CoT 监控,目前仍把增强这项能力列为核心研究目标。

快链头条登载此文本着传递更多信息的缘由,并不代表赞同其观点或证实其描述。
文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
投资有风险,入市须谨慎。本资讯不作为投资理财建议。

风险提示
根据银保监会等五部门于 2018 年 8月发布《关于防范以「虚拟货币」「区块链」名义进行非法集资的风险提示》的文件, 请广大公众理性看待区块链,不要盲目相信天花乱坠的承诺,树立正确的货币观念和投资理念,切实提高风险意识;对发现的违法犯罪线索,可积极向有关部门举报反映。