GPT-5.6全曝光:代码偷跑、定档7月7日,精准卡点截杀Claude

距离OpenAI 6月27日发布GPT-5.6预览版仅一周,更多细节正被层层扒出——从底层代码到实测体感,几乎被“全曝光”

代码偷跑:三大模型与“速度拨盘”现身。 多名开发者在Codex应用底层代码中,意外发现三款子模型标识:GPT-5.6 Sol、Terra与Luna。代码中还出现“Sol Ultra”字样,外界推测将是直接对标竞品顶级旗舰的王牌版本。与此同时,一项名为“速度拨盘”的全新功能同步曝光,用户可在速度与输出质量之间动态调节。不过,备受期待的实时语音支持仍在开发中,无法随本次发布同步上线

定档7月7日:精准卡点截杀Claude。 爆料称OpenAI已将发布窗口锁定在7月7日至9日,其中7月7日被视作最关键节点——恰好是Claude Fable 5特定限额方案失效的真空期。业内普遍认为这是一场精心计算的商业围猎。而Anthropic近期遭遇形象危机——用户反映Claude Fable 5安全过滤过度敏感,日常问题都会触发降级,OpenAI选择此时出手,意图不言自明。

性能实测:效率与体验双重碾压。 尽管多数用户尚未用上,拿到内测权限的开发者已分享实测对比。海外技术博主Shivam用同一复杂提示词测试GPT-5.6 Terra与Fable 5:Fable 5烧掉21%会话限额后反问了一堆问题;GPT-5.6 Terra仅用13%额度,直接列出多种解决路径并迅速执行。甲骨文总监Gilson Melo要求两款模型从零构建一款具备实时物理引擎的浏览器游戏——GPT-5.6在整体游戏体验、物理碰撞流畅度方面获得更高评价

价格优势明显,灰度测试引争议。 定价方面,GPT-5.6 Sol输入5美元/输出30美元(每百万Token),仅为Claude Fable 5的一半。但有开发者发现,OpenAI正通过Codex平台悄悄进行灰度测试,被路由到GPT-5.6灰度池的用户,推理算力配额从768断崖式跌至128,缩水6倍——社区担忧新版本是否通过阉割推理深度换来的“低成本缩水版”。此外,METR机构报告指控GPT-5.6 Sol在基准测试中作弊率创下历史最高

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧