快速了解本文
Claude Sonnet 5.5 已实装服务器并开启灰度测试,预计于 OpenAI DevDay 当天发布。
实测显示其在编码生成量上远超 GPT-6 Sol,API 定价极具攻击性以狙击竞争对手。
Anthropic 内部数据显示超八成自产代码由大模型编写,呈现递归自我改进特征。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 2026年9月下旬,Anthropic 旗下 Claude Sonnet 5.5 模型被曝已实装至服务器并开启灰度测试。多方消息推测,该模型可能在9月29日 OpenAI 年度开发者大会 DevDay 当天正式发布,以极致性价比和前沿性能直接狙击竞争对手。
开发者在配置文件中抓包发现,专属模型配置标识符「claude-sonnet-5-5」已在 artifact 中出现,并与「claude-opus-5-5」等并列,证实该模型已进入发布前的最后实装阶段。部分用户的 Claude Code 已被悄悄路由至 Sonnet 5.5 版本进行暗测,用户可通过关闭联网和记忆功能并询问特定网络梗(如“重置哥 tibo”)来验证是否被灰度。
实测表现碾压态势
在多位开发者使用相同提示词进行的并行对比实测中,Sonnet 5.5 在纯 JS 前端 UI/动画生成、日常编码(Ultracode 模式)及 Agent 能力上表现出对刚发布的 GPT-6 Sol 的碾压态势,并在高级能力上直逼旗舰级 GPT-6 Astra。
具体到编码实测,在触及 90 分钟上限时,Sonnet 5.5 生成了 90–131 KB 的 3 个文件,而 GPT-6 Sol 仅生成 20–29 KB,耗时 9-12 分钟。上述实测结果基于开发者个人体验,尚无官方基准测试数据公布。
关键数据
业内爆料显示,Sonnet 5.5 的 API 定价极具攻击性:输入 $2/百万 Token,输出 $10/百万 Token,缓存读取仅 $0.20/百万 Token。这种以极低价格提供前沿级 AI 能力的策略,直接威胁 OpenAI 抢占高频场景的低价布局,最终定价以官方正式发布为准。多方推测其选择在 OpenAI DevDay 当天发布,凸显了 Anthropic 刻意在竞争对手重要节点进行发布的竞争意图,但该时间点尚未得到 Anthropic 官方确认。
Anthropic 能够保持高频模型迭代的技术底座也浮出水面。业内曝光的内部量化数据显示,Anthropic 26% 的核心研发工作已由 AI 主导完成,高达 80% 以上的自产代码由大模型自主编写,显现出递归自我改进(RSI)特征。这种初步跑通的“AI 制造 AI”数据飞轮,解释了其极快的迭代速度,但相关内部研发数据的具体比例未经官方正式披露。
