Anthropic 卡着 OpenAI 年度开发者大会的节点,抢先甩出了 Claude Sonnet5.5。这款被定位为日常工作全能助手的新模型,把速度快、成本低、质量高这套常被说成不可能三角的标签直接撕了下来——相比前代 Sonnet5,速度提升30%,单任务成本最高降30%,定价却只有 Opus5.5的一半,性能却几乎追平,甚至在 Terminal-Bench4.0等多项测试里反超了自家的高端型号。
最能说明它脑子够用的,是游戏里的表现。Sonnet5.5成了首个仅靠看截图就能通关《宝可梦 红》的 Sonnet 模型——不靠内存修改、不靠内置攻略,只凭一帧帧画面去理解世界、做决策、推进剧情,把视觉理解与长程规划揉进了同一个脑袋。
能力版图远不止写代码。办公、设计、3D 模拟等场景里它都表现亮眼,且支持五档 Effort Level 调节:低和中档位专门服务常规任务,性价比极高;但把最高档开满时,输出 Token 量会剧增,成本反而可能超过大杯的 Opus5.5,甚至出现性能回落——换句话说,档位不是越高越香,得按活儿的轻重来拨。
护城河也被进一步加厚。Sonnet5.5搭载了防蒸馏机制,并配上与 Opus 同级别的网络安全防护,既防着别人拿自家模型去偷师,也把安全底线拉到和旗舰一致。当 Anthropic 用一半的价格、追平的性能、外加通关宝可梦的实景演示,在对手大会前夜按下发布键,这一发瞄准的显然不只是开发者钱包,更是整个中端市场的定价权。