Anthropic Claude Opus 5.5降价20%至$4/$20,MMLU达58分历史最高;OpenAI GPT-6 Sol半价至$2/$10,Luna仅$0.10/$0.50。
本周最清晰的信号来自美国时间 9 月 22 日:三大前沿实验室中有两家在 90 分钟内相继推出了低成本模型。
Anthropic — Claude Opus 5.5。 5.5 家族的首款模型,Opus 5.5 定价为每百万 token 4 美元 / 20 美元——比 Opus 5 降价 20%——Anthropic 表示在典型工作负载下运行成本降低约 40%,同时在大多数任务上与 Fable 5.1 持平(Artificial Analysis Intelligence Index 得分 58,该指数迄今测得的最高分)。它配备了此前仅为 Fable 预留的网络/生物/前沿安全防护,并加入了来自 METR 和 Frontier Design 的外部测试。Sonnet 5.5 和 Haiku 5.5 将在未来几周陆续推出。
OpenAI — GPT-6 Sol 和 GPT-6 Luna。 Sol 定价为每百万 token 2 美元 / 10 美元,Luna 为 0.10 美元 / 0.50 美元——恰好是 GPT-5.6 促销价的一半,标注为标准定价(非限时促销)。两者都通过改进的缓存和推理效率继承了 GPT-6 Astra 的大部分能力;Sol 进入价值层级,成为 OpenAI 单位任务成本最优的选择。两款模型于周四在 ChatGPT Work 和 Codex 中上线。
读懂这背后的逻辑:开源模型的压力(DeepSeek、Qwen、Kimi、MiMo)现在对前沿定价的影响力已超过任何安全承诺。竞争的重心正在从"谁最强"转向"谁以最低成本、最快速度、最大规模部署接近前沿的能力"。
Google DeepMind 在 Gemini API 和 AI Studio 中新增了两款文本转语音模型:Gemini 3.8 Flash TTS 和更便宜的 Flash-Lite TTS,两者均支持可编程的语音设计。
亮点:2,000+ 个生产级嗓音、30 秒同意授权的语音克隆并受 SynthID 和 C2PA 来源保护、100+ 种语言和方言、数小时的双人说唱场景,以及语音爆发(vocal burst)标记语言。Flash 在 Hume Voice Design(71.4)和口音(60.8)上排名第一;Flash-Lite 在 Hume 整体质量上排名第二。未公布公开定价。
这与两周前的实时音频推送模式相同——Google 将语音视为一种商品化模态:高保真、低摩擦、默认水印。竞争护城河现在更多在于分发渠道(Chrome、Android、Workspace)而非原始质量。
Anthropic 新成立的生命科学研究团队利用 Claude 对海量 DNA 序列数据库进行自主搜索,发现了一个此前未知的酶系统:阵列相关逆转录酶(array-associated reverse transcriptases,ART)。
此次运行动用了约 950 个并行智能体,历时 21 小时、消耗 2.1 亿 token,识别出噬菌体中一种不寻常的逆转录酶,伴随类 CRISPR 重复阵列和一个辅助蛋白。MIT 的张锋(Feng Zhang)称这一发现"确实令人着迷"。预印本已发布;功能仍在研究中。
这是"AI 作为科学发现引擎"论题的一个具体数据点:不仅能总结论文,还能设计和执行大规模并行搜索,穿越生物序列空间并浮现出人类尚未分类的候选对象。预计更多实验室将组建"智能体蜂群"用于发现工作,而非仅仅用于编码。
Daily AI briefing from AI Nexus Daily.