前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8742
  • 两款 AI 代码审查基准测评结论相反
  • AI 编码提速后:验证环节成为新瓶颈
  • AI 审查同一 PR 给出不同结论:确定性判定器来解决
  • AI计量工具审计启示:独立交易ref是防重复计费的关键
  • OpenAI发布GPT-6 Sol/Luna:API价格下调50%
  • GPT-6/Claude 5.5 同日发布:价格战开打,Luna 成本腰斩
  • GitHub Copilot 大幅提升C++代码索引速度
  • Anthropic和OpenAI同时推出性价比新模型
  • GPT-6 提示缓存重大升级:更高命中率与可诊断性
  • 六边形架构的端口在撒谎:HTTP 不等于业务语义
  • GPT-5.6 价格策略解读:Luna 降价 80%,多版本差异化定位
  • 高通骁龙8 Gen6端侧跑300亿参数MoE模型,吞吐330 Token/s
  • Claude Opus 5.5评测:智商极高但费用惊人
  • 小米开源 MiMo-V2.6:万亿参数开源模型登顶榜
  • AI Agent 工具 API 设计指南
  • 一个浏览器扩展权限即可劫持五大 AI Agent
  • Claude Opus 5.5 主打端到端代码补全而非起步
  • GPT-6 Sol发布:对齐能力逼近Astra,价格仅五分之一
  • GPT-6 Sol/Luna编程能力比肩Claude,成本降80%
  • Claude Opus 5.5发布:性能对标Fable 5.1,成本低40%
  • Claude Opus 5.5:编程修复成功率达97.5%,成本降40%
  • 开源工具llm 0.36支持GPT-6 Sol/Luna
  • JetBrains押注Agent开发:称其为26年最重要一步
  • 为 AI 代理添加预算守卫的实战方案
  • OpenAI GPT-6 Sol和Luna模型上线Amazon Bedrock
  • OpenAI发布GPT-6 Sol和Luna,API价格减半
  • OpenAI 发布 GPT-6 Sol/Luna 模型,Token 价格减半
  • GPT-6 Sol/Luna 正式发布:成本更低、错误更少
  • OpenAI 发布 GPT-6 Sol/Luna,主打低成本低幻觉
  • Claude Opus 5.5 登陆 Google Cloud,在 Model Garden 可用
  • Claude Opus 5.5 现已在 AWS Bedrock 可用
  • Strands Evals + Bedrock AgentCore:Agent 技能选择评估指南
  • llm-anthropic 0.29支持Claude Opus 5.5
  • Claude Opus 5.5发布:性能持平Fable 5.1,定价直降40%
  • GitHub Copilot上线Claude Opus 5.5,支持长时Agent任务
  • GitHub Copilot 新增 GPT-6 Sol/Luna 模型选项
  • Claude Opus 5.5 智能/性能/价格深度分析
  • Anthropic发布Opus 5.5降价20%,但Agent调用可能暗中路由至旧模型
  • Anthropic称Opus 5.5为「史上最强」,定价更低的Fable级性能
  • Anthropic 发布 Claude Opus 5.5:强化网络安全防护,遏制越狱行为
  • Claude Opus 5.5 正式发布:832 分成社区热议
  • 生产级 AI 语音 Agent 架构:WebSocket 与延迟优化实战
  • Permission Envelope:让 AI 权限自动过期的安全控制机制
  • llm-typesafe插件支持Jev模型二元判断
  • Python AI Agent 上线前必读:测试、可观测性与零成本方案
  • Cloudflare Worker Previews:为 Agent 每次变更提供隔离预览环境
  • NVIDIA Isaac ROS 5.0 发布:加速 Agentic 机器人开源开发
  • Meta Muse macOS 应用零日漏洞遭修复
  • 小米6天烧2000万训练开源模型MiMo,跃居开放模型榜首
  • LLM应用输入输出Guardrails实战指南
  • Claude发现libheif堆缓冲区溢出:HEIC图片供应链安全研究
  • 已加载 51 / 8742
9.0
重磅
AI SCORE
模型发布2026-09-23 02:55

Claude Opus 5.5:编程修复成功率达97.5%,成本降40%

IT之家#Anthropic#Claude#AI编程
Editor brief · 编辑速览

Claude Opus 5.5修复软件低效程序成功率达97.5%,默认设置成本比Opus 5低40%,输出速度快30%以上。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

9 月 23 日消息,Anthropic 今日正式发布了 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个模型,宣称在大多数工作上表现可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40%。

文章配图

从 Anthropic 公告获悉,具体来看,Claude Opus 5.5 模型有以下提升:

性能方面,Opus 5.5 比 Opus 5 有了很大提升,官方宣传早期测试者在最复杂的工作中看到性能大幅提升。一名测试人员在不到一天内完成了 68 万行代码迁移 —— 这一任务本应耗时数周。Opus 5.5 擅长发现并修复软件中的低效程序 —— 当官方要求它将网页应用的每个页面缩短加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次,而 Opus 5 仅仅做了一些小改进,也改变了应用的行为。另一位测试者让多个 Claude 模型根据单一提示构建游戏,Opus 5.5 凭借其画面和精致度获得了高于其他任何模型的评分。

安全方面,Opus 5.5 在 Anthropic 的自动化行为审计中取得了迄今为止所有模型中最高的分数,该套件在数千个模拟场景中测试 Claude。它比其他最近发布的模型采取难以逆转的行动或超出既定界限的概率更低,且比 Opus 5 更能抵抗被提示注入。官方还扩大了对齐测试范围,涵盖更长的任务、不可能完成的任务以及基于真实事件的场景。

由于 Opus 5.5 在生物学和网络安全领域与 Claude Mythos 5.1 相当,官方部署时采取了类似于 Claude Fable 5.1 的防护措施。经过审核的机构今天就可以申请生命科学验证项目,使用 Opus 5.5 进行生物学研究。未来几周,Anthropic 还将扩大对网络验证项目的访问,认证的网络安全从业者将能够使用 Opus 5.5 进行工作。

成本和速度方面,Opus 5.5 所需的计算量比 Opus 5 少,其定价也反映了这一点。官方测试显示,默认设置下,Opus 5.5 在典型工作负载下的成本比 Opus 5 低 40%。Opus 5.5 的输出速度也比 Opus 5 快 30% 以上。

输入和输出 Token 的价格分别为 4 美元 / 百万 Token 和 20 美元 / 百万 Token,比 Opus 5 低 20%。

缓存命中的价格为 0.20 美元 / 百万 Token,比 Opus 5 低 60%。

文章配图

除了降价外,Anthropic 还放宽了 Pro、Max、Team 等企业套餐的使用时间限制,还为订阅用户提供速率限制重置功能,现在客户可以随时保存和使用。

沟通交流能力上,Opus 5.5 的沟通比之前的模型更自然。早期测试者发现其文字更清晰易懂,它把最重要的信息放在最前面,在长时间训练中成为更好的工作伙伴。正如一位早期测试者所说:"它的写作方式和我一样。"

Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周推出,性能、效率和安全性方面也有许多相同的改进。

在 Anthropic 官方的基准测试中,Claude Opus 5.5 在智能编码、计算机使用和知识工作方面保持领先。

文章配图

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
Claude Opus 5.5发布:性能对标Fable 5.1,成本低40%
下一篇
开源工具llm 0.36支持GPT-6 Sol/Luna