前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9295
  • 本地优先AI宣言:模型主权与隐私保护新思路
  • 紧急:SharePoint认证绕过漏洞CVE-2026-55040正被积极利用
  • Agent的State、Memory、Checkpointing不是一回事
  • 受监管行业LLM基础设施检查清单
  • 无限画布性能架构:视口虚拟化与空间索引
  • AI 编程 Agent 的 harness 才是决定因素:同一模型最大 23.8 分差距来自它
  • OpenCode 源码解读:MIT 开源 AI Agent Harness 内部机制全解析
  • AI Coding Agent 的 prompt 格式正在标准化:规则/流程/记忆如何引导代码修改
  • Same input, same receipt:让 AI 基准测试结果可验证、可复现
  • Claude Mythos + Project Glasswing 已发现超一万个高危漏洞
  • GraphQL N+1 排查新法:数 Resolver 调用次数而非响应延迟
  • Grok 4.6:后训练优化突破Scaling Law,成本不变性能跃升
  • 用免费模型从数据库迁移文件自动生成Seed数据,告别手写Fixture
  • AI生成服务的安全审计:systemd能力边界检查实战
  • Attention机制原理深度解析:逐行代码讲解Transformer核心
  • 2026年AI API成本实测:开源开发者的省钱指南
  • 9个多模态API实战对比:成本与效果实测
  • Kimi K3的2.8T参数不是最难部分:MoE推理系统工程分析
  • 做AI产品别先上RAG:汽车检测AI架构教训
  • 向量检索的精确匹配盲区:RAG检索架构补全方案
  • AI日报:DeepSeek调价、智谱发布最强代码模型、Anthropic隐藏模型
  • AI生成文本中的隐藏字符:零宽空格等陷阱
  • 安全运行AI生成代码:E2B/Modal/Piston实战对比
  • DebugClip:把 DevTools 上下文一键贴给 AI 的 Chrome 插件
  • 我从月均$400 的 GPT-4o 切换到国产开源模型,节省了 95% 成本
  • AI生成代码的隐性维护成本:三个月后的真实代价
  • llama.cpp作者Georgi Gerganov:开源丰碑
  • DeepRead:溯源式AI阅读工具,区分事实与推断
  • 别把数据库连接串发给AI工具:正确做法在此
  • Claude Code周报:可靠性工程与工具链实践
  • 用HyperNexus消除MCP配置碎片化:企业级RBAC实践
  • dbctx:将PostgreSQL编译为LLM友好上下文的Go工具
  • SGLang 深度解析 CUDA Graph 推理优化技术
  • AI写令牌桶限流器的评测方法:假时钟+真实HTTP验证
  • AI改配置文件的变更账本:merge前的回滚保障机制
  • AI声称C++锁多余但竞态检测器打脸:真实案例分析
  • 免费模型输出必须加Schema校验层
  • 用toolcontract检测模型更新是否破坏Agent工具调用
  • 顶尖数学家:LLM 是强计算器但缺乏真正创造力
  • 模型没变笨,是你的Agent技能指令过时了
  • SharePoint CVE-2026-55040认证绕过漏洞正被活跃利用
  • 本地跑大模型需要多少VRAM:2026硬件实战指南
  • Dario Amodei 直言:AI 公司最大的批评是我们没兑现承诺
  • AI代码助手缺上下文的根因与修复方法
  • 高级后端工程师必知的安全问答
  • ChatGPT桌面版新功能:记录你的点击和按键
  • agent-authz:AI Agent工具调用的最小权限授权引擎
  • AI 算力积分转售经济解析
  • 从提示工程到上下文工程:AI应用开发的核心技能转变
  • YouTube转技术博客的AI流水线实现
  • 给AI编码Agent装上眼睛:UI工作的截图反馈循环方案
  • 已加载 51 / 9295
8.0
热点
AI SCORE
模型发布2026-08-17 01:57

AI日报:DeepSeek调价、智谱发布最强代码模型、Anthropic隐藏模型

dev.to · AI#DeepSeek#智谱#Anthropic
Editor brief · 编辑速览

DeepSeek V4-Pro实行峰谷定价,智谱GLM-5.3开源权重编程benchmark登顶(Terminal-Bench 3.0: 28.3),Anthropic未发布Model 2。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

  1. DeepSeek 开启峰谷定价(8 月 17 日生效)

自北京时间 8 月 17 日 0 时起,DeepSeek API 开始实行时段差异化定价。非高峰时段(北京时间 9:00–12:00 和 14:00–18:00 以外)费率为高峰时段的五折。

V4-Pro:高峰时段输出 ¥27 / $3.96 每百万 token,非高峰 ¥13.5 / $1.98。

V4-Flash:高峰时段输出 ¥9 / $1.32 每百万 token,非高峰 ¥4.5。

此次调价终结了超低固定费率时代——仅 V4-Pro 非高峰输出价格就已约为原官方定价的 2.25 倍,高峰时段更是达到约 4.5 倍。

信号:这家开源权重领域的领导者如今正在依据容量和能力定价,而非单纯低价竞争。可以预期企业会把大量调用迁移至非高峰时段。

  1. Zhipu GLM-5.3 —— 迄今最强的开源权重编程模型(8 月 14 日)

Zhipu 于 8 月 14 日发布了 GLM-5.3,构建于与 GLM-5.2 相同的基础之上——所有提升均来自后训练 scaling。如今在开源权重编程基准上名列榜首:

Terminal-Bench 3.0:28.3(此前为 4.6),DeepSWE v1.1:66.9(此前为 46.2)。

CyberGym:84.5%——在漏洞发现方面与 Claude Mythos 5(83.8%)持平或超越。

在预发布测试期间,它共发现 2,404 个潜在漏洞(其中 1,088 个为高危/中危),包括一个存在了 40 年的 DNS 协议缺陷。

权重将在安全加固完成后约 2 周内开放下载。要点:仅凭后训练就在不断缩小与前沿闭源模型的差距。

  1. Anthropic 风险报告披露 —— 然后封存 —— "Model 2"(8 月 14 日)

Anthropic 长达 186 页的风险报告揭示了一款内部专属模型 Model 2,其能力超越公开的 Claude Mythos 5:

CoBench v2:62.8% 对比 Mythos 5 的 50.3%——该模型已在公司内部被大量用于编程、agentic 任务和训练数据生成。

无发布计划。对齐风险评级从"非常低"升至"低"。

报告还披露了真实事件:生物安全分类器静默关闭了约 11 个月,导致约 1.33 亿次对话(涉及约 50,000 名外包人员)绕过了该分类器。

前沿的真正能力优势如今存在于实验室内部,而非消费产品之上。

想紧跟 AI 前沿动态?每日简报请关注 AI Nexus Daily。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
向量检索的精确匹配盲区:RAG检索架构补全方案
下一篇
AI生成文本中的隐藏字符:零宽空格等陷阱