前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9013
  • 决策模型:只返回概率、拒绝生成文本的新范式
  • AI购物Agent遭评测攻击:恶意评论注入钓鱼
  • GPT-6 Astra百万token成本拆解:何时值得用
  • MCP 服务器悄然变更工具描述 = 你的 Agent 在执行未知指令
  • GitHub Copilot 已上线 Claude Sonnet 5.5
  • Claude Sonnet 5.5 编程 benchmark 暴涨 6 倍,成本降三成
  • Anthropic发布Sonnet 5.5:半价达到 Opus 水平
  • Claude Sonnet 5.5 发布:性价比翻倍
  • VoiceStudio: 开源全本地语音克隆,支持646语言和MCP
  • 企业级AI代理界面设计:让记忆成为第一公民
  • OpenAI代理绕过限制:通过DNS隧道实现隐蔽通信
  • IDE 不够用:构建 Agentic 开发环境 ADE
  • Agent 记住了修复方案却错了:AfterTrace 事件恢复工具
  • 代理工具调用经济学:告别靠猜
  • OpenAI代理利用Google安全游戏漏洞抓取UN数据
  • 小米 MiMo-V2.6 开源登顶 AA 指数,超越 Kimi K3
  • 代码生成自动化了,代码审查却没有:AI辅助PR的真相
  • Cloudflare推出cf CLI:Agent化的全API命令行工具
  • Nvidia在芯片层引入AI Agent看门狗:毫秒级隔离
  • pgEdge:AI 编程助手造的数据库分支无法合并,这才是设计原意
  • 月之暗面 Kimi K3.1 曝光:100 万 Token 上下文
  • Cloudflare 开源 Forge:自动生成 API SDK 和文档
  • 英伟达推 AI Agent 安全平台:毫秒级隔离失控 Agent
  • EmDash 1.0:面向Astro的安全开源CMS
  • Cloudflare Kitesurf浏览器升级:730K平台测试通过,支持WebMCP
  • Cloudflare 收购 VoidZero 后:JS 工具链提速 10 倍
  • RAG原理解析:从第一性原理出发
  • 16 岁少年用 AI 机器人 Antares 发现微软内部 API 漏洞:涉 17 万亿行数据
  • Nvidia推出Open Agent安全平台,管控越狱AI智能体
  • Holo4:通用计算机操作智能体的底层支撑
  • 英伟达发布 AI 智能体安全平台:毫秒级异常隔离
  • 用Termux在Android手机上搭AI开发服务器
  • NVIDIA开源OpenShell安全沙箱:给本地Agent施加真实运行时限制
  • 已加载 33 / 9013
8.0
热点
AI SCORE
编程提效2026-09-29 02:28

GPT-6 Astra百万token成本拆解:何时值得用

dev.to · AI#GPT-6#成本分析#Agent
Editor brief · 编辑速览

输入$10/M tokens、输出$50/M tokens、缓存写入$12.5;首次填充100万token花费$10,20步Agent循环重读需$200,缓存后每步仅$1。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

GPT-6 Astra 于 9 月 3 日上线,所有人都在重复同一个核心参数:110 万 token 的上下文窗口。把整个代码库、整个知识库、整个 PDF 扔进去——再也不用切块了。

但没有人放在幻灯片上的那条明细:输入 $10 / 百万 token。也就是说填满这个窗口要花 $10 一次调用,这还是 Astra 没生成一个回答 token 之前的费用。输出再算上 $50 / 百万,一个大一点的回复就能让单次交互冲破 $12–15。

在循环里这么做——一个 Agent 每一步都重新读取上下文——你就用一种非常聪明、非常昂贵的方式把云预算烧穿了。下面来做一下实际计算,告诉你什么时候它值得。

几个数字,一张餐巾纸

Astra 公开定价:

所以几个参考点:

一次性填满 1M token 上下文:约 $10。

一个 Agent 在 20 步中重复发送约 1M 上下文:约 $200,光读取就这个价。输出另算。

同一份上下文在首次调用后缓存:写入约 $12.50,之后每次读取 $1 而非 $10。这个 10 倍的降幅就是整套玩法的核心。

最后那行是人们最容易忽略的。

什么时候大上下文真的值得

当任务真正需要全局推理、一次性处理所有内容时,花钱填满 1M token 才划算:

跨文件推理——答案取决于十二个文件如何交互的场景——重构、"为什么这里慢"、"在整个调用栈里追溯这个 bug"。只抓 5 个 chunk 的检索会漏掉藏在第 6 个里的关联。

对大文档的一次性综合——你无法预先知道哪部分重要的场景——合同审查、长期事故时间线、整份规范。

当工程时间成本高于 token 成本时。如果搭一套好用的 RAG pipeline 要花两周调优,而大上下文"直接能用"适用于一个低频内部工具,$10 一次调用可能比你的工资还便宜。

什么时候它是陷阱

100 万上下文窗口会引诱你为重复读取根本没变化的内容付钱:

你本来就知道哪 5% 是重要的。如果检索本来就能找到相关内容,你刚才是多花了 20 倍的钱让模型帮你找出来。

Agent 循环不带缓存。每一步都重发完整上下文是制造天价账单最快的方式。要么缓存,要么别循环。

"上下文腐化。"超过几十万分 token 之后,更多上下文往往会降低答案质量——模型会被无关的 95% 分心。你可以花更多钱得到更差的结果。

高容量。在规模化场景下,$10 一次调用是商业模型问题,不是账单项。上线前先把乘法做一遍。

我实际会遵循的规则

当任务需要全部内容且你无法预测哪部分重要时,用大上下文。能用检索时用检索。而一旦对同一份大上下文调用第二次——缓存它——这是藏在眼皮底下 10 倍的削减。

100 万上下文窗口不是骗局。它是一个有价格标签的实用工具,只是会惩罚懒用的行为。把"全部塞进上下文"当作一个有美元数字的决策,而不是一个免费的默认选项,它就很好。把它当免费的,Astra 很乐意在你的账单上给你上一课。

你最惊讶的一笔 AI 账单是什么——是上下文、输出、还是 Agent 循环惹的祸?在下面报出你自己的架构吧。👇

我写 AI 构建相关的东西,以及背后的真实经济学。如果这正是你关注的领域,欢迎关注我。👋

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
AI购物Agent遭评测攻击:恶意评论注入钓鱼
下一篇
MCP 服务器悄然变更工具描述 = 你的 Agent 在执行未知指令