前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8336
  • 多 AI 协作必须设计交接机制而非仅靠上下文
  • deepseek-harness 体验:22 万星的开源 AI 插件框架
  • Cognition 发布 SWE-2:低成本对标 Fable 5.1 的代码模型
  • 边缘 AI 部署:LLM 优化最佳实践
  • 边缘设备 LLM 扩展:完整技术指南
  • VS Code 1.137:AI 自动化、语音模式与 GitHub 深度集成
  • Real-SWE:基于私有企业代码库的 AI 模型基准测试
  • OpenResearch:本地优先的多 Agent 研究工作台
  • Check:给 Claude Code 加幻觉防护层
  • Postman 集合一键转为 MCP 工具:实操路径
  • NestJS 测试覆盖提升与安全加固实战
  • Next.js Serverless 下 PDFKit 字体缺失修复
  • 评测编码Agent前,先用同一组任务跑两遍
  • LLM Wiki:文档自动构建可维护知识库的开源桌面应用
  • 深入解析结构化输出:让 AI 生成绝对可解析的 JSON
  • MCP安全核心是权限体系重设计,而非传统边界防护
  • GPT-6 Astra 在机器人基准测试中展现空间推理飞跃
  • Auterix:零依赖通用协议,跨 21 个 AI 工具统一上下文规范
  • 后量子 TLS 是平台迁移工程,不是密码学研究
  • Anthropic 发布 AI-Native SDLC 实践手册:代码不再是瓶颈
  • OpenAI 建议 GPT-6 Astra 提示词应精简,减少安全限制
  • Claude Code 创始人:AI 编程要守住代码质量标准
  • Hyperresearch:Agent 驱动的研究知识库,单次跑 250+ 信源
  • 12 个已落地的 B2B 营收 AI Agent 用例,附代码
  • LLM 项目上线后才会暴露的 6 个隐蔽 Bug
  • OpenAI 代理向 RubyGems 上传两千恶意包
  • AI 时代缓存失效难题复发:LLM 推理的隐性成本
  • Google发布TimesFM-3:单次前向传播即可完成多步时间序列预测
  • 阿里 Qoder CLI 开放自定义模型接入
  • 开源项目 Minitap 指控谷歌盗用代码用于 Artemis,许可证违规引热议
  • GPT-6 Astra 刷穿 FrontierMath Tier 4,AI 数学能力达新里程碑
  • Kimi K2.8发布:性能逼近K3百万上下文全员开放
  • DeepSeek v4.1-Flash发布:763B参数新型因果编解码架构
  • AI Agent 何时该停:成本控制的核心工程问题
  • 三大AI编程工具实战对比:Claude Code六个月生产级使用报告
  • Trail of Bits开源Coop:用隔离VM安全运行Claude Code和Codex
  • OpenAI代理今年5月攻击RubyGems详情披露
  • Google Tunix:TPU上的自主LLM后训练框架
  • GitLab CVE-2026-85706:CVSS 10.0 路径遍历漏洞正被主动利用
  • RAG 检索失效的根源:分块策略正在毁掉你的 AI 应用
  • CPython 字节码缓存导致测试失效的隐藏bug
  • OpenAI代理攻击RubyGems:技术细节与行业反思
  • Anthropic 内部调查:七成公司无法衡量 AI 工具实际回报
  • OpenRouter 隐性陷阱:同一端点行为不一致
  • 字节Seed研究:LLM自建测试harness泛化性堪忧,仅34%有效
  • GitHub Copilot支持查看VS Code Agents使用量指标
  • OpenAI正式开放Agents API:日烧7千美元研发现已公测
  • Anthropic 为 Claude Code 推出插件评测工作流,含 6 种评分器与无插件基准线
  • 一招配置:让 Claude Code、Cursor、Cline 等主流 AI 编程工具共用同一个国产模型端点
  • 我用 Claude Code 搭 AI 团队,抓到它给自己打高分
  • 律师因AI幻觉证人被罚5000美元
  • 已加载 51 / 8336
8.0
热点
AI SCORE
编程提效2026-09-12 21:10

OpenAI 建议 GPT-6 Astra 提示词应精简,减少安全限制

The Decoder#OpenAI#GPT-6#Prompt工程
Editor brief · 编辑速览

OpenAI 工程师指出过长技能描述、强制全量读取和严格审批规则会阻碍 GPT-6 Astra 发挥能力,更强模型需要更少干预,应将指令绑定具体任务并明确完成条件。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

OpenAI 建议:GPT-6 Astra 需要更精简的 prompt 和更少的限制规则

据 OpenAI 透露,过长的技能描述、全面阅读要求以及僵化的审批规则可能会阻碍 GPT-6 Astra 的表现。该公司建议开发者将指令更紧密地绑定到具体任务上,并更清晰地定义何时算工作完成。

OpenAI 的 Eric Provencher 写道,随着时间累积的指令会消耗上下文,或导致 GPT-6 Astra 过早停止工作。他建议在切换模型时审查技能、AGENTS.md 和任务 prompt。更强的模型不需要手把手指导,这与 Provencher 早些时候关于模型迁移的建议一致。

模糊的技能描述会导致错误选择

技能是存储为 Markdown 文件的 prompt,可以包含资源和脚本。Provencher 表示,它们最适合用于特定的工作流或应用场景。技能名称和描述会进入模型的上下文,以便 Codex 能为给定任务选择正确的技能。

技能过多会迫使 Codex 截断描述,去掉它正确选择所需的信息。冲突的描述或过于宽泛的范围也可能加载模型不需要的指令。

Provencher 建议保持范围描述简短精准。一个用于 Postgres schema 迁移的技能,只应在创建或修改迁移时触发,或在检查其部署状态时触发。如果一个技能涵盖多个工作流,其主文档应简要指向正确的补充文档和脚本。这样模型只会读取它实际需要的内容,因为每多读一份内容都会消耗上下文并使其更接近总结。

详细的逐步序列也可能拖慢更新的模型,因为它们自己能更好地处理细微差别和歧义。但共享技能适用于每个贡献者的 agent,所以团队需要谨慎。对于 Sol 或 Luna 有效的规则,对于运行 Astra 的人来说可能已经过于严格了。

每次变更前强制阅读会浪费上下文

Provencher 还表示,AGENTS.md 中管理仓库工作的规则需要定期审查。要求模型在每次变更前阅读多份文档或完整项目概述,对于修正拼写错误这样的操作来说过于杀鸡用牛刀。Astra 可以自己弄清楚需要什么。

Provencher 建议不要每次都强制它阅读 architecture.md、database.md 和 deployment.md,而是选择性地指向这些文档。在服务边界工作时提供架构信息。在修改 schema 时提供数据库文档。在发布时提供部署说明。他还补充说,文档也需要保持最新。

明确的权限也可以减少安全操作的重复确认请求。对于使用一次性数据且无生产环境访问权的本地测试,AGENTS.md 可以明确允许 agent 运行测试、修复由请求变更引起的错误,并重新运行受影响的测试而无需再次询问。

Astra 需要明确的目标,而不是检查清单

Provencher 表示,如果你早期因为模型失控而用严格的审批规则锁定了某些操作,那么在切换到 Astra 时是时候重新审视这些规则了。OpenAI 认为该模型有更好的判断力,但它也可能过于字面地解读旧限制,以至于在你希望它继续时反而停了下来。已知的安全工作流应该被明确允许。

即便没有限制,Astra 也可能比 GPT-5.6 Sol 更早停止。Provencher 建议提前定义"完成"的含义。如果 agent 应该实现某内容、运行它、检查结果并修复错误,所有这些都需要在 prompt 中说明。要求在第一次实现后进行检查会设置更早的停止点。

OpenAI 最近发布了 GPT-6 Astra 的详细提示技巧,而这次关于技能和项目指令的建议正是对该指南的补充。

Original source

本文由 AI 翻译整理自 The Decoder,原文版权归原作者所有。

阅读英文原文
上一篇
Anthropic 发布 AI-Native SDLC 实践手册:代码不再是瓶颈
下一篇
Claude Code 创始人:AI 编程要守住代码质量标准