前端进阶之旅前端进阶之旅
  • 基础篇HTML/CSS/JS 打底
  • 进阶篇原理与工程化
  • 高频篇面试最常问的那批
  • 精选篇按模块收敛的总结
  • 手写篇常考代码手写实现
  • 面经篇真实面试问题复盘
  • AI 篇NEWAI 时代的前端考点
  • 历年面经NEW按年份追踪真实考点
  • 每日一题每天一道,攒手感
  • 专项自测100 题快速查漏
  • 小程序题库小程序专项刷题
  • 算法题库NEW在线编码即时判题
  • 知识卡片NEW碎片时间过考点
  • 面试题大全常见问题解析
  • AI 答疑NEW随时提问,即时解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • AI 定制路线NEW按你的简历现排
  • AI 知识地图NEW串起全站知识点
  • 原理篇React / Vue 源码拆解
  • HTTP从报文一路讲到 HTTPS
  • 浏览器渲染、事件循环、进程
  • 计算机基础Linux、网络、操作系统
  • 设计模式23 种模式怎么用
  • Node学习指南从环境搭建到服务端
  • NPM工作流script、依赖与发布
  • Docker容器化部署上手
  • Canvas图形与动画实战
  • 前端系统进阶学习大型项目工程化
  • 前端综合文章长期沉淀的实践文
  • 思维导图知识点全景图
  • 学习路线按图索骥不跑偏
  • AI 热点NEWAI 每日动态
  • 公众号动态公众号历史文章
  • 博客动态站长的技术博客
  • 开发者导航常用工具与文档站
  • 基础篇HTML/CSS/JS 打底
  • 进阶篇原理与工程化
  • 高频篇面试最常问的那批
  • 精选篇按模块收敛的总结
  • 手写篇常考代码手写实现
  • 面经篇真实面试问题复盘
  • AI 篇NEWAI 时代的前端考点
  • 历年面经NEW按年份追踪真实考点
  • 每日一题每天一道,攒手感
  • 专项自测100 题快速查漏
  • 小程序题库小程序专项刷题
  • 算法题库NEW在线编码即时判题
  • 知识卡片NEW碎片时间过考点
  • 面试题大全常见问题解析
  • AI 答疑NEW随时提问,即时解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • AI 定制路线NEW按你的简历现排
  • AI 知识地图NEW串起全站知识点
  • 原理篇React / Vue 源码拆解
  • HTTP从报文一路讲到 HTTPS
  • 浏览器渲染、事件循环、进程
  • 计算机基础Linux、网络、操作系统
  • 设计模式23 种模式怎么用
  • Node学习指南从环境搭建到服务端
  • NPM工作流script、依赖与发布
  • Docker容器化部署上手
  • Canvas图形与动画实战
  • 前端系统进阶学习大型项目工程化
  • 前端综合文章长期沉淀的实践文
  • 思维导图知识点全景图
  • 学习路线按图索骥不跑偏
  • AI 热点NEWAI 每日动态
  • 公众号动态公众号历史文章
  • 博客动态站长的技术博客
  • 开发者导航常用工具与文档站
返回 AI 情报前线
All News · 全部资讯8179
  • ChatGPT 语音模式可选 GPT-5.6 Sol / GPT-6 Astra
  • AI辅助安全研究:两周内用LLM构建跨iOS/Android零点击漏洞蠕虫
  • Google开源Mantis:AI编程Agent漏洞全生命周期工具包
  • LLM控制物理设备的关键工程原则
  • AWS博客:HyperPod上部署Qwen3.8-2.4T推理模型实战
  • 微软MarkItDown:文档转Markdown的Python工具链
  • Agent队列空跑时的静默失败问题
  • 审批门模式:防止AI Agent误写生产系统的工程实践
  • FlyCrawl:为LLM定制的网页转Markdown工具,token消耗降77%
  • Claude 在「Agent 构建 Agent」基准测试中领先,但通过率仍不足 25%
  • GitHub Copilot企业版新增Agent操作权限托管
  • AWS 2026年8月AI更新:百万Token上下文、跨区域推理、14天长时Agent
  • OpenAI 用 AI 自动审查工程师代码并可主动拦截
  • 10 个 Claude Code 插件推荐
  • 2026年AI安全漏洞检测工具实战指南
  • AI 应用正在演化成分布式系统
  • AWS Bedrock AgentCore 实战:AI 原生投资工作台架构拆解
  • Gemini可跨Workspace应用后台创建文档表格
  • 循环工程四大陷阱:跑飞循环、无人验证、目标模糊、复杂度溢出
  • Qwen 3.8 跟进 GPT-5.5 Pro 推理预填充能力
  • Procedural Graphs:LLM Agent 的自演进执行结构
  • AI编程代理的评估与迭代方法论
  • Google ADK for Kotlin 1.0发布
  • Agent工具集必须提交到Schema并做哈希校验
  • 代理的第一个命令才是真正的入职测试
  • AI改代码边界失控:一行修复引出七文件改动
  • 用 RAG 构建代码库对话机器人:直接提升代码检索效率
  • OpenAI 开源 Codex Skills 目录:AI 智能体的可复用任务包
  • OpenAI 发布 Codex 插件完整示例仓库
  • OpenAI被指"截胡"纽约大学数学家研究成果
  • i-have-adhd:让 AI 编程助手直击答案不再废话
  • Claude Code权限规则优先级详解:deny优于allow是最大陷阱
  • LLM云端部署架构:自动扩缩容与低延迟推理实战
  • DeepSeek V4.1 Flash发布:性能全面超越V4 Pro,定价大幅下调
  • 面壁智能开源MiniCPM5-2B:4B以下开源基座模型全球第一
  • 本地离线视频转录实战:用Whisper实现隐私优先的转录管道
  • LangGraph完胜:CrewAI/AutoGen基准实测107个数据工程任务
  • AI Agent权限审计实战:OAuth Scope的真正风险
  • OpenAI用Agent集群88小时解决NS方程奇点,疑似拿下第二个千禧年大奖
  • Meta推出个人AI Agent:Muse可替你发邮件订酒店
  • LLM推理内存优化实战:FP8量化与GGUF格式对比
  • 移动端低功耗部署LLM:模型选择与量化实战指南
  • Cursor云Agent支持企业自托管沙箱,代码留在防火墙内
  • GitHub Copilot for JetBrains新增企业沙箱与跨文件编辑建议
  • 蚂蚁开源Ling-3.0-flash-VL:引入视觉反馈闭环的多模态模型
  • 旗舰模型成本控制:20/40/40路由法则
  • GitHub 本周 AI 项目盘点:Agent Skills 成为新风口
  • ChatGPT Images 2.5发布:多轮指令遵循与主体一致性提升
  • Meta推出个人AI智能体Muse,支持自主操作浏览器
  • Bedrock AgentCore 集成 GitHub Actions 实现 AI Agent 自动化评估
  • AI加速编码后瓶颈转移到了哪里
  • 已加载 51 / 8179
8.0
热点
AI SCORE
技术实践2026-09-10 01:13

Procedural Graphs:LLM Agent 的自演进执行结构

Hacker News#LLM Agent#论文#架构
Editor brief · 编辑速览

论文提出程序化图结构让 LLM Agent 能动态构建与自我改进执行计划,提升复杂任务的自主完成能力。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

参考与引用

BibTeX 格式引用

arXivLabs 是一个允许协作者在我们的网站上直接开发和共享新的 arXiv 功能的框架。

与 arXivLabs 合作个人和组织均已接受并遵循我们的开放、社区卓越和用户数据隐私价值观。arXiv 致力于践行这些价值观,且仅与遵守这些价值观的合作伙伴合作。

有一个想为 arXiv 社区增加价值的项目 idea?了解更多关于 arXivLabs 的信息。

Original source

本文由 AI 翻译整理自 Hacker News,原文版权归原作者所有。

阅读英文原文
上一篇
Qwen 3.8 跟进 GPT-5.5 Pro 推理预填充能力
下一篇
AI编程代理的评估与迭代方法论