前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8836
  • 阿里 Qwen Audio 3.1 发布:语音识别/TTS 多模型,API 价格最高降 95%
  • Claude Code部署到Lizard平台实战指南
  • Claude Opus 5.5降价却破坏四个Agent依赖项
  • OpenAI GPT-6 Sol/Luna 半价发布,缓存机制或为更大降本杠杆
  • treg:聚合 3000+ Agent 工具的统一网关
  • 向量检索权限校验应内嵌到 pgvector 查询中
  • Univer:面向 AI Agent 的开源办公套件 SDK
  • DeepSeek公开Agent训练新论文,梁文锋署名
  • 为 AI 编程 Agent 构建可复用技能系统的实践
  • DeepMind研究:百个AI智能体协作求解时出现作弊与告密现象
  • Google AX:开源Agent编排运行时
  • 阿里千问发布Qwen-Audio-3.1:TTS降价70%、ASR降价95%
  • 诺基亚开源AnyJev:无训练即可将任意开源LLM转为校准决策模型
  • 2026年AI网关横评:Bifrost领跑,多路 failover 哪家强
  • GPT-6 Sol/Luna 发布:准确率翻倍、成本减半,价格战开启
  • Claude Opus 5.5 登场,AI 模型价格普降 40-50%
  • Kyutai开源语音模型Voice of Reason,口算GSM8K准确率从27%升至77%
  • 微软Copilot大促:10万席最高半价,向超级AI应用转型
  • OpenAI GPT-6 Sol/Luna:API价格腰斩,长任务Prompt缓存优化
  • AI 编码 Agent 在移动端多久“看”一次才够用
  • GPT-6 Astra 引领 3D 生成技术,竞争格局生变
  • Claude Opus 5.5 缓存读取降价 60%,68 万行代码迁移攻略
  • 用 AI 辅助求职的工程实践:诚实原则与确定性设计
  • Agent 补丁评分卡:防止测试被悄悄弱化的 CI 策略
  • Opus 5.5 缓存降价后 text-to-SQL 成本重算分析
  • Slack推出Code Channels:团队对话内集成AI编程助手
  • GPT-6 Sol/Luna 登场:价格腰斩,定位细分
  • TypeSafe Jev:让AI返回结构化决策而非段落文本
  • Text-to-SQL访问控制:身份决定Schema可见性
  • Jev 1.13实测:工单分类精度达100%,对比规则引擎和本地LLM
  • GitHub Copilot应用支持OpenTelemetry可观测性配置
  • Copilot for JetBrains新增工具审批和Agent控制功能
  • 两款 AI 代码审查基准测评结论相反
  • AI 编码提速后:验证环节成为新瓶颈
  • AI 审查同一 PR 给出不同结论:确定性判定器来解决
  • AI计量工具审计启示:独立交易ref是防重复计费的关键
  • OpenAI发布GPT-6 Sol/Luna:API价格下调50%
  • GPT-6/Claude 5.5 同日发布:价格战开打,Luna 成本腰斩
  • GitHub Copilot 大幅提升C++代码索引速度
  • Anthropic和OpenAI同时推出性价比新模型
  • GPT-6 提示缓存重大升级:更高命中率与可诊断性
  • 六边形架构的端口在撒谎:HTTP 不等于业务语义
  • GPT-5.6 价格策略解读:Luna 降价 80%,多版本差异化定位
  • 高通骁龙8 Gen6端侧跑300亿参数MoE模型,吞吐330 Token/s
  • Claude Opus 5.5评测:智商极高但费用惊人
  • 小米开源 MiMo-V2.6:万亿参数开源模型登顶榜
  • AI Agent 工具 API 设计指南
  • 一个浏览器扩展权限即可劫持五大 AI Agent
  • GPT-6 Sol/Luna 价格减半但性能提升有限
  • Claude Opus 5.5 主打端到端代码补全而非起步
  • GPT-6 Sol发布:对齐能力逼近Astra,价格仅五分之一
  • 已加载 51 / 8836
8.0
热点
AI SCORE
模型发布2026-09-23 13:01

GPT-6 Astra 引领 3D 生成技术,竞争格局生变

量子位#GPT-6#3D生成#AI模型
Editor brief · 编辑速览

GPT-6 Astra 在 3D 生成任务上表现出色,引发行业格局变化,标志着 3D 生成下半场的开始。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

听雨 发自 凹非寺 量子位 | 公众号QbitAI

谁还没有被GPT-6 Astra搓3D的案例狠狠刷屏啊!

写代码、调Blender、搭场景,甚至从零做出一款3D游戏。

过去要在专业软件里折腾半天的活儿,现在一句话就能让Agent接手。

文章配图

不过吧,GPT-6 Astra的表现,也让3D生成行业突然多了一个问题:

通用大模型自己都能建模了,专业3D生成模型还有用吗?

事实上,GPT-6 Astra擅长理解目标、拆解任务,也能通过代码和基础几何体完成机械结构、工业零件等模型。

但遇到人体、动物和复杂道具等曲面丰富、细节密集的对象,还需要专业3D生成模型提供更完整的几何、网格和材质。

文章配图

文章配图

通用模型负责「想清楚怎么做」,专业3D模型负责「把复杂模型做好」。

这也意味着,3D生成正在迎来下一代用户:Agent。

过去,3D生成产品主要服务人类创作者。行业竞争围绕「Production-Ready」展开,谁能生成质量更高、更可控,也更容易进入生产管线的资产,谁就更有优势。

当Agent开始接管创作任务,评价标准又多了一层。

模型质量仍然是基础,但3D能力还要能够被Agent理解和调用。面对不同输入,系统需要自己判断建模路径;资产生成之后,还要支持Agent继续编辑、拆分和加工。

文章配图

文章配图

这也是3D生成在Agent时代的竞争新标准——Agent-Ready。

它代表的变化,是3D生成从一个等待人操作的单点工具,转向Agent工作流中的专业能力。

人可以直接在产品里发起创作,外部Agent也可以根据任务需要调用3D生成,并继续推进后续流程。

但当3D工具的用户从人扩展到Agent,新的问题也来了:Agent能否看懂输入素材,选对建模路径,并在模型生成后继续修改?

国际领先的3D生成大模型公司影眸Hyper3D今日上线的Agentic Mode,正是沿这条路线展开。

Agent会参与输入整理、参考图分析和建模路径选择,接管了建模过程中的更多专业判断,并围绕创作目标持续推进任务。

生成的Low-poly N-GONS模型还可以继续进行参数化调整、调用动画预设和增强材质。

从Production-Ready到Agent-Ready,3D生成竞争的重点正在从「能不能生成可用资产」,扩展到「能不能让Agent把专业3D能力真正用起来」。

Agentic Mode在自动优化输入上有怎样的表现?

主角都是同一台复古桌面风扇,但每张图提供的信息不太一样。

第一张是产品正面照,能看到深青色机身、奶油色扇叶和黄铜支架;第二张绕到背后,露出了电机外壳、散热孔和电源线。

文章配图

第三张只拍网罩、转轴和扇叶根部;第四张是一张杂乱的桌面照,风扇旁还堆着电脑、书、杯子和植物。

最后还有一张规格卡,文字描述了扇叶数量、材料和零部件颜色。

常规的多图生3D,最佳输入通常是一组提前整理好的参考图:主体一致,角度互补,背景尽量干净。

部分工具虽然已经支持背景去除和图片增强,但遇到场景图、局部特写和文字卡混在一起,用户往往还是要先挑图、裁图,甚至指定不同视角。

这里,我直接把5张图一口气输入给了Agentic Mode,看看它能做成什么样。

文章配图

文章配图

图片上传后,Agentic Mode没有立刻开始生成,界面下方先滚动起了一连串分析过程。

仔细查看,它先沿着物体边缘识别整体轮廓,再判断不同图片的拍摄角度,区分真实结构与光影,再寻找机身与局部零件之间的边界。

单张图片里看不清的信息,则会从其他参考图中补全。比如正面照能看清扇叶和网罩,但电机有多厚、背面长什么样,还得结合后侧图判断。

据影眸Hyper3D介绍,这一过程中,系统还会按需增强输入素材。用户无需提前筛选标准主图,也不用手动裁掉场景背景,再反复尝试不同的图片组合。

整个过程没花多久,一台完整的复古桌面风扇就出现在了我的工作台里。

文章配图

文章配图

出来一看,我还挺意外——桌面照里那些电脑、杯子、书,压根没跑进模型里。

它自动把主体和背景分了家,还把5张图里的信息拼到了一起:正面的扇叶网罩、背面的电机散热孔、特写里的转轴细节,一台完整的风扇就这么出来了。

这也是Agentic Mode这次更新的一大重点,模型在处理输入上不是简单把多张图堆在一起,而是先理解、自主筛选和组织参考信息,再进入生成。

对于Low-poly N-GONS生成的模型,Agentic Mode提供了可以用自然语言驱动的参数化调整、动画预设、材质增强等后续编辑功能,为用户提供了创作的延伸可能性。

嫌底座太宽,拉窄一点;支柱太矮,直接抬高。深青色搪瓷机身、黑色橡胶电源线和缎面黄铜支架随你挑,都可以单独换颜色、改质感。

甚至连怎么动都准备好了,开关循环、左右扫风、向上送风,点一下就能运行~

文章配图

文章配图

小物体玩熟了,难度直接拉满——这次输入的不是单个物体,而是一张完整的住宅建筑图纸。

正面、侧面和背面立面图挤在一起,还有一张带房间布局的平面图,密密麻麻标着尺寸和材料说明。

文章配图

对于普通图像生成模型来说,它看到的可能只是一张线条和数字堆成的复杂图片。

想把它变成3D模型,还得先理解不同图纸之间的关系:平面图决定房间和墙体位置,立面图提供门窗、楼层与屋顶结构,尺寸标注则约束各部分比例。

这次依然没有提示词,只上传图纸,剩下的交给Agentic Mode处理。

文章配图

文章配图

结果它自己读完了整套图——平面图管房间布局、立面图管门窗屋顶、尺寸标注管比例大小,全给理清楚了,直接就出了3D模型。

右侧同样有一整套参数化调整面板,建筑的结构、材质都能继续改。

这一轮考验的能力,和前面的风扇不太一样。上一轮的难点,是从一堆杂乱资料中找出共同主体,再把不同图片里的信息拼到一起。

这一次,素材本身已经整理成了建筑图纸,难点变成了读懂这套专业表达:哪些是平面布局,哪些是不同方向的立面,尺寸标注又该如何约束模型结构。

两轮试下来,我感觉Agentic Mode最不一样的地方就在于:无论是杂乱的产品照,还是信息密集的建筑图纸,系统都会先理解其中的主体、视角和约束关系,再根据任务特点自主规划最合适的建模路径。

而且生成不是终点,参数化调整、材质增强、动画预设等表现还能围绕同一个资产继续调整。

当然,如果你连参数名称都不想研究,还可以直接描述修改目标。

我们回到刚才生成的复古风扇,试着直接用自然语言下指令:

文章配图

修改完成后,风扇网罩被明显抬高,底座、网罩尺寸和5片扇叶则基本保持原样。

文章配图

文章配图

整个过程中,我没有寻找对应的参数滑杆,也没有给出具体建模步骤。系统需要先从文字中判断想改哪个部件,再将要求映射到相应参数,最后执行调整。

这一次,我要求系统只把5片奶油色扇叶改成半透明琥珀色,其他部件保持不变。

文章配图

文章配图

可以看到,5片扇叶都变成了暖橙色,深青色网罩、黄铜中心盖、支架和底座仍然保留原来的配色,模型结构也没有发生变化。

半透明效果不算特别强烈,但部件范围控制得比较准确。系统识别出了需要修改的扇叶,没有把旋钮或整台风扇一起染成橙色。

比如在厨房场景中,用户可以选中局部区域,单独替换材质,而不必重新生成整个空间。

用户还可以为模型添加动画,让原本静止的资产直接动起来。

对于机械手这类包含可动部件的模型,系统还提供了动作预设,可以直接调用相应动作。

从尺寸、材质到动画,修改都可以围绕已经生成的资产继续进行。

用户不必每次都回到输入端重新生成,3D模型也从一次性的结果,变成了可以反复加工的工作对象。

3D生成进入下半场,开始比「Agent-Ready」

前几轮实测,其实都指向了影眸Hyper3D一整套与AI融合、为AI适配的能力:Agent-Ready。

面对一组角度不同的产品照片,系统要知道哪些图片描述的是同一个物体,哪些场景元素应该排除;换成建筑图纸,还要理解平面图、立面图和尺寸标注之间的关系,再规划相应的建模路径。

过去的文生3D或图生3D,往往生成完一个模型,任务就结束了。但如果3D要进入Agent工作流,模型还得支持后续修改:尺寸能够调整,材质可以替换,零部件可以拆分,局部结构也能继续编辑。

Agent拿到的不能只是一份用来预览的3D成品,还得是一份可以接着加工的资产。

第三层,则是让这项能力能够被其他Agent调用。

此前影眸Hyper3D开放了面向AI Agent的MCP接口,接入之后,用户可以在支持MCP的AI客户端中直接描述需求,由Agent调用Hyper3D Rodin完成3D生成,再查询进度并取回结果。

文章配图

如今,全球越来越多创作者都在使用「GPT-6+Hyper3D MCP」的组合进行3D内容创作。

动图封面

动图封面

这样一来,3D生成就不必始终停留在独立网页里。它可以被接入更长的任务链,比如从产品设计图生成模型,再继续制作材质、拆分部件,最终交给游戏引擎或其他生产工具。

回头看影眸Hyper3D这几年的产品演进,一条路线已经逐渐清晰。

从自然语言驱动的3D Editing、支持模型智能分件的BANG,到开放MCP接口,再到如今的Agentic Mode,Hyper3D持续把3D生成从一次性交付,推向可调用、可修改、可继续执行的生产能力。

文章配图

评价标准在于,几何结构是否准确,材质和拓扑能否进入生产管线。它们决定了用户拿到的究竟是一份可供展示的3D结果,还是能够继续编辑和投入使用的3D资产。

Production-Ready,是影眸Hyper3D对这个阶段的回答。

GPT-6 Astra重新点燃3D生成之后,行业多了一个新问题:当通用模型也开始调用工具、搭建场景,专业3D生成模型还需要承担什么角色?

影眸Hyper3D的判断是,单次生成质量只是起点,真正的下一步是让3D能力接入更长的创作链路。

通用模型擅长理解目标、拆解任务,也能通过基础几何体与参数完成结构明确的模型。但面对人体、动物和复杂道具等曲面丰富、细节密集的对象,专业3D生成模型仍然承担着高质量资产生成的核心任务。

二者的协作,正在带来一个更关键的变化:3D工具的使用者,开始从人扩展到Agent。

进入下半场,单次生成质量依然是基础,新的竞争门槛则是Agent能否顺利使用这些3D能力。

工具需要能够被Agent调用,生成资产需要支持后续编辑,建模流程也要接入更长的任务链条。

从Production-Ready到Agent-Ready,影眸Hyper3D已经走在了下半场的前列。

当Agent能够理解素材、选择建模路径,并围绕资产继续完成编辑和加工,3D生成才真正从单点工具走进下一代内容生产流程。

Claude Opus 5.5突袭!68万行代码一天迁完,API价格打8折2026-09-23

协同办公进入Agent时代,飞书+豆包工作跑在了最前面2026-09-16

Claude双入口合并,原生Office上线!硅谷AI办公大战也开始了2026-09-17

百度秒哒再升级!让最懂业务的人,亲手造自己的系统2026-09-11

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1

Original source

本文由 AI 翻译整理自 量子位,原文版权归原作者所有。

阅读英文原文
上一篇
AI 编码 Agent 在移动端多久“看”一次才够用
下一篇
Claude Opus 5.5 缓存读取降价 60%,68 万行代码迁移攻略