前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9364
  • 7 行 Claude Code mod 可绕过 deny 规则:权限安全审计
  • Prime Intellect推出Prime Inference:前沿开源模型Serverless推理服务
  • OpenAI官方指南:如何选对GPT-6系列模型并优化提示词
  • 微软发布MAI-Transcribe-2-Streaming:实时语音转文字登顶基准榜
  • OpenAI 自研芯片 Jalapeño 量产,搭配 AMD Turin 而非英伟达
  • SQL Agent 的知识层缺失:OKF 实践(下)
  • 突变测试导致AI代理误删真实账本
  • 决策AI模型横评:TypeSafe Jev对阵Fastino GLiDE等开源竞品
  • Sparse VideoGen:TPU 上视频扩散模型注意力加速 1.69 倍
  • x402 生产避坑:支付签名重放漏洞与防护清单
  • Claude Code 首次请求实测:空文件夹 23207 tokens,flag 可降至 2664
  • Agent 沙箱逃逸警示:DNS 隐蔽信道与 Kill Switch 实测缺失
  • AI修代码前,先证明bug真实存在
  • 多Agent系统的零信任安全架构
  • Argo-Bench:企业数据Agent真实能力评估
  • Anthropic投1亿美元培训万名AI部署工程师
  • Apple收紧Mac全盘访问权限,剑指AI代理隐私风险
  • AI评委也会上当:评测模型审查作弊代码的深度测试
  • Meta 开源 Muse 代理硬件制作代码,支持 ESP32/树莓派
  • Mac将收紧磁盘访问权限,AI代理风险成核心理由
  • 开源 Lego AI 生成器:让 GPT/Claude 直接输出乐高 CAD 模型
  • 生产级LLM系统的状态架构设计要点
  • LLM输出JSON解析的正确做法
  • 2026年MCP Server实战入门:从零构建可用的工具服务器
  • Meta Muse Mac应用安全漏洞:零日与文件系统泄露
  • GitHub Actions添加cancel-in-progress:节省30%构建分钟数
  • MCP工具描述即指令:信任边界的安全教训
  • 7种数据格式Token消耗对比:JSON缩进比CSV多花3倍
  • LLM推理工程:KV-Cache瓶颈与PagedAttention
  • GitHub Copilot 代码审查支持 API 调用,默认改为 Balanced 级别
  • Google Workspace 更新:Gemini 3.8 语音、Google Vids 支持字幕定制、文档 API
  • GitHub Copilot 推出计算机操控功能
  • GitHub Copilot 废弃多款模型,请留意代码补全与聊天受影响
  • Cloudflare 开源 Clef 决策模型:39ms 完成 AI Agent 决策,无需人工介入
  • 苹果加强macOS全盘访问权限,防范AI Agent滥用
  • 英伟达发布 DGX Spark 64GB:1 PetaFLOP 级桌面 AI 工作站
  • Redis 作者开源 ds4:本地运行 LLM 的新方案
  • OpenAI企业级Agent平台Dots亮相,可代订外卖
  • jev-ultrafast:把浏览器操作变成多选题
  • AI Agent库的兼容性不止语义版本号
  • OpenAI悄然发布GPT-6官方使用指南
  • 远程MCP长时任务:Agent实际收到什么
  • AI Agent合规审计链路工程观察
  • Go+DiskANN+MCP 构建 AI Agent 时序记忆引擎实战
  • Copilot 桌面控制能力上线:权限模型与安全护栏详解
  • Node 拒绝 package 导入?一 CLI 告诉你根因
  • iPhone 17 Pro Max化身Mac外置GPU:Qwen 27B预填充速度提升29-44%
  • K8s"单体"经验对AI Agent架构的启示
  • GPT-6模型家族选型指南发布
  • Qwen3.8-27B-Humanlike-Chat 2.0:更像人、增工具调用、修指令遵循
  • AWS Quick+ MCP模式实现大规模合规审查
  • 已加载 51 / 9364
8.0
热点
AI SCORE
开源项目2026-10-03 04:00

开源 Lego AI 生成器:让 GPT/Claude 直接输出乐高 CAD 模型

Hacker News#AI生成#开源#GPT
Editor brief · 编辑速览

开发者经过数月迭代,实现了用 GPT-6 Astra 和 Opus 5.5 直接生成 LDraw 格式的乐高积木 CAD 模型,并封装为 Docker Web 应用。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

给 AI Agent 一个模型创意,引导它、让它去构建,然后得到一个 LDraw LEGO© 模型。

构建完成后你会得到:

LDraw 语言的源代码。

多种视图:3D 查看器、3D 播放器、VR 交互(Meta Quest 3)、图片……

Blender 可编辑的 glTF 文件,.glb 格式,元信息作为 Blender 的自定义属性存储。

对话历史和 Agent 的思考过程。

请看视频:

文章配图

Agent 用于寻找合适零件和示例模型的工具利用了 jev-rerank(我也是作者)。这是一个语义搜索工具,带有重新排序功能,由 TypeSafe 的 Jev System One AI 模型提供支持。

如果你有 TypeSafe API key(TYPESAFE_API_KEY),在 Web 应用的设置页面填入其值即可。

如果没有,重新排序搜索将不可用,Agent 会退而使用 FTS(全文搜索)作为备选方案,效果可能(大概)会更差。

用 Docker 运行 ldraw-nova Web 应用

需要 Git 和 Docker。

这个 Web 应用以 Docker 容器方式运行,构建 Docker 镜像需要两个同级的代码仓库:

ldraw-nova:当然是这个项目 😉

ldraw-nova-docker:提供 Docker 配置和 Web 应用。

  1. 将两个仓库克隆到同级目录,使用相同 tag 以保证协同工作:
git clone --branch v0.6.0 https://github.com/anteloc/ldraw-nova.git
git clone --branch v0.6.0 https://github.com/anteloc/ldraw-nova-docker.git
  1. 构建 Docker 镜像。首次构建耗时较长,需要约 5 GB 磁盘空间:
cd ldraw-nova-docker
docker compose build
  1. 启动容器:
docker compose up -d
  1. 在浏览器中打开:

https://localhost:8443:支持 Meta Quest 3 的 VR,需要此端口。证书是自签名的,首次访问时接受浏览器警告即可。

http://localhost:8765:纯 HTTP,没有证书警告。如果自签名证书造成干扰就使用这个端口。VR 功能在此端口上不可用。

同一网络下的其他设备可以用本机 IP 代替 localhost 访问应用,例如从 Quest 3 访问 https://192.168.1.20:8443。应用没有登录机制,因此只在你信任的网络中运行。

停止:

docker compose down

背景

总结一下我做这件事的初衷:我希望得到能够设计可构建的、真实物理制品的 Agentic LLM!

发现 LDraw——一种汇编语言(文字游戏!😜)——它同时具备简单、低级、可执行的特点,可以用来生成 3D CAD 模型——这让我萌生了用 ChatGPT 和 Claude 做实验的念头,看看能否让它们像编写其他编程语言一样来编写 LDraw 代码。

出乎意料的是,尽管这门语言严重依赖数学(零件旋转、定位……),LLM 通常在这方面很弱,但 Agent 在初始测试中表现相当不错,后续项目也取得了好的结果,只是从来没有好到可以认为生成的模型是"正确"的程度:

初始研究:ldbuilder-ai

第一次 Agentic Python 工具尝试:py2bricks

第二次尝试:py4bricks

这三次尝试,加上相当多的其他实验,让我得出以下结论:

💡 结论 1:Agent 有一条绕过几何数学的最低阻力路径,即:

给 Agent 提供生成 LDraw 源代码的工具,可以规避(可恶的!)几何数学

……因为它们生成产生数学的 Python 代码

……比自己直接做数学强得多!

Agent 从生成模型的 Python 代码中学习

……比从模型本身学习效果更好(LDraw 的可恶几何,又是它……)

那么,剩下的唯一事情 🤔 就是创建一套基于 Python 的工具,包含所需的原语、动词、构建词汇表……让 Agent 通过示例学习,然后自己去做类似的事情。

这件事做起来非常困难,即使 vibe coding 也一样……直到 GPT-6 Astra 和 Claude Opus 5.5 出现…… vibe coding 成功了!🚀🚀🚀

工作原理

ldraw-nova 提供了 Agent 设计真实 LDraw 零件模型所需的工具、示例和指令。

流程如下:

Agent 接收一个 prompt。

读取 instructions.md 及 LDraw 语言和 LEGO© 模型构建的相关文档。

规划如何构建模型:所需零件、要创建的子模型、美学设计……

迭代执行:

从模型/子模型渲染图像

检查渲染结果,调整定位、美学……然后回到渲染

……直到它认为模型完成,可以交付!

提供的工具帮助 Agent:

寻找合适的零件,以及可以此为基础的示例模型和子模型。

检测碰撞和间隙,以正确放置零件。

无头渲染,用于检查当前结果。

Agent 实际上并不是从放置零件开始的,除非是原型设计或通过修改已有的示例模型来学习的情况。

它生成模型的方式更像是:

从实验结果、文档和规划中收集所需信息。

构建一个或多个计划,完全描述模型和子模型的几何信息,例如 atlas-crane.plan.json

然后根据计划创建一个或多个生成器脚本,例如 generate.py

……执行后生成 LDraw 源文件(一种非常专业的 3D CAD 语言)

……例如 atlas-crane.mpd

总而言之,这个过程相当于:

Agent 创建一个生成器

……这个生成器产生 3D 模型

……用的是一种名为 LDraw 的汇编语言 🤯

可以说是一种编译器 🤓

flowchart TD
    agent([agent]) -- produces --> plan[plan.json]
    plan -- interpretation --> gen[generator.py]
    gen -- execution --> model[model.mpd]

Agent 的信息来源

以下是提供给 Agent 的部分指南和参考资料,将其塑造为构建者:

当前局限

作为首次发布,仍有许多工作需要完善:

VR on Meta Quest 3:模型操作存在许多问题,性能问题也比较明显。

适配低端 Agent:调整现有工具、文档和指令,以改善 Luna、Haiku 等低端模型的使用体验。

生成成本高昂:目前只有昂贵的高端模型才能生成大型且正确的模型。

提升效率:生成过程目前较慢。

添加和改善更多模型系列:

人像和动物:minifigs

Technic 模型:机械、引擎……

宇宙飞船:生成的模型效果不太好

从说明书构建模型:部分可用,如果页面说明书以图片形式提供效果更佳。

细粒度检查:用于检查子模型及其分步构建过程。

致谢

在此感谢:

LDView 的 Travis Cobbs(@tcobbs)及贡献者。

LeoCAD 的 Leonardo Zide(@leozide)及贡献者。

LDCad 和 Shadow Library,Roland Melkert。

ldraw.rs 的 Park Joon-Kyu(@segfault87)及贡献者。

pyldraw3 的 Harold Martin(@hbmartin)及贡献者。

……以及所有其他众多 LDraw 创作者!

NOTE:在这项工作中,我使用了来自许多来源的许多 LDraw 模型、库、工具、文档……

这里有非常多出色的人慷慨地贡献了自己的作品,有些甚至持续了几十年,将自己的心血无私地奉献给了公共领域和开源社区。

如果你认为自己应该被列入此致谢部分,请给我发邮件!

LEGO(R) 是乐高集团的商标,乐高集团不赞助、授权或认可本软件。

Original source

本文由 AI 翻译整理自 Hacker News,原文版权归原作者所有。

阅读英文原文
上一篇
Mac将收紧磁盘访问权限,AI代理风险成核心理由
下一篇
生产级LLM系统的状态架构设计要点