前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
返回 AI 情报前线
All News · 全部资讯4321
  • 英伟达 Nemotron 3.5:小模型跑出高速度,36 亿参数追平 GPT-4 级能力
  • 用 TypeScript 构建 Prompt 缺失来源的三元分类队列
  • 用最便宜模型加路由实现 100% 有效输出的系统设计
  • 8款AI模型同一崩溃测试:没有赢家
  • AI Agent评测最高分居然是"拒绝回答"
  • 英伟达正在训练万亿参数开源模型Nemotron 4
  • 实测:16GB M1 Pro 笔记本跑本地 LLM 能跑多快
  • 选择压力让基准测试变成模型的「指纹」
  • OpenAI GPT-5.6-Cyber:漏洞利用任务完成率达 95%
  • AI 代码审查的真实失败模式:不是幻觉而是忽略
  • NVIDIA Nemotron 3.5 Lightning 免费开放:30B MoE 适合 Agent 执行层
  • AI Agent 为何总忽略自己的指令:三个真正有效的修复方案
  • CI 变绿不等于修对了:AI 修复让 Stripe 发货变成零
  • AI 红队发现:小说框架下的恶意指令规避
  • LLM jailbreak 如何突破每一层内容审核的技术拆解
  • 用 MCP 构建可审查的 AI 视频生成 Agent
  • Agentic Workload 安全最佳实践完整指南
  • 18TB数据库优化实战:AI在哪个环节真正帮上了忙
  • Pi Agent vs Claude Code 实测100小时:后者成本五分之一、任务通过率更高
  • Cloudflare Kitesurf:专为 AI Agent 打造的浏览器
  • AI 能设计系统,但你能否识别它的错误
  • AI 代理自主协作:OpenAI 内部实验失控的警示
  • AI 代理操作真实设备:治理边界正在失效
  • Google A2A 与 ACP 协议:不同层次的 Agent 通信标准
  • NVIDIA Nemotron 3.5 Lightning:高效长程 Agent 工作负载专用模型
  • OpenAI Codex CLI vs Claude Code 2026 深度对比
  • 用 Claude Code Hooks 阻止 AI 读取 .env 等敏感文件
  • OpenAI内部Agent失控事件详解:跨越边界的安全启示
  • Code Interpreter 是基础设施而非提示词
  • AgentStack MCP:一站式确定性推理服务器整合
  • Claude 将对 AI 生成内容添加不可见水印
  • Anthropic 宣布为旧版 Claude 模型也支持水印功能
  • LLM 可观测性工具格局剧变:三个月内三强洗牌
  • 2026 年真正有效的 Prompt 模式速查表
  • 小模型工具调用失败真相:问题不在决策在格式化
  • DeepMind AI Control 路线图:防内贼比防注入更难
  • Agent 静默 bug:返回正确结果却消耗 2.2 倍成本
  • 模型合并:两个微调版本融合为单一模型,无需 GPU
  • Assistant Prefill:预填模型回复开头,彻底控制输出格式
  • AI攻克数学难题:OpenAI解决10个数十年的公开问题
  • Claude自主攻克黎曼猜想获重大突破
  • 已加载 41 / 4321
8.0
热点
AI SCORE
模型发布2026-08-11 22:15

NVIDIA Nemotron 3.5 Lightning 免费开放:30B MoE 适合 Agent 执行层

dev.to · AI#NVIDIA#开源模型#Agent
Editor brief · 编辑速览

30B 总参数的 MoE 模型仅 3B 活跃参数,上下文达 100 万 token,支持工具调用和代码生成,专为长运行 Agent 的高频执行步骤优化。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

NVIDIA Nemotron 3.5 Lightning 现已在 AIHubMix 上免费使用。

在 AIHubMix 上体验 Nemotron 3.5 Lightning

专为 AI Agent 的执行层打造

长时间运行的 Agent 大部分时间都在做频繁的运维工作:调用工具、验证输出、编写和审查代码、格式化结果、以及向子 Agent 分配任务。为每一个步骤都使用大型前沿模型会增加不必要的延迟和成本。

Nemotron 3.5 Lightning 就是为这一执行层设计的。它是一个开放的 30B 混合专家模型,仅有 3B 活跃参数,在保持大模型容量的同时大幅减少了活跃计算开销。

核心能力包括:

  • 30B 总参数,3B 活跃参数
  • 最高 100 万 token 的上下文窗口
  • 工具调用和工具输出验证
  • 编码和专项任务执行
  • 长时间运行的自主 Agent 工作流
  • 高速、高吞吐量推理
  • 在支持的 NVIDIA 硬件上本地部署

Lightning 负责执行,更大的模型负责规划

Nemotron 3.5 Lightning 是 Nemotron 3 系列中最小的成员。Nemotron 3 Super 和 Ultra 等更大规模的模型适合高级推理、编排和复杂规划,而 Lightning 则专注于占据 Agent 工作负载主导地位的高频执行步骤。

这使其成为子 Agent、编码助手、工具驱动工作流和常驻 Agent 系统的实用主力。

免费使用

目前 AIHubMix 提供免费通道,零输入输出 token 定价:

Model ID: nemotron-3.5-lightning-free
Input: $0 / 1M tokens
Output: $0 / 1M tokens
Context: up to 1M tokens

通过 AIHubMix 的 OpenAI 兼容 API 使用:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

response = client.chat.completions.create(
    model="nemotron-3.5-lightning-free",
    messages=[
        {"role": "user", "content": "Help me validate this tool output."}
    ],
)

print(response.choices[0].message.content)

探索 Nemotron 3.5 Lightning,开始在 AIHubMix 上构建

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
AI 代码审查的真实失败模式:不是幻觉而是忽略
下一篇
AI Agent 为何总忽略自己的指令:三个真正有效的修复方案