前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8633
  • Apple 支持应用误泄 Claude 配置文件
  • Cursor团队市场支持不连接仓库直接创建
  • 别用剪贴板给AI Agent传代码,有更好办法
  • Claude Code 对特定项目标识的请求限制
  • 自建成本监控系统,发现OpenAI账单上的100倍差异
  • Zig 语言禁用 AI 生成代码的立场与理由
  • Demis Hassabis剖析AGI与智能体的真实进展
  • Cursor推出常驻AI安全审查功能
  • 手机编码新体验:用AI优化移动开发工作流
  • AI助力重构百级测试套件的实战指南
  • Mistral发布Medium 3.5新模型
  • Granite 4.1模型架构与设计原理深度解析
  • DAC:智能体仪表板as-Code开源工具
  • Google推出企业级Gemini智能体完整平台
  • AI智能体自动化游戏测试的创新实践
  • 2026创业指南:警惕自研智能体,坚守可靠工作流
  • 用 Opus 模型降低 LLM 成本的实践
  • 深度拆解 Hermes Agent 的记忆系统设计
  • Agentic Engineering 才是 AI 编程的未来
  • Cursor SDK 发布,开发者可自构建 AI Agent
  • DeepInfra 成为 Hugging Face 官方推理供应商
  • Claude Agent 安全检查误判导致任务拒绝
  • Claude 在创意产业的应用案例分享
  • OpenAI 模型正式接入 AWS Bedrock 平台
  • 开源工具:后台自动化应用不占鼠标焦点
  • NVIDIA 发布 Nemotron 多模态 Agent 模型
  • 自动化的陷阱:何时值得自动化
  • 用 Gemini CLI 编排复杂 RAG 迁移项目
  • AI 代码生成的版权和所有权问题解析
  • AI 编程工具的规模效率反思
  • AI 工具商业模式的经济学困局
  • 开发者分享 Copilot 使用体验
  • Microsoft 与 OpenAI 终止独家合作协议
  • Windows Sandbox 中安全部署本地 AI 模型
  • EvanFlow:Claude Code 的 TDD 反馈循环框架
  • Token 经济学:从成本优化到思维方式革新
  • AI Agent 误删生产库的事后分析
  • Agent 维护的知识库系统
  • 通用 Agent 内存层框架开源
  • Agent 系统与数据库设计的矛盾
  • OpenAI 发布 GPT-5.5
  • Browser Harness 赋予 LLM 浏览器自由度
  • LLM 运作原理可视化教程
  • Cursor 新增异步子代理和多根工作空间
  • Agent 时代的产品设计新思路
  • DeepSeek-V4:百万 token 的 Agent 利器
  • Claude Code 质量报告最新进展
  • 语音 Agent 调试指南:快速定位故障源
  • OpenAI 推出隐私过滤功能
  • 浏览器中运行 Transformers.js:Chrome 扩展教程
  • Agent Vault:AI Agent 的凭证管理方案
  • 已加载 51 / 8633
5.0
关注
AI SCORE
工具产品2026-04-29 08:00

DeepInfra 成为 Hugging Face 官方推理供应商

Hugging Face Blog#推理服务#HuggingFace#基础设施
Editor brief · 编辑速览

DeepInfra 推理服务商加入 HF 官方生态,为开发者提供新的模型部署选项。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

我们很高兴地分享,DeepInfra 现已成为 Hugging Face Hub 上支持的 Inference Provider!

DeepInfra 加入了我们不断增长的生态系统,增强了 Hub 模型页面上无服务器推理的广度和能力。Inference Provider 也被无缝集成到我们的客户端 SDK 中(包括 JS 和 Python),使得使用各种模型搭配首选提供者变得极其容易。

DeepInfra 是一个无服务器 AI 推理平台,提供业界最具成本效益的 token 定价。拥有超过 100 个模型的目录,DeepInfra 让开发者能够轻松地将各种 AI 能力集成到他们的应用中,仅需最少的设置。

DeepInfra 支持广泛的模型类型——从 LLM 到文生图、文生视频、嵌入向量等。作为此次初期集成的一部分,DeepInfra 在 Hugging Face 上启动了对话和文本生成任务的支持,使得能够访问热门的开权重 LLM,比如 DeepSeek V4、Kimi-K2.6、GLM-5.1,以及更多其他模型。对额外任务的支持(文生图、文生视频、嵌入向量等)将很快推出!

如需了解更多关于如何使用 DeepInfra 作为 Inference Provider 的信息,请查阅其专用文档页面。

查看 DeepInfra 支持的完整模型列表。

在 Hugging Face 上关注 DeepInfra:https://huggingface.co/DeepInfra。

用户账户设置

在你的用户账户设置中,你能够:

设置你已注册提供者的自有 API 密钥。如果未设置自定义密钥,你的请求将通过 HF 进行路由。

按偏好对提供者进行排序。这适用于模型页面中的小部件和代码片段。

调用模式

如上所述,调用 Inference Provider 时有两种模式:

自定义密钥(请求直接发送到推理提供者,使用对应推理提供者的自有 API 密钥)

由 HF 路由(在这种情况下,你不需要来自提供者的 token,费用直接从你的 HF 账户而非提供者账户中扣除)

模型页面展示第三方推理提供者(与当前模型兼容的提供者,按用户偏好排序)

SDK 集成

DeepInfra 通过 Hugging Face SDK 提供——Python 版本为 huggingface_hub(>= 1.11.2),JavaScript 版本为 @huggingface/inference。

以下示例展示了如何通过 DeepInfra 使用 DeepSeek V4 Pro。使用 Hugging Face token 进行身份验证——请求将自动路由到 DeepInfra。

import os
from openai import OpenAI

client = OpenAI(
    base_url="https://router.huggingface.co/v1",
    api_key=os.environ["HF_TOKEN"],
)

completion = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-V4-Pro:deepinfra",
    messages=[
        {
            "role": "user",
            "content": "Write a Python function that returns the nth Fibonacci number using memoization."
        }
    ],
)

print(completion.choices[0].message)
import { OpenAI } from "openai";

const client = new OpenAI({
    baseURL: "https://router.huggingface.co/v1",
    apiKey: process.env.HF_TOKEN,
});

const chatCompletion = await client.chat.completions.create({
    model: "deepseek-ai/DeepSeek-V4-Pro:deepinfra",
    messages: [
        {
            role: "user",
            content: "Write a Python function that returns the nth Fibonacci number using memoization.",
        },
    ],
});

console.log(chatCompletion.choices[0].message);

Agent Harness 集成

Hugging Face Inference Provider 已集成到大多数 Agent Harness 中——包括 Pi、OpenCode、Hermes Agents、OpenClaw 等。这意味着你可以直接将 DeepInfra 托管的模型插入到你喜爱的工具中,无需任何额外的粘合代码。浏览完整的集成列表。

计费信息

对于直接请求,即当你使用推理提供者的密钥时,你将由相应的提供者进行计费。例如,如果你使用 DeepInfra API 密钥,你将在 DeepInfra 账户上被计费。

对于由 HF 路由的请求,即当你通过 Hugging Face Hub 进行身份验证时,你仅需支付标准提供者的 API 费率。我们不收取任何额外费用;我们只是直接传递提供者费用。(将来,我们可能与提供者伙伴建立收益分享协议。)

重要提示 ‼️ PRO 用户每月获得价值 2 美元的推理积分。你可以跨提供者使用。🔥

订阅 Hugging Face PRO 计划以获得推理积分、ZeroGPU、Spaces 开发模式、20 倍更高的限制等。

我们也为已登录的免费用户提供免费推理,但如果你能的话,请升级到 PRO!

反馈和后续步骤

我们非常希望获得你的反馈!请在这里分享你的想法和/或评论:https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49

Original source

本文由 AI 翻译整理自 Hugging Face Blog,原文版权归原作者所有。

阅读英文原文
上一篇
Cursor SDK 发布,开发者可自构建 AI Agent
下一篇
Claude Agent 安全检查误判导致任务拒绝