8.0
热点
AI SCORE
模型发布2026-08-21 08:00
DeepSeek V4 Flash Vision实验版发布
Vercel Blog#DeepSeek#多模态#AI Gateway
Editor brief · 编辑速览
DeepSeek推出支持图像理解的多模态实验版本,已上线Vercel AI Gateway,兼容主流编码Agent。
DeepSeek V4 Flash with Vision 现已在 AI Gateway 上线。
该模型为实验版本,支持同时接收图像和文本输入。你可以让它描述图片内容、读取截图中的文字,或者在同一请求中结合图表和你的 prompt 进行分析。Tool use、reasoning 和 caching 的使用方式与此前完全一致。
通过 deepseek/deepseek-v4-flash-vision-exp 开始使用:
import { generateText } from 'ai';
import fs from 'node:fs';
const { text } = await generateText({
model: 'deepseek/deepseek-v4-flash-vision-exp',
messages: [
{
role: 'user',
content: [
{ type: 'text', text: 'What is in this screenshot?' },
{
type: 'file',
mediaType: 'image/png',
data: fs.readFileSync('./example.png'),
},
],
},
],
});
支持的图像格式包括 JPEG、PNG、GIF 或 WebP。格式从文件本身的字节数据中读取,而非根据文件名或你声明的 mediaType 来判断,因此即使文件扩展名有误也能正常处理。
模型 ID 中的 -exp 表明这是一个实验性版本。预期其行为可能会发生变化,如果该模型处于生产路径上,请务必配置好 fallback 模型。
要在 coding agent 中使用,请运行 vercel ai-gateway coding-agents setup 连接 Claude Code、Codex、OpenCode、Cursor 和 Pi 等 agent,然后在 agent 内部选择 deepseek/deepseek-v4-flash-vision-exp。
欢迎在模型 playground 中体验 DeepSeek V4 Flash Vision Experimental。
AI Gateway 实时反映提供商定价,不收取溢价,也不收取推理平台费用,包括 BYOK 请求。查看 AI Gateway 上的所有语言模型了解更多。