DeepSeek 上线 V4-Flash-Vision-Exp 多模态视觉理解模型

8 月 22 日,昨天,DeepSeek 上线实验性视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,并将其开放至 API 平台。用户可通过 deepseek-v4-flash-vision-exp 模型名调用;官方称,其纯文本 Agent、推理与知识能力与 V4-Flash 正式版基本持平,同时补上图像理解能力。

DeepSeek 上线 V4-Flash-Vision-Exp 多模态视觉理解模型

 

官方公布的 4 项多模态 Agent 评测中,该模型在 Agents’ Last Exam 和 ZeroBench 上高于 Opus 4.8,在 ApexBench 与 Chartography 上略低。上述成绩均来自厂商测试,测试所用的 Agent 框架和任务设置也由官方给出。

API 支持 Chat Completions、Messages 和 Responses 三种调用格式,可接收 base64、外部 URL 与 Files API 三种图像输入。一张图片最多转换为 384 个 token,计费价格与 V4-Flash 相同。同步开放的 Files API 不收取存储费用,同一图片上传后可通过 file\_id  跨请求复用。

 

声明:内容来源公开的各类媒体平台,若收录的内容侵犯了您的权益,请联系邮箱,本站将第一时间处理。
资讯

GPT Image 2 API 开始预览透明背景生成

2026-8-22 14:15:44

资讯

豆包工作任务加入技能、连接器和专业 Agent

2026-8-22 14:18:45

搜索