当前位置: 首页 - 学院 - 资讯 - 其他资讯 - 正文

DeepSeekV4视觉模型上线,多模态Agent性能逼近Opus-4.8

2026-08-28 17:24:35 来源:互联网 作者:down

deepseek

deepseek

软件类型:办公软件 软件大小:7.29MB 软件平台:  WinALL  软件语言:简体

标签: ai人工智能软件 DeepSeek

查看详情

据第一财经报道,DeepSeek 官方 API 文档的模型详情页已上线新模型 DeepSeek-V4-Flash-Vision-Exp,这是 V4 系列中首款原生支持图片输入的视觉模型。

DeepSeekV4视觉模型上线,多模态Agent性能逼近Opus-4.8

该模型拥有 100 万上下文窗口与 384K 最大输出长度,支持 JSON 输出、工具调用、Responses API、Anthropic API 兼容及对话前缀续写;图片输入将按尺寸折算为 Token,与文本 Token 合并计费。

DeepSeek-V4-Flash-Vision-Exp 的纯文本表现与 DeepSeek-V4-Flash 正式版不分伯仲;但在视觉理解类 Agent Benchmark 上,该模型相较后者实现大幅提升,多模态 Agent 水平已逼近 Opus-4.8。

DeepSeekV4视觉模型上线,多模态Agent性能逼近Opus-4.8截图

定价方面,DeepSeek-V4-Flash-Vision-Exp 目前的 API 价格与标准版 V4-Flash 相同:缓存命中时,闲时 0.05 元/百万 Token、忙时 0.10 元/百万 Token;缓存未命中时,闲时 1.5 元/百万 Token、忙时 3 元/百万 Token;输出侧则为闲时 4.5 元/百万 Token、忙时 9 元/百万 Token。

就在 DeepSeek 开源 Agent Harness 框架短短一周后,视觉能力即宣告接入。此前彼此割裂的模型、图片、文件、工具与 Agent 执行链路被彻底贯通,DeepSeek 由此补上了 Agent 架构中关键的感知输入短板。