热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > 热点新闻 >DeepSeek-V4-Flash-Vision-Exp视觉模型上线:Agent能力接近Opus-4.8

DeepSeek-V4-Flash-Vision-Exp视觉模型上线:Agent能力接近Opus-4.8

来源:互联网 更新时间:2026-08-21 20:03

8月21日消息,DeepSeek在API平台正式上线实验性质多模态模型DeepSeek-V4-Flash-Vision-Exp,开发者设置model参数为deepseek-v4-flash-vision-Exp即可完成调用。

该版本保留V4-Flash全部文本能力,补齐视觉理解能力,多模态Agent综合表现接近Claude Opus-4.8旗舰水平。

纯文本层面,该模型的推理、知识储备、文本Agent能力与V4-Flash正式版保持对齐,Terminal Bench 2.1、DeepSWE、DSBench-Hard等文本类评测维持原有得分,能够继续胜任代码编写、工具调用、长文档处理等原有业务场景。

DeepSeek-V4-Flash-Vision-Exp视觉模型上线:Agent能力接近Opus-4.8

在视觉相关Agent基准测试中,相较于原版V4-Flash实现了显著跃升。在ApexBench、Agents'Last Exam、Chartography等多模态专项评测中,其分数大幅提升。如今,它能够轻松完成截图解析、界面识别、图表读取以及图文混合等任务,完美适配GUI智能体、屏幕操作、图文数据分析等开发场景。

计费规则与V4-Flash现有的定价标准保持一致,图片输入会被转换为token来参与计费,单张图片最高按384 tokens计算,不会额外收取视觉专项费用。每百万token输入缓存未命中需1元,输出则需2元,而缓存命中时,每百万token的费用可低至0.02元,这大大降低了多模态Agent开发的调用成本。

DeepSeek-V4-Flash-Vision-Exp视觉模型上线:Agent能力接近Opus-4.8

模型延续100万token超长上下文窗口,支持思考模式,可设置high、max推理强度,复杂多模态智能体任务推荐开启max档位,适配Harness智能体框架,支持工具调用、Function Call,能够结合图片理解完成调研、数据提取、自动化任务编排等链路工作。

最新明确该产品属于Exp实验预览版本,不建议直接用于生产环境,后续会根据线上真实调用反馈迭代优化,稳定性、输出效果会持续调整,正式版上线时间暂未对外公布。

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc