RecodeX 重构消息,DeepSeek新视觉模型deepseek-v4-flash-vision-exp已浮出水面,社区已通过API跑通,可直接传图提问。更直接的信号是,DeepSeek Harness今日将该模型加入默认模型目录,并明确标记支持图片输入,对应代码PR标题为「publish the vision model」。目前DeepSeek尚未正式官宣,官方API文档中也暂未出现。此前DeepSeek网页和App已上线识图模式,视觉团队公开研究基于V4-Flash,让模型将点和边界框直接插入推理链,实现视觉CoT推理。两天前Harness RC.8已为官方适配器补上原生图片输入,但未放入默认目录,理由是等待模型端点准备好;今日Harness v0.1.1-rc.1已将其列为默认视觉模型,新视觉模型即将发布。
DeepSeek视觉模型deepseek-v4-flash-vision-exp进入官方Harness默认目录
后续报道
DeepSeek上线V4-Flash-Vision-Exp多模态模型
RecodeX 重构消息,DeepSeek今日在API平台上线实验性多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp,用户可通过设置model='deepseek-v4-flash-vision-exp'访问。该模型纯文本能力(Agent、推理、世界知识等)与DeepSeek-V4-Flash正式版持平,但在视觉理解的Agent Benchmark上实现大幅跃升,多模态Agent能力已接近Opus-4.8。
DeepSeek-V4-Flash-Vision-Exp上线 开启多模态API服务
RecodeX 重构消息,DeepSeek推出实验性多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp,已上线DeepSeek API平台,用户可通过设置model='deepseek-v4-flash-vision-exp'访问。该模型在纯文本能力(Agent、推理、世界知识等)上与DeepSeek-V4-Flash正式版持平,但在需要视觉理解的Agent Benchmark上实现大幅跃升,多模态Agent能力接近Opus-4.8。
DeepSeek发布多模态视觉理解模型V4-Flash-Vision-Exp
RecodeX 重构消息,DeepSeek推出多模态视觉理解模型DeepSeek V4-Flash-Vision-Exp,该模型已正式上线。此次发布标志着DeepSeek在视觉理解领域的技术进展,具体性能参数和应用场景尚未披露。
DeepSeek推出实验性视觉模型,单图最高384令牌
RecodeX 重构消息,梁文锋旗下DeepSeek发布实验性视觉模型deepseek-v4-flash-vision-exp,支持Chat Completions、Messages和Responses三种请求格式。该模型对每张图像的计费上限为384个V4-Flash令牌。
DeepSeek发布视觉理解测试模型,逼近Anthropic Opus 4.8
RecodeX 重构消息,DeepSeek推出了一款实验性AI模型,能够理解视觉提示,并称其性能接近美国竞争对手Anthropic的先进模型Opus 4.8。该模型目前处于测试阶段,具体发布时间和可用性尚未公布。
DeepSeek发布实验性视觉理解模型,多模态Agent能力逼近Opus-4.8
RecodeX 重构消息,DeepSeek今日发布一款实验性视觉理解模型,官方称其多模态Agent能力已接近Opus-4.8水平。该模型专注于图像理解与多模态交互,具体技术细节和开放时间尚未公布。此次发布标志着DeepSeek在视觉与语言融合领域迈出重要一步,有望推动多模态AI应用发展。
DeepSeek发布视觉模型挑战Anthropic,主打低成本高性能
RecodeX 重构消息,DeepSeek于周五发布实验性多模态模型DeepSeek-V4-Flash-Vision-Exp,声称其智能体能力可与Anthropic支持的Opus-4.8系统相媲美。该模型基于纯文本版本构建,以显著更低的API定价向外国竞争对手发起挑战,标志着中国AI企业缩小与海外差距的最新举措。
DeepSeek视觉模型上线API,价格对齐V4 Flash
RecodeX 重构消息,DeepSeek正式上线全新视觉模型deepseek-v4-flash-vision-exp,官方API文档已将其与V4 Flash、V4 Pro并列,开发者可通过DeepSeek API直接传入图片。该模型支持100万Token上下文,最大输出38.4万Token,并支持JSON Output、Tool Calls、Responses API和Anthropic API。 价格与V4 Flash完全一致:每百万Token输入在缓存未命中时,高峰期为3元、空闲期1.5元;缓存命中分别仅需0.1元和0.05元。每百万Token输出高峰期9元、空闲期4.5元,相比V4 Pro同档价格仅为三分之一。图片不单独按张收费,而是按尺寸换算成Token与文本合并计费。高峰期为北京时间9:00–12:00、14:00–18:00,其余时间价格减半。
DeepSeek视觉模型Agent跑分逼近Opus 4.8
RecodeX 重构消息,DeepSeek公布V4-Flash-Vision-Exp首批Agent跑分。在4项多模态Agent评测中,与Opus 4.8打成2胜2负:Agents' Last Exam为27.3对25.7,ZeroBench为35.0对34.0;ApexBench为36.5对39.4,Chartography为64.3对65.0。相比纯文本版V4-Flash-0731,视觉版在ApexBench从26.2升至36.5,Agents' Last Exam从25.2升至27.3。官方注明V4-Flash会忽略评测中的多模态内容,因此主要体现补上视觉输入后的能力。7项文本评测中,Vision Exp有6项高于V4-Flash-0731,如DeepSWE从54.4升至59.3,超过Opus 4.8的58.0;Toolathlon为75.9,接近Opus 4.8的76.2。结果来自DeepSeek官方自测,非第三方独立榜单。