🚀 2026.08.21 正式发布 · V4-Flash-Vision-Exp
🐋 小鲸鱼长眼睛了 · 多模态视觉模型

DeepSeek 多模态来了

看懂图片 · 分析图表 · 识别截图 · Agent视觉理解

⚡ 多模态Agent能力已接近 Opus 4.8  |  ApexBench 36.5 vs 39.4
🍎 iOS
App Store 搜索 "DeepSeek"
57.6MB · iOS 15.0+
📱 Android
各大应用商店下载
完全免费
🌐 网页版
chat.deepseek-Lg.com.cn
无需下载

💡 所有功能无广告 · 无使用次数限制

✨ 多模态核心能力

DeepSeek V4-Flash-Vision-Exp 让AI真正"看见"世界

🖼️

看懂图片

自然语言理解图像内容,描述、问答、推理

📊

分析图表

从折线图、柱状图、饼图中提取数据洞察

📸

识别截图

理解UI、文档截图,提取文字与结构

🧠

Agent视觉理解

多模态Agent自主规划、操作、反馈

📌 官方发布 · 多模态视觉模型

DeepSeek 由杭州深度求索人工智能基础技术研究有限公司开发。2026年8月21日,DeepSeek正式上线多模态视觉理解模型 V4-Flash-Vision-Exp,开启多模态API服务。这是DeepSeek首次面向Agent时代推出的视觉模型,标志着小鲸鱼终于"长眼睛"了——DeepSeek从纯文本模型进化为可看懂图片、分析图表、识别截图的视觉Agent。该模型支持JPEG、PNG、GIF、WebP四种图片格式。DeepSeek官方App与网页端完全免费无广告,所有功能无使用次数限制。

📥 下载与使用引导

iOS版:App Store搜索"DeepSeek",约57.6MB,需iOS 15.0+,开发者"杭州深度求索人工智能基础技术研究有限公司"。
Android版:各大应用商店搜索"DeepSeek"。
网页版:直接访问 chat.deepseek-Lg.com.cn 无需下载。

开发者API:设置 model='deepseek-v4-flash-vision-exp' 即可访问,支持Chat Completions、Messages、Responses三种格式,支持图文混合输入,支持base64内联、外部URL、Files API三种图片传入方式。

⚡ 性能表现:逼近Opus 4.8

V4-Flash-Vision-Exp在纯文本能力与DeepSeek-V4-Flash正式版持平。在需要视觉理解的Agent Benchmark上,多模态Agent能力已接近Opus 4.8。

36.5ApexBench (vs 39.4)
27.3Agents' Last Exam (反超Opus 25.7)
64.3Chartography (vs 65.0)
35.0ZeroBench Pass@5 (反超34.0)

一张图片最多换算384个Token,计费价格与V4-Flash一致——输入1元/百万Token,输出2元/百万Token。高峰时段理解一张图片最高仅需0.001152元,约为Anthropic Opus 4.8输出价格的百分之一。

🚀 多模态解锁的Agent场景

V4-Flash-Vision-Exp在各类Agent框架内展现出了较好的多模态适配能力。官方展示了三大典型应用场景:
场景一:Agent框架下生成商业定制PPT——输入"帮我做个西藏攻略的PPT,藏南+藏北,一个月,自驾游,高端定制游,核心调性:野性、原始、探索感,所有配图使用真实摄影图片风格",模型结合多模态能力自动完成内容和视觉呈现。
场景二:对DeepSeek Harness官网进行二次创作——用黑蓝深海、玻璃UI和ASCII原子像素等视觉要素,经多轮交互后重构出未来主义风格的开发者网站。
场景三:制作黏土怪物风格动态特效前端Demo——按"一群可爱的3D黏土小怪物加入跃动复古舞池派对"的创意生成动态视觉效果。

📂 Files API 与 Harness 联动

DeepSeek同步上线了Files API,该API不收费,用户可先将图片上传到平台,在后续请求中通过file_id引用同一文件,无需重复上传,节省带宽开销。DeepSeek Harness也在同一天更新至v0.1.1-rc.1版本,新增对V4-Flash-Vision-Exp多模态模型的原生支持,/goal、/plan等命令可接收图文输入,@菜单可引用文件和会话,MCP/ACP同时支持图片附件持久化,PTC Mode支持转发嵌套图片。

🌐 DeepSeek 官网 — 探索AI的起点

DeepSeek 官网不仅是模型的展示窗口,更是开发者与AI爱好者的一站式平台。在这里,你可以第一时间获取模型更新、技术文档、性能评测以及社区动态。官网以极简设计承载丰富信息,从多模态视觉到Agent框架,每一处细节都体现着"探索未至之境"的品牌理念。我们相信,AI的边界应由每一个使用者共同定义。

  • 实时模型状态与更新日志
  • 交互式API调试控制台
  • 开源社区与案例库
  • 企业级解决方案白皮书

官网同步提供 Harness 联动入口,支持一键部署多模态Agent,让视觉理解能力无缝融入您的业务流。

🧠 DeepSeek AI — 不止于对话

DeepSeek AI 代表着新一代通用人工智能的演进方向。从文本生成到多模态理解,从推理规划到Agent自主决策,DeepSeek AI 正在重塑人机协作的范式。V4-Flash-Vision-Exp 的发布,标志着AI首次以"视觉Agent"的形态参与复杂任务,其能力在 ApexBench、Chartography 等评测中已逼近甚至局部超越 Opus 4.8。

  • 多模态融合理解引擎
  • 长上下文与深度推理
  • 视觉-语言联合Agent框架
  • 成本仅为同类模型的1%

DeepSeek AI 坚持开放与免费,所有基础能力无门槛使用,让智能真正普惠。

🚀 AI探索未至之境 — 边界由你定义

"探索未至之境"是DeepSeek的核心理念,它驱动我们不断突破视觉、语言、推理与Agent能力的边界。通过多模态模型,AI第一次能够"看见"并理解物理世界的信息,从图表分析到创意设计,从代码生成到动态特效,DeepSeek正在打开前所未有的应用场景。我们邀请每一位开发者、创作者和思考者,共同参与这场探索之旅。

  • 社区驱动的创意工坊
  • 多模态API + Files API 免费生态
  • Harness 可视化Agent编排
  • 未来:视频理解与实时交互

加入DeepSeek,一起探索AI的未至之境——每一次交互,都是新的发现。

🎯 完全免费 · 无限使用

DeepSeek官方App与网页端完全免费,不包含任何广告和付费项目。搭载DeepSeek-V4系列旗舰模型,支持联网搜索与深度思考模式、文件上传(图像、PDF、Word、Excel、PPT等)、1M超长上下文(约75万中文字符)。所有基础对话、文档解析完全开放,无使用次数限制。


📱 下载量突破 3200万+ · 全球用户信赖的AI助手

🔹 多模态视觉 🔹 1M上下文 🔹 文件解析 🔹 联网搜索
❓ 常见问题

Q:如何下载?
通过iOS App Store或Android应用商店搜索"DeepSeek",或直接使用网页版。

Q:图片支持哪些格式?
JPEG、PNG、GIF、WebP。

Q:API如何调用?
设置 model='deepseek-v4-flash-vision-exp',通过Chat Completions等接口传入图片。