分享
DeepSeek 新模型上线:支持图像识别,智能体能力媲美 Opus-4.8
2026-08-24 10:10 星期一
8月21日,深度求索正式在API平台上线全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp。
该模型不仅支持文本输入,还能直接处理图片,具备描述画面、识别截图文字以及分析图表等功能,兼容 JPEG、PNG、GIF 和 WebP 等主流图片格式。
官方指出,这款新模型在多模态适配方面表现优异,能更好地融入各类智能体(Agent)框架,帮助用户拓展更多实用工作场景。在纯文本处理能力上,它与 DeepSeek-V4-Flash 正式版保持一致;而在需要视觉理解的测试中,其性能相比旧版大幅提升,多模态智能体能力已接近 Opus-4.8 的水平。
该模型不仅支持文本输入,还能直接处理图片,具备描述画面、识别截图文字以及分析图表等功能,兼容 JPEG、PNG、GIF 和 WebP 等主流图片格式。
官方指出,这款新模型在多模态适配方面表现优异,能更好地融入各类智能体(Agent)框架,帮助用户拓展更多实用工作场景。在纯文本处理能力上,它与 DeepSeek-V4-Flash 正式版保持一致;而在需要视觉理解的测试中,其性能相比旧版大幅提升,多模态智能体能力已接近 Opus-4.8 的水平。
AI解读
1、AI视觉识别能力跃升,将重塑电商内容生产与客服流程。卖家可利用该技术实现自动化Listing优化、智能售后及竞品图表分析,显著降低运营成本并提升转化效率,技术红利向精细化运营者倾斜。
2、建议接入API自动化处理产品图生成多语言描述,利用视觉分析监控竞品价格图表。在客服环节部署智能体识别截图问题,提升响应速度。同时关注数据隐私合规,避免过度依赖单一技术工具。
免责声明:内容由AI生成
新闻推荐
查看更多



