该模型支持在文本之外输入,可以让模型描述、识别中的文字、分析图表等。支持的格式包括 JPEG、PNG、GIF、WebP。
深度求索官方表示,V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。在 Agent、推理、世界知识等纯文本任务上与 V4-Flash 正式版持平,原有优势完整保留。在需要
该模型支持在文本之外输入,可以让模型描述、识别中的文字、分析图表等。支持的格式包括 JPEG、PNG、GIF、WebP。
深度求索官方表示,V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。在 Agent、推理、世界知识等纯文本任务上与 V4-Flash 正式版持平,原有优势完整保留。在需要