新闻

DeepSeek首个视觉实验模型正式开源,3050亿参数对标顶尖水平 DeepSeek近日正式开源了其V4系列的首个实验性多模态模型——DeepSeek-V4-Flash-Vision-Exp

1 分钟阅读
DeepSeek首个视觉实验模型正式开源,3050亿参数对标顶尖水平 DeepSeek近日正式开源了其V4系列的首个实验性多模态模型——DeepSeek-V4-Flash-Vision-Exp。该模型基于现有的V4-Flash底层架构深度融合了视觉模块,使其在原有的强大文本处理能力之上,全面具备了深度的图片理解与分析能力。 在核心技术参数方面,该实验模型总参数量达到了3050亿规模。通过将视觉模块与文本架构进行有机结合,它不仅能够精准解读各类图像内容,还可以无缝结合外部工具独立完成复杂的Agent(智能体)任务。官方评测数据显示,该模型在纯文本Agent任务上的表现与此前的V4-Flash保持相当水准,而在多模态综合测试中则展现出强劲竞争力,其实际多模态Agent能力在多项行业测试中表现亮眼,接近行业顶尖水平。 为了进一步推动开源生态的发展与技术的普惠应用,DeepSeek此次为该实验性多模态模型选择了开放且友好的MIT许可证。这一举措允许全球开发者、研究机构以及企业在合规的前提下更自由地进行二次开发、商业集成与技术创新,有望在开源社区中掀起新一轮的多模态应用落地热潮。 via AI新闻资讯 (author: AI Base)