新闻

刚刚,DeepSeek新模型上线,长文本缓存硬盘占用暴降88%!

1 分钟阅读
来源:zhidx.com
智东西 作者|毕伟豪 编辑|李水青 智东西9月10日报道,刚刚, DeepSeek正式发布DeepSeek V4.1 Flash ,该模型采用全新架构,是一款552B参数的MoE模型,为DeepSeek全新模型架构系列中尺寸最小的成员,在性能上 超越了包括DeepSeek V4 Pro在内的一众旗舰模型 。 模型开源地址: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash 论文链接: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf 同时,DeepSeek App显示已完成全新升级,整合了快速、专家和识图模式,并上线了新模型,网页端应该也已同步上新。 一、性能全面超越旗舰,定价下调 价格方面,得益于模型架构的创新,与DeepSeek V4 Flash相比,DeepSeek 下调了V4.1 Flash的定价 ,峰谷定价机制被保留,闲时价格为高峰时段价格的一半,官方鼓励用户根据实际使用情况调整任务时间。 全新定价为闲时 输入(缓存命中)0.02元、未命中1.0元、输出4.0元 ,高峰时段 输入(缓存命中)0.04元,未命中2.0元,输出8.0元 ,新价格已于2026年9月10日12:00正式生效。 ▲DeepSeek V4.1 Flash定价表(图源:DeepSeek) 该模型具备原生多模态视觉理解能力,采用了 全新的Causal-Encoder-Decoder架构 ,输入和输出不对称,