北京商报讯(记者 魏蔚)9月10日,深度求索正式发布DeepSeek V4.1 Flash模型。DeepSeek V4.1 Flash是552B参数的MoE(混合专家)模型,采用全新的Causal-Encoder-Decoder(一种)结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,DeepSeek V4.1 Flash还采用新的预训练方式、经过更大规模的强化学习后训练,在基准测试中,超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。
深度求索称,经多方测试,DeepSeek V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越DeepSeek V4 Pro,因此计划有序下线DeepSeek V4 Pro 模型。北京时间 2026 年9月14日12:00之后,至未来DeepSeek V4.1 Pro上线之前,用户访问DeepSeek V4 Pro的请求将全部路由到DeepSeek V4.1 Flash,并按DeepSeek V4.1 Flash 单价计费。腾讯(WorkBuddy、CodeBuddy)和 OpenCode 作为官方合作伙伴,现已全量接入 DeepSeek V4.1 Flash。
本网站所有内容属北京商报社有限公司,未经许可不得转载。 商报总机:010-64101978 版权合作:010-64101871
商报地址:北京市朝阳区和平里西街21号 邮编:100013 法律顾问:北京市中同律师事务所(010-82011988)
![]()
网上有害信息举报 违法和不良信息举报电话:010-84276691 举报邮箱:bjsb@bbtnews.com.cn
ICP备案编号:京ICP备08003726号-1
京公网安备11010502045556号 互联网新闻信息服务许可证11120220001号