AI 前沿 · 动态速递
DeepSeek 发布 V4.1-Flash:总参数 552B 的混合专家(MoE)模型,处理输入时只激活 8B 参数、生成时激活 16B。凭借这个「少吃多干」的架构,闲时缓存输入价格低至每百万 token 0.003 美元——只有 GPT-6 Astra 输入价格的万分之三。模型保持开放权重,可自行部署。
在第三方 Agent 与编程评测 Terminal-Bench 2.1 上拿到 90.6 分,略高于 Claude Opus 5 的 89.1 分,进入第一梯队。便宜和能干第一次同时出现在一个模型身上。
MoE 可以理解成「大医院分诊」:全院有 552 个医生,但看你的病只叫 8 个专科医生出手,其余人待命——所以又强又省。对企业用户的实际意义是:批量处理文档、跑客服、做数据清洗这类「按 token 计费」的活,成本可能低到可以忽略不计,「用得起前沿 AI」的门槛被实质性拉低。
本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。