🇨🇳 国产模型

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
9月10日国产模型

DeepSeek V4.1-Flash:把前沿能力打到「三厘钱」

发生了什么

DeepSeek 发布 V4.1-Flash:总参数 552B 的混合专家(MoE)模型,处理输入时只激活 8B 参数、生成时激活 16B。凭借这个「少吃多干」的架构,闲时缓存输入价格低至每百万 token 0.003 美元——只有 GPT-6 Astra 输入价格的万分之三。模型保持开放权重,可自行部署。

实力如何

在第三方 Agent 与编程评测 Terminal-Bench 2.1 上拿到 90.6 分,略高于 Claude Opus 5 的 89.1 分,进入第一梯队。便宜和能干第一次同时出现在一个模型身上。

白话解读

MoE 可以理解成「大医院分诊」:全院有 552 个医生,但看你的病只叫 8 个专科医生出手,其余人待命——所以又强又省。对企业用户的实际意义是:批量处理文档、跑客服、做数据清洗这类「按 token 计费」的活,成本可能低到可以忽略不计,「用得起前沿 AI」的门槛被实质性拉低。

552B MoE$0.003/百万tokenTerminal-Bench 90.6
腾讯网 / 第一财经 / 一财有看投
← 上一篇:OpenAI 发布 GPT-6 Astra:… 下一篇:李飞飞 World Labs 发布 Atla… →
延伸阅读
大模型

OpenAI 发布 GPT-6 Astra:105万 token 上下文,「AGI 之争」再起

开源浪潮

开源密集周:端侧小模型集体爆发,AI 开始住进手机和汽车

真实案例

华大集团 × WPS Comate:AI 员工的两个月考卷

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。