🇪🇺 开源大模型

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
10月6日大模型

欧洲造出 1 万亿参数的开源模型:Mistral Large 4 来了

1 万亿参数,但你只为 490 亿付钱

Mistral Large 4(社区昵称 Le Chonk)用的是细粒度混合专家(MoE)架构:总共 1.05 万亿参数,但每生成一个 token 只激活其中约 490 亿——算下来大约 4.7%。这意味着它的运行算力和一个 490 亿参数的稠密模型差不多,而不是真的在跑一万亿。它还带一个 16 亿参数的视觉编码器,支持文本+图像输入、100 万 token 上下文、函数调用、结构化输出和 Agents / Conversations 接口。训练是在自家欧洲数据中心、约 3800 至 4000 张英伟达 Grace Blackwell 上从零完成的,前后约两个月。

它赢在哪、输在哪:一份不那么好看的成绩单

Mistral 主张的强项集中在安全与企业任务:CyberBench 93 分、真实漏洞复现与修复测试 82 分(自称为最高)、视觉接地(Dense 200)42% 略胜 GPT-6 Astra 的 41%、657 项业务流程的 AutomationBench 59.9%、法律任务(Harvey)也领先。但在编程上差距很实在:DeepSWE v1.1 只有 61.7%,而 GPT-6 Astra 与 Claude Opus 5.5 大约在 74%。第三方 Artificial Analysis 智能指数给它 38 分,落后 Claude Opus 5.5 的 58 分。有一个背景值得补充:部分闭源模型在安全研究类任务上会直接拒答,这会让「敢做安全任务」的模型在同类基准上显得更高分——所以那个 93 分要打个折扣看。

为什么有人就是需要「非美国、非中国」的模型

Mistral 的这轮融资是 30 亿欧元 D 轮,估值超过 210 亿欧元,三星参投,是欧洲科技公司史上最大的一笔股权融资;已有 125 家以上企业客户,包括空客、ASML、汇丰。对欧盟的公共部门、金融机构、国防承包商和医疗行业来说,把数据送进美国托管的闭源 API,在 GDPR 和欧盟 AI 法案下是有真实法律风险的。开源权重 + 欧洲境内基础设施,正好把这个障碍拿掉。不过要提醒两点:一是权重10 月 27 日才放出,现在只是 API 预览,还不能下载自部署;二是按报道估算,完整权重约 240GB,本地跑至少要八张 A100 80GB 级别,量化版大概率会在权重放出后几天内跟上。

💬 白话解读

「开源」这两个字,这几年被用得很随意。这条新闻值得记住的是它的时间差:API 先开,权重后放,中间留三周给企业安全团队压测——这其实是一种成熟的发布节奏。对我们普通人没直接影响,但它说明一件事:最强的那批模型,正在从「只有几家公司能提供服务」,变成「谁有硬件谁就能自己跑」。这个变化对数据敏感行业的意义,比对普通用户大得多。

Mistral开源模型欧洲主权
Mistral AI / ForkLog / VentureBeat / The AI News / rAI.nvent
← 上一篇:Nano Banana 2.1 发布:多轮改图不「换脸」了… 下一篇:Claude 搬进 Google 文档、表格、幻灯片… →
延伸阅读
开源模型

欧洲首个「主权开源」模型 Kolibri

开源模型

501B 参数的 Beam:开源战场转向「更省」

大模型

DeepSeek 年化收入破 10 亿美元

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。

↑