💎 大模型

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
9月30日大模型

谷歌发布 Gemini 4 Argon:迟到七个月的旗舰,内部却有质疑声

迟到七个月的第一代 Gemini 4

9月30日,谷歌 DeepMind 发布 Gemini 4 Argon——Gemini 4 世代的首个模型,主打编程、网络安全、金融与法务专业任务。这是谷歌七个多月来第一个前沿模型:原计划的 Gemini 3.5 Pro 已被放弃,全力转向 Argon。首批访问权只给通过 Fairwind 计划筛选的网络安全合作伙伴,之后才逐步开放给开发者和付费用户;入门 API 价格计划为每百万 token 输入 2 美元、输出 10 美元。

漂亮的榜分与内部的怀疑

官方口径是:Argon 在软件开发测试中创纪录,网络安全能力与 GPT-6 Astra、Grok 4.7 并列第一。但据彭博社报道,谷歌内部对其实战表现存在分歧——有员工反映它在某些真实编程任务、前端开发上不理想,并且认为 Anthropic 的 Fable 和 OpenAI 的 Astra 进步更快;也有员工认为这版已经追平领先实验室。市场反应也很微妙:发布后 Alphabet 股价盘后涨约 1.7%,随后在质疑报道出来后回吐涨幅。独立测试的结论更直白:性能与 Astra 相当,但落后 Claude Opus 5.5,且完成同一任务的 token 消耗约为 Astra 的两倍。

💬 白话解读

跑分第一、内部不买账、token 还费一倍——这就是当下大模型的真实状态。对你有两个实用提醒:一是别急着为发布会榜单买单,等第三方实测再迁移工作流;二是「单价便宜」不等于「总成本便宜」,如果它每件事要多花一倍 token,账要一起算。

谷歌Gemini 4大模型竞争
彭博社 / Google 官方博客 / AI Briefing
← 上一篇:ElevenLabs v4:10 秒克隆一个声音… 下一篇:OpenAI 暂停前沿模型训练… →
延伸阅读
大模型

GPT-6 与 Opus 5.5 同日发布

模型安全

GPT-6 Astra 被评首个严重级模型

大模型

苹果重构 Siri 与 Gemini 联姻

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。

↑