如果几款 AI 都能写邮件、改代码、查资料,谁才算“最好”?答案并不像百米赛跑看终点线那么简单:有的擅长长文研究,有的更会编程,有的回答更讨人喜欢。Google 此时推出新一代 Gemini 模型 Gemini 4 Argon,值得关注的正是这场竞争出现了新的领跑者——至少在媒体评价和预测市场里如此。但现有材料没有完整技术报告或统一测试结果,本文只能确认发布及市场反应,不能替它宣布一场已经结束的胜利。
Google重新回到牌桌中央
《Financial Times》将 Argon 称为 Google“最先进的 Gemini AI 模型”,并称公司希望借它重新站到人工智能前沿。这里的“前沿模型”(frontier model),通常指当下能力最强、训练规模最大的通用 AI 模型。《MarketWatch》则把 Gemini 4 Argon 的发布概括为:Google 又回到了尖端模型的第一梯队。
这是评价,不是统一认证。所谓 AI“王座”,可能由基准测试决定,也可能来自真实产品体验,甚至取决于评测者怎样出题。现有供稿没有披露 Argon 的模型结构、训练方法、参数规模、价格或具体跑分,因此还无法解释它在技术上究竟改了什么。
不过,这次发布有一层更长的组织故事。据 Google、The Information 和 Ars Technica 的相关材料,Gemini 最初暂名“Titan”,后来选用意为“双子”的名字,一方面象征 Google Brain 与 DeepMind 两支研究团队合流,另一方面致敬 NASA 的 Project Gemini。ChatGPT 引发 Google 内部“code red”后,两支长期分头工作的团队被要求共同开发 Gemini,并在 2023 年正式合并。
这也让 Argon 的意义不只是一款新品。TIME 与 The Information 的报道材料显示,Google Brain 的研究人员曾在 2017 年提出 Transformer 架构,后来主流大语言模型大多建立在这一架构之上;但在 ChatGPT 带动的消费产品浪潮中,Google 一度落后。现在,Argon 至少让“Transformer 的故乡能否追上来”这个问题重新有了悬念。
71%押注,押的不是确定答案
市场反应把这条主线补完整了。Polymarket 的“10 月底哪家公司拥有最佳 AI 模型”盘口显示,截至 10 月 1 日 15:00 UTC,Google 的价格对应约 71%的隐含概率,过去 24 小时交易额为 54.1 万美元。
“隐含概率”是把预测市场价格近似读成事件发生概率。它反映交易者愿意用多少钱押某个结果,会受到流动性、结算规则和参与者结构影响,并不是实验室测出的客观胜率。换句话说,71%说明市场目前更愿意押 Google,不等于 Argon 已在所有能力上赢过同行。
同一市场页面的实验性 AI 摘要给出的数字是 Google 69.6%、Anthropic 30.5%、OpenAI 0.7%,与编辑部稍后取得的71%快照接近,但并不完全相同。该摘要还声称 Argon 在若干 intelligence indices、Arena 文本与创意评测、幻觉指标上达到或超过页面所称的“GPT-6 Astra”和“Claude Opus 5.5”,并称它在长上下文研究、编程和网络安全任务上表现强劲。
这些说法目前只有这一处来源,而且页面没有给出具体分数、测试方法或第三方评测链接。相关模型名称也缺少官方材料交叉确认。因此,更稳妥的读法是:这是预测市场页面对交易叙事的概括,不是经过广泛验证的跨模型结论。
月末领先,不等于年末封王
不同结算时间也给出了不同答案。在“2026 年底哪家公司拥有最佳 AI 模型”的 Polymarket 页面中,实验性 AI 摘要给 Anthropic 52.5%、Google 40.5%、OpenAI 4.3%。这与 Google 在 10 月底盘口领先并不矛盾:前者押注更远的年末格局,后者交易的是眼前势头。模型更新很快,一次发布足以改变月末排序,却未必能锁定三个月后的结果。
这正是 Argon 最值得关注的地方。它没有终结竞争,而是改变了竞争的形状。Google 从“是否掉队”的讨论对象,重新变成短期盘口中的首选;Anthropic 仍在年末市场领先;现有材料也明确承认,没有任何单一大语言模型统治所有能力领域。
局限与未知
- 现有材料没有 Argon 的技术报告、完整基准分数和第三方复测,无法判断优势来自模型能力、评测选择还是版本差异。
- 9 月 30 日这一发布日期及具体性能描述仅见于 Polymarket 的实验性 AI 摘要,不宜视为多方确认。
- 相关市场页面同时出现“View resolved”和面向未来的结算叙述,状态表述含糊;盘口只能作为市场情绪快照,不能充当能力证明。