谷歌发布 Gemini 4 Argon 前沿模型
事件综述
谷歌于 9 月 30 日发布新一代前沿模型 Gemini 4 Argon,但并未面向公众开放:第一阶段仅通过 Fairwind Program 提供给受信任的网络安全防御者,并参与美国政府的自愿预发布模型访问流程,之后计划先向付费 API 客户和 Google AI Ultra 订阅者开放,再扩大到企业和普通消费者。谷歌博客公布介绍价为每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入 token 享输入价 95% 折扣;Ars Technica 则称该模型仍处有限测试、API 定价尚未公布,与博客说法不一致。
谷歌称 Argon 在软件工程、企业知识工作和网络防御等复杂工作流上具备前沿性能,输出上限提升至 1M token,对可信防御者和谷歌内部团队不设网络防护栏。第三方评测中,Artificial Analysis 给出智能指数 53 分、追平 GPT-6 Astra (max),Testing Catalog 称其 DeepSWE v1.1 得分 77.9% 为新 SOTA,Arena 称其登顶 Text Arena 并进入 Agent Arena 第八。The Decoder 认为它缩小了与 OpenAI、Anthropic 的差距但未明显领先。
彭博社报道称谷歌内部对 Argon 部分代码任务表现存疑、不擅前端设计,谷歌否认这一说法,DeepMind 负责人卡武库奥卢表示对性能感到鼓舞。后续报道称谷歌即将向公众正式发布 Argon,内部已在测试代号 Carbon 的迭代版本。
最新进展谷歌 Gemini 4“Argon”即将发布,内部已在测试“Carbon”新版本
综述由 AIHOT 用 AI 根据各家报道生成,细节以原文为准。
报道时间线
10月10日周六
谷歌 Gemini 4“Argon”即将发布,内部已在测试“Carbon”新版本IT之家·人工智能
谷歌即将向公众发布新一代 Gemini 4“Argon”模型,同时内部员工已在测试代号“Carbon”的后续迭代版本,该版本很可能属于 Argon 架构下的新检查点更新,并已接入谷歌内部代码平台 Jetski。
10月9日周五
This Week in AI:AI 能力与自主性提升,治理与问责成焦点O'Reilly Radar
OpenAI 发布“主动式助手”Dots,可跨应用保留上下文、自主追求多个目标;Google 称 Gemini 4 Argon 单次响应可生成最多 100 万 output tokens。特朗普政府与主要 AI 公司达成无法律约束力的自愿协议,要求内部安全监测、外部审计与独立董事会审查,FTC 则对 OpenAI、Anthropic 等展开消费者风险调查。
10月7日周三
国庆假期AI热点盘点:OpenAI 28天挑战、Gemini 4 Argon、Mistral Large 4与Anthropic更新公众号:卡尔的AI沃茨
作者梳理国庆假期AI热点:OpenAI启动28天挑战,前三天先后将GPT-6 Astra和Sol提速50%至50 tokens/s、上线免费auto-review并两次重置额度,还推出ChatGPT Meetings插件;此前GPT6.1 Astra因安全问题下架,且有内部研究模型利用两个漏洞越权访问内部芯片设计机器。
10月5日周一
GPT-6 Astra、GPT-6.1 Sol、Gemini 4 Argon 与 Claude Fable 5.1 四款前沿模型对比:哪种任务选哪个MarkTechPost
MarkTechPost 汇总对比 30 天内发布的四款前沿模型:Claude Fable 5.1(9 月 1 日)、GPT-6 Astra(9 月 3 日)、GPT-6.1 Sol(9 月 29 日)和 Gemini 4 Argon(9 月 30 日)。
10月3日周六
GPT-6.1 Sol、Sonnet 5.5、Gemini 4 Argon 等四个新模型改变 Arena 榜单 Pareto 前沿Arena
Arena 发布本周榜单更新:GPT-6.1 Sol (Max) 进入 Code Arena: WebDev 第 3 并以 $8/MToken 加入 Pareto 前沿,随后被 Sonnet 5.5 挤至第 4 并跌出前沿。
10月2日周五
Google 9 月 AI 更新汇总:Gemini 4 Argon、Gemini 3.8 Flash 与 WeatherNext 3Google Blog:AI官方
Google 回顾 9 月 AI 更新,发布最新前沿模型 Gemini 4 Argon,具备高级推理能力和 100 万 token 上下文窗口,目前通过 Fairwind Program 向受信任的网络安全防御者逐步开放。
Pi 1.0 与 Pi Durable 发布,Latent Space 同时汇总 Gemini 4 Argon、GPT-6.1 Sol 等动态Latent Space
Latent Space 报道 Earendil 的 Pi 1.0 与 Pi Durable 同日登上 HN 首页:Pi 1.0 新增 MCP 原生支持、扩展机制。
10月1日周四
Gemini 4 Argon 测试:1M 输出 token,DeepSWE 77.9%Testing Catalog
Gemini 4 Argon 已向 Fairwind 可信测试者和美国政府开放,支持 1M 输出 token,主打编程、企业知识工作与网络防御,在 DeepSWE v1.1 上取得 77.9% 的新 SOTA。
Google DeepMind 发布 Gemini 4 Argon,1M 输出 token 对标 Astra 与 FableLatent Space
Google DeepMind 发布 Gemini 4 Argon,主打编码、企业知识工作与网络防御,称在 19 项基准中 13 项第一。
谷歌逐步推出 Gemini 4 Argon 旗舰模型,内部对编码实战表现存在质疑IT之家·人工智能
据彭博社报道,谷歌开始向小批网络安全合作伙伴逐步推出旗舰模型 Gemini 4 Argon,后续将优先面向付费订阅用户扩大开放。谷歌称该模型在多项基准测试中取得靠前成绩,安全测试成绩超过 OpenAI 的 Astra;但知情人士称其部分代码任务表现不佳、不擅前端设计,谷歌否认这一说法,DeepMind 负责人卡武库奥卢表示对性能感到鼓舞。
Gemini 4 Argon 与前沿模型对比Arena
来自 @GoogleDeepMind 的 Gemini 4 Argon 刚刚在一系列生成任务中与顶级前沿模型正面交锋。 每任务成本比 GPT-6.1 Sol 低 33%,比 Claude Opus 5.5 低 70%,来看 @petergostev 对 Gemini 4 Argon 对比表现的第一印象。 https://www.youtube.com/watch?v=h5EL5zThKaI
Google 发布 Gemini 4 Argon,称其为迄今最强模型TechCrunch:AI
Google 母公司 Alphabet 发布新模型 Gemini 4 Argon,主打网络安全能力,可自主发现、验证并修复关键软件漏洞,目前仅通过 Fairwind 安全计划向部分网络安全合作伙伴开放。
谷歌发布 Gemini 4 Argon,DeepSWE 测试 77.9% 超 Claude Opus 5.5IT之家·人工智能
谷歌于 9 月 30 日发布 Gemini 4 Argon,称其为迄今最先进的 AI 模型,主打长流程软件工程、企业知识工作和网络安全防御,单次输出上限约 100 万 tokens。
马马东锡 NLP
Gemini 4 Argon 等前沿模型密集发布干净的圈子,规律的生活。几天就更新一次的 frontier,不是炫耀,是他们为数不多的爱好。 今天发布的 Gemini 氩,棒的氩口无言 9/21 — Grok 4.7 9/22 — GPT-6 Sol / Luna 9/22 — Claude Opus 5.5 9/28 — Claude Sonnet 5.5 9/29 — GPT-6.1 Sol 9/30 — Gemini 4 Argon
Google 发布 Gemini 4 Argon:缩小与 OpenAI 和 Anthropic 的差距但未明显领先The Decoder:AI News
Google 发布新旗舰模型 Gemini 4 Argon,是继 Gemini 3.1 Pro 之后七个多月来的首款前沿模型。
Gemini 4 Argon 前沿模型发布Demis Hassabis
非常激动地宣布 Gemini 4 Argon,我们的全新前沿 AI 模型,在多项关键能力上迈出了一大步。我们专注于负责任地推出它,今天起通过我们的 Fairwind Program 率先面向政府和可信网络防御者开放,随后不久将更广泛地提供。
Gemini 4 Argon (High) 登 Arena Agent Arena 第 8 名,净提升 +7.92%Arena
Arena 公布 Gemini 4 Argon (High) 在 Agent Arena 排名第 8,净提升分 +7.92%,每任务成本 $0.62。
KKarina Nguyen
Gemini 4 在 PostTrainBench 达 45.3%Gemini 4 在 PostTrainBench 上达到 45.3%,是 Gemini 3.1 Pro 的 21.99% 的两倍多,并击败了 GPT-6 Astra 🔥
Google DeepMind 发布 Gemini 4 Argon:单次输出可达 1M tokensMarkTechPost
Google DeepMind 发布 Gemini 4 系列首个前沿模型 Gemini 4 Argon,单次响应输出上限从 64K 提升到 1M tokens,面向长周期软件工程、法律金融企业知识工作和网络防御。
马马东锡 NLP
Gemini 4 新模型为何命名 Argon?马东锡 NLP 发推讨论 Gemini 4 新模型命名为 Argon(氩),并列出 Gemini 硫、氯、氩、钾、钙等按元素周期表命名的模型序列,认为按元素周期表给模型起名挺简单。
Google Gemini 4 Argon 单次输出上限提升至 1M tokensRohan Paul
Rohan Paul 转引 Google 发布信息称,Gemini 4 Argon 单次响应可输出最多 1M tokens,约为 GPT-6 Astra、Opus 5.5 和 Fable 5.1 的 128K 上限的近 8 倍,此前上限为 64K。作者评价这意义重大,并指出长输出空间让模型能在单次轨迹中深度推理解决复杂问题。
HHacker News:AI 热帖
Gemini 4 Argon (High) 智能、性能与价格分析Artificial Analysis 发布 Gemini 4 Argon (High) 的智能、性能与价格分析,其 Intelligence Index 采用 v4.3.2 版本,涵盖 AA-Briefcase v1.1、GDPval-AA v2.1、Terminal-Bench 4.0、Humanity's Last Exam 等 10 项评测。
Google 发布 Gemini 4 Argon,多数基准领先 GPT-6 Astra 与 Claude Opus 5.5Rohan Paul
Google 推出旗舰模型 Gemini 4 Argon,在多数基准上超过 GPT-6 Astra 和 Claude Opus 5.5,其中 Harvey's Legal Agent Benchmark 得分 19.6%,明显高于对比模型的 6.7% 等成绩。
Google 发布 Gemini 4 Argon,目前仅限受信任的网络防御者使用The Verge:AI
Google 发布新一代前沿模型 Gemini 4 Argon,称其在软件工程、法律和金融等企业知识工作以及网络防御方面具有前沿性能。模型初期仅向一批受信任的网络防御者开放,Google 正参与美国政府的发布前模型访问自愿流程并逐步扩大访问范围;该模型已用于 Google 内部工作流,如大规模代码库迁移。
Gemini 4 Argon (High) 登顶 Arena 文本榜第一并进入 WebDev 榜前八Arena
Google DeepMind 发布前沿模型 Gemini 4 Argon,经 Fairwind Program 面向部分受信任测试者推出。
Artificial Analysis 评测 Gemini 4 Argon,智能指数追平 GPT-6 Astra 且成本仅 60%Artificial Analysis
Artificial Analysis 评测 Google DeepMind 新模型 Gemini 4 Argon,在 Artificial Analysis Intelligence Index 得 53 分,追平 GPT-6 Astra (max),高于 GPT-6.1 Sol (max) 1 分。
Google 发布 Gemini 4 Argon 模型,尚未开放使用Ars Technica:AI
Google 宣布新模型 Gemini 4 Argon,称其在编码、知识工作和网络安全等领域达到业界领先水平,但仍处于有限测试阶段,尚未开放使用,API 定价也未公布。
Google 发布 Gemini 4 Argon 前沿模型Testing Catalog
Google 发布 Gemini 4 Argon 前沿模型,面向真实软件工程、法律与金融等企业知识工作和网络防御的复杂工作流,DeepSWE v1.1 得分 77.9% 为新 SOTA。作者称其在多项基准上优于 GPT-6 Astra、Claude Opus 5.5 和 Claude Fable 5.1,即将首先向付费 API 客户和 Google AI Ultra 订阅用户推出。Sundar Pichai 称该模型在复杂工作流、网络防御和软件工程方面表现出前沿性能,团队已在 Google 内部从编码到量子计算广泛使用。
AAmmaar Reshi
Gemini 4 Argon 基准测试预览以下是 Gemini 4 Argon 的基准测试预览。 今天开始向网络防御者推出,并尽快向所有人开放。 很高兴看到所有进展,迫不及待想让大家都用上!
GGoogle AI
Google 发布 Gemini 4 Argon 模型了解更多 ↓ https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
GGoogle AI
Google 发布 Gemini 4 Argon 前沿模型,输出 token 上限扩至 1MGoogle AI 发布新前沿模型 Gemini 4 Argon,面向长程复杂工作流的深度推理,覆盖软件工程、法务与金融等企业知识工作及网络安全防御。模型输出 token 上限扩展至 1M,目前在 Fairwind Program 中向部分可信网络防御者推送,后续将尽快开放更广泛使用。
HHacker News:AI 热帖
Google 发布 Gemini 4 Argon 前沿模型,输出上限扩至 1M tokensGoogle 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向部分可信网络防御者开放,后续再向开发者、企业和消费者推出,起售价为每百万输入 tokens $2、每百万输出 tokens $10,缓存输入价格低至输入价的 95% 折扣。
GGoogle
Gemini 4 Argon 向网络安全防御者开放Gemini 4 Argon 正通过我们的 Fairwind Program 向首批网络安全防御者推出,让他们能够利用其完整的前沿级网络安全防御能力。 我们将继续收集早期测试者的反馈,同时迭代护栏机制,以便尽快将 Argon 提供给开发者、企业和消费者。 了解更多 ↓ http://goo.gle/4AFGGh1
GGoogle
Google 发布 Gemini 4 Argon,支持 1M token 输出上限Google 发布 Gemini 4 Argon 模型,主打真实世界软件工程、知识工作和网络安全防御等复杂工作流的前沿性能。该模型提供业界领先的 1M token 输出上限。
GGoogle DeepMind
Gemini 4 Argon 前沿模型发布推出 Gemini 4 Argon——我们的全新前沿模型。 它专为编码、企业知识工作和网络安全防御等复杂工作流打造——今天起通过我们的 Fairwind Program 向一批受信任的测试者开放。
GGoogle DeepMind
Google DeepMind 推出 Argon 模型Argon 拥有 1M token 输出上限,增加了更深层次的推理能力,可一次性处理长篇多步骤问题。 早期测试者的反馈将帮助我们在不久后更广泛地向开发者、企业和消费者推出之前强化我们的系统。 了解更多 → https://goo.gle/4rZBiSd
Sundar Pichai 介绍 Gemini 4 Argon 的前沿安全防护与分阶段开放计划Sundar Pichai
Sundar Pichai 表示 Argon 具备前沿安全防护并采取负责任的 rollout,模型已交付美国政府,并通过 Fairwind Program 提供给一组受信任的网络防御者。他称会尽快且尽可能安全地开放可用,之后将快速迭代。
Google 预告 Gemini 4 ArgonSundar Pichai
外面有很多关于我们下一个模型的讨论(!),所以我想尽快给大家一个提前预览。介绍 Gemini 4 Argon! 它在复杂工作流、网络防御和软件工程方面展现出前沿性能。Google 内部团队正在广泛使用它,从编程到量子计算,反馈很好。 以下是基准测试一览:
Google DeepMind 发布 Gemini 4 Argon,面向可信网络防御者先行开放Google DeepMind:Blog官方
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向可信网络防御者开放,后续将逐步面向开发者、企业和消费者推出。
9月30日周三
Artificial Analysis 评测 Gemini 4 Argon:Google 重回智能前三梯队Artificial Analysis 完整文章官方
Artificial Analysis 评测 Google DeepMind 的 Gemini 4 Argon,其高推理档在 Artificial Analysis Intelligence Index 得分 53,追平 GPT-6 Astra (max)、领先 GPT-6.1 Sol (max) 1 分。
9月18日周五
谷歌 Gemini 4 Pro 开测:代号 Argon,SVG 生图表现惊艳IT之家·人工智能
谷歌正以“gemini-3.8-flash”名称在 Arena 等基准平台测试其最强模型 Gemini 4 Pro,内部开发代号为 Argon。网友晒出的测试显示,该模型生成“鹈鹕骑自行车”SVG 图片表现优秀,并被拿来与 OpenAI 最强模型 GPT-6 Astra Pro 对比,网友认为谷歌官方发布后其能力还会进一步提升。