谷歌Gemini 4 Argon发布:单次输出可达100万Token

谷歌Gemini 4 Argon发布:单次输出可达100万Token

AI 资讯 来源:新闻/公众号 发布时间:2026-10-01 更新于 2026-10-01 预计阅读 5 分钟

Google 宣布推出新一代前沿模型 Gemini 4 Argon,定位为面向复杂、长周期工作流的模型,重点覆盖软件工程、法律与金融等企业知识工作,以及网络安全防御。与以往直接面向公众开放不同,Argon 采用分阶段发布策略,首批通过 Fairwind Program 提供给受信任的网络安全防御者。API 初始定价为每百万输入 Token 2 美元、每百万输出 Token 10 美元,缓存输入价格比标准输入低 95%。

Argon 最受关注的变化是将单次输出 Token 上限从 6.4 万提升至 100 万。该指标与上下文窗口不同,更高的输出空间意味着模型可在一条任务轨迹中持续推理,生成数十万甚至接近百万 Token 的结果,主要面向大型代码迁移、深度研究和多步骤企业流程。多数前沿模型输出上限约为 12.8 万 Token,Argon 的能力较为罕见。

刚刚,谷歌发布Gemini 4 Argon:单次输出上限达100万Token

Google 称,Argon 在 DeepSWE v1.1 软件工程评测中得分 77.9%,达到当前最高水平;在企业知识工作方面位列 Vals Index 第一,该指数覆盖金融、编程、法律和税务等领域并按行业对 GDP 贡献加权。Argon 还在 Vals Finance Agent v2、Harvey Legal Agent Benchmark 和 Zapier 的 AutomationBench 等评测中领先,AutomationBench 得分 51.3%。视觉理解方面,Argon 可分析专业图表、理解长视频并根据多份文档采取行动,在 LVBench 中得分 91.7%。

Google 表示,已有数千名员工在日常工作中使用 Argon,应用于代码调试、算法设计和大型代码库迁移。在量子计算领域,Argon 帮助优化量子算法中的时空资源,一项测试中仅用几分钟就将已发表的基准结果提升 40%。在数据中心内存优化项目中,Argon 代理分析全网性能监控数据并自动识别实施优化方案,上线后已释放超过 300 TiB 内存,预计总节省量达 500 TiB 至 1 PiB。Argon 还参与 Google 内部 C/C++ 代码库向 Rust 迁移,覆盖 re2、libgav1 等核心库,并延伸至超过 80 万行代码的 Fuchsia Zircon 内核,迁移仍需自动化审计、人工评审和仿真测试。在 libgav1 项目中,Argon 代理重写约 3.2 万行 SIMD 代码,新 Rust 版本在保持视频输出一致的情况下,运行速度达原 Rust 版本的 2.7 倍。

刚刚,谷歌发布Gemini 4 Argon:单次输出上限达100万Token

网络安全是 Argon 首批落地重点领域。Google 称该模型能自主发现、验证并修复关键软件漏洞。网络安全公司 Wiz 已通过「Scan for Good」计划使用 Argon 为公共基础设施免费排查高风险暴露面。Google 表示,Argon 曾发现一项影响全球医院所用医疗软件的严重漏洞,可能暴露敏感个人信息,此前前沿模型未识别出该风险。在 CWE-bench v1 漏洞修复评测中,Argon 以 68% 的成绩并列第一。Google 还称,在覆盖 20 种编程语言的内部漏洞测试及黑盒渗透测试中,Argon 表现均优于 Gemini 3.8 Flash Cyber。

随着能力提升,Google 同步强化安全机制。Argon 会限制网络攻击及化学、生物、放射性和核相关滥用请求,并通过内部激活监测、自动化红队测试和人工评估识别潜在风险。针对间接提示注入攻击,Google 通过对抗训练和自动化测试提升防护能力,还部署了针对模型失配的监控机制,跟踪推理过程与行动轨迹,必要时中止任务执行,并对高风险训练和评测环境进行隔离。

刚刚,谷歌发布Gemini 4 Argon:单次输出上限达100万Token

不过,评测成绩与真实工作体验之间仍存在差距。彭博社报道称,Google 内部对 Gemini 4 在编码等关键任务中的表现仍有疑问。知情人士表示,模型虽在行业基准测试中表现突出,但员工真正使用时,部分编码任务依然难以稳定完成。Argon 能否兑现长周期推理和复杂任务执行能力,还需更多真实场景验证。

Google 表示,公司正在参与美国政府推动的模型预发布自愿流程,首批测试者将帮助评估模型表现并完善安全防护。完成早期测试后,Argon 将逐步向开发者、企业和消费者开放,首批公开用户包括付费 API 客户和 Google AI Ultra 订阅者。

标签: AI 资讯 AI

更多推荐阅读

没有App只有手机号,这家公司凭什么估值百亿

没有App只有手机号,这家公司凭什么估值百亿

Personal Agent 正成为热门产品方向。Meta 的 Muse 上线 10 天登顶美区 App Store 免费榜,OpenAI 开发者大会首个发布的产品也是 Dots。创业公司 Instinct 的交互方式尤为特别:没有 App,只有一个手机号、一台电脑和一个邮箱。用户发短信、打电话,它就去办事;遇到急事,它还会主动打电话。 用户用它玩出了不少意想不到的用法:有人扫描整个衣橱,让它每...

2026-10-01
腾讯WorkBuddy上线一键发布微信小程序功能

腾讯WorkBuddy上线一键发布微信小程序功能

现在,不懂开发也能自己把一个想法做成并上线微信小程序了。今年的办公 Agent 大战竞争已进入新阶段,各家厂商都在 Agent 里连接自己的生态,帮用户做出更有用的东西,微信小程序就是其中一个典型场景,也是腾讯特别的生态优势。但想让 AI 独立走完整个微信小程序开发和上线流程依然不容易,原因是多数小程序代码来自商业项目,公开样本有限。 上周,腾讯 WorkBuddy 上线了微信小程序发布能力,把...

2026-10-01
机器人拜师苏绣:穿针引线合绣,最细的活成最硬考题

机器人拜师苏绣:穿针引线合绣,最细的活成最硬考题

苏绣被搬入机器人灵巧手的课堂。临界点发布视频显示,其旗舰灵巧手OmniHand 3 Ultra向苏绣传承人学习上绷、劈丝、穿针、捻线、挑线、合绣等精细工艺,相关苏绣画面均为实拍,无CG动画。 苏绣难点不只是“东西小”。丝线绸面细小柔软,机器人既不能抓死也不能太松,需在稳定拿住的同时完成穿针引线等细微动作。嵌绳需指尖捏绳,卷轴需手掌压平绸面,上绷扇靠虎口撑开,穿绷绳以指腹夹线穿孔。从指尖到掌心,每...

2026-10-01
北京AI算力公司冲刺港交所,年收入暴涨178%

北京AI算力公司冲刺港交所,年收入暴涨178%

智东西9月30日报道,北京AI Infra公司九章云极9月29日向港交所递交上市申请,拟在港交所主板上市,中国银河国际证券为独家保荐人。九章云极成立于2013年2月,总部位于北京,早期业务为数据科学平台,后转型为AI算力基础设施供应商,提供一站式智算中心(AIDC)基础设施解决方案和按需云计算服务,正推进Token工厂战略。按2025年收入计,其在中国智算服务商中排名第九,是前十名中唯一的“智算新...

2026-10-01
AI短剧《非妖哉》三集破亿,导演用聊斋讲现实人心

AI短剧《非妖哉》三集破亿,导演用聊斋讲现实人心

在电话那头,AIGC创作者不吃榨菜语速不快,偶尔停顿,像在边想边说。他并不像刻板印象中的技术至上者,细腻与柔软总在谈及人情世故时流露。他是爆款AI志怪短剧《非妖哉》的导演。这部借狐妖、画皮、符水等中国志怪元素讲述人心的作品,截至9月16日已上线三集,播放量破亿,累计点赞超600万,账号粉丝从一两千涨到70万+。在2026年的AI内容赛道里,这是一个绕不开的名字。 但对话中,他几乎没主动提“爆款”...

2026-10-01
快手AI架构大调整:程一笑兼任社区科学线,于越出任可灵CEO

快手AI架构大调整:程一笑兼任社区科学线,于越出任可灵CEO

快手发布公告,创始人兼CEO程一笑将兼任社区科学线负责人;原社区科学线负责人于越转任可灵AI公司董事兼CEO,专注可灵AI经营管理。 于越(本名盖坤)毕业于清华大学,是国内搜广推领域顶尖算法专家,曾任职阿里妈妈,职级达P10;2020年加入快手,历任高级副总裁、社区科学线负责人、主站线业务负责人,主导快手可灵AI视频大模型技术研发。 快手另一份公告宣布成立跨事业部虚拟组织“企业AI生产力”,负...

2026-10-01
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部