10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 标签云 排行榜

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

Google 发布 Gemini 4 Argon:百万 token 输出,18 项测试 14 项第一

1小时前 AI最新动态 5 0

Google 发布了新一代前沿模型 Gemini 4 Argon,将单次输出上限从 64K token 提升至 100 万 token。推广期价格为每百万 token 输入 2 美元、输出 10 美元,结束后调整为输入 4 美元、输出 20 美元。

Gemini 4 Argon 配图 1

Argon 目前未全面开放,先通过 Fairwind 计划交给网络防御者,并进入美国政府发布前评估流程,之后从付费 API 用户和 Google AI Ultra 订阅者开始陆续开放。

Gemini 4 Argon 配图 2

基准测试成绩

Argon 与 GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5 对比 18 项测试、19 个分项,拿下 14 项第一(CWE-bench v1 与 GPT-6 Astra 并列)。编程方面,DeepSWE v1.1 拿到 77.9%,刷新最好成绩。

Gemini 4 Argon 配图 3

Vals Index 综合测评(按美国 GDP 加权)上,Argon 得分 68.9%,首次超过 Claude Opus 5.5(67.0%)排第一。

Gemini 4 Argon 配图 4

分行业看,金融研究 Argon 拿到 65.4%,比第二名高 6.5 个百分点;法律方向(Harvey Legal Agent Benchmark)Argon 拿到 19.6%,其他三家都没超过 7%。

Gemini 4 Argon 配图 5

Gemini 4 Argon 配图 6

AutomationBench(企业工作流自动化)Argon 以 51.3% 排名第一,Claude Opus 5.5 是 42.5%。

Gemini 4 Argon 配图 7

长视频理解 LVBench 拿到 91.7%,图表理解 Chartography 71.6%。长上下文测试 GraphWalks(256K 到 100 万 token)Argon 84.2%,大幅领先。

100 万 token 输出

输出余量大幅提升,模型可以在一条执行轨迹里思考、生成几十万 token,把难题一次做完,推理更深一层。

Gemini 4 Argon 配图 8

Google 内部应用

数千名 Google 员工已在日常工作中使用 Argon:

  • 量子算法优化:帮研究员优化量子子程序的时空资源,几分钟将基线成绩提升 40%
  • 内存效率:分析整个服务器集群性能,释放超过 300 TiB 内存,预计节省 500 TiB 到 1 PiB
  • 大规模代码迁移:将 C/C++ 代码库迁移到 Rust,从 re2、libgav1 到 Fuchsia Zircon 内核 80 万行以上

其中 libgav1 的 Rust 移植版经 Argon 优化后,速度是原版的 2.7 倍,解码输出完全一致。

网络安全能力

Argon 在 CWE-bench v1 漏洞修复测试中以 68% 并列第一。真实漏洞发现测试(覆盖 20 种编程语言)Argon 85.8%,比 Gemini 3.8 Flash Cyber 的 71.0% 有明显进步。Wiz 渗透测试基准(无源代码,分析线上网站)Argon 70.9% 对 3.8 的 58.2%。

Gemini 4 Argon 配图 9

Gemini 4 Argon 配图 10

Wiz 在 Scan for Good 项目中用 Argon 发现了多家医院医疗软件的严重漏洞。面向受信任的防御者,Argon 会以不带网络安全护栏的版本提供。

安全防护

  • 防滥用:拒绝网络攻击和 CBRN 攻击请求,保留正当两用科学研究
  • 防提示注入:Gray Swan 间接提示注入测试排名第一,15 次尝试攻击成功率仅 0.7%
  • 监测失准:监控思维链和行动,发现越界时中止执行
  • 加固系统:高风险训练前隔离沙箱环境

Gemini 4 Argon 配图 11

价格与上线

推广价:输入 2 美元/百万 token,输出 10 美元。缓存输入便宜 95%。正式价:输入 4 美元,输出 20 美元。

Gemini 4 Argon 配图 12

Gemini 4 Argon 配图 13

Google DeepMind CEO Demis Hassabis 表示 Argon 在关键能力上是巨大进步。

Gemini 4 Argon 配图 14

Gemini 4 Argon 配图 15

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Google 发布 Gemini 4 Argon:百万 token 输出,18 项测试 14 项第一
#Google #Gemini #大模型 #AI新闻 
收藏 1
Anthropic 长文评测 GLM-5.3:网络安全能力逼近 Claude Mythos 水平
dlss5-visual-enhancer:开源 AI 图像视频增强工具,DLSS 5 技术用于日常影音处理
推荐阅读
  • 豆包桌面端工作任务升级:支持 GUI 操作电脑、飞书妙搭应用生成与画中画模式
  • 智谱 GLM-5V-Turbo 发布:原生多模态 Coding 基座模型
  • Claude Desktop 新增定时任务:本地版 Claude Code,正在把 OpenClaw 的活变得更简单
  • Gemma 4 开源实测:31B 参数跻身全球前三,oMLX + Mac Mini 打造高性价比 AI 底座
  • 网易有道Confucius4双榜第一:R2T2语音识别与T3PO实时翻译模型开源
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
34231 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30847 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23541 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
22991 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
21332 6月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
19044 5月前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
18652 1年前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18452 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
18219 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16640 1年前

文章目录

关于苏米客
分类排行
1 Google 发布 Gemini 4 Argon:百万 token 输出,18 项测试 14 项第一
2 Anthropic 长文评测 GLM-5.3:网络安全能力逼近 Claude Mythos 水平
3 Claude Sonnet 5.5 发布:性能超越 Fable 5.1 和 GPT-6 Astra,成本大幅降低
4 Claude Sonnet 5.5 发布:性能逼近 Opus 5.5,价格减半
5 Qoder实测:2小时生成293个测试全绿,Credits一分不扣
6 OpenAI DevDay前瞻:常驻型AI助手"O"曝光,关掉ChatGPT它还在替你干活
7 腾讯Hy Image 3.5 preview实测:生图效果媲美GPT Image 2.5,限时免费
8 Anthropic 两周提速 Claude 3 倍:可衡量就能优化,150 线程并行 + CI 棘轮护栏实战
9 腾讯QClaw宣布12月停运:AI办公内部赛马结束,WorkBuddy胜出
10 网易有道Confucius4双榜第一:R2T2语音识别与T3PO实时翻译模型开源
苏米客
登录 注册
显示
没有账号? · 立即注册
显示
已有账号? · 直接登录
登录代表你已同意 用户协议 和 隐私政策
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6 网站地图 百度地图
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联