[AINews] Gemini 4 Argon:GDM 对 Astra/Fable 的回应,支持 100 万输出
![[AINews] Gemini 4 Argon:GDM 对 Astra/Fable 的回应,支持 100 万输出](https://media.bestblogs.dev/20261001070452_HTfV52SWgAIlX3W.png)
📌 One-Sentence Summary
Google DeepMind 发布 Gemini 4 Argon,这是一款支持 100 万输出 token 的前沿模型,在 13 项基准测试中达到 SOTA,但初期仅限网络安全预览,同时还有其他 AI 动态。
📝 Summary
本期 AI 新闻回顾重点介绍了 Google DeepMind 发布的 Gemini 4 Argon,专为编程、企业和网络安全工作流设计。它具备业界领先的 100 万 token 输出上限,并在与 GPT-6 Astra 和 Claude Opus 5.5 等竞品的 19 项基准测试中,于 13 项取得最佳表现。该模型初期通过 Fairwind Program 面向受信任测试者开放,定价为每 100 万 token 4 美元/20 美元。文章还涵盖了 OpenAI 的 GPT-6.1 Sol 超高速推理、Perplexity 和 Cohere 的新嵌入模型、图像与视频模型更新、智能体研究进展、推理提取攻击等安全隐忧,以及融资轮次和企业变动等行业新闻。
💡 Main Points
Gemini 4 Argon 是 Google 的新前沿模型,支持 100 万输出 token,基准表现强劲。
在与 GPT-6 Astra 和 Claude Opus 5.5 的 19 项公开基准测试中,它于 13 项排名第一,其中 DeepSWE 得分 77.9%,但初期仅限网络安全预览。
该模型专为复杂工作流打造,并已展示出实际的内部部署能力。
Argon 智能体已释放超过 300 TiB 的数据中心内存,并将 80 万行 C/C++ 代码迁移至 Rust,还被用于完成 CK 猜想等研究。
独立评估凸显了成本效益与性能之间的权衡。
Artificial Analysis 在其智能指数上给出 53 分,每任务成本低至 1.99 美元(折扣价),但幻觉率高达 15%,而 Astra 为 51%,表明准确性有所妥协。
新闻回顾还包含 Gemini 4 Argon 之外的多元 AI 动态。
涵盖 OpenAI 的 GPT-6.1 Sol 快速推理、新嵌入模型、图像与视频基准、Context Language Models 等智能体研究、安全问题,以及融资和企业纠纷等行业进展。
💬 Key Quotes
Argon 在与 GPT-6 Astra 和 Claude Opus 5.5 的 19 项公开基准测试中,于 13 项排名第一。
Google 称其具备业界领先的 100 万 token 输出上限
它完美构建了 30 个 Vibe Code Bench 应用
📊 Article Meta
AI Screening: 86
Source: Latent.Space
Author: Latent.Space
Category: 人工智能
Language: 英文
Read Time: 10 min
Word Count: 2421
Tags:
AI 与智能应用 , 模型发布 , AI Agent , 产业动态 , 大语言模型 (LLM)
刚好最近在找这方面的资料,太及时了。
刚好最近在找这方面的资料,太及时了。