[AINews] Gemini 4 Argon:GDM 对 Astra/Fable 的回应,支持 100 万输出

山止川行AI 前沿📡 BestBlogs·AI高分精选⭐ 862026-10-01379 阅读💛 97 收藏
[AINews] Gemini 4 Argon:GDM 对 Astra/Fable 的回应,支持 100 万输出

📌 One-Sentence Summary

Google DeepMind 发布 Gemini 4 Argon,这是一款支持 100 万输出 token 的前沿模型,在 13 项基准测试中达到 SOTA,但初期仅限网络安全预览,同时还有其他 AI 动态。

📝 Summary

本期 AI 新闻回顾重点介绍了 Google DeepMind 发布的 Gemini 4 Argon,专为编程、企业和网络安全工作流设计。它具备业界领先的 100 万 token 输出上限,并在与 GPT-6 Astra 和 Claude Opus 5.5 等竞品的 19 项基准测试中,于 13 项取得最佳表现。该模型初期通过 Fairwind Program 面向受信任测试者开放,定价为每 100 万 token 4 美元/20 美元。文章还涵盖了 OpenAI 的 GPT-6.1 Sol 超高速推理、Perplexity 和 Cohere 的新嵌入模型、图像与视频模型更新、智能体研究进展、推理提取攻击等安全隐忧,以及融资轮次和企业变动等行业新闻。

💡 Main Points

Gemini 4 Argon 是 Google 的新前沿模型,支持 100 万输出 token,基准表现强劲。

在与 GPT-6 Astra 和 Claude Opus 5.5 的 19 项公开基准测试中,它于 13 项排名第一,其中 DeepSWE 得分 77.9%,但初期仅限网络安全预览。

该模型专为复杂工作流打造,并已展示出实际的内部部署能力。

Argon 智能体已释放超过 300 TiB 的数据中心内存,并将 80 万行 C/C++ 代码迁移至 Rust,还被用于完成 CK 猜想等研究。

独立评估凸显了成本效益与性能之间的权衡。

Artificial Analysis 在其智能指数上给出 53 分,每任务成本低至 1.99 美元(折扣价),但幻觉率高达 15%,而 Astra 为 51%,表明准确性有所妥协。

新闻回顾还包含 Gemini 4 Argon 之外的多元 AI 动态。

涵盖 OpenAI 的 GPT-6.1 Sol 快速推理、新嵌入模型、图像与视频基准、Context Language Models 等智能体研究、安全问题,以及融资和企业纠纷等行业进展。

💬 Key Quotes

Argon 在与 GPT-6 Astra 和 Claude Opus 5.5 的 19 项公开基准测试中,于 13 项排名第一。

Google 称其具备业界领先的 100 万 token 输出上限

它完美构建了 30 个 Vibe Code Bench 应用

📊 Article Meta

AI Screening: 86

Source: Latent.Space

Author: Latent.Space

Category: 人工智能

Language: 英文

Read Time: 10 min

Word Count: 2421

Tags:

AI 与智能应用 , 模型发布 , AI Agent , 产业动态 , 大语言模型 (LLM)

#AI 与智能应用# 模型发布# AI Agent# 产业动态# 大语言模型 (LLM)

文章评论(2)

白向阳32 分钟前

刚好最近在找这方面的资料,太及时了。

回复
龙文博1 小时前

刚好最近在找这方面的资料,太及时了。

回复