龙虾专属模型来了,给你的虾换个好脑子吧

采集助手AI 前沿2026-09-161 阅读

最近🦞养虾成了全国潮流。

各家大厂都在推波助澜,线下活动场场爆满。

当我们去线下交流的时候,就发现了真正的问题。

除了国产大模型御三家之外,大部分云厂商所提供的模型,都还是上一代的模型,DeepSeek V3.2 或者同级别。

以这样的模型当大脑,显然是无法支撑 Agent 的,只能养出一只只笨笨虾。

都不说复杂的,非常简单安装一个 TTS skill,模型都有幻觉。

模型说我装好了,用户说那你来一段,模型说我给你了,用户说你给我放哪儿了,模型说你给我邮箱,我发邮件给你…

这辛辛苦苦养了半天,连实习生都不如,更别提什么数字员工了。

究其原因,是这些龙虾的脑子出了问题,都是聊天脑,不是干活脑

大模型强化学习的基本原理就是在真实的环境中强化学习。

在龙虾之前训练的模型,都没有龙虾的环境,大概率也做不好龙虾的事情。

现在龙虾这么火,微信指数过亿,安装量少说也有百万台了,模型厂商也开始为龙虾训练单独的龙虾模型。

全球第一个为龙虾训练的模型

智谱今天发了全球第一个专门为龙虾打造的模型 GLM-5-Turbo。

这个模型在龙虾任务里进行了高强度的强化学习,有效提升了模型的工具调用能力、复杂指令遵循能力、定时与持续任务能力。

在智谱构建的 ZClawBench 中,GLM-5-Turbo 的跑分是国产模型综合第一,同时还超越了 Gemini 3.1 Pro。

图片

我体验下来,这个模型不仅完成任务的成功率高,速度也飞快,让龙虾有一种终于睡醒,脑袋清明的感觉。

就像武侠小说里英雄找到一把趁手的兵器。

真实的任务测试

我的龙虾养了有七八只,活着的不多了。

智谱的澳龙内置了 GLM-5-Turbo,不用配置开箱即用,我就用它真实地养了一只入门虾,给新手小白朋友们做个参考。

浏览器

养龙虾最重要的事,就要先把 Skills 技能包安装好。

一般我都是先给龙虾装上它的专用浏览器:Browserwing(https://github.com/browserwing/browserwing

这个插件就是龙虾自己的 Chrome,有些朋友说龙虾访问不了内网啊,只能搜索不能看全文啊,有了这个浏览器就都解决了。

图片

我让龙虾打开 Hackernews,找几篇我可能喜欢的文章,给我总结一下。

于是它就打开了这个网站进去,把每篇文章的 HN 评论都抓了一遍,并整理出 4 篇深度总结:

Coding after coders — AI 写代码后程序员何去何从 Can I Run AI Locally — 本地跑 AI 模型实操指南 Emacs & Vim in the Age of AI — 老编辑器在 AI 时代还能打吗 Negative Light — 负光源,很有意思的概念

如果你经常需要上网查资料、读文章、做总结,这个插件是必备的。

多媒体技能包

如果想让龙虾能听,会说,会画图,就需要装上多媒体技能包。

我一般用 ListenHub 的,ASR 免费,其他统一消耗会员积分

安装命令:npx skills add marswaveai/skills

一分钟之后,6 个技能包就装好了:ASR、TTS、AI播客、AI生图、内容提取、解说视频。

有了这些,可以组合出非常多的自动化工作流。

图片

定时任务

下午,龙虾最大的特点就是可以完成定时任务。

比如我让龙虾帮我做一个港股 AI 日报,每个交易日收盘后自动生成信息图,发到飞书群。

龙虾就开始做了:

1.确定标的:MiniMax(00100.HK)和智谱AI(2513.HK) 2.数据源:接了东方财富的港股 API,实时拉股价数据 3.生图:用 ListenHub Skill 生成 3:4 小红书风格的收盘信息图,红涨绿跌 4.定时:创建了 macOS launchd 定时服务,每个交易日 16:15 自动执行

生成的示例是这样的:

图片

再比如现在刚入春,温差很大不知道穿什么衣服,可以让 AI 做一个每日穿搭版的天气预报:

“来个天气信息的每日穿搭,每天早上发。”

龙虾就会每天 07:30 查北京天气,生成穿搭建议图,发到飞书里。

图片

除了做图片,还可以每天为自己整理信息做播客,人人都有自己的生动早咖啡。

而且定时任务的方式也变得很简单,就是说需求就行了。

Coding 能力

很多逮虾户都忽略了一点重要的事情,就是龙虾虽然最擅长的是 Skills 技能使用,但大脑的 Coding 能力也非常重要。

现在流行自己 DIY 软件,比如我平时用的翻译插件,就是自己写的。

平时遇到什么bug,就交给龙虾随手修一下,非常方便。

不过要注意,GLM-5-Turbo 在龙虾综合任务上超过了 GLM-5,不过 Coding 能力并不如 GLM-5好。

图片

你的虾,值得一个好脑子

回到文章开头说的那个问题。

中国几百万只龙虾,大多数都是鸡肋龙虾。

不是他们不会养虾,是虾的脑子配不上他们的期待。

聊天脑和干活脑,真的不太一样。

在龙虾的环境里训练模型,应该是接下来各家模型厂的一个必然趋势。

为你的虾,配一个好脑子吧。

模型选型依据很简单:先看模型是否在真实 Agent 环境里做过强化学习(工具调用、复杂指令遵循、定时任务),再看 Coding 与 Skills 的能力平衡——GLM-5-Turbo 强在龙虾综合任务,GLM-5 强在 Coding,按你的主力用途选。

原文信息

阅读原文

原文链接:https://www.jxxy.net/ai/articles/oran-ge-lobster-model-glmturbo/