MINIAPP SCREENSHOTS
演示效果
最近🦞养虾成了全国潮流。
各家大厂都在推波助澜,线下活动场场爆满。
当我们去线下交流的时候,就发现了真正的问题。
除了国产大模型御三家之外,大部分云厂商所提供的模型,都还是上一代的模型,DeepSeek V3.2 或者同级别。
以这样的模型当大脑,显然是无法支撑 Agent 的,只能养出一只只笨笨虾。
都不说复杂的,非常简单安装一个 TTS skill,模型都有幻觉。
模型说我装好了,用户说那你来一段,模型说我给你了,用户说你给我放哪儿了,模型说你给我邮箱,我发邮件给你…
这辛辛苦苦养了半天,连实习生都不如,更别提什么数字员工了。
究其原因,是这些龙虾的脑子出了问题,都是聊天脑,不是干活脑
大模型强化学习的基本原理就是在真实的环境中强化学习。
在龙虾之前训练的模型,都没有龙虾的环境,大概率也做不好龙虾的事情。
现在龙虾这么火,微信指数过亿,安装量少说也有百万台了,模型厂商也开始为龙虾训练单独的龙虾模型。
智谱今天发了全球第一个专门为龙虾打造的模型 GLM-5-Turbo。
这个模型在龙虾任务里进行了高强度的强化学习,有效提升了模型的工具调用能力、复杂指令遵循能力、定时与持续任务能力。
在智谱构建的 ZClawBench 中,GLM-5-Turbo 的跑分是国产模型综合第一,同时还超越了 Gemini 3.1 Pro。