Gemma 4 代理工具调用达 86.4%
Google DeepMind 发布 Gemma 4,代理化工具调用能力从上一代的 6.6% 跃升至 86.4%(τ2-bench Retail)。这不是微小改进,而是能力级别跨越。
要点:
- 31B dense 模型在 τ2-bench 上得 86.4%,26B MoE 得 85.5%(参数量激活仅 3.8B),逼近旗舰级代理能力。
- 架构原生支持函数调用(专用控制 token)、可配置思考模式(4000+ token 逐步推理)和系统提示,无需 prompt 工程拼凑。
- 首次采用 Apache 2.0 许可证,允许商用、微调和产品嵌入,无需 Google 额外授权。
- 四种模型:31B dense(高精度)、26B MoE(速度与精度平衡)、E4B(边缘端/语音输入)、E2B(IoT/离线)。注意 26B MoE 需加载全部 26B 参数至内存。
链接:原文链接
#开发者 #工具
📢 频道:@DevToolboxHub
Post #720
3
