跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/Reno0vacio·· 3 小时前AI 评分41

15 个本地模型 agent/工具使用实测:Bonsai 27B 垫底

Tested 15 local models for agent/tool use.. Bonsai 27B was last!

AI 导读

一位用户用 Toolery 基准测试了 15 个本地模型的 agent/工具使用能力,每模型跑 429 次试验,全部通过 LM Studio 本地服务。qwen3.8-27b 以 71.8% 排名第一,bonsai-27b 以 50.5% 垫底,在 Very Hard 场景仅 22.2%。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com