Reddit r/LocalLLaMA (开源AI)· /u/Reno0vacio·· 3 小时前AI 评分41
15 个本地模型 agent/工具使用实测:Bonsai 27B 垫底
Tested 15 local models for agent/tool use.. Bonsai 27B was last!
AI 导读
一位用户用 Toolery 基准测试了 15 个本地模型的 agent/工具使用能力,每模型跑 429 次试验,全部通过 LM Studio 本地服务。qwen3.8-27b 以 71.8% 排名第一,bonsai-27b 以 50.5% 垫底,在 Very Hard 场景仅 22.2%。
来源:Reddit r/LocalLLaMA (开源AI) · reddit.com