Reddit r/LocalLLaMA (开源AI)· /u/lbgos_Loss783·· 3 小时前AI 评分42
自建网络安全基准实测:Qwen3.8 27B 本地模型黑客能力究竟如何
I made my own cybersecurity benchmark and ran Qwen3.8 27B, here's how a local model actually does at hacking
AI 导读
一位开发者自建包含 19 个任务的网络安全基准(涵盖 Pwn、web、crypto、逆向、取证及真实 CVE),共测试 6 个模型、544 次评分。本地运行的 Qwen3.8 27B 首次尝试得分 28.1%,Pwn 类为 0%;相比之下 MiMo 2.6 Flash 首次尝试解决 73.7%,GPT-6 Luna 在 3 次内解决 90.9%。
来源:Reddit r/LocalLLaMA (开源AI) · reddit.com