跳到正文
热点事件持续更新

自建网络安全基准评测Qwen3.8 27B本地模型

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月2日,一位开发者在Reddit r/LocalLLaMA发布自建网络安全基准的实测结果。该基准包含19个任务,涵盖Pwn、web、crypto、逆向、取证及真实CVE,共测试6个模型、进行544次评分。结果显示,本地运行的Qwen3.8 27B首次尝试得分28.1%,其中Pwn类任务为0%;相比之下,MiMo 2.6 Flash首次尝试解决73.7%的任务,GPT-6 Luna在3次尝试内解决90.9%。该报道是目前该事件的唯一信息来源,尚无后续进展。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. Reddit r/LocalLLaMA (开源AI)
    自建网络安全基准实测:Qwen3.8 27B 本地模型黑客能力究竟如何

    一位开发者自建包含 19 个任务的网络安全基准(涵盖 Pwn、web、crypto、逆向、取证及真实 CVE),共测试 6 个模型、544 次评分。本地运行的 Qwen3.8 27B 首次尝试得分 28.1%,Pwn 类为 0%;相比之下 MiMo 2.6 Flash 首次尝试解决 73.7%,GPT-6 Luna 在 3 次内解决 90.9%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。