跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/FantasticNature7590·· 3 小时前AI 评分42

实测本地 Qwen3.8 三个 checkpoint:DFlash2 投机解码提速 2.8x,27B NVFP4 战斗竞技场胜过 Claude Fable 5.1

I spent 3 weeks testing local Qwen3.8 on the new low-latency SGLang/vLLM recipes: DFlash2 2.8x. Builds: RadixArk + Inferact 27B NVFP4, 27B BF16, orcarouter 27B Uncensored, Flash-Next NVFP4

AI 导读

一位用户在 RTX PRO 6000 上用同一套 10 项测试对比三个 Qwen3.8 本地模型:RadixArk 27B NVFP4、Uncensored 27B NVFP4 和 Flash-Next MoE NVFP4。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com