Reddit r/LocalLLaMA (开源AI)· /u/FantasticNature7590·· 3 小时前AI 评分42
实测本地 Qwen3.8 三个 checkpoint:DFlash2 投机解码提速 2.8x,27B NVFP4 战斗竞技场胜过 Claude Fable 5.1
I spent 3 weeks testing local Qwen3.8 on the new low-latency SGLang/vLLM recipes: DFlash2 2.8x. Builds: RadixArk + Inferact 27B NVFP4, 27B BF16, orcarouter 27B Uncensored, Flash-Next NVFP4
AI 导读
一位用户在 RTX PRO 6000 上用同一套 10 项测试对比三个 Qwen3.8 本地模型:RadixArk 27B NVFP4、Uncensored 27B NVFP4 和 Flash-Next MoE NVFP4。
来源:Reddit r/LocalLLaMA (开源AI) · reddit.com