跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/fuzhongkai·· 3 小时前AI 评分45

在 16GB RTX 3080 Laptop 上运行 Qwen3.8 Flash Next 176B

Running Qwen3.8 Flash Next 176B on a 16GB RTX 3080 Laptop + 32GB RAM + SSD

AI 导读

开发者在 RTX 3080 Laptop(16GB VRAM)+ 32GB RAM + SSD 上运行 Qwen3.8 Flash Next 176B MoE 模型,使用其开源推理引擎 TensorSharp,通过量化与 MoE 感知的跨层级内存调度实现。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com