Reddit r/LocalLLaMA (开源AI)· /u/fuzhongkai·· 3 小时前AI 评分45
在 16GB RTX 3080 Laptop 上运行 Qwen3.8 Flash Next 176B
Running Qwen3.8 Flash Next 176B on a 16GB RTX 3080 Laptop + 32GB RAM + SSD
AI 导读
开发者在 RTX 3080 Laptop(16GB VRAM)+ 32GB RAM + SSD 上运行 Qwen3.8 Flash Next 176B MoE 模型,使用其开源推理引擎 TensorSharp,通过量化与 MoE 感知的跨层级内存调度实现。
来源:Reddit r/LocalLLaMA (开源AI) · reddit.com