Reddit r/LocalLLaMA (开源AI)· /u/N34257·· 21 小时前AI 评分18
RDNA4 上跑 Qwen 3.8 目前的主流方案是什么?
What's the current meta for RDNA4 with Qwen 3.8?
AI 导读
一位用户在双 AMD R9700(RDNA4)上用 vllm-radiance 运行 Qwen 3.8 27B FP8(Swift 1.5 FP8),取得 5000t/s prefill 和 130t/s+ 代码生成速度,想询问是否有更好的推理方案。他特别关注能支持 Qwen 3.8 Flash Next 的引擎,但不愿退回到 llama.cpp 的性能水平。
来源:Reddit r/LocalLLaMA (开源AI) · reddit.com