热点事件持续更新
作者在双昇腾Atlas 300I Duo上跑通Qwen3.8 Flash-Next
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月2日,一名作者在Reddit r/LocalLLaMA发帖,分享在两张华为Atlas 300I Duo(共四枚Ascend 310P3,标称显存192 GB)上跑通Qwen3.8 Flash-Next的全过程。帖子内容包括硬件笔记、对vLLM的改造,以及实测基准数据。据其描述,项目初期推理速度仅约每秒1个token且输出不连贯,经过优化后,单请求速度提升至约每秒30个token,四路并发时达到约每秒61个token。目前事件仅有这一篇报道,尚无其他后续进展披露。
AI 根据报道生成 · 2 小时前更新
最新进展10月2日 20:54
作者发文称在双Atlas 300I Duo上跑通Qwen3.8 Flash-Next,优化后单请求约30 tok/s。报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- Reddit r/LocalLLaMA (开源AI)两张 96 GB 华为 Atlas 300I Duo 跑通 Qwen3.8 Flash-Next:硬件笔记、vLLM 改造与实测基准
作者分享在两张华为 Atlas 300I Duo(四枚 Ascend 310P3,共 192 GB 标称显存)上跑通 Qwen3.8 Flash-Next 的过程,从初期不连贯的约 1 tok/s 优化到单请求约 30 tok/s、四路并发约 61 tok/s。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。