热点事件持续更新
Strata引擎在12GB VRAM笔记本实现Qwen3.8高速推理
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年9月30日,用户 /u/MLDataScientist 在 Reddit r/LocalLLaMA 发帖,报告用 Strata 推理引擎实测运行 ISTA-DASLab 发布的 Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 量化模型。实测在一台配备 12GB 显存的笔记本上,达到约 51 t/s 的生成速度和约 1500 t/s 的预填充速度,显示出该引擎在消费级低显存硬件上运行 Qwen3.8 模型的高速推理能力。目前事件仅有这一篇报道,尚无后续进展或第三方复现的信息。
AI 根据报道生成 · 45 分钟前更新
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Reddit r/LocalLLaMA (开源AI)Strata 引擎实测 Qwen3.8 Flash Next GGUF:12GB 显存笔记本达 51 t/s 生成与 1500 t/s 预填充
/u/MLDataScientist 在 r/LocalLLaMA 实测 Strata 推理引擎运行 ISTA-DASLab 的 Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 量化模型。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。