跳到正文
热点事件持续更新

Strata引擎在12GB VRAM笔记本实现Qwen3.8高速推理

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年9月30日,用户 /u/MLDataScientist 在 Reddit r/LocalLLaMA 发帖,报告用 Strata 推理引擎实测运行 ISTA-DASLab 发布的 Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 量化模型。实测在一台配备 12GB 显存的笔记本上,达到约 51 t/s 的生成速度和约 1500 t/s 的预填充速度,显示出该引擎在消费级低显存硬件上运行 Qwen3.8 模型的高速推理能力。目前事件仅有这一篇报道,尚无后续进展或第三方复现的信息。

AI 根据报道生成 · 45 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. Reddit r/LocalLLaMA (开源AI)
    Strata 引擎实测 Qwen3.8 Flash Next GGUF:12GB 显存笔记本达 51 t/s 生成与 1500 t/s 预填充

    /u/MLDataScientist 在 r/LocalLLaMA 实测 Strata 推理引擎运行 ISTA-DASLab 的 Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 量化模型。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。