跳到正文
热点事件持续更新

Slipstream引擎让95.5GiB Qwen3.8模型在64GB Mac上提速1.76x

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月2日,作者在Reddit r/LocalLLaMA发布Slipstream,这是一个面向Apple Silicon的C++ Metal推理引擎,支持SSD专家流式加载与投机解码。该引擎可在64GB Mac上运行95.5 GiB的Qwen3.8-Flash-Next模型,解码速度达到41-52 tok/s,相比llama.cpp fork的23.1 tok/s,平均提升至40.8 tok/s,加速比为1.76x。

AI 根据报道生成 · 6 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. Reddit r/LocalLLaMA (开源AI)
    Slipstream 发布:64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next

    作者发布 Slipstream,一个面向 Apple Silicon 的 C++ Metal 推理引擎,支持 SSD 专家流式加载与投机解码,在 64GB Mac 上将 95.5 GiB 的 Qwen3.8-Flash-Next 解码速度从 llama.cpp fork 的 23.1 tok/s 提升到平均 40.8 tok/s(1.76x)。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。