跳到正文
热点事件持续更新

vLLM 新增专家 RAM 卸载功能

1 篇报道1 个报道来源18 小时前更新

先了解这件事

AI 综述

2026 年 9 月 30 日,Reddit r/LocalLLaMA(开源 AI 版块)报道,vLLM 在开发者 tcclaviger 的贡献下新增了 expert RAM offloading(专家参数内存卸载)支持。报道中,一位本地部署用户使用四张 R9700 显卡,借助该功能成功跑通了 DeepSeek-V4-Flash-Vision-Exp 模型。该功能通过将 MoE 专家权重卸载到内存,缓解显存压力。目前事件仅为该社区报道及功能上线消息,暂无更多后续进展或官方回应的报道。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. Reddit r/LocalLLaMA (开源AI)
    vLLM 借助 tcclaviger 支持 expert RAM offloading,本地四张 R9700 跑通 DeepSeek-V4-Flash-Vision-Exp

    vLLM 在 tcclaviger 的贡献下新增 expert RAM offloading 支持。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。