热点事件持续更新
vLLM 新增专家 RAM 卸载功能
1 篇报道1 个报道来源18 小时前更新
先了解这件事
AI 综述
2026 年 9 月 30 日,Reddit r/LocalLLaMA(开源 AI 版块)报道,vLLM 在开发者 tcclaviger 的贡献下新增了 expert RAM offloading(专家参数内存卸载)支持。报道中,一位本地部署用户使用四张 R9700 显卡,借助该功能成功跑通了 DeepSeek-V4-Flash-Vision-Exp 模型。该功能通过将 MoE 专家权重卸载到内存,缓解显存压力。目前事件仅为该社区报道及功能上线消息,暂无更多后续进展或官方回应的报道。
AI 根据报道生成 · 1 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Reddit r/LocalLLaMA (开源AI)vLLM 借助 tcclaviger 支持 expert RAM offloading,本地四张 R9700 跑通 DeepSeek-V4-Flash-Vision-Exp
vLLM 在 tcclaviger 的贡献下新增 expert RAM offloading 支持。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。