跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/naklitechie·· 23 小时前AI 评分61

LocalMind 支持浏览器标签页内从磁盘流式运行 Gemma 4 26B-A4B 与 Qwen3.6 MoE

Gemma 4 26B-A4B and a 37 GB Qwen3.6 MoE running in a browser tab on a 24 GB Mac — experts streamed from disk, output matches llama.cpp

AI 导读

/u/naklitechie 更新 LocalMind,新增两个在生成时从磁盘流式读取 MoE 专家权重的引擎,使浏览器标签页可运行超过内存大小的模型,代码以 MIT 协议开源。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com