热点事件持续更新
Qwen3.8-27B量化版本单卡24GB跑262k上下文
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月2日,Reddit r/LocalLLaMA 用户 LexiPanel 发布了 Qwen3.8-27B CODER 的量化版本:采用 IQ4_XS 量化并结合 imatrix 技术,生成 18.35 GB 的 GGUF 文件,模型以 Apache-2.0 协议开源。借助其 Fit planner 工具,该量化模型可在单张 24 GB 显存的显卡上运行,并支持 262144(262k)token 的上下文长度。这是目前关于该事件的唯一报道,尚无后续进展。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- Reddit r/LocalLLaMA (开源AI)LexiPanel 量化 Qwen3.8-27B CODER:24 GB 显卡跑出 262k 上下文
LexiPanel 将 Qwen3.8-27B CODER 量化为 IQ4_XS + imatrix 版本(18.35 GB GGUF),Fit planner 使其在单张 24 GB 显卡上支持 262144 token 上下文,Apache-2.0 开源。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。