热点事件持续更新
用FFT压缩AdamW优化器状态省一半显存
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
据2026年10月6日Reddit r/LocalLLaMA社区的报道,一个团队在微调8B和70B模型时,提出用FFT(快速傅里叶变换)替换AdamW优化器状态的压缩方法:将优化器状态变换到频域,丢弃低影响的频率分量,从而将VRAM用量降低约50%。该方法不依赖可能损害收敛的8-bit量化。代价是每步训练因FFT运算而略慢,但可以避免OOM崩溃,并提升消费级GPU上可用的batch size。团队已开放内部Colab环境和基线权重供外界验证,目前尚无第三方复现结果的报道。
AI 根据报道生成 · 4 小时前更新
最新进展10月6日 03:54
团队开放了内部Colab环境和基线权重,供外界验证其FFT压缩优化器状态方法。报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- Reddit r/LocalLLaMA (开源AI)用 FFT 替换 AdamW 优化器状态以削减一半 VRAM 微调显存
微调 8B 和 70B 模型时,团队用 FFT 把 AdamW 优化器状态变换到频域、丢弃低影响频率来压缩状态,VRAM 用量约降低 50%,且不依赖会损害收敛的 8-bit 量化。代价是每步训练因 FFT 运算略慢,但可避免 OOM 崩溃并提升消费级 GPU 上的 batch size。团队已开放内部 Colab 环境和基线权重供外界验证。
本事件热度走势
当前热度 9·可比范围峰值 10(10月6日 05:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。