Diffusers 原生集成 Nunchaku Lite,支持 4-bit SVDQuant 推理
Hugging Face 宣布 Diffusers 通过新的 Nunchaku Lite 路径原生加载 Nunchaku SVDQuant 4-bit 检查点,调用 from_pretrained() 即可,无需单独推理引擎或本地 CUDA 编译。
推荐理由:原文给出基准数字和完整量化工作流,读者可以据此评估在消费级 GPU 上跑大扩散模型的可行路径。
Hugging Face 宣布 Diffusers 通过新的 Nunchaku Lite 路径原生加载 Nunchaku SVDQuant 4-bit 检查点,调用 from_pretrained() 即可,无需单独推理引擎或本地 CUDA 编译。
推荐理由:原文给出基准数字和完整量化工作流,读者可以据此评估在消费级 GPU 上跑大扩散模型的可行路径。
Google Research 在 ICLR 2026 发表的论文"On the Interpolation Effect of Score Smoothing in Diffusion Models"指出,扩散模型的“创造力”并非偶然,而是神经网络训练中由正则化引起的 score smoothing 的结果。
Photoroom 发布 PRX 系列第 4 篇,详解 7B 文生图模型的预训练数据管道:混合公开与内部数据集、用 VLM 重新生成长标注、构建可流式训练语料。
Google 宣布将一项新的视角重构方法上线 Google Photos 的 Auto frame 功能,可自动调整拍摄视角优化人像照片。方法分两阶段:先用内部 3D point map 估计模型重建场景并近似焦距,再用生成式 latent diffusion 模型补全新视角下被遮挡的内容,并自动修正广角前置镜头造成的透视畸变。
推荐理由:原文解释了方法如何用 3D 场景估计加生成补全来改换拍摄视角,读者可以理解它与常规裁剪编辑的本质差异。