跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/fechyyy·· 13 小时前AI 评分45

21M 模型配上 6.4B 参数查找表,性能媲美 114M 稠密模型,表还能放在 SSD 上运行(RX 9070)

I gave a 21M model a 6.4B-parameter lookup table. It matches a 114M dense model and runs with the table on an SSD (RX 9070)

AI 导读

一位开发者公开了业余研究项目:给 21M 模型配一张 16.8M 行的查找表(6.4B 参数,每 token 使用 33M),性能约等于在同样 500M Wikipedia tokens 上训练的 114M 稠密模型。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com