跳到正文
原文
Reddit r/LocalLLaMA (开源AI)· /u/paranoidray·· 3 小时前AI 评分56

开源推理引擎在本地设备编译调优 kernel,声称比 llama.cpp 快达 2 倍

Open source inference engine (like LM Studio or Unsloth Desktop) that optimizes itself for your exact hardware. Compiles and tunes its kernels on your device, so open models run up to 2x faster than llama.cpp. Works on Apple Silicon, NVIDIA, AMD or nothing but a CPU.

AI 导读

作者介绍一个类似 LM Studio 或 Unsloth Desktop 的开源推理引擎,会在用户设备上编译并调优 kernel,为具体硬件自我优化,声称开源模型运行速度最高比 llama.cpp 快 2 倍,支持 Apple Silicon、NVIDIA、AMD 或纯 CPU。

来源:Reddit r/LocalLLaMA (开源AI) · reddit.com