# Apple Silicon 和 macOS 虛擬機：使用 llama.cpp 實現更快的 LLM 推論

**Apple Silicon** 和 **macOS 虛擬機** 的組合可以實現更快的 **LLM 推論**，尤其是使用 **llama.cpp**。在特定的虛擬化框架中，該組合可以達到 11.08 倍的速度提升和 16.36 倍的代幣生成速度。這是因為解決了虛擬機導致 **llama.cpp** 選擇錯誤核心的問題。

原始來源（Hacker News）：https://github.com/trycua/cua/blob/main/blog/gpu-passthrough-macos-vms.md

— ai.luvai.net（繁中 AI 情報站）
