Ollama
Ollama
一行指令在本地跑開源模型,附 OpenAI 相容 API
本地模型運行小白
開源免費有免費方案定價已核實 2026-09-29
完全免費開源;成本只有你的硬體與電費。
適合
- 資料不能出網的隱私場景
- 大量呼叫時把 Token 成本降為零
- 離線或網路不穩的環境
LM StudiomacOS · Windows · Linux
圖形介面下載、管理並運行本地模型,支援 GGUF 與 MLX
我們刻意把不適合的場景寫在同一屏 —— 只講優點的評測沒有資訊量。
編輯部意見,非用戶聚合評分。資料最後核實:2026-09-29。
每個場景都是一條「痛點 → 工具組合 → 步驟 → 成果」的完整配方。
LM Studio 完整指南 — 在 Mac 上通過圖形界面下載、管理、運行本地 LLM,支援 GGUF 和 MLX 格式,提供 OpenAI 兼容 API。
oMLX 完整安裝與使用指南 — 在 M3 Ultra 上原生運行 MLX 格式模型,涵蓋安裝、模型導入、效能對比和最佳配置。
在 M3 Ultra 上用 oMLX 原生運行 Qwen3 Coder Next,完整取代 Ollama — 為什麼放棄 Ollama、oMLX 優勢、安裝步驟。
Ollama
一行指令在本地跑開源模型,附 OpenAI 相容 API
完全免費開源;成本只有你的硬體與電費。
開源社群(源於 UC Berkeley)
高吞吐量的 LLM 推論伺服器,生產環境自架首選
開源免費(Apache-2.0);成本為 GPU 硬體或雲端租用。本站有部署實測與效能數據。
本頁為編輯部整理的工具資訊,非官方頁面。商標與產品名稱屬於各自擁有者。 若你發現任何資訊有誤或已過期,請告知我們修正。最後核實:2026-09-29。