跳至內容
模型家族 · 量化與GGUF/MLX

在本地跑大模型 — 用實測,不靠猜。

這是在自己的 Mac 或 PC 上執行開源大模型的實操參考。每篇指南都基於我們自有裝置實測的每秒 token、記憶體佔用和量化對比。用資料而非感覺,挑對模型和版本。

41總訪問
0月訪問
0周訪問
0今日訪問
8總文章數5月發布5本週發布0今日發布
4GB VRAM硬體限制下的模型選擇策略與指南
模型家族

4GB VRAM硬體限制下的模型選擇策略與指南

本文深入探討如何透過量化技術與硬體最佳化,在個人電腦或Mac上執行在地大型語言模型(Local LLM),並提供實務指南與不同硬體架構的選擇對比。

READ →
LATEST
AI 模型本地部署硬體規格選擇策略與執行指南
模型家族

AI 模型本地部署硬體規格選擇策略與執行指南

本文深入探討如何在個人裝置上執行大型 AI 模型,涵蓋模型大小與硬體規格的平衡,並提供量化技術、Mac與PC硬體選擇的實用指南。

♥ 0
量化技術指南:從FP32到低精度轉換的實用操作建議
模型家族

量化技術指南:從FP32到低精度轉換的實用操作建議

本文深入探討大型語言模型(LLM)的量化技術,解釋如何透過降低模型權重位元數來壓縮模型體積與提升運算速度,並分析其在效能與智慧損失之間的權衡。

♥ 0
本地LLM部署與選擇指南:模型7B參數執行對比
模型家族

本地LLM部署與選擇指南:模型7B參數執行對比

本文為開發者提供本地大型語言模型(Local LLM)的選用指南,說明如何根據硬體規格、模型引數規模與量化技術,在生成品質和運算速度間取得最佳平衡。

♥ 0
部署大型語言模型於Mac PC的量化技術指南
模型家族

部署大型語言模型於Mac PC的量化技術指南

本文深入解析模型引數規模如何決定語言模型的邏輯深度,並提供量化技術的實用指南,幫助開發者在個人裝置上高效部署大型模型。

♥ 0
Qwen對決Llama 3.1:本地端模型如何選才不踩雷
模型家族

Qwen對決Llama 3.1:本地端模型如何選才不踩雷

本文透過實測資料,深入比較 Qwen 與 Llama 3.1 在不同硬體環境下的表現,指導使用者如何根據自身裝置的規格和應用需求,選擇最適合的本地端大型語言模型。

♥ 0
本地 LLM 驅動程式碼生成 2025 年開發新標準
模型家族

本地 LLM 驅動程式碼生成 2025 年開發新標準

本文深入探討如何透過在本地端部署大型語言模型(LLM),為開發者建立一個兼顧資安與成本控制的私密程式碼生成夥伴,並提供實戰部署指南。

♥ 0
Llama 3.1 開源模型解析:如何依據硬體規格挑選最佳版本
模型家族

Llama 3.1 開源模型解析:如何依據硬體規格挑選最佳版本

本文深入分析 Meta 推出的 Llama 3.1 系列模型,提供不同規模參數的硬體配置建議、在地端安裝路徑及量化技術優化指南。

♥ 0
本地模型實驗室 訂閱最新內容輸入郵箱,第一時間獲取新文章。
分享分享這篇文章