在 Mac 上运行本地大模型
在你的 Mac 上本地运行大模型
大语言模型可以完全在你的 Mac 上运行:私密、离线、免费。下面介绍你需要什么、该选哪个模型,以及最简单的上手方法。如果你用的是 PC,Twoody 也有 Windows 和 Linux 版。
为什么要在 Mac 上运行大模型
模型在这台机器上回答问题、阅读你的文件。没有网络也能用。没有订阅,没有用量限制,也无需账户。代价是:能装进 Mac 的模型比最大的在线模型小——写作、总结和处理你的文档都很出色,但最难的推理就稍逊一筹。
你需要什么
搭载 Apple 芯片(M1 或更新)的 Mac 能流畅运行模型;Intel Mac 只能用处理器运行小模型,速度较慢。内存决定能用什么模型:约 40 亿参数需要 8 GB,80 亿参数需要 16 GB,140 亿参数需要 24 GB,笔记本能容纳的最大模型则需要 48 GB 或更多。
该选哪个模型
Qwen3.5 在各种尺寸下都能用多种语言写得很好;Llama、Gemma、Mistral 和 gpt-oss 也是不错的选择。先从能宽裕地装进你内存的模型开始:太大的模型会让 Mac 频繁使用交换空间,反而比小模型更慢。
三种方法
- Twoody——一款应用,会为你的 Mac 推荐合适的模型并一键安装;它能阅读你的文档文件夹并注明出处。支持 Intel Mac 和 macOS 13,也有 Windows 和 Linux 版。
- LM Studio——一款可以探索数千个模型及其设置的应用。需要 Apple 芯片和 macOS 14 或更高版本。
- Ollama——一个通过终端、API 或其应用使用的引擎。需要 macOS 14 或更高版本。
用 Twoody,只需三步
-
1
加入候补名单:Twoody 目前处于内测阶段,Mac 版和 Windows、Linux 版都是如此;向你开放时,我们会写信通知你。
-
2
安装它为你的 Mac 推荐的模型:2.8 GB 或 5.8 GB,一键完成。
-
3
提出你的第一个问题——愿意的话,可以关掉 Wi-Fi 试试。
常见问题
在 Mac 上本地运行大模型免费吗?
免费:开放权重的模型可以免费下载,Twoody、LM Studio 和 Ollama 等应用也都免费。唯一的成本是 Mac 的内存和电费。
在 Mac 上运行大模型需要多少内存?
Qwen3.5 4B 这样的小模型需要 8 GB,Qwen3.5 9B 需要 16 GB,LM Studio 或 Ollama 中更大的模型则需要更多。计算器会显示每款 Mac 能运行哪些模型,以及运行速度。
Intel Mac 能运行本地大模型吗?
可以,使用 Twoody,需要 macOS 13 或更高版本:模型在处理器上运行,所以小模型可以用,但速度较慢。LM Studio 和 Ollama 需要 macOS 14,LM Studio 还需要 Apple 芯片的 Mac。
本地大模型和 ChatGPT 一样好用吗?
日常写作和关于你文档的问题,通常已经足够接近;最难的问题,则比不上。作为交换,它私密、离线、免费。
Twoody 正处于内测阶段。
支持 Mac、Windows 和 Linux,免费,无需账户,无需订阅;也支持 iPhone 和 Android,配合你电脑上的 Twoody 使用。留下你的电子邮件地址:Twoody 向你开放时,我们会写信通知你。