Twoody

在 Mac 上运行本地大模型

在你的 Mac 上本地运行大模型

大语言模型可以完全在你的 Mac 上运行:私密、离线、免费。下面介绍你需要什么、该选哪个模型,以及最简单的上手方法。如果你用的是 PC,Twoody 也有 Windows 和 Linux 版。

为什么要在 Mac 上运行大模型

模型在这台机器上回答问题、阅读你的文件。没有网络也能用。没有订阅,没有用量限制,也无需账户。代价是:能装进 Mac 的模型比最大的在线模型小——写作、总结和处理你的文档都很出色,但最难的推理就稍逊一筹。

你需要什么

搭载 Apple 芯片(M1 或更新)的 Mac 能流畅运行模型;Intel Mac 只能用处理器运行小模型,速度较慢。内存决定能用什么模型:约 40 亿参数需要 8 GB,80 亿参数需要 16 GB,140 亿参数需要 24 GB,笔记本能容纳的最大模型则需要 48 GB 或更多。

该选哪个模型

Qwen3.5 在各种尺寸下都能用多种语言写得很好;Llama、Gemma、Mistral 和 gpt-oss 也是不错的选择。先从能宽裕地装进你内存的模型开始:太大的模型会让 Mac 频繁使用交换空间,反而比小模型更慢。

三种方法

  • Twoody——一款应用,会为你的 Mac 推荐合适的模型并一键安装;它能阅读你的文档文件夹并注明出处。支持 Intel Mac 和 macOS 13,也有 Windows 和 Linux 版。
  • LM Studio——一款可以探索数千个模型及其设置的应用。需要 Apple 芯片和 macOS 14 或更高版本。
  • Ollama——一个通过终端、API 或其应用使用的引擎。需要 macOS 14 或更高版本。

用 Twoody,只需三步

  1. 1

    加入候补名单:Twoody 目前处于内测阶段,Mac 版和 Windows、Linux 版都是如此;向你开放时,我们会写信通知你。

  2. 2

    安装它为你的 Mac 推荐的模型:2.8 GB 或 5.8 GB,一键完成。

  3. 3

    提出你的第一个问题——愿意的话,可以关掉 Wi-Fi 试试。

常见问题

在 Mac 上本地运行大模型免费吗?

免费:开放权重的模型可以免费下载,Twoody、LM Studio 和 Ollama 等应用也都免费。唯一的成本是 Mac 的内存和电费。

在 Mac 上运行大模型需要多少内存?

Qwen3.5 4B 这样的小模型需要 8 GB,Qwen3.5 9B 需要 16 GB,LM Studio 或 Ollama 中更大的模型则需要更多。计算器会显示每款 Mac 能运行哪些模型,以及运行速度。

Intel Mac 能运行本地大模型吗?

可以,使用 Twoody,需要 macOS 13 或更高版本:模型在处理器上运行,所以小模型可以用,但速度较慢。LM Studio 和 Ollama 需要 macOS 14,LM Studio 还需要 Apple 芯片的 Mac。

本地大模型和 ChatGPT 一样好用吗?

日常写作和关于你文档的问题,通常已经足够接近;最难的问题,则比不上。作为交换,它私密、离线、免费。

Twoody 正处于内测阶段。

支持 Mac、Windows 和 Linux,免费,无需账户,无需订阅;也支持 iPhone 和 Android,配合你电脑上的 Twoody 使用。留下你的电子邮件地址:Twoody 向你开放时,我们会写信通知你。