把家里的 Mac,变成你的私人 AI 服务器。
Mac 上跑 Ollama
在你的 Mac 装好 Ollama,拉一个喜欢的模型。打开 Ollaby 桌面端,一个二维码就绪。
扫码配对
手机扫一下二维码即可配对。身份密钥长期有效,之后自动重连,不用每次重扫。
随时随地聊
同一网络走局域网直连;在外面自动经加密中继连回家。网络切换也无感自愈。
从零开始,十分钟跑通。
四步,做一次。之后打开手机就能聊。
1在 Mac 上安装 Ollama
Ollama 是真正跑模型的引擎。从官网下载,或用 Homebrew:
brew install ollama
装好后它在后台常驻,ollama --version 有输出即就绪。
2挑一个你的 Mac 跑得动的模型
最关键的一步。太大挤爆内存,太小答得潦草——按内存对号入座:
| 内存 | 推荐模型 | 下载体积 |
|---|---|---|
| 8 GB | gemma3:4bllama3.2:3b | ~3.3 GB ~2 GB |
| 16 GB | qwen3:8bgemma3:12b | ~5 GB ~8 GB |
| 24–32 GB | gpt-oss:20bgemma3:27b | ~14 GB ~17 GB |
| 36–64 GB | qwen3:30b-a3bqwen3:32b | ~19 GB ~20 GB |
| 64 GB+ | gpt-oss:120b | ~65 GB |
经验法则:模型体积别超过内存的六成。同体积优先选 MoE(名字带 a3b 的、以及 gpt-oss)——它每次只激活一小部分参数,在 Mac 上比同体积的稠密模型快数倍。
拉取(16 GB 为例):
ollama pull qwen3:8b
要看图?gemma3 全系(4b/12b/27b)自带视觉,选它就不用再装第二个模型;已经在用别的模型,再拉一个 qwen2.5vl:7b(约 6 GB)即可。
3装 Ollaby Mac 端,拿二维码
下载 DMG,拖进「应用程序」打开。它常驻菜单栏,点开就是配对二维码。
不方便扫码时,二维码下方的连接码可一键复制。
4手机装 Ollaby,扫码连上
扫一下就配对完成。之后自动重连,不用再扫。
同一 Wi-Fi 走局域网直连;出门自动切到加密中继,切网自愈。
把"本地 AI"真正带出家门。
市面上的本地 AI 客户端大多只能同网聊天。Ollaby 让你在任何地方,都能安全连回自己的模型。
出门也能用 · 零配置
在家扫码一次,出门自动经加密中继连回来。别的 App 只能同 WiFi,或要你自己配端口和地址——Ollaby 把最难的跨网穿透藏好了。
端到端加密
基于 QUIC/TLS 的点对点加密,连中继服务器都看不到你聊了什么——只有你和你的 Mac。
你的模型,你做主
Llama、Qwen、Gemma、DeepSeek,甚至视觉模型——只要 Ollama 能跑,你就能用,全在本地。
多端一致
iOS、Android、Mac 一套体验。会话、图片、文件、系统提示词,随手就来。
你的对话,永远只属于你。
模型跑在你自己的 Mac 上,数据不上传任何云。中继只转发加密字节、看不到内容。没有账号、没有追踪、没有训练你数据的第三方。
Ollaby