教你用笔记本部署的大模型,30 分钟搭一个安全又灵活的私有 AI 助手
有读者留言问了一个非常好的问题:
“能不能用飞书对接本地模型,不同问题用不同模型回答,数据完全不出本地?”
答案是:完全可以。 今天就来拆解这套方案。
先说结论:三件套搞定
整套方案只需要三样东西:
- Ollama:本地跑大模型,调用本地部署的轻量开源模型
- OpenClaw(龙虾):开源 AI 网关,负责把飞书和本地模型连起来
- 飞书:你的聊天入口,@机器人就能和本地模型对话
架构很简单:
飞书消息 → OpenClaw(本地网关) → Ollama(本地模型) → 返回飞书全程走本地网络,没有任何数据发到云端。
为什么数据真的不出本地?
这是很多人最关心的问题,我拆开讲:
- 模型推理在本地
Ollama 跑在你自己的电脑或服务器上,所有的提问和回答都在本地 GPU/CPU 完成。不像 ChatGPT 或文心一言,你的数据不会经过任何第三方服务器。
- 飞书用 WebSocket 反向连接
OpenClaw 和飞书之间用的是 WebSocket 长连接,由 OpenClaw 主动连接飞书服务器。这意味着:
- 你不需要暴露公网 IP
- 不需要配置域名和 HTTPS
- 不需要在防火墙上开端口
- 飞书只传递消息文本,不碰你的文件和数据
- 文件处理也在本地
如果你在飞书发了图片或文件给机器人,OpenClaw 会从飞书临时 URL 下载到本地内存处理,处理完返回结果,不做额外存储。
- 配置和日志全在本地
所有配置文件、对话记录都存在本地文件系统,你可以随时备份、审计、删除,完全自主可控。
一句话:从你发消息到收到回复,数据只在「你的电脑 ↔ 飞书服务器」之间流转,模型推理完全在本地完成。
按需切换模型:三种方式
不同问题用不同模型,这是本地部署的一大优势。OpenClaw 支持三种切换方式:
方式一:聊天中直接切换(最常用)
在飞书对话框里发/model命令,就能查看和切换当前可用的模型:
/model # 查看当前模型 /model ollama/qwen3.5:9b # 切换到 Qwen 9B /model ollama/deepseek-coder:6.7b # 切换到代码模型切换后立即生效,下一条消息就用新模型回答。
方式二:命令行全局切换
用 OpenClaw 命令行设置默认模型:
# 查看所有可用模型 openclaw models list # 设置默认模型 openclaw models set ollama/qwen3.5:9b # 切换到轻量模型(日常问答) openclaw models set ollama/qwen3.5:2b # 切换到代码模型 openclaw models set ollama/deepseek-coder:6.7b方式三:多机器人绑定不同模型(团队推荐)
如果你是团队使用,可以在飞书建多个机器人,每个绑定不同的 Agent 和模型:
{ "agents":{ "list":[ {"id":"daily","model":"ollama/qwen3.5:2b"}, {"id":"coding","model":"ollama/deepseek-coder:6.7b"}, {"id":"analysis","model":"ollama/qwen3.5:9b"} ] }, "bindings":[ { "agentId":"daily", "match":{"channel":"feishu","peer":{"kind":"direct","id":"ou_轻量助手"}} }, { "agentId":"coding", "match":{"channel":"feishu","peer":{"kind":"direct","id":"ou_代码助手"}} } ] }这样 @不同机器人,就自动用对应的模型回答:
- 「轻量助手」→ 2B 小模型,秒回,适合日常问答
- 「代码助手」→ DeepSeek Coder,专注代码生成和调试
- 「深度分析」→ 9B 大模型,适合长文本分析和复杂推理
什么场景用什么模型?
| 场景 | 推荐模型 | 显存需求 | 特点 |
|---|---|---|---|
| 日常问答、闲聊 | Qwen3.5:2B | 2-3GB | 速度快,秒回 |
| 写作、总结、翻译 | Qwen3.5:4B | 3.5GB | 中文理解强 |
| 代码生成、调试 | DeepSeek-Coder:6.7B | 5GB | 代码补全准确 |
| 复杂分析、长文本 | Qwen3.5:9B | 6.5GB | 推理能力强 |
| 看图、OCR | Qwen-VL | 8GB+ | 多模态理解 |
| 通用均衡 | GLM-4.7-Flash | 5-6GB | 综合表现好 |
小技巧:先用小模型回答,觉得不够好再用/model切到大模型重新问。小模型不花钱、不排队,随便用。
30 分钟部署全流程
第一步:确认 Ollama 已就绪(5 分钟)
如果你电脑装好了 Ollama,直接拉取几个模型,也可以根据需求拉取所需的:
# 通用对话 ollama pull qwen3.5:9b # 代码专用 ollama pull deepseek-coder:6.7b # 轻量快速 ollama pull qwen3.5:2b第二步:安装 OpenClaw(5 分钟)
需要先安装 Node.js(v22 或更高)和Git,然后执行下面命令(需要科学上网,OpenClaw安装教程网上比较多,可以自己查找,不会可评论区留言):
npm install -g openclaw@latest运行初始化向导:
openclaw onboard选择 Ollama 作为模型提供商,向导会自动检测本地 Ollama 实例并列出可用模型。
如果搞不定OpenClaw的网络或配置,其实也可以安装最近推出的国产龙虾,如阿里的CoPaw、腾讯的QClaw都是替代方案,也都能实现Ollama对接。
第三步:创建飞书机器人(10 分钟)
打开飞书开放平台,登录后创建企业自建应用(网上有很多教程可参考,不会可留言)
复制 App ID 和 App Secret
在「应用能力」中启用「机器人」
在「权限管理」中添加消息相关权限
在「事件订阅」中选择「使用长连接接收事件」,添加
im.message.receive_v1创建版本并发布
第四步:连接飞书和 OpenClaw(5 分钟)
openclaw channels add选择 Feishu,粘贴 App ID 和 App Secret。
启动网关:
openclaw gateway start第五步:测试(5 分钟)
在飞书找到你的机器人,发一条消息。首次会收到配对码,在终端执行:
openclaw pairing approve feishu <配对码>再发一条消息,本地模型就会回答你了。试试/model切换不同模型感受一下差异。
OpenClaw响应慢的问题
不少人都遇到了直接调用Ollama模型很快,但是用OpenClaw调用返回就很慢,最核心原因就是上下文窗口与显存溢出,Ollama默认上下文窗口很小,KV缓存占用低,但是OpenClaw默认全开,直接用模型原生大窗口,组合的上下文大量提示词全部发给Ollama,KV缓存瞬间占满显存,模型被迫切内存+CPU跑,速度暴跌10-100倍。
在硬件条件不变的前提下,我的解决方式是在OpenClaw中配置缩小上下文窗口(修改contextWindow: 4096),关闭全量记忆,采用QMD,这样通过牺牲一部分OpenClaw记忆功能,换取更快的速度。
适合谁?
- ✅ 注重数据安全的个人/团队:敏感数据、商业文档、内部资料都不上云
- ✅ 企业内网环境:等保合规、数据主权要求
- ✅ 开发者:本地调试代码、多模型对比测试
- ✅ 预算有限:模型跑在本地,长期使用零成本
写在最后
很多人觉得本地部署 AI 很复杂,其实 OpenClaw + 飞书 + Ollama 这套组合,30 分钟就能跑通,数据安全有保障,模型切换很灵活。直白讲,轻量模型在复杂逻辑处理体验上确实和全量大模型有差距,但能满足日常对AI对话的基本需求,并且能微调实现专项领域知识的处理。
如果你对数据隐私有要求,或者团队需要一个私有化的 AI 助手,强烈建议试试这套方案。
这里给大家精心整理了一份全面的AI大模型学习资源,包括:AI大模型全套学习路线图(从入门到实战)、精品AI大模型学习书籍手册、视频教程、实战学习、面试题等,资料免费分享!
👇👇扫码免费领取全部内容👇👇
1. 成长路线图&学习规划
要学习一门新的技术,作为新手一定要先学习成长路线图,方向不对,努力白费。
这里,我们为新手和想要进一步提升的专业人士准备了一份详细的学习成长路线图和规划。可以说是最科学最系统的学习成长路线。
2. 大模型经典PDF书籍
书籍和学习文档资料是学习大模型过程中必不可少的,我们精选了一系列深入探讨大模型技术的书籍和学习文档,它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础。(书籍含电子版PDF)
3. 大模型视频教程
对于很多自学或者没有基础的同学来说,书籍这些纯文字类的学习教材会觉得比较晦涩难以理解,因此,我们提供了丰富的大模型视频教程,以动态、形象的方式展示技术概念,帮助你更快、更轻松地掌握核心知识。
4. 2026行业报告
行业分析主要包括对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。
5. 大模型项目实战
学以致用,当你的理论知识积累到一定程度,就需要通过项目实战,在实际操作中检验和巩固你所学到的知识,同时为你找工作和职业发展打下坚实的基础。
6. 大模型面试题
面试不仅是技术的较量,更需要充分的准备。
在你已经掌握了大模型技术之后,就需要开始准备面试,我们将提供精心整理的大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。
7. 资料领取:全套内容免费抱走,学 AI 不用再找第二份
不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:
👇👇扫码免费领取全部内容👇👇
