当前位置: 首页 > news >正文

教你用笔记本部署的大模型,30 分钟搭一个安全又灵活的私有 AI 助手

有读者留言问了一个非常好的问题:

“能不能用飞书对接本地模型,不同问题用不同模型回答,数据完全不出本地?”

答案是:完全可以。 今天就来拆解这套方案。

先说结论:三件套搞定

整套方案只需要三样东西:

  • Ollama:本地跑大模型,调用本地部署的轻量开源模型
  • OpenClaw(龙虾):开源 AI 网关,负责把飞书和本地模型连起来
  • 飞书:你的聊天入口,@机器人就能和本地模型对话

架构很简单:

飞书消息 → OpenClaw(本地网关) → Ollama(本地模型) → 返回飞书

全程走本地网络,没有任何数据发到云端。

为什么数据真的不出本地?

这是很多人最关心的问题,我拆开讲:

  1. 模型推理在本地

Ollama 跑在你自己的电脑或服务器上,所有的提问和回答都在本地 GPU/CPU 完成。不像 ChatGPT 或文心一言,你的数据不会经过任何第三方服务器。

  1. 飞书用 WebSocket 反向连接

OpenClaw 和飞书之间用的是 WebSocket 长连接,由 OpenClaw 主动连接飞书服务器。这意味着:

  • 你不需要暴露公网 IP
  • 不需要配置域名和 HTTPS
  • 不需要在防火墙上开端口
  • 飞书只传递消息文本,不碰你的文件和数据
  1. 文件处理也在本地

如果你在飞书发了图片或文件给机器人,OpenClaw 会从飞书临时 URL 下载到本地内存处理,处理完返回结果,不做额外存储。

  1. 配置和日志全在本地

所有配置文件、对话记录都存在本地文件系统,你可以随时备份、审计、删除,完全自主可控。

一句话:从你发消息到收到回复,数据只在「你的电脑 ↔ 飞书服务器」之间流转,模型推理完全在本地完成。

按需切换模型:三种方式

不同问题用不同模型,这是本地部署的一大优势。OpenClaw 支持三种切换方式:

方式一:聊天中直接切换(最常用)

在飞书对话框里发/model命令,就能查看和切换当前可用的模型:

/model # 查看当前模型 /model ollama/qwen3.5:9b # 切换到 Qwen 9B /model ollama/deepseek-coder:6.7b # 切换到代码模型

切换后立即生效,下一条消息就用新模型回答。

方式二:命令行全局切换

用 OpenClaw 命令行设置默认模型:

# 查看所有可用模型 openclaw models list # 设置默认模型 openclaw models set ollama/qwen3.5:9b # 切换到轻量模型(日常问答) openclaw models set ollama/qwen3.5:2b # 切换到代码模型 openclaw models set ollama/deepseek-coder:6.7b

方式三:多机器人绑定不同模型(团队推荐)

如果你是团队使用,可以在飞书建多个机器人,每个绑定不同的 Agent 和模型:

{ "agents":{ "list":[ {"id":"daily","model":"ollama/qwen3.5:2b"}, {"id":"coding","model":"ollama/deepseek-coder:6.7b"}, {"id":"analysis","model":"ollama/qwen3.5:9b"} ] }, "bindings":[ { "agentId":"daily", "match":{"channel":"feishu","peer":{"kind":"direct","id":"ou_轻量助手"}} }, { "agentId":"coding", "match":{"channel":"feishu","peer":{"kind":"direct","id":"ou_代码助手"}} } ] }

这样 @不同机器人,就自动用对应的模型回答:

  • 「轻量助手」→ 2B 小模型,秒回,适合日常问答
  • 「代码助手」→ DeepSeek Coder,专注代码生成和调试
  • 「深度分析」→ 9B 大模型,适合长文本分析和复杂推理

什么场景用什么模型?

场景推荐模型显存需求特点
日常问答、闲聊Qwen3.5:2B2-3GB速度快,秒回
写作、总结、翻译Qwen3.5:4B3.5GB中文理解强
代码生成、调试DeepSeek-Coder:6.7B5GB代码补全准确
复杂分析、长文本Qwen3.5:9B6.5GB推理能力强
看图、OCRQwen-VL8GB+多模态理解
通用均衡GLM-4.7-Flash5-6GB综合表现好

小技巧:先用小模型回答,觉得不够好再用/model切到大模型重新问。小模型不花钱、不排队,随便用。

30 分钟部署全流程

第一步:确认 Ollama 已就绪(5 分钟)

如果你电脑装好了 Ollama,直接拉取几个模型,也可以根据需求拉取所需的:

# 通用对话 ollama pull qwen3.5:9b # 代码专用 ollama pull deepseek-coder:6.7b # 轻量快速 ollama pull qwen3.5:2b

第二步:安装 OpenClaw(5 分钟)

需要先安装 Node.js(v22 或更高)和Git,然后执行下面命令(需要科学上网,OpenClaw安装教程网上比较多,可以自己查找,不会可评论区留言):

npm install -g openclaw@latest

运行初始化向导:

openclaw onboard

选择 Ollama 作为模型提供商,向导会自动检测本地 Ollama 实例并列出可用模型。

如果搞不定OpenClaw的网络或配置,其实也可以安装最近推出的国产龙虾,如阿里的CoPaw、腾讯的QClaw都是替代方案,也都能实现Ollama对接。

第三步:创建飞书机器人(10 分钟)

  1. 打开飞书开放平台,登录后创建企业自建应用(网上有很多教程可参考,不会可留言)

  2. 复制 App ID 和 App Secret

  3. 在「应用能力」中启用「机器人」

  4. 在「权限管理」中添加消息相关权限

  5. 在「事件订阅」中选择「使用长连接接收事件」,添加im.message.receive_v1

  6. 创建版本并发布

第四步:连接飞书和 OpenClaw(5 分钟)

openclaw channels add

选择 Feishu,粘贴 App ID 和 App Secret。

启动网关:

openclaw gateway start

第五步:测试(5 分钟)

在飞书找到你的机器人,发一条消息。首次会收到配对码,在终端执行:

openclaw pairing approve feishu <配对码>

再发一条消息,本地模型就会回答你了。试试/model切换不同模型感受一下差异。

OpenClaw响应慢的问题

不少人都遇到了直接调用Ollama模型很快,但是用OpenClaw调用返回就很慢,最核心原因就是上下文窗口与显存溢出,Ollama默认上下文窗口很小,KV缓存占用低,但是OpenClaw默认全开,直接用模型原生大窗口,组合的上下文大量提示词全部发给Ollama,KV缓存瞬间占满显存,模型被迫切内存+CPU跑,速度暴跌10-100倍。

在硬件条件不变的前提下,我的解决方式是在OpenClaw中配置缩小上下文窗口(修改contextWindow: 4096),关闭全量记忆,采用QMD,这样通过牺牲一部分OpenClaw记忆功能,换取更快的速度。

适合谁?

  • ✅ 注重数据安全的个人/团队:敏感数据、商业文档、内部资料都不上云
  • ✅ 企业内网环境:等保合规、数据主权要求
  • ✅ 开发者:本地调试代码、多模型对比测试
  • ✅ 预算有限:模型跑在本地,长期使用零成本

写在最后

很多人觉得本地部署 AI 很复杂,其实 OpenClaw + 飞书 + Ollama 这套组合,30 分钟就能跑通,数据安全有保障,模型切换很灵活。直白讲,轻量模型在复杂逻辑处理体验上确实和全量大模型有差距,但能满足日常对AI对话的基本需求,并且能微调实现专项领域知识的处理。

如果你对数据隐私有要求,或者团队需要一个私有化的 AI 助手,强烈建议试试这套方案。

这里给大家精心整理了一份全面的AI大模型学习资源包括:AI大模型全套学习路线图(从入门到实战)、精品AI大模型学习书籍手册、视频教程、实战学习、面试题等,资料免费分享

👇👇扫码免费领取全部内容👇👇

1. 成长路线图&学习规划

要学习一门新的技术,作为新手一定要先学习成长路线图方向不对,努力白费

这里,我们为新手和想要进一步提升的专业人士准备了一份详细的学习成长路线图和规划。可以说是最科学最系统的学习成长路线。

2. 大模型经典PDF书籍

书籍和学习文档资料是学习大模型过程中必不可少的,我们精选了一系列深入探讨大模型技术的书籍和学习文档,它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础(书籍含电子版PDF)

3. 大模型视频教程

对于很多自学或者没有基础的同学来说,书籍这些纯文字类的学习教材会觉得比较晦涩难以理解,因此,我们提供了丰富的大模型视频教程,以动态、形象的方式展示技术概念,帮助你更快、更轻松地掌握核心知识

4. 2026行业报告

行业分析主要包括对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。

5. 大模型项目实战

学以致用,当你的理论知识积累到一定程度,就需要通过项目实战,在实际操作中检验和巩固你所学到的知识,同时为你找工作和职业发展打下坚实的基础。

6. 大模型面试题

面试不仅是技术的较量,更需要充分的准备。

在你已经掌握了大模型技术之后,就需要开始准备面试,我们将提供精心整理的大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。

7. 资料领取:全套内容免费抱走,学 AI 不用再找第二份

不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:

👇👇扫码免费领取全部内容👇👇

http://www.cnnetsun.cn/news/1824704.html

相关文章:

  • ESP32轻量级Sonos本地控制库:UPnP协议嵌入式实现
  • Android音频系统调试指南:用adb命令快速定位audio_policy配置问题
  • Navicat16/17 Mac版无限重置试用期终极指南:免费使用完整功能
  • PPTAgent终极指南:3分钟从文档到专业演示文稿的AI革命
  • Android集成超轻量级OCR引擎:4.7M模型实现毫秒级离线文字识别
  • 专业的南昌GEO优化推荐
  • 为什么你的RAG系统缓存命中率不足31%?——基于12家头部AI厂商的缓存拓扑审计报告
  • Seed-Coder-8B-Base快速部署:在消费级显卡上运行代码生成模型
  • 解锁Mac文件预览新境界:QuickLook插件完全指南
  • 避坑指南:Dify集成Ollama本地模型时,如何解决‘unable to load model’等常见报错(以Qwen3-Embedding为例)
  • SiameseUniNLU惊艳效果展示:中文会议纪要自动提炼‘决议事项-责任人-截止时间’结构化清单
  • Geo-SAM终极指南:如何在QGIS中实现秒级地理空间AI图像分割
  • 茉莉花插件终极指南:如何让Zotero中文文献管理效率提升3倍
  • Windows 11 上 Docker + RAGFlow + Ollama 搭建个人知识库,我踩过的坑都帮你填平了
  • 【2026年最新600套毕设项目分享】微信小程序的小说阅读器(30028)
  • 如何用Python轻松下载B站4K大会员视频?这个开源工具让你告别在线观看限制
  • 3步彻底卸载OneDrive:Windows 10终极清理指南
  • Golang的车载应用场景
  • Python数据库操作实战
  • Isaac Sim 8 灯光参数全解析:从零到一的实战调光指南
  • 三步搞定QQ空间历史说说完整备份:GetQzonehistory终极指南
  • 若依与BladeX框架下用户组织架构同步的实践指南
  • 用Chord视频分析工具做影视剪辑:快速定位特定场景与人物出场时间
  • QT桌面应用集成Phi-4-mini-reasoning:开发智能配置向导与帮助系统
  • 如何永久保存QQ空间青春记忆?GetQzonehistory开源工具完整备份指南
  • 怎样高效使用PCB分析工具:硬件工程师的实战指南
  • 数字文旅必备工具:Asian Beauty Z-Image Turbo生成古风虚拟导游全流程
  • 鸿蒙Flutter三方库适配:Flutter Markdown适配实战-鸿蒙平台的Markdown渲染解决方案
  • 博导建议:研究生至少要有一篇 “保底” 论文
  • Qwen3-ASR-1.7B在在线教育中的应用:实时课堂语音转文字