告别云端API、零成本离线写代码!开源项目Claude Code Local,让Mac本地跑满配Claude Code
还在为Claude高昂的API账单心疼?处理涉密代码不敢上传云端?飞机、无网环境想随时调用AI编程助手?
今天给大家挖到一款2026年超硬核开源神器——claude-code-local,专为Apple Silicon Mac打造,依托Apple原生MLX框架,100%本地离线运行Claude Code,无需联网、不用API密钥、所有代码数据永不离开你的电脑,速度比传统代理方案快7.5倍!
一、它到底解决了开发者哪些痛点?
熟悉Claude Code的朋友都知道,这款终端AI编程Agent能力极强:通读全项目、自主改文件、执行Shell、调试重构、对接MCP插件生态。但官方版本有三大硬伤:
- 强依赖云端:必须联网调用Anthropic服务器,私有业务代码、NDA涉密内容存在泄露风险;
- 持续付费成本:按token计费,长期重度开发每月数百元开销;
- 网络限制:国内访问不稳定,无网场景完全无法使用。
市面上现有本地替代方案(Ollama+中转代理、llama.cpp转发)又有致命短板:多层API翻译转发、多进程损耗性能,单次编码任务动辄上百秒,工具调用频繁失效、无限循环。
而claude-code-local彻底重构底层逻辑,直击所有痛点:
核心黑科技:原生兼容Anthropic API,砍掉多余代理
传统本地方案链路:Claude Code → 中转Proxy → Ollama → 大模型
3个进程、2次协议转换,单任务耗时133秒
本项目全新链路:Claude Code → MLX原生服务器 → 本地大模型
仅1个进程、零协议翻译,同等任务仅需17.6秒,提速7.5倍
二、四大旗舰本地模型,按需自由切换
项目内置4套经过量化优化、专门适配编码场景的开源大模型,一行环境变量即可切换,覆盖16GB-192GB全规格Mac:
| 模型 | 定位 | 内存需求 | 核心优势 |
|---|---|---|---|
| Gemma 4 31B | 日常编码主力 | 最低32GB Mac | 15token/s,轻量化均衡,日常开发首选 |
| Llama 3.3 70B | 深度推理专家 | 最低96GB Mac | 高精度逻辑,复杂算法、架构重构最强 |
| Qwen 3.5 122B | 吞吐性能怪兽 | 最低96GB Mac | MoE稀疏架构,峰值65token/s,速度碾压云端Opus |
| DeepSeek V4 Flash | 百万上下文巨兽 | 最低128GB Mac | 支持100万token上下文,超长文档、多文件项目审计 |
额外适配轻量机型:Hermes 4 14B,16GB内存Mac也能流畅运行,满足基础代码补全与工具调用。
亮点:所有模型均为作者自制abliterated无限制量化版本,上传至HuggingFace一键拉取,规避模型内置过度限制,同时兼容原模型开源协议。DeepSeek V4采用Antirez自研ds4 Metal引擎,本地推理速度甚至超越云端Claude。
三、不止本地编码,五大全能离线模式
该项目不只是单纯代码工具,整套离线AI生态全部内置,双击启动即用:
1. 核心:离线Claude Code编码模式
完整复刻官方全部能力,完美兼容MCP插件体系(文件读写、GitHub、网页搜索等200+插件)。服务端内置工具调用纠错逻辑,修复本地模型XML/JSON格式错乱问题,98/98项测试零失败,告别AI只会“说不会做”。
同时内置代码专属提示词压缩优化,将10K系统提示精简至150token,预填充时间从60秒缩短至2秒。
2. 浏览器自主Agent
本地AI直接操控Brave浏览器,自动完成页面点击、表单填写、数据抓取、网页测试,全程不产生外网数据交互,适合自动化爬虫、前端自测。
3. 全离线语音交互
麦克风实时输入→本地语音识别→模型生成代码→本地克隆人声朗读,整套语音闭环完全断网运行。Mac风扇、环境噪音自动过滤,长时间稳定运行,写代码不用敲键盘。
4. iPhone远程操控
iMessage双向联动Mac:手机发送文字/图片指令,本地AI完成编码、网页操作、录屏,自动回传截图/视频,躺床上远程操控本地开发主机。
5. AirGap纯隔离办公模式
彻底断网环境下处理保密合同、金融/医疗涉密代码,lsof命令可全程监控,零对外网络请求,律所、企业涉密开发场景完美合规。
四、拉满安全感:极致隐私保护
这是项目最亮眼的设计,从底层杜绝数据泄露:
- 全程本地闭环:代码、提示词、语音、图片所有数据仅在Mac统一内存流转,无任何数据上传外网;
- 封堵Claude Code全部后台联网:通过环境变量关闭遥测、自动更新、市场后台任务,
lsof仅能看到localhost本地端口; - 移除LiteLLM等存在供应链风险的依赖,所有组件开源可审计;
- 支持完全断网使用,飞机、无网会议室、隔离内网均可正常工作。
五、三分钟一键部署,小白也能上手
项目提供全自动安装脚本,三条命令完成全部配置:
# 1. 克隆项目gitclone https://github.com/nicedreamzapp/claude-code-local# 2. 进入目录cdclaude-code-local# 3. 自动安装(检测内存、下载适配模型、生成桌面启动器)bashsetup.sh安装完成后桌面生成双击启动脚本「Claude Local.command」,打开即可直接使用离线版Claude Code。
手动部署备选(进阶用户)
单独创建MLX虚拟环境,手动指定模型启动服务,自定义量化参数、KV缓存、工具重试次数等数十项可调参数,适配个人硬件优化需求。
硬件适配对照表
- 8-16GB Mac:Hermes 4 14B轻量模型
- 32-64GB Mac:Gemma 4 31B(日常开发)
- 96GB Max:全系列除DeepSeek外全部流畅运行
- 128GB+ Ultra:四款旗舰模型通吃,百万上下文无压力
六、实测性能对比,碾压传统本地方案
速度横向对比
- Ollama代理方案:30 token/s,单任务133秒
- llama.cpp中转方案:41 token/s,单任务133秒
- 本项目MLX原生方案:最高65 token/s,单任务仅17.6秒
本地 vs 云端Claude
- 速度:本地Qwen 122B(65tok/s)>云端Claude Opus(40tok/s),仅略低于Sonnet
- 成本:本地一次性下载模型,永久0服务费;云端每月几十至数百元
- 离线能力:本地完全支持断网;云端必须联网
- 隐私:本地数据不出本机;云端代码上传第三方服务器
七、适合这些开发者,直接闭眼冲
程序员、架构师,重度使用Claude Code,想省去API开销
金融、律所、医疗行业从业者,需要处理涉密/客户敏感代码文档
经常出差、通勤,无网络环境也需要AI辅助开发
隐私敏感人群,绝不允许源代码上传任何第三方云端
Apple Silicon Mac用户,想充分榨干M系列芯片本地AI性能
八、开源信息与后续规划
项目开源协议为MIT,可商用、自由二次修改,仓库持续迭代更新:
- 短期计划:一键DMG图形化安装包、全语种本地Whisper语音识别、兼容更多开源编码大模型;
- 长期方向:支持自定义HuggingFace模型接入、企业批量部署方案;
- 配套生态:联动NarrateClaude(语音)、browser-agent(浏览器)、claude-screen-to-phone(手机远程)全套离线工具链。
结语
在AI工具普遍依赖云端、持续收费的当下,claude-code-local走出了一条本地优先、隐私优先的路线。依托Apple MLX原生加速砍掉代理损耗,兼顾速度、免费、离线、安全四大核心需求,是Mac开发者专属的免费AI编程神器。
仓库地址:https://github.com/nicedreamzapp/claude-code-local
有Apple Silicon Mac的朋友,赶紧克隆体验,从此告别云端账单与代码泄露焦虑!
