【免费下载链接】ClaudeCode-Portable
Run Claude Code from a USB drive on any PC — no installation required.
ClaudeCode-Portable是一款免安装、可放在 U 盘里运行的便携式 AI 编程智能体,内置 Ollama 离线模式——配合Ollama 本地模型,即可在断网环境下完成代码编写、文件操作与终端命令执行,是隐私敏感场景与无网办公的离线运行方案。本教程手把手带你完成从下载项目到纯本地推理的全流程配置。
一、为什么选择 ClaudeCode-Portable 离线模式?
很多 AI 编程工具依赖云端 API,一断网就"罢工",代码和对话还会经过第三方服务器。ClaudeCode-Portable 的 Ollama 离线模式则完全不同:
| 特性 | 说明 |
|---|---|
| 🔌 完全离线 | 推理由本机 Ollama 完成,无需联网、不产生 API 费用 |
| 💾 零安装 | 一切文件都收纳在项目文件夹内,U 盘插到任何电脑都能用 |
| 🛡️ 隐私安全 | 数据、日志、会话全部写在项目data/目录,不污染宿主机 |
| ⚡ 加速代理 | 内置 tools/local-proxy.js 自动精简系统提示词,本地 CPU 推理也能用 |
它同时支持 9 种 AI 提供方(云端 API + 本地模型),随时可在云端与离线之间切换。
二、准备工作:获取项目并首次启动
⚠️ 只有第一次启动需要联网(自动下载 Node.js 运行时和 OpenClaude 引擎)。下载模型也需要联网。此后即可彻底离线。
1. 克隆项目到 U 盘或本地目录:
git clone https://gitcode.com/gh_mirrors/op/ClaudeCode-Portable2. 启动入口(二选一):
- Windows:双击运行 START.bat,它会自动下载 Node.js(约 25 MB)和引擎(约 5 MB)
- Linux / macOS:
chmod +x start.sh ./start.sh首次启动成功后会进入"AI 提供方选择"菜单,此时先不要选 Ollama,因为本地引擎和模型都还没下载——先做下一步。
三、一键下载 Ollama 本地模型(离线关键步骤)
主菜单提供5) Setup Offline — Download local AI models (Ollama)选项,它会调用平台对应的离线模型安装脚本:
- Windows:tools/setup_local_models.ps1
- Linux / macOS:tools/setup_local_models.sh
该脚本会自动完成三件事:
- 下载便携版 Ollama 引擎(存入
data/ollama/,不污染系统) - 拉取你选择的模型(支持断点续传,中断后重跑会自动跳过已完成的模型)
- 自动写好离线配置,默认模型直接生效
推荐模型一览(按内存/速度排序):
| 编号 | 模型 | 大小 | 适用场景 |
|---|---|---|---|
| 1 | Gemma 4 E2B (Q4_K_M) | ~3.1 GB | 综合最佳,配置低首选 |
| 2 | Gemma 4 E2B (Q6_K) | ~4.5 GB | 量化精度更高 |
| 3 | Gemma 4 E4B (Q4_K_M) | ~5.0 GB | 大多数用户默认推荐 |
| 4 | Qwen 3.5 (9B) | ~6.6 GB | 支持文本+图像,推荐 |
| 5 | Ministral 3 (8B) | ~6.0 GB | 支持文本+图像,日常使用 |
脚本还会检测已下载过的模型(编号 6 起)并显示[DOWNLOADED]标记,输入C还可输入任意 Ollama 标签自定义模型。U 盘剩余空间不足 5 GB 时会给出警告,建议模型体积预留充足。
四、将 AI 提供方切换为 Ollama
模型就绪后,重新运行 start.sh 或 START.bat,在提供方菜单选择7) Ollama — Local Offline AI (No internet)。
启动器会自动:
- 唤醒便携版 Ollama 引擎并启动本地服务(start.sh)
- 列出
data/ollama/中所有已安装模型供你选择 - 写入 data/ai_settings.env:
AI_PROVIDER=ollama OPENAI_BASE_URL=http://localhost:11434/v1 OPENAI_MODEL=<你选择的模型>之后每次启动都会自动跳过配置直接进入菜单,并在启动前自动拉起本地 Ollama 服务、退出时自动关闭——全程无需手动操作。
💡 想临时换模型?用 tools/change_provider.sh(Windows 用 tools/Change_Provider.bat)随时切换提供方和模型。
五、秘密武器:内置加速代理让本地模型"飞快"
本地模型(尤其是纯 CPU 推理)最大的痛点是慢。ClaudeCode-Portable 内置了一个系统提示词修剪代理tools/local-proxy.js:
OpenClaude 引擎 → localhost:11435(加速代理)→ localhost:11434(Ollama)它拦截每一次/chat/completions请求,把约 10 000 token 的系统提示词裁剪到约 300 token 再转发给 Ollama(见 local-proxy.js),官方实测数据:
| 硬件 | 首 token 延迟 |
|---|---|
| 无代理(CPU 推理) | 60–120 秒 |
| 启用加速代理 | 5–20 秒 |
代理日志静默写入data/proxy.log,不会干扰终端界面显示,属于全自动生效,无需任何配置。
六、日常离线使用技巧
- 跳过更新检查:完全断网时加参数启动,避免等待网络超时:
./start.sh --offline- 恢复会话:中断的任务可用
RESUME.bat <session-id>(Windows)按会话 ID 恢复 - 网页控制台:主菜单
3) Open Dashboard打开 dashboard/server.mjs 提供的浏览器界面(http://localhost:3000),聊天式操作本地模型同样完全离线 - 性能优化:U 盘是 USB 2.0 且模型读取慢时,可把
data/ollama/模型目录复制到本地 SSD 再运行
七、常见问题速查
| 症状 | 解决办法 |
|---|---|
EADDRINUSE: port 11435 | 上次的加速代理还在运行,重新运行START.bat会自动结束它 |
| Ollama 响应非常慢 | 换更小的模型(如 Gemma 4 E2B),或把模型复制到本地 SSD |
U 盘上卡住Installing OpenClaude Engine | USB 2.0 需要 10–15 分钟;建议先在内置硬盘完成首次安装再拷回 U 盘 |
| 下载模型中断 | 重跑Setup Offline,脚本支持断点续传,已完成部分自动跳过 |
Port 3000 already in use | 控制台其实已在运行,直接访问http://localhost:3000 |
八、总结
整套流程只需要三步:克隆项目 → Setup Offline 下载模型 → 选择 Ollama 提供方。首次联网完成后,ClaudeCode-Portable + Ollama 就能在航班、内网办公环境、无网会议室里持续工作——数据不出机器,模型不产生费用,拔掉网线照样写代码。
更多细节可参考 README.md 与 LICENSE(MIT 协议,可自由使用)。
【免费下载链接】ClaudeCode-Portable
Run Claude Code from a USB drive on any PC — no installation required.
相关推荐
告别网络依赖:ollama-deep-researcher完全本地API指南
告别网络依赖:ollama deep researcher完全本地API指南 你还在为研究工具依赖云端服务而担忧数据安全吗?还在因网络延迟影响研究效率吗?本文将
AI Agent大模型交互助手后端lobe-chat本地部署:Ollama模型离线运行指南
lobe chat本地部署:Ollama模型离线运行指南 在当今AI技术快速发展的时代, lobe chat本地部署 为个人和企业提供了完全掌控数据安全和隐私的
人工智能AI 应用大模型AI Agent多智能体工具调用前端后端MoneyPrinterPlus与Ollama本地大模型集成:完全离线运行方案
MoneyPrinterPlus与Ollama本地大模型集成:完全离线运行方案 在当今AI技术飞速发展的时代, MoneyPrinterPlus 作为一款强大的
人工智能大模型媒体生成语音短视频
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考