Ollama v0.33.0 上线本地代理,让 Claude Desktop 能直接运行 DeepSeek、Qwen、Kimi、GLM 等开放模型。它还支持把 Opus 槽位映射到任意模型,绕开 Anthropic 四月的名单拦截,把模型选择权交还给用户。
四个月前被 Anthropic 堵上的一条通道,换了个思路重新打通。
近期,Ollama 在 v0.33.0 版本中上线一项新实现:为 Claude Desktop 提供专用本地代理。8 月 26 日官方博客正式介绍,Claude Desktop 可以把 Ollama 配置成「第三方网关提供商」,Qwen、DeepSeek、Kimi、GLM 等开放模型,由此可以直接出现在 Anthropic 自家应用界面里。

这件事值得聊的地方,不在于多了一个集成,而在于它绕过了 Anthropic 四个月前亲手关上的门。
把时间线拉长看,猫鼠游戏节奏相当清晰:
中间发生了什么?Claude Desktop 一次更新后,用户发现网关照常接受连接,却拒绝所有非 Anthropic 的模型 ID。有用户把当时日志贴到 GitHub:网关的 /v1/models 接口明明返回 39 个模型,可用数量却是 0。应用发消息时固执地调用 claude-sonnet-4-6,随后报错「模型不存在或无权访问」。
Anthropic 关门的方式很讲究:接口照开、协议照通,只动模型名单。Ollama 随后下架功能,承认 Claude Desktop 第三方集成已「仅限 Anthropic 模型使用」。

v0.33.0 的新方案,把绕行点从网关配置挪到本机。Ollama 起了一个专用本地代理(源码位于 internal/proxy/claude_desktop.go),Claude Desktop 的请求先落到这个代理,再由代理转发给 Ollama 托管的任何模型。
配置被压成一次点击:打开 Ollama,选择 Claude,打开开关;Ollama 会自动把第三方网关配置写好。Mac 菜单栏会常驻一个「使用 Ollama 模型」切换,关闭后原有 Claude 设置原样恢复。
为什么能解开四月的死结?关键在信任边界的位置。四月的方案里,Claude Desktop 直连网关,校验模型名单的权力握在应用手里,看到陌生模型 ID 就拒绝。新方案里,应用连接的是本机回环地址上的代理,对 Claude Desktop 来说,对话对象只是一个「合法」的本地端点;请求出了应用后往哪走、由哪个模型承接,全由 Ollama 在本机决定。校验那一关,被搬到了用户自己可控的一侧。

最有意思的设计是槽位重映射。Claude Desktop 的界面围绕 Anthropic 自家模型构建,模型选择器里是 Opus、Sonnet 这些名字。Ollama 允许用户自定义每个槽位背后的真实模型:选 Opus 5,请求可能路由到 Kimi K3;选 Sonnet 5,实际跑的是 DeepSeek V4 Pro。界面还是那个界面,引擎已经换了。Claude Desktop 内置的 Auto mode 也完整保留。
这种「界面不动、底座换掉」的做法,Claude Code 生态里早有先例:LiteLLM、Bifrost 等网关可以把 Sonnet、Opus、Haiku 三个槽位映射到任意提供商。Ollama 这次是把同一套思路从终端搬进图形界面,顺手把配置门槛压到一键。
隐私方面也有明确交代:遥测默认关闭,模型和服务执行零数据保留政策,提示词既不会发给 Anthropic,也不会被 Ollama 存储。
不少人问:既然有 Claude,为什么要绕一圈?Ollama 的答案可以浓缩成四个词:成本、速度、可移植性、自定义。本地模型零调用成本、无网络延迟;微调过的自有模型能塞进日常工作流;重活交给 Ollama Cloud 的大模型,轻活本地跑,也可以随时切回 Anthropic 前沿模型。
更深一层是数据不出机。敏感代码、内部文档、客户资料走本地模型,意味着整条链路留在自己设备上,叠加零数据保留政策,这对既想用 AI 又怕合规风险的企业场景有实际吸引力。
也有人困惑,这和 Claude Code 接 Ollama 有什么区别。差别在场景:Claude Code 是终端里的编程智能体,主要服务开发者;这次集成把同样能力带进图形化的桌面应用,对话、研究、写作、文档处理这类非终端场景,第一次可以整条链路不离开 Claude Desktop。Ollama 显然想覆盖更大的用户群。
目前该功能仅限 Mac 版 Ollama,Windows 支持据官方在 X 上的暗示已在规划中。

把这件事放进产业坐标系,几组公开事实值得并排看。
7 月,Ollama 完成 6500 万美元 B 轮融资,CEO Jeffrey Morgan 当时把话讲得很满:AI 的未来,是开放模型在工作发生的每一处地方运行。同期,Ollama 还在推进 Apple MLX 原生支持,提升 Mac 本地推理性能。Claude Desktop 集成正是这条战略线的最新一环:用户留在自己熟悉的应用里,Ollama 在底层供模型。
免费获取企业 AI 成熟度诊断报告,发现转型机会
由此可以推演两层。其一,这类「壳与引擎解耦」会继续扩散——LiteLLM、Bifrost 等网关已经把开发者生态教熟了,桌面应用只是下一个被解耦的界面。其二,猫鼠游戏未必结束。Anthropic 四月已经演示过「协议放行、名单拦截」,公开资料里也看不到它对本轮集成的表态;如果应用层再次收紧校验,Ollama 的本地代理能扛多久,仍是开放问题。
对开放模型阵营来说,意义更直接:Qwen、DeepSeek、Kimi、GLM 第一次集体出现在 Anthropic 自家应用的模型选择器里。围墙还在,但墙上多了一扇别人装的门。
回看这条产品线,Ollama 的打法已经成型:本地运行时打底,云端服务补算力,再逐个敲开开发者正在用的工具——终端、IDE、桌面应用。它不劝任何人换界面,只做一件事:让开放模型出现在工作正在发生的地方。
后面值得盯的,一是 Windows 版本何时落地,二是 Anthropic 会不会再次出手。四月的封杀和八月的回归说明了另一件事:模型这件事上的「默认选项」之争,已经打到了别人的应用里。
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断