在本地运行大语言模型(LLM)的工具「Ollama」推出了一条名为 ollama launch 的新命令,只需一条命令即可完成编程工具的配置与启动[1]。它支持 Claude Code、OpenCode、Codex、Droid 这 4 款工具,无需准备环境变量或配置文件,就能搭配本地模型或云端模型立即使用[1]。
「ollama launch」是什么 — 无需配置文件的启动命令
ollama launch 是一条新命令,用于把 Claude Code、OpenCode、Codex 等热门编程工具与本地模型或云端模型组合配置,并直接启动[1]。它最大的特点是,你无需自己准备环境变量或配置文件[1]。
在终端里把模型连接到编程工具时,往往需要手动把连接地址和认证令牌设置为环境变量。ollama launch 把这些准备工作整合进一条命令,并以向导的形式引导你完成从模型选择到启动的全过程[1]。
使用方法 — 安装 Ollama 并一条命令启动
首先,安装 Ollama v0.15 或更高版本[1]。然后在终端中拉取你要使用的模型。如果使用在自己机器上运行的本地模型,可按如下方式指定[1]:
# 以 64000 token 的上下文长度运行时,约需 23GB 显存
ollama pull glm-4.7-flash
当需要更大的上下文长度时,也可以选择拉取云端模型[1]:
ollama pull glm-4.7:cloud
模型准备好后,指定你想用的工具并启动。Claude Code 的命令如下[1]:
ollama launch claude
OpenCode 的命令如下[1]:
ollama launch opencode
执行命令后,会按向导引导你选择模型并启动所选工具。在这一步同样无需创建环境变量或配置文件[1]。如果只想完成配置而不立即启动,可在末尾加上「--config」[1]:
ollama launch opencode --config
支持的编程工具与推荐模型
ollama launch 支持的工具包括 Anthropic 的编程工具 Claude Code,以及 OpenCode、Codex、Droid,共 4 款[1]。它们都是在终端中运行、面向开发者的编程工具,可以连接 Ollama 所支持的模型使用。
Ollama 还列出了编程用途的推荐模型[1]。在自己机器上运行的本地模型方面,列出了 glm-4.7-flash、qwen3-coder、gpt-oss:20b;云端模型方面,列出了 glm-4.7:cloud、minimax-m2.1:cloud、gpt-oss:120b-cloud、qwen3-coder:480b-cloud[1]。你可以根据自己机器的性能和想使用的模型规模,在本地与云端之间灵活选择。
上下文长度与 5 小时编程会话
对于编程这类需要处理长上下文的工作,Ollama 建议把上下文长度(模型一次能处理的 token 数)设置为至少 64000 token[1]。该设置可在 Ollama 的设置界面中更改[1]。
针对在本地运行这些模型较为困难的情况,Ollama 还提供了托管模型的云端服务[1]。该云端支持完整的上下文长度,据介绍即便是免费档位也设有相对宽裕的使用上限[1]。配合本次更新,使用额度有所扩大,并新增了支持 5 小时编程会话的额度[1]。资费详情可在 Ollama 的定价页面查看[1]。
总结
ollama launch 是一条新命令,可让你无需环境变量或配置文件,仅用一条命令就完成 Claude Code、OpenCode、Codex、Droid 等编程工具的配置与启动[1]。它在 Ollama v0.15 及更高版本中可用,可同时搭配本地模型和云端模型[1]。在编程用途上建议使用至少 64000 token 的上下文长度;当在本地运行较为困难时,也可选择支持完整上下文长度的云端服务[1]。对于想在自己的硬件上、或用开源模型尝试编程工具的人来说,这可以说是一项降低上手门槛的更新。
