在本機執行大型語言模型(LLM)的工具「Ollama」推出了一個名為 ollama launch 的新指令,只要一行指令就能完成程式設計工具的設定與啟動[1]。它支援 Claude Code、OpenCode、Codex、Droid 這 4 款工具,不必準備環境變數或設定檔,就能搭配本機模型或雲端模型立即使用[1]。

「ollama launch」是什麼 — 免設定檔的啟動指令

ollama launch 是一個新指令,用來將 Claude Code、OpenCode、Codex 等熱門程式設計工具與本機模型或雲端模型搭配設定,並直接啟動[1]。它最大的特色在於,你不需要自行準備環境變數或設定檔[1]。

在終端機裡把模型連接到程式設計工具時,往往得手動把連線位址與驗證權杖設定為環境變數。ollama launch 把這些準備工作整合成一行指令,並以引導的方式帶你完成從選擇模型到啟動的整個流程[1]。

使用方式 — 安裝 Ollama 並一行指令啟動

首先,安裝 Ollama v0.15 或更新版本[1]。接著在終端機中拉取你要使用的模型。若使用在自己機器上執行的本機模型,可依下列方式指定[1]:

# 以 64000 token 的上下文長度執行時,約需 23GB 顯示記憶體
ollama pull glm-4.7-flash

當需要更大的上下文長度時,也可以選擇拉取雲端模型[1]:

ollama pull glm-4.7:cloud

模型準備好後,指定你想用的工具並啟動。Claude Code 的指令如下[1]:

ollama launch claude

OpenCode 的指令如下[1]:

ollama launch opencode

執行指令後,會以引導方式帶你選擇模型並啟動所選工具。在這個步驟同樣不需要建立環境變數或設定檔[1]。如果只想完成設定而不立即啟動,可在結尾加上「--config」[1]:

ollama launch opencode --config

支援的程式工具與建議模型

ollama launch 支援的工具包括 Anthropic 的程式設計工具 Claude Code,以及 OpenCode、Codex、Droid,共 4 款[1]。它們都是在終端機中執行、面向開發者的程式設計工具,可以連接 Ollama 所支援的模型使用。

Ollama 也列出了程式設計用途的建議模型[1]。在自己機器上執行的本機模型方面,列出了 glm-4.7-flash、qwen3-coder、gpt-oss:20b;雲端模型方面,則列出了 glm-4.7:cloud、minimax-m2.1:cloud、gpt-oss:120b-cloud、qwen3-coder:480b-cloud[1]。你可以依據自己機器的效能與想使用的模型規模,在本機與雲端之間彈性選擇。

上下文長度與 5 小時的程式設計工作階段

對於程式設計這類需要處理長上下文的工作,Ollama 建議將上下文長度(模型一次能處理的 token 數)設定為至少 64000 token[1]。此設定可在 Ollama 的設定畫面中變更[1]。

針對在本機執行這些模型較為困難的情況,Ollama 也提供了託管模型的雲端服務[1]。該雲端支援完整的上下文長度,據說即使是免費方案也設有相對寬裕的使用上限[1]。配合本次更新,使用額度有所擴大,並新增了支援 5 小時程式設計工作階段的額度[1]。資費詳情可在 Ollama 的定價頁面查看[1]。

總結

ollama launch 是一個新指令,讓你不需要環境變數或設定檔,只用一行指令就能完成 Claude Code、OpenCode、Codex、Droid 等程式設計工具的設定與啟動[1]。它在 Ollama v0.15 及更新版本中可用,並可同時搭配本機模型與雲端模型[1]。在程式設計用途上,建議使用至少 64000 token 的上下文長度;當在本機執行較為困難時,也可選擇支援完整上下文長度的雲端服務[1]。對於想在自己的硬體上、或用開源模型嘗試程式設計工具的人來說,這可說是一項降低上手門檻的更新。

來源:https://ollama.com/blog/launch