Coocolab

把 Claude Code 接到 OpenRouter:免費模型能用嗎?我推哪一款

Claude Code 兩行 export 就能指到 OpenRouter,加一個 gateway model discovery 就能在 /model 選單裡切換 Qwen 3 Coder 免費版或 MiniMax M2。設定、雷區、CP 值一次講。

Jimmy · · 約 8 分鐘
#Claude Code#OpenRouter#AI 工具#MiniMax M2#Qwen 3 Coder

先講一件很多人不知道的事:

Claude Code 的底層模型端點是可以換掉的——最實用的目的地就是 OpenRouter。

截至 2026-08: 底下的模型版本、預設別名、pricing 都以我這篇寫作的當週對到官方頁為準,Anthropic/OpenRouter 幾乎每月都在動,看的時候請自己核對一次。

它預設接 Anthropic 家的 Sonnet 5(也就是 Anthropic 官方那組介面——一般叫 API,白話講就是「軟體對外開的一個窗口」——現行 claude-sonnet 別名解析到的版本),用你付費的金鑰認證。但底下其實是兩個環境變數在指揮流量——只要在 shell 或設定檔加兩行,你就能把整支命令列工具(也就是那個叫 CLI 的東西)指到別的服務去。

以 OpenRouter 為例。這是一個把上百個模型收在同一組 API 底下的中轉站,你付一次錢、拿一把金鑰就能打 Claude、GPT、Gemini。當中還有一批完全免費的:480B 參數的 Qwen 3 Coder、120B 的 GPT-OSS,價格是每百萬 tokens(也就是模型讀寫的最小計費單位,大約等於幾個中文字)都收 0 元。

如果你的電腦記憶體只有 8 GB、或你把 Claude Code 裝在樹莓派上,這條路特別實用——免費不代表無條件、也不代表品質等於 Sonnet,但用來扛 80% 的日常任務綽綽有餘。我把設定、免費用戶的雷、跟一個 CP 值頂到天的付費選項一次寫清楚。

為什麼你會想這樣做

先講清楚立場:我不是要你別付 Sonnet/Opus 的錢。

真要拿去做正事——複雜的重構、多檔案的架構調整、上下文塞爆的大專案——付費的 Sonnet 或 Opus 還是最順的手感,這件事不用糾結。但下面這幾種場景,硬用旗艦模型就是浪費:

  • 你把 Claude Code 裝在樹莓派或雲端小型虛擬機上,那台機器連 8 GB 記憶體都不到,本地跑模型根本不用想
  • 你只是想讓它幫你改個說明檔、寫個小 shell 腳本、格式化一份 JSON(也就是網路上很常見的那種結構化資料格式)——這種活給免費模型跑就夠
  • 你想試新出的開源模型(Qwen 3、GPT-OSS、Step 3、MiniMax),但不想每個都自己寫一套指令列工具

這幾種情境下,接到 OpenRouter 是最省事的路。你不用在本機裝 Ollama、不用自己跑本地推論伺服器、也不用寫轉譯層——OpenRouter 那邊已經把 Anthropic 的介面格式跟一大堆模型接好,Claude Code 感覺不到自己在跟誰講話。

最短路徑:兩行 export,直接在 Claude Code 裡切換模型

新版 Claude Code 有一個叫 gateway model discovery 的開關。打開之後,你在對話裡直接打 /model,就會看到 OpenRouter 上你能用的所有模型——不用回頭改設定檔、也不用重開視窗。

流程就三步:

  1. 01
    🔑

    拿一把 OpenRouter 金鑰

    去 openrouter.ai 註冊、右上角 Keys → Create Key。複製出來的字串以 sk-or- 開頭

  2. 02
    🖥️

    在終端機貼三行

    export ANTHROPIC_BASE_URL=https://openrouter.ai/api/v1、export ANTHROPIC_AUTH_TOKEN=sk-or-你的金鑰、export CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1

  3. 03

    同一個終端機打 claude 進去,用 /model 選

    進到對話後打 /model,會多一批 From gateway 標籤的模型——qwen/qwen3-coder、minimax/minimax-m2 之類的都在裡面。要換模型就再打 /model 挑一個,不用重開 Claude Code

驗證有沒有生效:在 Claude Code 裡打 /status,看 Anthropic base URL 這一行變成 https://openrouter.ai/api/v1 就對了。

三行 export 只在當前這個終端機有效,開新視窗就沒了。想每次開機都自動接 OpenRouter,就把它寫死在設定檔裡。

想永久生效:改一次 ~/.claude/settings.json

~/.claude/settings.json 是 Claude Code 的家目錄設定檔,寫在這裡影響所有專案。改成這樣:

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://openrouter.ai/api/v1",
    "ANTHROPIC_AUTH_TOKEN": "sk-or-你的金鑰",
    "CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY": "1"
  }
}

從此每次 claude 打進去,/model 選單裡都自帶 OpenRouter 那份清單,跟開機一樣自然。

有個小提醒:如果你電腦以前設過 ANTHROPIC_API_KEY,官方文件寫 ANTHROPIC_AUTH_TOKEN 會立刻蓋過它,所以你不會被舊金鑰打擾。真的想更保險,就在同一個 env 區塊裡把 ANTHROPIC_API_KEY 明確留成空字串,明確跟它說「這個檔案沒有 Anthropic 官方金鑰」。

這個檔案只影響全域:如果某個高難度專案想切回 Anthropic 官方,就在那個專案裡另外建 .claude/settings.local.json(Claude Code 會自動把它加進 gitignore),寫回你的 Anthropic 金鑰即可。專案設定會覆蓋家目錄設定。

免費模型有哪些

openrouter.ai/models 這一頁,把篩選器打勾「Free」,這是唯一的權威清單、它會變。到我寫這篇的當下,主流的三個是:

Qwen 3 Coder 480B
每百萬字元 0 元,本地載入要幾百 GB 顯示卡記憶體
GPT-OSS 120B
每百萬字元 0 元,官方文件說 120B 要 80 GB H100 才裝得下
Free Router
0 元,隨機分流到當前可用的免費模型,成功率高

看到那個「幾百 GB」了嗎?這就是為什麼「用雲的比裝本地實際」。買一張能塞下 480B 模型的顯示卡,錢夠你付好幾年的 Sonnet 訂閱。就算退一步跑官方能塞進 16 GB 的 GPT-OSS 20B 版本,Apple 基本款 Mac 也才 16 GB 統一記憶體——扣掉系統、瀏覽器、其他 app,你什麼都跑不動。

免費用戶的雷:共用額度、限流不留情

免費不代表無條件。這些模型的成本是 OpenRouter 跟提供商吸收的,額度全球所有用戶共用

實務上會遇到:

  • 台灣清晨(美西剛下班):通常沒事,能穩定跑
  • 台灣午後(美西剛醒):熱門免費模型常常一送就被打回、告訴你「太多人在用、稍後再試」
  • 尖峰時段連續失敗:Qwen 3 Coder、Step 3 這種話題大的模型最常斷

想穩定用免費,在 /model 選單裡挑那個叫做 openrouter/free 的路由端點——這是 OpenRouter 自己維護的路由,收到請求後從當前可用的免費模型裡隨機挑一個丟過去。單一模型的一致性會消失,但因為備選多,成功率高很多。

還有一個限流細節寫在官方文件裡:帳號累積加值不到 10 美元時,免費模型每天最多送 50 次呼叫;累積加值滿 10 美元後,這個上限拉到每天 1000 次。免費模型本身沒加值也能存取,加值 10 美元只是把「一天能打幾次」拉高。想密集用就先加值 10 美元。

真正划算的其實是便宜付費:MiniMax M2

免費模型的定位有點像速食店的免費甜筒——能吃,不是主餐。真正讓我覺得這套流程有價值的,是有一組便宜到不像話但品質不俗的付費模型可以搭配用。目前最典型的是 MiniMax 出的 M2。

MiniMax M2 vs Claude Opus 5(拿來寫程式的話)

可考慮
Claude Opus 5

「頂配」等級,Anthropic 目前的旗艦

  • 每百萬讀入字元 5 美元
  • 每百萬產出字元 25 美元
  • 複雜重構、長上下文分析仍是最強

真要下重手時,該花就花

推薦
MiniMax M2

中國團隊做的開源程式模型

  • 每百萬讀入字元約 30 美分
  • 每百萬產出字元約 1.2 美元
  • 日常改程式、寫測試綽綽有餘

在 /model 選單裡挑 minimax/minimax-m2 就切過去了

具體的金額請以 OpenRouter 當前定價為準——上面寫的是我這篇寫作時(2026-08)的區間,模型定價會調。重點是比例:MiniMax M2 每百萬字元的成本大約是 Opus 5 的十幾分之一。

不是叫你全部丟 MiniMax、Opus 完全不用。是說:如果你手上 80% 的 Claude Code 任務其實不需要旗艦的火力,那部分為什麼要用旗艦的錢跑?

我建議的用法:讓 /model 變成你的儀表板

弄清楚設定以後,最有價值的動作不是「省下訂閱費」,是/model 選單當儀表板,日常任務照難度切換:

  • 順手小事(改說明檔、格式化 JSON、寫小 shell 腳本)→ Qwen 3 Coder 免費版
  • 中等程度的日常(改一個小功能、寫測試、重構單一檔案)→ MiniMax M2,幾分錢跑完
  • 真要下重手的專案(多檔案架構調整、上下文長的大專案)→ 專案 .claude/settings.local.json 切回官方的 Opus/Sonnet

因為專案設定會覆蓋全域設定,你只要在需要旗艦模型的專案裡加一個本地設定檔就好,其他地方全部走便宜路線。這個「同一支工具、/model 一鍵切換多把後端金鑰」的搭法,才是外接的真正意義。

Claude Code 外接 OpenRouter · 優缺點

優點
  • + 省訂閱費,日常任務可能每月只花幾十塊台幣
  • + 同一支 Claude Code 能自由切換不同底層模型,全部在 /model 選單裡完成
  • + 免費用戶身分拿來試新模型很划算,不用先掏錢
  • + 不用在本機裝 Ollama、下模型檔,硬碟省下幾十 GB
缺點
  • 免費用戶常被限流打回,尖峰時段不能靠
  • 免費模型跟旗艦 Sonnet/Opus 的品質差距,在複雜任務上很明顯
  • 換第三方後,Anthropic 官方新功能不一定同步吃得到
  • 設定寫錯(例如 base url 少了 /api/v1)會出現詭異的認證錯,除錯很煩

最後說兩句

「Claude Code 綁 Anthropic」這個印象,是它剛出的時候給人的錯覺——那時候文件寫得很像必須用官方金鑰才能跑。實際上底層就是幾個環境變數的事,社群早就在外接 LiteLLM、OpenRouter 這些代理服務。到 2026 年這一版的 Claude Code,官方文件裡「換 gateway」已經是有專章的正規用法。

真正該從這篇拿走的,不是那份免費模型清單——那份清單會過期。是你手上的 Claude Code 是一支通用的助理工具,換底層模型只是打一次 /model 的距離。

下次你看到新的開源程式模型出來、心想「不知道好不好用」的時候,三分鐘就能接上跑一輪,不用等別人做評測。

這才是這招最大的意義。


延伸閱讀:

AI 工具

Claude 每個專案都要重教一次?寫 CLAUDE.md 四條家規一勞永逸

在專案根目錄放一份 CLAUDE.md,AI 每次動手前都會先讀。這篇拆解四條真的有用的家規:想清楚再動手、只改該改的、能少就不要多、驗證才算完成。附我在用的模板。

AI 工具

Caveman prompt:叫 Claude 講話像山頂洞人,token 帳單瘦一圈

Claude 每次回話都繞客套話——那些字都要錢。Caveman prompt 叫它切成山頂洞人語氣:只留動詞、名詞、數字。什麼場合能用、什麼場合會爛掉,附我整理的 prompt。

AI 工具

graphify 知識圖譜:讓 AI 不用每次都重新認識你的專案

AI 每開新對話就重讀專案、燒額度。graphify 把專案畫成知識圖譜,AI 查圖不用一個個翻檔案。程式碼在本機跑、不外送、不用辦帳號。六個專案實測數字與我踩到的四個坑。

AI 工具

AI 幫你寫程式老是衝太快、還自稱「完成了」?幫它裝一套資深工程師的工作紀律(一行指令)

AI 很會寫 code,但它像個超聰明卻很衝動的新人:你說『做個 X』它二話不說開始狂寫,不問清楚、不寫測試、出錯亂猜、還沒驗證就說『完成了』。問題不在它笨,在它沒紀律。這篇介紹 Superpowers —— 一套讓 AI 像資深工程師一樣工作的方法論(動手前先想清楚、測試先行、驗證才算完成),一行指令就能裝。附一鍵上手 prompt,Coocolab 免費會員可拿。

想把這些變成你的實戰能力?

加入 免費會員 — 解鎖「加密貨幣新手 30 天」+「AI 工具 21 天」實戰課、免費 prompt 資源區,還有每天自動生息的放貸 Bot 可試用。email 一鍵註冊、不用密碼。