Kimi 長上下文專用配置
Kimi-1M 處理大型程式碼庫 / 長合同 / 研究文件場景,與 GLM 共存。
看 Kimi 配置Hermes Agent 國內 LLM Provider 指南
智譜 GLM-4 是 Hermes Agent 國內最快的 LLM 選項:3 步配置完成、新使用者 18 元試用額度、API 價格低於 GPT-4 一個數量級、與 Claude/GPT 效能對比、國內訪問無需代理。本文同步 v2026.9.14 與 GLM-4-Plus / Air / Flash 三檔模型最新接入方式。
智譜 AI 是國內做得最早、最穩的大模型 API 平臺之一(清華系),GLM-4 是當前他們對外開放的主力閉源模型。對 Hermes Agent 國內使用者來說,它解決了三個最痛的問題:
簡而言之:如果你的 Hermes Agent 主要在國內跑,且關心賬單 + 網路穩定性,GLM-4 是當前最划算的預設選擇。
配置 GLM 之前要拿到一個能用的 API Key。流程在 5 分鐘之內可以完成。
1. 註冊智譜開放平臺
訪問 https://open.bigmodel.cn → 手機號註冊 → 完成實名認證(個人 / 企業都行)。實名是必須的,不實名不能領試用額度。
2. 建立並複製 API Key
登入後進 控制台 → API 管理 → 建立 API Key。複製 Key 到剪貼簿(形如 abcdef123456.xyz)。Key 只顯示一次,請立刻儲存到 1Password / 系統鑰匙串。
3. 確認 Hermes 版本 ≥ v0.9.5
GLM Provider 原生支援是 v0.9.5 引入的。終端跑 hermes --version 確認。版本低的先 hermes update(詳見 /install)。
準備就緒。下一節直接 3 步把 GLM 接入 Hermes。
配置檔案在 ~/.hermes/config.toml,但你不用手動編輯,全部用 CLI 完成。
hermes config set provider zhipu把預設 LLM Provider 切到智譜。Hermes 內建 zhipu 介面卡,直接走官方 OpenAI 相容介面。
1. 切換 Provider
上面那條命令一跑,~/.hermes/config.toml 裡的 [llm].provider 欄位會改成 zhipu,並在 [llm.zhipu] 節佔好位。
2. 寫入 API Key
跑 hermes config set provider.zhipu.api_key "你的_API_KEY"(注意雙引號,Key 裡可能有點號)。Key 會加密存到 ~/.hermes/secrets.toml,許可權 0600,不會被 git 誤傳。
3. 選模型 + 自檢
hermes config set provider.zhipu.model glm-4-plus(推薦:能力最強)。然後跑 hermes doctor --provider 驗證:指令碼會發一個 ping 請求,5 秒內返回 ✅ 表示通路正常。
裝完直接 hermes 啟動 Agent,跑任何任務就會走 GLM。下一節講三檔模型怎麼選、要花多少錢。
智譜按 token 計費,輸入和輸出分別按價。當前主流三檔模型適合的場景與價格如下(2026-05 資料):
上面的數字會隨智譜定價策略調整,最新價格請以智譜開放平臺「價格說明」頁為準 → https://open.bigmodel.cn/pricing 。Hermes Agent 不參與計費,所有費用直接結算到智譜賬戶。
GLM-4 vs Claude / GPT-4 / Kimi 在 Hermes Agent 實際場景的對比。資料基於 Hermes 團隊 2026-04 在國內 4 臺機器上的實測(每條任務跑 50 次取均值),僅供選型參考。
結論:日常 + 國內場景用 GLM-4-Plus 或 Air;需要超長上下文(>200K)用 Kimi;寫大量英文程式碼 + 預算充足用 Claude。Hermes 支援多 Provider 共存,按 Skill 切換詳見 /docs。
把 GLM 接入 Hermes 之後,下面 4 條經驗能讓你少踩坑、賬單可控、效果更好。
配合 Hermes Memory 模組(詳見 /docs#memory)使用,可以把高頻上下文壓縮到 5K 以內,長會話場景下賬單能再降 60%。
日常使用中遇到 GLM 報錯,90% 是下面 5 類。挨個對照即可。
401 Unauthorized / Invalid API key
原因 / Cause: API Key 複製時多了空格、引號、換行;或 Key 沒有從對應賬號生成;或長時間不用被自動停用。
修复 / Fix: 到開放平臺後臺重新建立一個 Key,跑 hermes config set provider.zhipu.api_key "新KEY"。注意雙引號是英文引號、Key 不要帶任何前後空格。
429 Too Many Requests / Rate limit exceeded
原因 / Cause: RPM(每分鐘請求數)超限。免費使用者 5 RPM 很快就撞牆,Gateway 模式下併發任務尤其容易。
修复 / Fix: 短期:在 Hermes 里加全侷限流:hermes config set llm.zhipu.rpm 4(留 1 個 buffer)。長期:到開放平臺後臺 → API 管理 → 提工單申請提 RPM,付費使用者一般 24 小時內拉到 600。
Insufficient balance / 賬戶餘額不足
原因 / Cause: 試用額度耗光或預付費扣到 0。
修复 / Fix: 開放平臺「賬戶中心」→「我的賬戶」→「充值」。建議留 50 元緩衝,避免半夜跑長任務時停服。可設餘額低於 10 元郵件告警。
Model not found: glm-4-plus / glm-4-air
原因 / Cause: 模型名拼錯;或者你的賬號還沒有這個模型的訪問許可權(部分新模型預設不開放)。
修复 / Fix: 到 https://open.bigmodel.cn/dev/api 看當前你賬號可用的模型 ID 列表,複製到 hermes config set provider.zhipu.model <正確ID>。GLM-4-Flash 偶爾需要在「開通服務」頁手動開通。
Timeout after 60s / 上下文超長
原因 / Cause: 128K 上下文塞太滿,模型推理超時;或者網路中轉抖動。
修复 / Fix: 先 hermes context summarize 壓縮當前會話;如果是非 RAG 場景大文件,改用流式輸出 hermes config set llm.zhipu.stream true。仍超時考慮切到 Kimi-128k,詳見 /providers/kimi。
Kimi-1M 處理大型程式碼庫 / 長合同 / 研究文件場景,與 GLM 共存。
看 Kimi 配置Hermes Skills 系統:Skills Hub、自學習機制、與 GLM 函式呼叫配合。
看 Skills 指南hermes config / hermes skills / hermes gateway 等 50+ 命令分類速查。
看 CLI 手冊與 v2026.9.14 同步的完整中文文件,含安裝、Skills、Memory、Gateway。
主文件