回到 GLM 主指南
GLM-4 是日常 / 短上下文场景首选,与 Kimi 多 Provider 并存。
看 GLM 配置Hermes Agent 长上下文 LLM 指南
Kimi (Moonshot) 是 Hermes Agent 在国内的长上下文首选 LLM:8K / 32K / 128K / 1M 多档窗口,适合处理大型代码库、长合同、研究文档对话场景。本文给出 API Key 申请、Hermes 接入命令、模型选择策略与 5 大实际使用场景。
Kimi 由 Moonshot AI 开发,是国内最早把长上下文能力做成卖点的大模型。对 Hermes Agent 用户来说,它的价值场景非常清晰:当 GLM-4 / Claude 的 128K-200K 窗口被塞满之后,Kimi-1M 接力。
Kimi 不是 GLM 的替代品,而是补充。建议:日常用 GLM-4-Plus,遇到 60K+ 上下文任务切到 Kimi。Hermes 支持多 Provider 同时配置,按需切换。
Moonshot 开放平台和智谱流程相似,5 分钟内可以走完。
1. 注册 Moonshot 开放平台
访问 https://platform.moonshot.cn → 手机号注册 → 完成实名认证。企业用户走「企业认证」可拿更高的 RPM 上限。
2. 生成并复制 API Key
登录后 → 账户设置 → API Key 管理 → 新建 API Key。复制 Key(形如 sk-xxxxxx)到密码管理器,Key 仅出现一次。
3. 充值(可选)
新用户送 15 元免费额度。Kimi-128k 输入约 0.060 元/千 tokens,免费额度大约够 25 万 tokens(约一个中型 PDF)。继续用需要在「财务中心」充值,最低 10 元起。
建议先用试用额度跑一两个长上下文任务感受效果,再决定是否充值。
Hermes 内置 moonshot 适配器,走官方 OpenAI 兼容接口。3 条命令搞定。
hermes config set provider.moonshot.api_key "你的_KIMI_KEY"写入 Moonshot Key 到 ~/.hermes/secrets.toml(加密 0600 权限)。注意双引号是英文双引号。
1. 写入 API Key
上面那条命令一跑,Key 就加密落盘,不会出现在 git diff 里。多 Provider 并存的场景下 Kimi 和 GLM 的 Key 可以同时配置、互不干扰。
2. 选默认模型
hermes config set provider.moonshot.model moonshot-v1-128k(推荐:128K 上下文 + 性价比最佳)。如果偶尔需要超长场景再切到 moonshot-v1-1m。
3. 切到 Kimi 或保持多 Provider
想全局切到 Kimi:hermes config set provider moonshot。想保留 GLM 默认、仅在长上下文场景临时用 Kimi:在 Skill 的 meta.yaml 里加 provider_override: moonshot(详见 /skills)。
配置完跑 hermes doctor --provider 自检,5 秒内看到 ✅ 表示通路正常。
Moonshot 当前对外开放 4 档模型,按上下文窗口和价格区分。表面看都是 Kimi,性能与价位差异巨大,选错档可能多花 10 倍钱。
选型建议:默认 moonshot-v1-128k;只有遇到「单次必须 > 80K」的明确场景才升到 1M。最新价格请以 Moonshot 平台「计费说明」页为准 → https://platform.moonshot.cn/docs/pricing 。
把 Kimi 接入 Hermes 之后,下面 5 类任务是它真正发挥优势的地方。每条都对应一个 Hermes Agent 内置 / 推荐 Skill。
如果你的日常任务都在 60K tokens 以下,没必要切 Kimi——GLM-4-Plus 更便宜、更快。只在「明确需要长上下文」时拉 Kimi 出来用。
Kimi 日常使用 4 类报错最常见。挨个排查即可。
context_length_exceeded / 上下文超长
原因 / Cause: 当前对话或单次请求的 token 数超过了选定模型的窗口。比如选了 moonshot-v1-8k 但塞进去 12K 的内容。
修复 / Fix: 两个选择:(a) 升档:hermes config set provider.moonshot.model moonshot-v1-128k;(b) 压缩:hermes context summarize 把历史会话压缩。如果确实需要 > 128K,切到 moonshot-v1-1m。
Model not found / 模型不可用
原因 / Cause: 账号没有开通该模型的访问权限。moonshot-v1-1m 默认是「申请制」开通。
修复 / Fix: Moonshot 控制台 → 服务开通 → 申请开通 1M 模型。审核通常 1-2 个工作日。如果是 128k 之类的常规模型,确认账号已实名认证。
401 Invalid API key
原因 / Cause: Key 复制错误、过期、或者在其他账号下生成。
修复 / Fix: 重新到控制台生成 Key,跑 hermes config set provider.moonshot.api_key "新KEY"。注意 Moonshot Key 前缀是 sk-,不要漏掉。
429 Rate limit / TPM exceeded
原因 / Cause: Moonshot 按 TPM(tokens per minute)限流,而不只是 RPM。长上下文请求一次就消耗大量 TPM,更容易撞墙。
修复 / Fix: 到控制台「账户中心」→「速率限制」查看当前 TPM 上限并申请提升。临时方案:hermes config set llm.moonshot.concurrent 1 串行化请求,等业务量上来再付费提额。