Skip to content

模型渠道

渠道(provider)可以是模型端点或本地模型进程。hipmmcode 内置大型预置目录(Top + Extended),也可接任意自定义 URL。原生支持四种 HTTP wire 协议 —— OpenAI 兼容、Anthropic、Gemini、OpenAI Responses(Codex / xAI 搜索等)—— 以及本地 Claude Code 进程桥。

核心渠道(Top)

id协议base URL环境变量说明
anthropicanthropichttps://api.anthropic.comANTHROPIC_API_KEY服务端原生 web_search
anthropic-claude本地进程已安装的 claude CLIClaude Pro/Max 订阅桥
openaiopenai-compathttps://api.openai.com/v1OPENAI_API_KEY
openai-codexResponsesChatGPT Codex 后端OAuth设备码订阅登录
geminigeminihttps://generativelanguage.googleapis.comGEMINI_API_KEY原生 googleSearch 接地
deepseek-anthropicanthropichttps://api.deepseek.com/anthropicDEEPSEEK_API_KEY推荐 DeepSeek 路径 · 原生联网 · V4 Pro/Flash
deepseekopenai-compathttps://api.deepseek.com/v1DEEPSEEK_API_KEY无原生 web_search(用 AnySearch 或换 deepseek-anthropic)
qwen-token-plan-anthropicanthropichttps://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropicQWENCLOUD_TOKEN_PLAN_API_KEY推荐 Token Plan 路径 · 个人版/团队版 · sk-sp-
qwen-token-planopenai-compathttps://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1QWENCLOUD_TOKEN_PLAN_API_KEYToken Plan 个人版/团队版 · sk-sp-
kimiopenai-compatMoonshot 国际 .aiKIMI_API_KEY
kimi-cnopenai-compatMoonshot 国内KIMI_API_KEY

DeepSeek 建议模型 id(API 真名,非营销名):deepseek-v4-flashdeepseek-v4-pro,可选 deepseek-v4-pro[1m]不要把日期后缀(如 0731)当成 API model id —— 接口会拒绝。

anthropic 还支持 ANTHROPIC_BASE_URL(中转)与 ANTHROPIC_AUTH_TOKEN(bearer 别名,排在 API key 之后)。详见设置 → 环境变量

阿里云百炼:Token Plan 与按量付费

阿里云百炼的 Token Plan 和按量付费是两套独立计费产品。HiPMMCode 为每套产品分别提供 OpenAI 兼容与 Anthropic Messages 两种协议入口:

qwen-token-plan 就是 Token Plan 的 OpenAI 兼容渠道;更直观的别名 qwen-token-plan-openai 会解析到同一渠道。

渠道 id计费方式协议Base URL密钥
qwen-token-plan-anthropicToken Plan 个人版/团队版Anthropic Messageshttps://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic推荐 QWENCLOUD_TOKEN_PLAN_API_KEY;兼容 Qwen Code 的 BAILIAN_TOKEN_PLAN_API_KEY 与旧名 QWEN_TOKEN_PLAN_API_KEY;必须是 sk-sp-...
qwen-token-planToken Plan 个人版/团队版OpenAI 兼容https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1推荐 QWENCLOUD_TOKEN_PLAN_API_KEY;兼容 Qwen Code 的 BAILIAN_TOKEN_PLAN_API_KEY 与旧名 QWEN_TOKEN_PLAN_API_KEY;必须是 sk-sp-...
qwen-anthropic按量付费Anthropic Messageshttps://dashscope.aliyuncs.com/apps/anthropicDASHSCOPE_API_KEY,也兼容旧名 QWEN_API_KEY;使用 sk-...sk-ws-...
qwen按量付费OpenAI 兼容https://dashscope.aliyuncs.com/compatible-mode/v1DASHSCOPE_API_KEY,也兼容旧名 QWEN_API_KEY;使用 sk-...sk-ws-...

密钥不能跨计费产品混用:sk-sp-... 只用于 Token Plan,sk-... / sk-ws-... 只用于按量付费。HiPMMCode 也不会让这两组渠道互相回退凭证。内置预设使用北京端点;国际区可把 QWEN_TOKEN_PLAN_BASE_URL 指向 https://token-plan.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1。Token Plan 面向交互式编程与 Agent 工具,不应作为无人值守的批量后端。

bash
# Token Plan:Agent 场景优先选择 Anthropic 协议
export QWENCLOUD_TOKEN_PLAN_API_KEY='sk-sp-...'
hipmmcode model qwen-token-plan-anthropic
hipmmcode chat -p qwen-token-plan-anthropic -m qwen3.8-max

# 按量付费:同一 DashScope key 可用于这两种协议
export DASHSCOPE_API_KEY='sk-ws-...'
hipmmcode model qwen-anthropic
hipmmcode chat -p qwen-anthropic -m qwen3.7-plus

推荐模型:qwen3.8-max 用于主 Agent 和高难度任务,qwen3.7-max 可作强力子 Agent,qwen3.7-plus 适合日常编码与性价比场景,qwen3.6-flash 适合轻量、低延迟任务。实际可用模型以阿里云控制台中的套餐或地域为准。Anthropic 兼容端点不提供 /v1/models,因此向导会使用 HiPMMCode 内置的精选列表,而不是把发现失败误报为配置失败。

qwen3.8-maxqwen3.8-max-preview 在未显式选择 effort 时默认使用 xhigh;前者可用 /effort off 关闭思考,后者始终开启。OpenAI 兼容端点会发送 reasoning_effort: xhighenable_thinkingpreserve_thinking,并把思考模式温度提升到最低 0.6。Anthropic 渠道使用对应的 Anthropic 自适应思考格式,严格网关若拒绝该字段会安全降级重试。

Token 用量与套餐 Credits

HiPMMCode 会读取响应中的 usage,保留输入、输出、缓存创建、缓存读取与推理 Token 明细。/usage 显示规范化后的会话输入/输出总量,无头 JSON 输出还会包含这些明细字段。OpenAI 兼容流式请求会启用 stream_options.include_usage;Anthropic 流式请求则使用最终 message_delta.usage。这些值是 Token 计数,不等于 Token Plan 的 Credits:Credits 还会随模型、思考和工具调用动态折算。套餐剩余 Credits、重置时间与 5 小时/7 天窗口请到阿里云百炼控制台的套餐用量详情查看,不能从普通模型响应准确推算。

图像、视频和音频生成使用各自独立的多模态生成 API,不要把生成模型放进普通聊天模型选择器。直连 qwen-token-planqwen-token-plan-anthropic 时,HiPMMCode 的原生 GenerateImage 会自动改走 Token Plan 专用端点,和 Grok Imagine 一样无需 Skill。个人版可用 wan2.7-image / wan2.7-image-pro;团队版还可逐次选择 qwen-image-2.0 / qwen-image-2.0-pro。默认使用两种套餐共有的 wan2.7-image,也可设置 HIPMMCODE_IMAGE_MODEL

原生 GenerateVideo 也会在 qwen-token-planqwen-token-plan-anthropic 上复用同一个已配置的 sk-sp-...;聊天协议不同不会改变北京专用视频端点。当前个人版和团队版都列出 happyhorse-1.1-t2vhappyhorse-1.1-i2vhappyhorse-1.1-r2v,可生成 720P/1080P、3–15 秒 MP4。新付费任务提交前会经过权限门禁;HiPMMCode 私密记录返回的 task_id、持续轮询并立即下载仅保留 24 小时的结果,恢复模式只查询同一任务而不会再次 POST。官方 Skills 仍可作为独立按量付费工作流使用。参见Token Plan 多模态生成个人版支持模型异步任务管理

原生 GenerateSpeech 同样复用直连渠道的 sk-sp-...,通过北京专用 WebSocket 调用个人版和团队版均列出的 qwen-audio-3.0-tts-plus。默认使用 Plus 兼容音色 longanlingxin、输出 MP3 22.05 kHz,也可设置兼容音色、格式、采样率、音量、语速、音高、语言提示与指令。HiPMMCode 在联网前按官方规则校验文本/指令的加权长度,在消耗 Credits 前请求确认,完整接收并校验二进制音频流,再通过固定本地输出 capability 原子落盘。参见Qwen-Audio-TTS WebSocket API与当前的Qwen-Audio-TTS 音色列表

扩展目录(节选)

hipmmcode modelMore providers… 中可见(也是 -p / /provider 的合法 id)。各自带好 base URL、协议与惯用环境变量:

id说明
xaixAI Grok API Key(XAI_API_KEY)—— 对话、Imagine 出图、Responses 联网搜索
xai-oauthSuperGrok / Premium+:设备码 OAuth(或复用 ~/.grok/auth.json)
qwen / qwen-anthropic阿里云百炼按量付费 · OpenAI 兼容 / Anthropic Messages
qwen-oauth复用外部 Qwen CLI OAuth 凭证文件;不同于百炼 API Key 渠道
dashscope / dashscope-cn阿里云百炼国际 / 国内
alibaba-coding / alibaba-coding-cn阿里 coding-plan 端点
zai / zai-cnZ.AI / GLM
minimax / minimax-cn / minimax-cn-anthropicMiniMax(含国内 Anthropic 协议)
mimo小米 MiMo
tokenhub腾讯 TokenHub
nvidiaNVIDIA API 目录
stepfun / stepfun-cn阶跃星辰国际 / 国内
openrouterai-gatewayhuggingfacecopilotcopilot-acp聚合器与 GitHub Copilot
ollamalmstudio本机 OpenAI 兼容服务
arceegmikilocodeopencodeopencode-gonous其他目录项
bedrockAWS Bedrock bearer(AWS_BEARER_TOKEN_BEDROCK)

渠道向导

bash
hipmmcode model              # 完整向导:渠道 → 认证 → 实时模型列表 → 默认模型
hipmmcode model deepseek-anthropic
hipmmcode model qwen-token-plan-anthropic # Token Plan(sk-sp-)
hipmmcode model openai-codex # ChatGPT Codex 订阅(或复用 ~/.codex/auth.json)
hipmmcode model xai-oauth    # 设备码登录(或复用 Grok CLI)

向导拉取渠道真实的 /v1/models 列表(失败时回退精选预设),并持久化 key 或 OAuth 凭证、渠道定义与 defaultProvider / defaultModel

OAuth 与订阅渠道

以下渠道不用静态 API key 认证:

渠道工作方式
Claude Code 订阅(anthropic-claude)调用本机已登录的官方 claude 进程。先运行 claude auth login --claudeai,再在 hipmmcode model 里选择 Anthropic → Claude Pro/Max subscription。非交互式可用 hipmmcode -p anthropic-claude -m 'sonnet[1m]' exec "..." 或把模型换成 opus[1m]。默认模型列表只包含这两个已验证的 1M 选项;后缀会原样传给 Claude Code,HiPMMCode 的上下文预算也按 1M 计算,最终可用性仍由官方 CLI 按账号权益判断。HiPMMCode 不读取、不复制、不保存 Claude OAuth token,该渠道也不会读取 Anthropic API/代理环境变量。这是实验性的本机兼容桥:每个模型回合都以 safe mode 启动 Claude Code、禁用其内置工具,再把工具意图交回 HiPMMCode 自己的权限/工具循环;不能作为会员网关或托管订阅中转。
OpenAI Codex(openai-codex)用 ChatGPT/Codex 订阅走设备码:向导展示 URL + 验证码,浏览器授权后 token 写入 ~/.hipmmcode/config.jsonoauthCredentials。每轮前自动刷新。再次进入向导可选 Use existing / Reauthenticate / Cancel。原生 OpenAI Responses(含联网与出图)。若本机已有 Codex CLI 的 ~/.codex/auth.json 也可被动复用。
xAI Grok OAuth(xai-oauth)https://auth.x.ai设备码登录(与 Grok CLI / Hermes 同款公开客户端)。token 存入 oauthCredentials["xai-oauth"]自动刷新(约 1 小时提前量)。若已用 Grok CLI 登录,可直接复用 ~/.grok/auth.json。覆盖对话(grok-4.5 等)、Imagine 出图Responses 联网搜索。API Key 替代方案:渠道 xai + XAI_API_KEY
Qwen OAuth(qwen-oauth)复用外部 qwen CLI 凭证(~/.qwen/oauth_creds.json)—— 先 qwen auth qwen-oauth;hipmmcode 只读并自动刷新该文件。
AWS Bedrock(bedrock)AWS_BEARER_TOKEN_BEDROCK 的 bearer 模式。完整 IAM/SigV4 不支持。

Claude 订阅桥和原生 anthropic API 渠道是两回事:它只启动用户安装的官方 CLI, 不会把 Claude.ai 登录变成可复用的 HTTP 凭据。生产、远程或高吞吐场景请继续使用 Anthropic Console API key 配置 anthropic;可用模型和额度以本机 Claude 套餐及 CLI 为准。

OpenAI Codex 快速配置

bash
# 方案 A —— 设备码登录(ChatGPT / Codex 订阅)
hipmmcode model openai-codex
# 打开打印的 URL,输入验证码,等待凭证写入

# 方案 B —— 本机已有 Codex CLI 登录(~/.codex/auth.json)
hipmmcode model openai-codex   # 无自管 token 时被动复用本机登录
# 或临时指定、不改默认:
hipmmcode -p openai-codex -m gpt-5.1-codex "hello"

xAI Grok 快速配置

bash
# 方案 A —— 设备码(无需安装 Grok CLI)
hipmmcode model xai-oauth
# 打开打印的 URL,确认验证码,等待 ✓ Logged in to xAI Grok

# 方案 B —— API Key
export XAI_API_KEY=xai-...
hipmmcode model xai

# 方案 C —— 本机已有 Grok CLI 登录(~/.grok/auth.json)
hipmmcode model xai-oauth   # 选择 Use existing credentials

运行时切换

bash
hipmmcode chat -p deepseek-anthropic -m deepseek-v4-flash
hipmmcode chat -p qwen-token-plan-anthropic -m qwen3.8-max
hipmmcode chat -p openai-codex -m gpt-5.1-codex
hipmmcode chat -p xai-oauth -m grok-4.5
hipmmcode models --all                          # 无头列出所有渠道的模型
hipmmcode models -p kimi --json                 # 单渠道,机器可读

REPL 里:

  • /model —— 两段式选择器:先渠道后模型(实时发现,带上下文窗口信息)。/model prov/model 也有 ghost 补全。OAuth 渠道在凭证就绪时出现(自管 store 或外部 CLI 文件)。
  • /provider <id> —— 切换渠道(持久化为默认)。
  • /refresh-models —— 清发现缓存。

/model 走渠道 → 模型两步,当前组合有标记:

hipmmcode
 /model

Channel  — 选一个渠道,Enter 查看其模型
  anthropic            key: config
 deepseek-anthropic  key: config  (active)
  xai-oauth            oauth
  kimi                 key: env

deepseek-anthropic — models  实时发现 / 精选回退
 deepseek-v4-flash   ctx  (active)
  deepseek-v4-pro      ctx

↑/↓ 移动 · Enter 确认 · Esc 返回

自定义渠道

任何 OpenAI 兼容、Anthropic 协议或 Gemini 协议端点都能接。交互式添加(hipmmcode modelcustom),或直接写 ~/.hipmmcode/config.json:

json
{
  "custom": {
    "my-proxy": {
      "baseUrl": "http://10.0.0.5:8080",
      "protocol": "Anthropic",
      "envVar": "MY_PROXY_API_KEY",
      "models": ["claude-opus-4-8", "claude-sonnet-4-6"],
      "headers": { "X-Team": "platform" },
      "modelOverrides": {
        "claude-opus-4-8": { "contextWindow": 200000, "maxOutputTokens": 16000 }
      }
    }
  },
  "apiKeys": { "my-proxy": "sk-..." }
}
bash
hipmmcode chat -p my-proxy -m claude-opus-4-8

字段说明:

  • protocol —— OpenaiCompat(默认)/ Anthropic / Gemini / OpenaiResponses
  • models —— 省略则实时发现;设置则钉死列表。
  • headers / headersHelper —— 静态附加头,或输出 JSON 头的 shell 命令(短期 token)。
  • envVar —— 无存储 key 时去哪个环境变量找。
  • envVars —— 在 envVar 之后按序尝试的额外环境变量名(如 Gemini 也认 GOOGLE_API_KEY,Copilot 认 GH_TOKEN/GITHUB_TOKEN)。预置目录渠道自带正确的回退列表。
  • modelOverrides —— 纠正代理误报的上下文窗口 / 输出上限。
  • oauth —— 需要浏览器登录的端点的 OAuth 配置。

自定义渠道从其协议家族继承合理默认 —— openai-compat 自定义借用 openai 的模型建议,gemini 自定义借用 gemini 的,以此类推。

模型名解析

模型名在所有入口解析一致 —— REPL、execserve、ACP:

  1. 简写 → 规范名:opussonnethaiku 这类家族别名展开为渠道的规范 id。
  2. 长上下文标记:[1m] 后缀在内部选中长上下文变体,调 API 前剥除。
  3. provider/model 形式在任何接受模型名的地方都可用(如 /model kimi/kimi-k2)。

回退与韧性

  • --fallback-model(可重复,最多 3 个)或配置里的 fallbackModels —— 主模型过载时按序尝试。
  • 瞬时故障指数退避重试;重试横幅显示原因。
  • 上下文溢出走压缩恢复而不是让回合失败。

模型元数据

上下文窗口、输出上限、模态支持(视觉 / 视频)来自内置的 models.dev 元数据层,随发现缓存刷新。可用 modelOverrides(自定义渠道)或 <provider>.modelOverride.<model>.… 配置键逐模型覆盖。

推理力度

bash
hipmmcode config set effort=high      # off / low / medium / high / max

或运行中执行 /effort high。按各协议的原生方式生效(reasoning token、adaptive thinking)。deepseek-anthropic 的主 Agent 与子 Agent 默认均为 max;Codex 类渠道默认 high,其他渠道保持原有默认行为。显式执行 /effort off 始终会关闭 DeepSeek 的思考。