Skip to content

常见问题

这里汇总了客户最常问到的问题。如果没找到答案,可以看故障排查联系客服

🔥 Hermes Agent 接入指南

近期很多用户在用 Hermes Agent 接入 AI通道,这里统一说明:

基本配置

Hermes 使用 OpenAI 兼容格式,配置时注意:

  • Base URLhttps://ai.aitongdao.com/v1(必须带 /v1,不带会报错)
  • API Key:后台生成的 sk- 开头的令牌
  • 分组:选 claude(不要选 ccmax,ccmax 只能在 Claude Code 客户端使用)

模型名称

手动输入完整名称,不支持缩写:

claude-opus-4-8
claude-opus-4-8-thinking
claude-sonnet-4-6
claude-haiku-4-5

启动后可以用 /model claude-sonnet-4-6 切换模型。

常见问题

配置后无法使用 / 报错? → 检查 URL 是否带了 /v1。Hermes 走 OpenAI 兼容协议,不带 /v1 会 404。

不能同时添加两个不同分组的 Key? → 一个配置只能绑一个 Key。如果需要多个分组,分别配置不同的 endpoint。

能用 ccmax 分组吗? → 不能。ccmax 专供 Claude Code 客户端,Hermes 请用 claude 分组,模型和上下文完全一样,价格还更低。

支持 KV Cache 吗? → 支持,后台日志可以看到缓存命中情况。

可以切换模型吗? → 可以,用 /model 模型名称 切换。所有 claude 分组支持的模型都能用。


价格与计费

什么价格?怎么计费?

按量计费,用多少扣多少。充值基准 1 人民币 = 1 美元,不同分组有不同倍率。各分组实时倍率与每个模型的具体单价见 价格页(会随上游调整,本 FAQ 不维护具体数字)。

分组适合谁
claude日常编码,大多数用户首选
ccmax(满血)Claude Code 重度用户,需要 1M 上下文
codexCodex CLI / GPT 系列用户
geminiGemini CLI 用户

倍率是什么意思?

倍率是在官方美元价基础上的折扣系数:N× 表示你花 N 元人民币 就能用到 官方 1 美元 的额度,倍率越低越划算。

常见误解

倍率不是"每百万 token 多少元"。token 单价取决于你用的模型(opus 比 haiku 贵很多),倍率是在官方价基础上的统一折扣系数。

充 10 块就相当于 10 美元的额度吗?

是的,1 人民币 = 1 美元基准,再按你使用分组的倍率折算成官方额度(10 ÷ 倍率)。当前倍率见 价格页

100 万 token 大概多少钱?

取决于模型和分组。每个模型的实时单价(¥/百万 token,输入/输出/缓存分列)都在 价格页,公式为:模型倍率 × ¥2/M 基准 × 分组倍率。

有套餐/月卡吗?

目前按量计费,暂未推出月卡。我们的 token 单价本身已经很低了。

别的中转站几毛钱一刀但倍率 10 倍,你们怎么比?

那是虚标。折算到实际成本是一样的甚至更贵:比如 0.1 元充值汇率 × 10 倍率 = 1 元/美元。看"充值汇率 × 分组倍率"的最终结果,不要只看单一数字;我们的实时倍率见 价格页

充值与付款

怎么充值?

目前通过微信转账充值:

  1. 微信转账给客服,告知充值金额
  2. 收到 兑换码(CDK)
  3. 登录 aitongdao.com钱包 → 粘贴兑换码 → 确认

在线自助充值正在开发中。

支持支付宝吗?

支持,联系客服即可。

额度会过期吗?

正常充值的余额永久有效,没有有效期。活动赠送的额度以活动规则为准。

可以开发票吗?

不支持开票。对公付款或企业采购请充值前先联系客服确认。

可以退款吗?

未使用的余额可以退款,已消费的无法退回。联系客服处理。

逆向版 vs 满血版

逆向和满血有什么区别?

底层是同一个模型,区别在于渠道和上下文长度:

满血版(ccmax)逆向版(claude)
模型同款同款
上下文1M tokens1M tokens
价格(倍率)较高(实时见价格页较低(实时见价格页
适合场景Claude Code 重度用户日常编码,性价比高

两者模型和上下文长度完全一致,区别只在价格。大多数用户选 claude 分组就够了。

逆向版稳定吗?

够用。我们的企业用户消耗量大,大部分都用逆向版。如果需要最高稳定性,可以走 AWS 通道,但价格会贵不少。

逆向版效果会不会差一些?

不会,底层是同一个模型,上下文长度也一样(均为 1M),区别只在价格。

账号与 API Key

API Key 在哪里创建?

登录 aitongdao.com → 点顶部的令牌添加令牌。创建时选择分组,生成后复制 sk- 开头的 Key。

不同工具可以共用同一把 Key 吗?

技术上可以,但建议每个工具单独建一把 Key

  • 每把 Key 可以单独设额度上限
  • 泄漏时影响面可控
  • 后台日志能区分每个工具的消耗

分组选错了怎么办?

进入令牌页 → 找到对应的 Key → 点编辑 → 切换分组即可。

常见问题

ccmax 分组只能在 Claude Code 客户端使用。如果你用 Hermes Agent、Trae 等第三方工具调 Claude,应该选 claude 分组。选错了会报 403。

配置与接入

Base URL 该填什么?

协议/工具Base URL
Claude Code、Anthropic SDKhttps://ai.aitongdao.com
Codex CLI、OpenAI SDK、Hermes Agenthttps://ai.aitongdao.com/v1
Gemini CLIhttps://ai.aitongdao.com

注意

OpenAI 兼容格式的工具(Codex、Hermes 等)URL 末尾必须加 /v1,否则会报 404。

模型名称怎么填?

必须使用完整的模型名称,不支持缩写:

正确写法错误写法
claude-opus-4-8opus-4.8
claude-sonnet-4-6sonnet4.6
claude-haiku-4-5haiku
gpt-5.5

可以用 /model claude-opus-4-8 在 Claude Code 中切换模型。

需要翻墙吗?

不需要,国内直连。

需要 Claude 官方账号吗?

不需要。AI通道是独立的中转服务,直接注册 aitongdao.com 即可,不需要 Anthropic 官方账号或国外手机号。

可以在 VS Code 里用吗?

可以。安装 Claude Code 扩展或其他 AI 编程插件后,配置 Base URL 和 API Key 即可接入。

上下文与缓存

中转支持 Prompt Cache 吗?

支持。后台的使用日志里可以看到缓存命中情况。

额度怎么感觉用得很快?

几个常见原因:

  1. 上下文太长:200K+ 的上下文,即使有缓存,一次调用也要几毛钱。
  2. 缓存失效:超过 5 分钟不活动,缓存会过期。下次调用要重新创建缓存,费用较高。
  3. 用了贵的分组/模型ccmax + Opus 4.8 是最贵的组合,日常编码建议用 claude 分组。
  4. 插件太多:一些工具的插件会在系统提示里塞很多内容,占用 token。

建议

  • 经常压缩上下文(Claude Code 里用 /compact
  • 小任务用新会话,不要在一个超长会话里做所有事
  • 日常用 claude 分组 + 逆向版本,性价比最高
  • 后台日志页可以看每次调用的 token 消耗明细

压缩上下文会影响推理质量吗?

会有轻微影响,但利大于弊。不压缩的话上下文越来越长,不仅贵,模型的注意力也会被稀释。建议完成一个模块后就压缩或开新会话。

会话可以 resume 吗?

可以。Claude Code 的 session 存在本地,跟中转通道无关。但注意:如果中途切换了不同的 API 渠道(比如从逆向切到满血),可能会因为签名不一致导致 resume 失败。

常见错误

错误原因解决
403 "no access to model"分组选错了(如 codex 分组调 Claude)编辑令牌,切换到正确分组
404Base URL 缺少 /v1,或模型名称拼错检查 URL 和模型名
429触发限流或上游容量不足降低并发,稍后重试
500 / 503上游服务临时异常等待恢复,持续出现请联系客服
一直弹登录页环境变量没设置检查 ANTHROPIC_BASE_URLANTHROPIC_AUTH_TOKEN

更多排查步骤见故障排查

仍然没解决?

AI通道 · 让国内开发者直连全球 AI 模型