查询直连卡用量 直连卡 DIRECT

直连卡与智谱卡是两种卡种,账户互不通用。用哪种卡的 Key 就进哪个面板; 智谱卡点此进原面板 →

模型广场 · 分项计价 ¥/百万 tokens
模型输入缓存命中输出
登录后显示该卡可用模型与实时价目

扣减公式:额度点 = ⌈(输入×输入价 + 缓存命中×缓存价 + 输出×输出价) × 时段倍率⌉。 缓存命中的 token 只按约 1/10 的缓存价计费——agent 重缓存场景下显著省钱。

客户端配置

OpenAI 兼容客户端(Cursor / ChatBox / OpenCode 等)填以下两项即可:

Base URL:  https://ai.shimiaocheng.top/dc/v1
API Key:   sk-...
Claude Code(/v1/messages 协议)
export ANTHROPIC_BASE_URL=https://ai.shimiaocheng.top/dc
export ANTHROPIC_AUTH_TOKEN=sk-...
模型选直连卡列表中的 claude 系精确名(如 claude-opus-5)。 直连卡不支持兼容简写:claude-sonnet / claude-opus 等短名是智谱卡兼容层,直连卡会被拒绝(400 model_not_in_plan)。必须用完整精确模型名。
codex / OpenAI SDK
OPENAI_BASE_URL=https://ai.shimiaocheng.top/dc/v1
OPENAI_API_KEY=sk-...
模型用直连卡列表中的精确名(如 gpt-5.2kimi-k3)。 glm-* 系模型属智谱卡范围,直连卡不可调用。
curl 直测
curl https://ai.shimiaocheng.top/dc/v1/chat/completions \
  -H "Authorization: Bearer sk-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [{"role":"user","content":"hi"}]
  }'
常见问题
直连卡和智谱卡有什么区别?
两种独立卡种,账户互不通用。智谱卡按调用次数 + 时段倍率计费,模型为 glm 系;直连卡按 token 分项计价(输入/缓存/输出三价目),可调用 claude / gpt / kimi / deepseek 等直连模型,经第三方服务商(aig-ai)转发。
三价目怎么算钱?
每条调用:扣减点数 = ⌈(输入token×输入价 + 缓存命中×缓存价 + 输出token×输出价) ÷ ¥0.1⌉。缓存命中的 token 按约 1/10 的缓存价计——重缓存的 agent 用户(Claude Code 等)实际支出远低于按输入全价。
有高峰时段倍率吗?
当前为平价计费(无高峰倍率)。若启用高峰倍率,将在上方模型广场显著标注「高峰时段扣减 ×K」及具体时段。
5h / 周限额是什么?
直连卡无上游窗口概念,5h / 周限额是平台风控止损线(防异常刷量),正常使用远不会触顶。额度点余额才是可用余额。
429 错误怎么区分?
额度点耗尽或 5h/周风控触顶会返回 429 quota_exceeded(看面板余额);并发超限返回 429 concurrency_limit_exceeded(稍后重试即可);上游服务商限流返回的 429 通常数十秒内自愈。
隐私说明
直连卡的请求内容经第三方服务商(aig-ai)转发至最终模型厂商,请勿在请求中包含敏感个人信息。