模型管理

云团网关统一接入模型服务,开箱即用、按积分计费、自动故障转移。

CodeMama 的模型能力由云团网关统一提供。你不需要配置任何上游服务商的 API Key,模型列表由云端实时下发,登录即可使用。

模型从哪来?

  • 模型由管理端统一维护,桌面端在线拉取,新增模型无需更新应用
  • 所有请求经由云团网关(api.yuntuan.ai/v1)转发到上游模型服务
  • 上游密钥由服务端保管加密存储,桌面端不接触任何上游凭证,安全可控

提示

对话中发现模型列表更新了?说明云端刚上线了新模型。模型在对话中可随时切换,不影响已生成的内容。

选择与切换模型

在对话输入框附近打开模型选择器:

  • 列表展示模型名称、能力类型与积分价格(输入/输出单价)
  • 常用模型可固定为默认,新会话自动使用
  • 切换模型即时生效,当前会话上下文保留
场景 推荐模型类型
日常对话、代码生成 旗舰通用模型
长文档、小说创作 长上下文模型
简单问答、草稿 轻量高性价比模型

计费规则

模型按 积分 计费,规则如下:

  • 价格以「每百万 token 消耗」为单位,输入与输出分别计价
  • 展示价格为积分;汇率由管理端统一配置(默认 1 积分 ≈ 0.007 人民币)
  • 每次对话结束后,用量实时入账并从账户余额扣减

说明

计费在服务端完成:网关解析用量 → 按模型价格计价 → 写入用量记录并扣减余额,全程异步,不会阻塞对话

余额查询与充值:

  • 桌面端账户区域实时显示剩余积分
  • 余额不足时,对话会收到提示,可跳转 Web 控制台充值
  • 具体扣费明细可在 Web 账单页 按时间查询

高可用保障

网关内置多项稳定性机制,日常使用几乎无感:

  • 故障转移:主上游不可用时自动切换到备用通道
  • 熔断重试:连续失败自动熔断,指数退避重试,避免雪崩
  • 限流保护:异常高频调用返回 429,保护账户余额

注意

如对话持续失败或提示模型不可用,可能是上游服务波动。稍等 1~2 分钟重试即可;若长时间异常,可在常见问题中找到处理方式。

相关文档