毫秒级 Token 流水
输入、输出、上下文缓存逐项分账,每笔调用可追溯、逐笔可对账。
每一次调用按输入、输出、缓存逐项计账,配合三层预算熔断与多维成本拆解,企业 AI 开支笔笔有据。
输入、输出、上下文缓存逐项分账,每笔调用可追溯、逐笔可对账。
工作空间、成员、API Key 各设硬性上限,触顶即刻拦截,没人能打穿共享余额。
按工作空间、成员、模型、Key 逐层下钻,成本分摊与用量趋势一目了然。
消费、请求、Token 三维看板配毫秒级调用日志,按模型、密钥、状态码任意下钻;OpenTelemetry 标准协议,无缝融入企业既有观测体系。

从单打独斗到多部门协作,「租户 - 工作空间 - 成员」三级身份矩阵,配合角色授权与全程管理审计,建空间、分权、加人平滑扩展,无需推倒重来。
模型黑名单、IP 白名单与三层预算护栏编织进每一次调用,越界请求在网关层被拦下,命中哪条规则、为什么被拦,日志里直接可查。
自主圈定禁调模型,越权调用在网关层硬拦截,可用范围锁死在企业安全域内。
白名单限定调用来源,只允许受信 IP / CIDR 发起请求,密钥即使泄露也调不通。
全局、个人、Key 三层策略叠加,更严者生效,任何一层触线即拦、命中原因可查。
提供 OpenAI / Anthropic 标准协议的完美兼容,只需替换 base_url 与 API Key 即可即刻迁入,支持 cURL、Python、Node 等多语言接入。
from openai import OpenAI client = OpenAI( base_url="https://api.modelgo.com/v1", # 仅需替换此行网关地址 api_key="mg-xxxxxxxxxxxx", ) resp = client.chat.completions.create( model="deepseek-chat", # 换模型只需修改参数名称 messages=[{"role": "user", "content": "您好,ModelGo"}], ) print(resp.choices[0].message.content)
一条命令,把 ModelGo 网关一键接入 Claude Code、Codex 等 12 个主流 AI 编程客户端——粘贴 Key 即用,自动写入配置并验证连通,国内 / 国外双站用 -r 区分。