My Token Exchange for AI

myTEA 一个 API,接入所有模型,
让每个 Token 都更高效。

One API. Every Model. Every Token Optimized.

多模型统一接入与智能 Token 路由平台 AI Model Gateway & Intelligent Token Router
所有模型服务由 myTEA 自建、自营、自保障

quickstart.sh
# 存量代码只需改 base_url,一把 Key 调用全部模型
curl https://api.mytea.ai/v1/chat/completions \
  -H "Authorization: Bearer $MYTEA_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role":"user","content":"..."}]
  }'
model: "auto" —— 把选型交给 myTEA,按成本 / 延迟 / 质量自动路由。
≈1.2EFLOPS
自营算力(FP16 稠密)
984GPU
H200 × 800 + B300 × 184
≈166TB
HBM 总显存
1API
OpenAI 兼容,接入全部模型
About myTEA

myTEA 是面向企业和开发者的
多模型接入与 Token 智能路由平台

不是"再多一个模型入口",而是一个可靠、可验证、可控成本的统一入口。所有模型服务由 myTEA 自建、自营、自保障。

My

属于每个开发者 / 企业的个性化 AI 基础设施

你的网关、你的策略、你的账本。

私有网关 · 自定义策略
Token

AI 推理服务的基本计量与调度单位

所有模型、所有节点,用同一把尺子计量。

统一计量 · Token 级路由
Exchange

在不同模型、节点、渠道之间交换与路由

把 Token 当成标准化的算力货币来调度与结算。

智能路由 · 统一结算
AI

统一提供各类模型能力

自营开源旗舰模型 + 闭源厂商官方直连。

自营模型矩阵 · 官方直连
The Problem

企业用 AI 的四个现实痛点

01

模型太多、变化太快

每季度都有新模型,团队没精力逐一评测、逐一对接。

02

价格不透明、账单分散

多家供应商、多种币种、多套计费口径,财务难对账。

03

稳定性不可控

限流、排队、区域不可用时有发生,业务只能被动等待。

04

"拿到的是不是真模型"说不清

转发层层加码,上下文被截、缓存被偷换,用户无从验证。

企业需要的不是"更多模型入口",而是一个可靠、可验证、可控成本的统一入口

Two Models

市场上的两种模式:开放平台 vs 自营

开放平台解决"有没有";自营解决"稳不稳、真不真、贵不贵"。

OpenRouter 淘宝开放平台 vs myTEA 京东自营
维度OpenRouter(开放平台)myTEA(自营)
模式聚合市场:路由到第三方供应商全链路自营:自有算力 + 自部署模型 + 自研网关
模型来源60+ 外部供应商入驻自建推理集群 + 闭源厂商官方直连
算力不持有算力自有 GPU 集群(H200 / B300)
质量与 SLA取决于各供应商平台统一,端到端负责
价格逻辑供应商定价 + 平台手续费成本可控,阶梯预付透明
可验证性弱(多跳转发)强:探针验证 + 调用审计

淘宝模式把风险留给商家和买家;自营模式把风险留给自己,把确定性交给客户

Product

产品全景:三层一体

接入、路由、交换三层合一,运行在 myTEA 自营推理集群与闭源厂商官方 API 直连通道之上。

接入层Access

一个 API,OpenAI 兼容协议。一把 Key 调用全部模型,存量代码只改 base_url

MaaS
路由层Routing

按价格 / 速度 / 质量 / 上下文智能选型,模型或节点故障自动切换,支持企业自定义策略。

Model Router · Token Router
交换层Exchange

统一充值、阶梯定价、多币种结算;用量看板、审计与探针一应俱全。

Token Exchange
▼ 运行在 myTEA 自营推理集群 + 闭源厂商官方 API 直连通道 之上 ▼
一个 API 接入多个模型MaaS
自动选择最合适的模型Model Router
按价格、速度和质量分配请求Token Router
统一充值、计费和结算Token Exchange
模型故障自动切换Reliability Layer
企业自定义模型路由策略Private AI Gateway
Architecture

技术架构

所有请求经 Gateway 完成调用与计量;路由引擎按任务特征与企业策略选模型、选节点。

企业 / 开发者应用OpenAI 兼容 API · SDK · Key 管理
myTEA Gateway
鉴权限流计量审计探针
智能路由引擎 — 策略:成本 / 延迟 / 质量 / 上下文长度 / 合规
▼     ▼     ▼
自营推理集群 A
Kimi K3 / GLM-5.4
NVIDIA H200 节点
自营推理集群 B
DeepSeek V4 等
NVIDIA B300 节点
官方渠道直连
Claude / OpenAI 等闭源模型
原厂 Key · 不二次转发 · 国内可直接调用
统一结算 · 用量看板 · 对账 · 多币种(USD / CNY / …)
  • Gateway:所有请求经网关完成调用与计量,一把 Key 用所有模型。
  • 路由引擎:按任务特征与企业策略选模型、选节点;节点或模型异常时秒级切换。
  • 自营集群:模型由 myTEA 自部署、自运维,版本、精度、上下文长度全部可控。
  • 官方渠道直连:对闭源旗舰模型,以原厂 Key 直连官方 API,不替换模型、不转发;国内可直接调用。
Why Self-Operated

为什么坚持自营

自营带来的六种确定性 —— 从网关到 GPU 都是自己的,才能对结果负责。

01

端到端 SLA

从网关到 GPU 都是自己的,故障可定位、可承诺。

02

价格可控

没有中间商层层加价,阶梯折扣直接给到客户。

03

模型一致性

客户调用的就是我们部署的那个版本,不被偷换、不被降级。

04

数据与合规

请求不出自营链路,可按区域 / 行业提供数据驻留方案。

05

可验证

探针服务 + 调用日志,客户可自行核验上下文长度与缓存行为。

06

可私有化

同一套网关与路由,可部署进企业 VPC / 机房。

Core Capabilities

三大核心能力

统一接入MaaS · One API, Every Model

一个 API Key,调用全部模型。OpenAI Chat Completions 兼容,存量代码只改 base_url

  • 提供 Python / Node / Java / Go SDK,适配 LangChain、LlamaIndex 等框架。
  • 模型目录统一:命名、上下文长度、价格、限额、可用区域一目了然。
  • 企业级 Key 管理:子 Key、项目配额、按部门 / 按应用分账。
  • 流式输出、函数调用、JSON 模式、思考模式全部支持。

Supported

OpenAI 兼容协议 — 只改 base_url 即可迁移
Streaming 流式输出
Function Calling 函数调用
JSON Mode 结构化输出
Thinking Mode 思考模式
子 Key / 配额 / 分账 企业级 Key 管理

智能 Token 路由Model Router · Token Router

不同模型像不同茶叶:有的提神、有的回甘、有的便宜耐泡。myTEA 按任务"调配"。

  • 模型 / 节点故障 自动切换,对客户透明。
  • 支持 优先级 + 回退链(primary → fallback1 → fallback2)。
  • 企业可 自定义路由策略:固定模型、权重分流、预算封顶、灰度实验。

Routing Dimensions

成本同等质量下优先低价模型 / 低价节点
延迟按 TTFT / 吞吐实时打分,避开拥塞节点
质量按任务类型(代码、摘要、对话、抽取)选择最擅长的模型
上下文按输入长度自动匹配上下文窗口足够的模型
合规按客户策略限定区域、模型白名单
primaryfallback1fallback2

Token Exchange统一结算 · Unified Billing

把 Token 当成"标准化的算力货币"来买卖、调度和结算 —— 这就是 Exchange。

  • 一处充值,全模型通用:预付费余额按 Token 统一扣减。
  • 阶梯折扣:按月度用量自动升档;大客户合同价。
  • 多币种结算:USD 为主,支持 CNY 等。
  • 发票与合同:企业合同、月结、发票齐全。

Exchange Console

用量看板按模型 / 项目 / Key / 日期多维统计,支持导出对账
预算与告警预算封顶、阈值告警、自动降级到低成本模型
阶梯折扣月度用量自动升档,折扣直接体现在账单
多币种USD 为主,支持 CNY 等结算方式
Compute & Models

自营算力与模型矩阵

旗舰级开源模型 + 旗舰级算力,自部署、自运维,客户调到的就是完整版本。

自营推理集群(华南)规模单卡显存算力
NVIDIA H200100 台 · 800 卡141 GB HBM3e≈ 791 PFLOPS
NVIDIA B30023 台 · 184 卡288 GB HBM3e≈ 414 PFLOPS
合计123 台 · 984 卡≈ 166 TB HBM≈ 1.2 EFLOPS
≈1.2EFLOPS
FP16 稠密;稀疏加速下约 2.4 EFLOPS
≈166TB
HBM 总显存

* 算力按每台 8 卡、FP16 / BF16 稠密算力折算,实际以交付配置为准。

已部署模型矩阵 FLAGSHIP MoE

Kimi K3月之暗面 · 旗舰级 MoE
自营 · H200
GLM-5.4智谱 · 旗舰级 MoE
自营 · H200
DeepSeek V4深度求索 · 旗舰级 MoE
自营 · B300
Qwen 等按客户需求少量部署
按需
Claude / OpenAI 等闭源旗舰模型 · 原厂 Key 官方直连 · 国内可直接调用
官方直连
Transparent & Verifiable

透明可验证:让客户"看得见"

全部经网关

所有请求在 myTEA Gateway 完成调用与计量,账单与日志一一对应。

探针服务

客户可随时测试 Context 长度、缓存命中、响应特征,核验模型真实性。

原厂直连约定

闭源模型流量在合同中约定直连原厂 API,使用原厂 Key,不替换、不二次转发。

调用审计

每次调用可追溯模型版本、节点、耗时、Token 数。

SLA 承诺

可用性、延迟指标写入合同,未达标按约定赔付。

Pricing

参考定价模式

预付费,USD 结算为主。示例数字仅作说明,最终价格与额度以合同为准。

A · 自营旗舰模型

按 Token 计价 + 月度阶梯

模型输入 / 输出
$ / M tokens
$1K–10K
/ 月
> $10K
/ 月
Kimi K32.50 / 12.509 折8 折
GLM-5.40.60 / 2.009 折8 折
DeepSeek V40.40 / 0.809 折8 折

对比锚点:Kimi K3 原厂 / OpenRouter 列表价 $3.00 / $15.00(数据 2026-07)。

B · 官方渠道直连

闭源模型,原厂价折扣

Claude / OpenAI 等闭源模型,以原厂 Key 直连官方 API,按原厂列表价折扣;国内可直接调用

$1K–10K / 月 9 折> $10K / 月 8 折
咨询直连方案
C · 企业私有网关 / 专属算力

包月节点或私有化部署

同一套网关与路由,可部署进企业 VPC / 机房;或包月专属 GPU 节点,按需报价。

包月节点私有化部署数据驻留
获取报价
How to Start

合作流程:三步上线

STEP 1

确认需求并签约

确认模型、月度用量、渠道与直连要求,签署合同。

STEP 2

预付并开通网关

完成预付,开通 myTEA Gateway 与 Key,配置路由策略。

STEP 3

上线与验证

开始调用;按需启用探针服务与 SLA 监控。

FAQ
必须经过 myTEA Gateway 吗?
是,所有请求经网关完成调用与计量,账单与日志一一对应,这是可验证与统一结算的前提。
可以保证直连原厂吗?
可以,指定流量可在合同中约定直连原厂 API、使用原厂 Key,不替换模型、不二次转发。
探针测什么?
Context 长度、缓存命中、响应特征,并结合调用记录验证模型真实性与一致性。
使用原厂 Key 和用 myTEA 一把 Key 调用所有模型冲突吗?
不冲突。客户侧始终只用一把 myTEA Key;对闭源模型,Gateway 在后端以原厂 Key 直连官方 API 完成调用与计量,客户无需维护多家厂商账号。
支持私有化部署吗?
支持。同一套网关与路由引擎可部署进企业 VPC / 机房,也可按月包专属 GPU 节点。
Different models have different strengths.
myTEA blends and routes them for every task.

不同模型各有所长,
myTEA 根据每项任务,自动调配最适合的模型。

申请接入或索取完整方案与报价,我们将在一个工作日内回复。