myTEA
一个 API,接入所有模型,
让每个 Token 都更高效。
多模型统一接入与智能 Token 路由平台
AI Model Gateway & Intelligent Token Router
所有模型服务由 myTEA 自建、自营、自保障。
# 存量代码只需改 base_url,一把 Key 调用全部模型
curl https://api.mytea.ai/v1/chat/completions \
-H "Authorization: Bearer $MYTEA_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "auto",
"messages": [{"role":"user","content":"..."}]
}'
model: "auto" —— 把选型交给 myTEA,按成本 / 延迟 / 质量自动路由。myTEA 是面向企业和开发者的
多模型接入与 Token 智能路由平台
不是"再多一个模型入口",而是一个可靠、可验证、可控成本的统一入口。所有模型服务由 myTEA 自建、自营、自保障。
属于每个开发者 / 企业的个性化 AI 基础设施
你的网关、你的策略、你的账本。
AI 推理服务的基本计量与调度单位
所有模型、所有节点,用同一把尺子计量。
在不同模型、节点、渠道之间交换与路由
把 Token 当成标准化的算力货币来调度与结算。
统一提供各类模型能力
自营开源旗舰模型 + 闭源厂商官方直连。
企业用 AI 的四个现实痛点
模型太多、变化太快
每季度都有新模型,团队没精力逐一评测、逐一对接。
价格不透明、账单分散
多家供应商、多种币种、多套计费口径,财务难对账。
稳定性不可控
限流、排队、区域不可用时有发生,业务只能被动等待。
"拿到的是不是真模型"说不清
转发层层加码,上下文被截、缓存被偷换,用户无从验证。
企业需要的不是"更多模型入口",而是一个可靠、可验证、可控成本的统一入口。
市场上的两种模式:开放平台 vs 自营
开放平台解决"有没有";自营解决"稳不稳、真不真、贵不贵"。
| 维度 | OpenRouter(开放平台) | myTEA(自营) |
|---|---|---|
| 模式 | 聚合市场:路由到第三方供应商 | 全链路自营:自有算力 + 自部署模型 + 自研网关 |
| 模型来源 | 60+ 外部供应商入驻 | 自建推理集群 + 闭源厂商官方直连 |
| 算力 | 不持有算力 | 自有 GPU 集群(H200 / B300) |
| 质量与 SLA | 取决于各供应商 | 平台统一,端到端负责 |
| 价格逻辑 | 供应商定价 + 平台手续费 | 成本可控,阶梯预付透明 |
| 可验证性 | 弱(多跳转发) | 强:探针验证 + 调用审计 |
淘宝模式把风险留给商家和买家;自营模式把风险留给自己,把确定性交给客户。
产品全景:三层一体
接入、路由、交换三层合一,运行在 myTEA 自营推理集群与闭源厂商官方 API 直连通道之上。
一个 API,OpenAI 兼容协议。一把 Key 调用全部模型,存量代码只改 base_url。
按价格 / 速度 / 质量 / 上下文智能选型,模型或节点故障自动切换,支持企业自定义策略。
Model Router · Token Router统一充值、阶梯定价、多币种结算;用量看板、审计与探针一应俱全。
Token Exchange技术架构
所有请求经 Gateway 完成调用与计量;路由引擎按任务特征与企业策略选模型、选节点。
- Gateway:所有请求经网关完成调用与计量,一把 Key 用所有模型。
- 路由引擎:按任务特征与企业策略选模型、选节点;节点或模型异常时秒级切换。
- 自营集群:模型由 myTEA 自部署、自运维,版本、精度、上下文长度全部可控。
- 官方渠道直连:对闭源旗舰模型,以原厂 Key 直连官方 API,不替换模型、不转发;国内可直接调用。
为什么坚持自营
自营带来的六种确定性 —— 从网关到 GPU 都是自己的,才能对结果负责。
端到端 SLA
从网关到 GPU 都是自己的,故障可定位、可承诺。
价格可控
没有中间商层层加价,阶梯折扣直接给到客户。
模型一致性
客户调用的就是我们部署的那个版本,不被偷换、不被降级。
数据与合规
请求不出自营链路,可按区域 / 行业提供数据驻留方案。
可验证
探针服务 + 调用日志,客户可自行核验上下文长度与缓存行为。
可私有化
同一套网关与路由,可部署进企业 VPC / 机房。
三大核心能力
统一接入MaaS · One API, Every Model
一个 API Key,调用全部模型。OpenAI Chat Completions 兼容,存量代码只改 base_url。
- 提供 Python / Node / Java / Go SDK,适配 LangChain、LlamaIndex 等框架。
- 模型目录统一:命名、上下文长度、价格、限额、可用区域一目了然。
- 企业级 Key 管理:子 Key、项目配额、按部门 / 按应用分账。
- 流式输出、函数调用、JSON 模式、思考模式全部支持。
Supported
智能 Token 路由Model Router · Token Router
不同模型像不同茶叶:有的提神、有的回甘、有的便宜耐泡。myTEA 按任务"调配"。
- 模型 / 节点故障 自动切换,对客户透明。
- 支持 优先级 + 回退链(primary → fallback1 → fallback2)。
- 企业可 自定义路由策略:固定模型、权重分流、预算封顶、灰度实验。
Routing Dimensions
Token Exchange统一结算 · Unified Billing
把 Token 当成"标准化的算力货币"来买卖、调度和结算 —— 这就是 Exchange。
- 一处充值,全模型通用:预付费余额按 Token 统一扣减。
- 阶梯折扣:按月度用量自动升档;大客户合同价。
- 多币种结算:USD 为主,支持 CNY 等。
- 发票与合同:企业合同、月结、发票齐全。
Exchange Console
自营算力与模型矩阵
旗舰级开源模型 + 旗舰级算力,自部署、自运维,客户调到的就是完整版本。
| 自营推理集群(华南) | 规模 | 单卡显存 | 算力 |
|---|---|---|---|
| NVIDIA H200 | 100 台 · 800 卡 | 141 GB HBM3e | ≈ 791 PFLOPS |
| NVIDIA B300 | 23 台 · 184 卡 | 288 GB HBM3e | ≈ 414 PFLOPS |
| 合计 | 123 台 · 984 卡 | ≈ 166 TB HBM | ≈ 1.2 EFLOPS |
* 算力按每台 8 卡、FP16 / BF16 稠密算力折算,实际以交付配置为准。
已部署模型矩阵 FLAGSHIP MoE
透明可验证:让客户"看得见"
全部经网关
所有请求在 myTEA Gateway 完成调用与计量,账单与日志一一对应。
探针服务
客户可随时测试 Context 长度、缓存命中、响应特征,核验模型真实性。
原厂直连约定
闭源模型流量在合同中约定直连原厂 API,使用原厂 Key,不替换、不二次转发。
调用审计
每次调用可追溯模型版本、节点、耗时、Token 数。
SLA 承诺
可用性、延迟指标写入合同,未达标按约定赔付。
参考定价模式
预付费,USD 结算为主。示例数字仅作说明,最终价格与额度以合同为准。
按 Token 计价 + 月度阶梯
| 模型 | 输入 / 输出 $ / M tokens | $1K–10K / 月 | > $10K / 月 |
|---|---|---|---|
| Kimi K3 | 2.50 / 12.50 | 9 折 | 8 折 |
| GLM-5.4 | 0.60 / 2.00 | 9 折 | 8 折 |
| DeepSeek V4 | 0.40 / 0.80 | 9 折 | 8 折 |
对比锚点:Kimi K3 原厂 / OpenRouter 列表价 $3.00 / $15.00(数据 2026-07)。
闭源模型,原厂价折扣
Claude / OpenAI 等闭源模型,以原厂 Key 直连官方 API,按原厂列表价折扣;国内可直接调用。
合作流程:三步上线
确认需求并签约
确认模型、月度用量、渠道与直连要求,签署合同。
预付并开通网关
完成预付,开通 myTEA Gateway 与 Key,配置路由策略。
上线与验证
开始调用;按需启用探针服务与 SLA 监控。
必须经过 myTEA Gateway 吗?
可以保证直连原厂吗?
探针测什么?
使用原厂 Key 和用 myTEA 一把 Key 调用所有模型冲突吗?
支持私有化部署吗?
myTEA blends and routes them for every task.
不同模型各有所长,
myTEA 根据每项任务,自动调配最适合的模型。
申请接入或索取完整方案与报价,我们将在一个工作日内回复。