Unified model access · routing · risk control · audit
Inference Space
One gateway for language, image, speech, and vision models
Connect your application to one API. The gateway handles routing, failover, key permissions, usage billing, and audit so multi-model capabilities can run reliably in production.
AI Gateway console

大语言模型
对话
推理 · 代码 · 长上下文
图像模型
生成
文生图 · 图生图 · 编辑
语音模型
语音
ASR 识别 · TTS 合成
视觉模型
视觉
OCR · 检测 · 分割
一层网关,统一纳管模型与调用链路
从模型接入到生产治理,统一处理协议、路由、密钥、成本和审计。应用接入一次,即可按需使用不同类型的模型能力。
多类型模型统一接入
大语言、图像生成、语音识别、语音合成、OCR 与视觉模型共用一套 API。
智能路由与自动切换
同一模型配置多路上游,按优先级、权重和健康状态调度,异常自动切换。
Key 级权限与预算
按系统或团队拆分 API Key,分别设置模型权限、速率、Token 与预算额度。
调用与成本全程留痕
逐笔记录模型、上游、路由、耗时、用量和费用,支持检索、归因与复盘。
从模型接入到生产治理
统一模型协议
通过 OpenAI / Anthropic 兼容接口接入,现有 SDK 和应用只需维护一个入口。
配置路由策略
为同一模型设置优先级、权重与备用线路,持续探测健康状态并自动故障转移。
划分 Key 边界
按系统、团队或场景分配独立 Key,分别控制可用模型、调用速率和预算。
追踪每次调用
按组织、模型、上游和 API Key 查看用量、延迟、状态与单次费用。
调用日志与成本分析

成本与审计透明
每次调用都能看清模型、路由、用量与费用
Token、图片、页数和语音时长按模型类型计量,成本归因到组织与 Key。
按请求查看模型、上游、路由、延迟和失败状态,快速定位异常线路。
调用明细可检索、导出和复盘,状态页持续展示可用率与历史事件。