Unified model access · routing · risk control · audit

Inference Space

One gateway for language, image, speech, and vision models

Connect your application to one API. The gateway handles routing, failover, key permissions, usage billing, and audit so multi-model capabilities can run reliably in production.

AI Gateway console
Inference Space multi-model playground
Choose providers and models in one console to test language, image, audio, and vision capabilities.
大语言模型
对话
推理 · 代码 · 长上下文
图像模型
生成
文生图 · 图生图 · 编辑
语音模型
语音
ASR 识别 · TTS 合成
视觉模型
视觉
OCR · 检测 · 分割

一层网关,统一纳管模型与调用链路

从模型接入到生产治理,统一处理协议、路由、密钥、成本和审计。应用接入一次,即可按需使用不同类型的模型能力。

多类型模型统一接入

大语言、图像生成、语音识别、语音合成、OCR 与视觉模型共用一套 API。

智能路由与自动切换

同一模型配置多路上游,按优先级、权重和健康状态调度,异常自动切换。

Key 级权限与预算

按系统或团队拆分 API Key,分别设置模型权限、速率、Token 与预算额度。

调用与成本全程留痕

逐笔记录模型、上游、路由、耗时、用量和费用,支持检索、归因与复盘。

从模型接入到生产治理

统一模型协议

通过 OpenAI / Anthropic 兼容接口接入,现有 SDK 和应用只需维护一个入口。

配置路由策略

为同一模型设置优先级、权重与备用线路,持续探测健康状态并自动故障转移。

划分 Key 边界

按系统、团队或场景分配独立 Key,分别控制可用模型、调用速率和预算。

追踪每次调用

按组织、模型、上游和 API Key 查看用量、延迟、状态与单次费用。

生产调用的四条治理主线

模型统一:大语言、图像、语音与视觉模型从同一入口调用。

稳定优先:多路上游按策略调度,异常自动熔断并切换备用线路。

权限可控:每个 API Key 独立配置模型范围、速率和预算额度。

调用可追:请求、路由、用量与费用逐笔留痕,状态页同步公开服务事件。

调用日志与成本分析
Inference Space API call logs
Track usage, latency, status, and costs by organization, model, and upstream route.
成本与审计透明

每次调用都能看清模型、路由、用量与费用

Token、图片、页数和语音时长按模型类型计量,成本归因到组织与 Key。
按请求查看模型、上游、路由、延迟和失败状态,快速定位异常线路。
调用明细可检索、导出和复盘,状态页持续展示可用率与历史事件。

把多模型接入收敛成一套稳定接口

告诉我们需要接入的模型类型、调用规模和上线时间,客服会给出开通方案、额度和价格口径。