跳转到内容

API 平台与聚合服务

类型 说明 适合谁
官方 API 直接使用模型厂商的开发者平台 需要原厂能力、稳定性、合同或企业支持
云厂商 API 通过 AWS、Azure、Google、阿里云等统一结算 已经在某个云上,重视权限和企业账单
聚合平台 一个账号或 Key 访问多个模型 想快速比较模型、减少分别注册
自建网关 自己部署转发、计费、限流或路由服务 团队内部、已有运维能力和合规要求

聚合和中转不等于官方。请求可能经过平台、上游模型厂商和日志系统多个环节,敏感数据、生产 Key 和客户内容要谨慎。

平台 入口 特点
OpenAI API API 文档 Responses、Chat Completions、Embedding 等官方接口
Anthropic API Claude API Messages、工具调用和 Claude 模型
Google Gemini API Gemini API AI Studio、Gemini Developer API
xAI API xAI Docs Grok 开发者接口
Mistral API Mistral Docs 文本、Embedding 和文档能力
Cohere API Cohere Docs 检索、重排、生成和企业搜索
Amazon Bedrock Bedrock AWS 账单和权限下的多模型服务
Azure OpenAI Azure OpenAI Azure 资源、部署名和企业网络
Google Vertex AI Vertex AI Google Cloud 项目和企业控制
IBM watsonx.ai watsonx.ai 企业 AI 平台和 Granite 等模型
平台 入口 常见用途
OpenRouter 官网 · 模型 一个 API 访问多家上游,按模型 slug 路由
Together AI 官网 · Docs 开源模型推理与微调
Fireworks AI 官网 · Docs 开源模型和低延迟推理
GroqCloud 官网 · Docs 高速推理 API
Cerebras 开发平台 · Docs 高吞吐推理
Replicate 官网 · Models 按次调用社区和官方模型
Hugging Face Inference Providers 模型社区和多家推理提供商
fal.ai 官网 · Docs 图像、视频、音频和生成式媒体
Novita AI 官网 · Docs 开源模型推理和媒体 API
Baseten 官网 · Docs 部署和服务化模型
平台 入口 备注
SiliconFlow 官网 · 文档 多模型、OpenAI 兼容接口
阿里云百炼 控制台 · 文档 Qwen 及多模型服务
百度千帆 平台 · 文档 文心及第三方模型服务
火山方舟 平台 · 文档 豆包和模型推理服务
腾讯混元 平台 · 文档 混元模型及云 API
智谱开放平台 平台 · 文档 GLM 系列
DeepSeek 平台 · 文档 DeepSeek 官方 API
Moonshot 平台 · 文档 Kimi API
MiniMax 平台 · 文档 文本、语音、视频和多模态
讯飞开放平台 官网 星火和语音能力
魔搭 ModelScope 模型服务 模型、数据集、创空间和推理服务

以下服务的定位是“兼容接口、模型聚合或第三方路由”,不应和上游模型官网混为一谈。使用前要自行核对隐私、日志、地区、余额、退款和上游授权。

服务 入口 适合了解什么
AiHubMix 官网 多模型兼容 API 和统一 Key
APIYI 官网 国内用户常见的聚合接口入口
OpenAI-compatible 服务 OpenRouter 兼容说明 了解 Base URL、模型 ID 和请求格式
LiteLLM Proxy 官网 · GitHub 自建路由、预算、Fallback 和统一接口
Portkey 官网 · Docs 网关、观测、路由和治理
Helicone 官网 · GitHub LLM 请求日志、成本和评测观测
项目 GitHub 适合什么
LiteLLM BerriAI/litellm 统一多家模型的 Python SDK/Proxy
One API songquanpeng/one-api 多模型渠道、Key、额度和分发
New API Calcium-Ion/new-api One API 生态的兼容网关分支
LobeChat lobehub/lobe-chat 自托管聊天界面和多模型配置
LibreChat danny-avila/LibreChat 多模型聊天和自托管
Open WebUI open-webui/open-webui 本地模型和 OpenAI 兼容 API 界面
  1. 服务商名称写成自己能识别的名称;
  2. API 类型按服务商文档选择,不要因为 Base URL 相似就随便选择;
  3. Base URL 填基础地址,不要重复拼接完整请求路径;
  4. 模型字段填准确的模型 ID、部署名或 slug;
  5. 使用最小权限 Key,保存后重新检测;
  6. 先用低额度测试,再把它用于长会话或生产工作流。