API 平台与聚合服务
先理解四类服务
Section titled “先理解四类服务”| 类型 | 说明 | 适合谁 |
|---|---|---|
| 官方 API | 直接使用模型厂商的开发者平台 | 需要原厂能力、稳定性、合同或企业支持 |
| 云厂商 API | 通过 AWS、Azure、Google、阿里云等统一结算 | 已经在某个云上,重视权限和企业账单 |
| 聚合平台 | 一个账号或 Key 访问多个模型 | 想快速比较模型、减少分别注册 |
| 自建网关 | 自己部署转发、计费、限流或路由服务 | 团队内部、已有运维能力和合规要求 |
聚合和中转不等于官方。请求可能经过平台、上游模型厂商和日志系统多个环节,敏感数据、生产 Key 和客户内容要谨慎。
国际官方与云 API
Section titled “国际官方与云 API”| 平台 | 入口 | 特点 |
|---|---|---|
| OpenAI API | API 文档 | Responses、Chat Completions、Embedding 等官方接口 |
| Anthropic API | Claude API | Messages、工具调用和 Claude 模型 |
| Google Gemini API | Gemini API | AI Studio、Gemini Developer API |
| xAI API | xAI Docs | Grok 开发者接口 |
| Mistral API | Mistral Docs | 文本、Embedding 和文档能力 |
| Cohere API | Cohere Docs | 检索、重排、生成和企业搜索 |
| Amazon Bedrock | Bedrock | AWS 账单和权限下的多模型服务 |
| Azure OpenAI | Azure OpenAI | Azure 资源、部署名和企业网络 |
| Google Vertex AI | Vertex AI | Google Cloud 项目和企业控制 |
| IBM watsonx.ai | watsonx.ai | 企业 AI 平台和 Granite 等模型 |
国际聚合和推理平台
Section titled “国际聚合和推理平台”| 平台 | 入口 | 常见用途 |
|---|---|---|
| OpenRouter | 官网 · 模型 | 一个 API 访问多家上游,按模型 slug 路由 |
| Together AI | 官网 · Docs | 开源模型推理与微调 |
| Fireworks AI | 官网 · Docs | 开源模型和低延迟推理 |
| GroqCloud | 官网 · Docs | 高速推理 API |
| Cerebras | 开发平台 · Docs | 高吞吐推理 |
| Replicate | 官网 · Models | 按次调用社区和官方模型 |
| Hugging Face | Inference Providers | 模型社区和多家推理提供商 |
| fal.ai | 官网 · Docs | 图像、视频、音频和生成式媒体 |
| Novita AI | 官网 · Docs | 开源模型推理和媒体 API |
| Baseten | 官网 · Docs | 部署和服务化模型 |
国内 API 与聚合平台
Section titled “国内 API 与聚合平台”| 平台 | 入口 | 备注 |
|---|---|---|
| SiliconFlow | 官网 · 文档 | 多模型、OpenAI 兼容接口 |
| 阿里云百炼 | 控制台 · 文档 | Qwen 及多模型服务 |
| 百度千帆 | 平台 · 文档 | 文心及第三方模型服务 |
| 火山方舟 | 平台 · 文档 | 豆包和模型推理服务 |
| 腾讯混元 | 平台 · 文档 | 混元模型及云 API |
| 智谱开放平台 | 平台 · 文档 | GLM 系列 |
| DeepSeek | 平台 · 文档 | DeepSeek 官方 API |
| Moonshot | 平台 · 文档 | Kimi API |
| MiniMax | 平台 · 文档 | 文本、语音、视频和多模态 |
| 讯飞开放平台 | 官网 | 星火和语音能力 |
| 魔搭 ModelScope | 模型服务 | 模型、数据集、创空间和推理服务 |
公开聚合和中转服务
Section titled “公开聚合和中转服务”以下服务的定位是“兼容接口、模型聚合或第三方路由”,不应和上游模型官网混为一谈。使用前要自行核对隐私、日志、地区、余额、退款和上游授权。
| 服务 | 入口 | 适合了解什么 |
|---|---|---|
| AiHubMix | 官网 | 多模型兼容 API 和统一 Key |
| APIYI | 官网 | 国内用户常见的聚合接口入口 |
| OpenAI-compatible 服务 | OpenRouter 兼容说明 | 了解 Base URL、模型 ID 和请求格式 |
| LiteLLM Proxy | 官网 · GitHub | 自建路由、预算、Fallback 和统一接口 |
| Portkey | 官网 · Docs | 网关、观测、路由和治理 |
| Helicone | 官网 · GitHub | LLM 请求日志、成本和评测观测 |
开源 API 网关和中转项目
Section titled “开源 API 网关和中转项目”| 项目 | GitHub | 适合什么 |
|---|---|---|
| LiteLLM | BerriAI/litellm | 统一多家模型的 Python SDK/Proxy |
| One API | songquanpeng/one-api | 多模型渠道、Key、额度和分发 |
| New API | Calcium-Ion/new-api | One API 生态的兼容网关分支 |
| LobeChat | lobehub/lobe-chat | 自托管聊天界面和多模型配置 |
| LibreChat | danny-avila/LibreChat | 多模型聊天和自托管 |
| Open WebUI | open-webui/open-webui | 本地模型和 OpenAI 兼容 API 界面 |
EasyAI 配置时的核对表
Section titled “EasyAI 配置时的核对表”- 服务商名称写成自己能识别的名称;
- API 类型按服务商文档选择,不要因为 Base URL 相似就随便选择;
- Base URL 填基础地址,不要重复拼接完整请求路径;
- 模型字段填准确的模型 ID、部署名或 slug;
- 使用最小权限 Key,保存后重新检测;
- 先用低额度测试,再把它用于长会话或生产工作流。