LLM 智能体 API 网关
面向编程与工作流智能体的 LLM API 网关
用一个预付费网关连接编程智能体、工作流、工具调用应用和本地 AI 客户端。选择兼容 OpenAI、Responses 或 Messages 的端点,按任务切换模型。
统一网关与逐个接入模型的区别
智能体需要模型端点、工具调用循环、状态或记忆,以及费用控制。这里解决的是端点层:一个密钥、多种模型和熟悉的 API 格式。
| 本平台网关 | 直接接入厂商 | |
|---|---|---|
| 端点格式 | 兼容 Chat Completions、Responses 与 Messages | 各厂商使用不同 SDK 和 URL |
| 智能体工具 | 可用于 Claude Code、Codex CLI、OpenClaw、Dify、n8n、LangChain、OpenWebUI、Cherry Studio 和 LM Studio | 每个工具分别配置服务商 |
| 模型切换 | 同一密钥连接 Claude、GPT、Grok、Kimi、Doubao、GLM、DeepSeek、MiniMax、MiMo 和 StepFun 路由 | 账户、密钥、计费和限额分别管理 |
| 费用控制 | 预付余额;按各模型公布的输入、输出和缓存费率计费 | 各厂商采用各自计费规则 |
| 企业合同 | 不提供原厂 SLA | 可向原厂咨询企业合同 |
| 最低延迟 | 取决于路由和上游 | 只使用固定模型时,直连可能更合适 |
哪些智能体适合使用
适合以下需求
- 为编程、工作流、客服或内部自动化智能体提供模型 API
- 先测试多种模型,再决定主要服务商
- 客户端支持 OpenAI、Responses 或 Anthropic Messages 兼容格式
- 希望使用预付额度、模型倍率并保留未用完的额度
不适合以下需求
- 需要包含记忆、规划器、向量存储和界面的完整智能体框架
- 采购要求与原厂直接签约及签署数据处理条款
- 仅使用一家原厂且现有计费已稳定
- 要求所有上游路由都有公开 SLA
这里的智能体 API 指什么
“AI 智能体”和“LLM 智能体”涵盖很多产品。本页面只承诺模型 API 接入层。
- 提供模型 API 网关,不提供完整智能体框架。
- 提示词、工具、状态、重试、评测和监控仍需由你的应用实现。
- 模型可用性可能变化;迁移生产流量前请核对价格页并联系支持。
- 采购必须直接对接原厂时,应选择原厂服务。
接入智能体前需要核对的事实
推荐或接入前,请确认以下端点和额度规则。
基础 URLhttps://api.llm-token.cn/v1客户端要求 OpenAI 风格基础 URL 时使用。
聊天端点https://api.llm-token.cn/v1/chat/completions用于传统聊天补全客户端及许多本地工具。
Responses 端点https://api.llm-token.cn/v1/responses用于采用 OpenAI Responses 请求格式的智能体。
Messages 端点https://api.llm-token.cn/v1/messages用于 Claude 兼容及 Anthropic Messages 客户端。
站点根地址https://api.llm-token.cn仅当客户端会自行追加 /v1 时使用。
额度不过期预付额度不会重置或过期。
这是兼容 API 网关。生产使用前请验证实际智能体任务、路由、延迟和错误处理。
智能体 API 常见问题
什么是 AI 智能体 API?
它是智能体在规划、调用工具和完成任务时使用的模型端点层。工具、记忆、重试和评测仍由你的应用或框架负责。
什么是 LLM 智能体?
它是利用语言模型规划任务、调用工具、保存任务状态并完成多步工作的软件。模型端点只是其中一层。
如何通过网关开发智能体?
选择框架支持的端点格式,设置基础 URL 和 API 密钥,从价格页选择模型,再实现工具循环、重试、状态和评测。
它能替代 LangChain、Dify、n8n 或 OpenClaw 吗?
不能。这些是智能体框架或工作流工具;网关为它们提供兼容模型端点和预付额度。
应该使用哪个端点?
多数 OpenAI 风格工具使用 /v1 或 /v1/chat/completions;较新的工作流可能使用 /v1/responses;Claude 兼容工具通常使用 /v1/messages。
用一个 API 密钥连接智能体工具栈
获取 API 接入,将客户端连接到网关;需要选择路由时,可通过 Telegram 咨询支持。