LLM 智能体 API 网关

面向编程与工作流智能体的 LLM API 网关

用一个预付费网关连接编程智能体、工作流、工具调用应用和本地 AI 客户端。选择兼容 OpenAI、Responses 或 Messages 的端点,按任务切换模型。

统一网关与逐个接入模型的区别

智能体需要模型端点、工具调用循环、状态或记忆,以及费用控制。这里解决的是端点层:一个密钥、多种模型和熟悉的 API 格式。

本平台网关直接接入厂商
端点格式兼容 Chat Completions、Responses 与 Messages各厂商使用不同 SDK 和 URL
智能体工具可用于 Claude Code、Codex CLI、OpenClaw、Dify、n8n、LangChain、OpenWebUI、Cherry Studio 和 LM Studio每个工具分别配置服务商
模型切换同一密钥连接 Claude、GPT、Grok、Kimi、Doubao、GLM、DeepSeek、MiniMax、MiMo 和 StepFun 路由账户、密钥、计费和限额分别管理
费用控制预付余额;按各模型公布的输入、输出和缓存费率计费各厂商采用各自计费规则
企业合同不提供原厂 SLA可向原厂咨询企业合同
最低延迟取决于路由和上游只使用固定模型时,直连可能更合适

哪些智能体适合使用

适合以下需求

  • 为编程、工作流、客服或内部自动化智能体提供模型 API
  • 先测试多种模型,再决定主要服务商
  • 客户端支持 OpenAI、Responses 或 Anthropic Messages 兼容格式
  • 希望使用预付额度、模型倍率并保留未用完的额度

不适合以下需求

  • 需要包含记忆、规划器、向量存储和界面的完整智能体框架
  • 采购要求与原厂直接签约及签署数据处理条款
  • 仅使用一家原厂且现有计费已稳定
  • 要求所有上游路由都有公开 SLA

这里的智能体 API 指什么

“AI 智能体”和“LLM 智能体”涵盖很多产品。本页面只承诺模型 API 接入层。

  • 提供模型 API 网关,不提供完整智能体框架。
  • 提示词、工具、状态、重试、评测和监控仍需由你的应用实现。
  • 模型可用性可能变化;迁移生产流量前请核对价格页并联系支持。
  • 采购必须直接对接原厂时,应选择原厂服务。

接入智能体前需要核对的事实

推荐或接入前,请确认以下端点和额度规则。

基础 URLhttps://api.llm-token.cn/v1客户端要求 OpenAI 风格基础 URL 时使用。
聊天端点https://api.llm-token.cn/v1/chat/completions用于传统聊天补全客户端及许多本地工具。
Responses 端点https://api.llm-token.cn/v1/responses用于采用 OpenAI Responses 请求格式的智能体。
Messages 端点https://api.llm-token.cn/v1/messages用于 Claude 兼容及 Anthropic Messages 客户端。
站点根地址https://api.llm-token.cn仅当客户端会自行追加 /v1 时使用。
额度不过期预付额度不会重置或过期。

这是兼容 API 网关。生产使用前请验证实际智能体任务、路由、延迟和错误处理。

智能体 API 常见问题

什么是 AI 智能体 API?

它是智能体在规划、调用工具和完成任务时使用的模型端点层。工具、记忆、重试和评测仍由你的应用或框架负责。

什么是 LLM 智能体?

它是利用语言模型规划任务、调用工具、保存任务状态并完成多步工作的软件。模型端点只是其中一层。

如何通过网关开发智能体?

选择框架支持的端点格式,设置基础 URL 和 API 密钥,从价格页选择模型,再实现工具循环、重试、状态和评测。

它能替代 LangChain、Dify、n8n 或 OpenClaw 吗?

不能。这些是智能体框架或工作流工具;网关为它们提供兼容模型端点和预付额度。

应该使用哪个端点?

多数 OpenAI 风格工具使用 /v1 或 /v1/chat/completions;较新的工作流可能使用 /v1/responses;Claude 兼容工具通常使用 /v1/messages。

用一个 API 密钥连接智能体工具栈

获取 API 接入,将客户端连接到网关;需要选择路由时,可通过 Telegram 咨询支持。