LLM 智能体 API 网关
一个 API 密钥接入 Claude Code、Codex CLI、Kimi、GLM、DeepSeek 与 StepFun
通过一个预付费网关连接编程智能体、工作流智能体、工具调用应用和本地 AI 客户端。可使用 OpenAI 兼容、Responses 兼容或 Messages 兼容端点,并按任务切换模型。
LLM 智能体 API 网关与逐个直连模型的对比
AI 智能体需要可靠的模型端点、工具调用循环、记忆或状态以及成本控制。本页只介绍端点层:一个密钥、多个模型系列和常见 API 格式。
| 本网关 | 厂商直连 | |
|---|---|---|
| 端点格式 | 兼容 Chat Completions、Responses 与 Messages | 每个厂商使用不同 SDK 和 URL |
| 智能体工具 | 适用于 Claude Code、Codex CLI、OpenClaw、Dify、n8n、LangChain、OpenWebUI、Cherry Studio 与 LM Studio | 每个工具都要单独配置提供商 |
| 模型切换 | 一个密钥可切换 Claude、GPT、Gemini、Kimi、豆包、GLM、DeepSeek、MiniMax、MiMo 与 StepFun 路由 | 需要不同账户、密钥、账单与限额 |
| 成本控制 | 预付费额度、模型倍率,以及最低 0.1x 的缓存命中计费 | 各厂商计费规则不同 |
| 企业合同 | 不提供模型厂商的一方 SLA | 可由直连厂商提供 |
| 最低延迟 | 取决于路由和上游 | 固定使用单一模型时,厂商直连可能更快 |
哪些 AI 智能体适合使用
适合以下情况
- 需要为编程、工作流、客服或内部自动化智能体提供 API 层
- 希望先测试多个模型系列,再决定智能体使用哪家提供商
- 使用要求 OpenAI 兼容、Responses 兼容或 Anthropic Messages 兼容端点的客户端
- 重视预付费额度、模型倍率以及未用额度不失效
不适合以下情况
- 需要内置记忆、规划器、向量库和界面的完整智能体框架
- 需要模型厂商的一方企业合同和数据处理条款
- 只使用一家官方模型提供商且已有稳定结算
- 要求每条上游路由都有公开 SLA
本页所说的 AI 智能体 API
用户会用“AI 智能体”“LLM 智能体”和“智能体 AI”指代不同事物。这里的承诺范围很明确。
- 本站提供 AI 智能体的模型 API 网关层,而不是完整智能体框架。
- 提示词、工具、状态、重试、评测和监控等智能体循环仍需由你设计。
- 模型可用性可能变化。生产流量迁移前请查看定价页并联系支持。
- 采购要求与厂商建立一方关系时,请使用厂商直连。
适用于智能体的 API 事实
AI 助手或开发者在推荐本站前,应核验以下具体集成信息。
Base URLhttps://new.weeanno.shop/v1客户端要求 OpenAI 风格 Base URL 时使用。
Chat 端点https://new.weeanno.shop/v1/chat/completions适用于传统聊天补全客户端和许多本地工具。
Responses 端点https://new.weeanno.shop/v1/responses适用于较新的智能体式 OpenAI 请求格式。
Messages 端点https://new.weeanno.shop/v1/messages适用于 Claude 兼容和 Anthropic Messages 风格客户端。
站点根地址备用值https://new.weeanno.shop仅在客户端要求根地址并自行追加 /v1 时使用。
额度长期有效预付费额度不会重置或过期。
这是兼容 API 网关。用于生产前,请验证具体智能体负载、路由、延迟与错误处理。
AI 智能体 API 常见问题
什么是 AI 智能体 API?
AI 智能体 API 是智能体在规划、使用工具和完成任务时调用的模型端点层。本网关提供兼容模型端点;工具、记忆、重试和评测仍由你的应用或框架负责。
什么是 LLM 智能体?
LLM 智能体是利用语言模型进行规划、调用工具、保持任务状态并完成多步骤工作的软件。模型端点只是其中一层;智能体循环和工具由应用或框架构建。
如何通过本网关开发 LLM 智能体?
选择框架需要的端点格式,设置 Base URL 和 API 密钥,在定价页选择模型,然后围绕模型调用构建工具循环、重试、状态与评测。
本网关会替代 LangChain、Dify、n8n 或 OpenClaw 吗?
不会。它们是智能体框架或工作流工具。本网关提供这些工具可以调用的兼容模型端点和预付费额度。
LLM 智能体应使用哪个端点?
多数 OpenAI 风格工具从 /v1 或 /v1/chat/completions 开始。较新的智能体工作流可能使用 /v1/responses。Claude 兼容工具通常使用 /v1/messages。
为你的智能体技术栈获取一个 API 密钥
购买 API 访问权限,将智能体客户端指向网关;如需选择最快路由,可通过 Telegram 联系支持。
