解决方案
面向企业的 AI 智能体
支撑 AI 智能体运行的基础设施:22 个对话模型共用一把 API 密钥和一个预付余额,兼容 OpenAI 与 Anthropic SDK,并在供应商故障时自动切换。智能体由你来写,我们负责模型的可用性和请求的送达。
22
个对话模型
智能体对基础设施的要求
智能体就是「模型 → 工具 → 模型」的循环,而线上出问题的地方大多在模型访问这一层:配额用尽、供应商报错、某一步需要换成更便宜或更强的模型。这些正是我们的 API 负责的部分。
每一步用不同的模型
路由和分类交给便宜的模型,规划和推理交给更强的模型。所有模型共用同一把密钥,切换只是请求里的一个 model 字段。
OpenAI 与 Anthropic 协议
我们以 OpenAI Chat Completions 和 Anthropic Messages 格式返回结果。LangChain、LlamaIndex、Vercel AI SDK 以及直接基于 OpenAI SDK 的代码都能继续运行——只需改 base URL 和密钥。
供应商自动兜底
每个模型都接入多家供应商。主供应商不可用或返回错误时,请求会自动转到备用供应商——你的智能体不会因为别人的故障而卡住。
全公司一个余额
一个预付余额覆盖所有模型和所有环境:不必为每家供应商单独签约和分配额度。按密钥和模型的消耗都能在控制台查看。
开通没有门槛
邮箱注册,银行卡或加密货币充值,密钥立即发放。没有订阅、没有最低消费,也没有什么需要谈判。
媒体模型同一把密钥
当智能体需要图片、视频或音乐时,用的是同一把密钥和同一个余额,不必为每种生成类型单独接入。
智能体可用的模型
价格按每百万输入 token 计,由低到高排列。表格取自实时目录,因此不会和你的密钥实际能调用的内容脱节。
| 模型 | 厂商 | 价格 |
|---|---|---|
| DeepSeek V4 Flash | DeepSeek | $0.168/ 100 万 tokens |
| GPT 5.6 Luna | OpenAI | $0.18/ 100 万 tokens |
| Claude Sonnet 5 | Anthropic | $0.3/ 100 万 tokens |
| Qwen3.7 Plus | Qwen | $0.343/ 100 万 tokens |
| MiniMax M3 | MiniMax | $0.36/ 100 万 tokens |
| DeepSeek V4 Pro | DeepSeek | $0.522/ 100 万 tokens |
| GPT 5.6 Terra | OpenAI | $0.8/ 100 万 tokens |
| Gemini 3.5 Flash | $0.9/ 100 万 tokens | |
| Gemini 3.6 Flash | $0.9/ 100 万 tokens | |
| Gemini 3.7 Flash | $0.9/ 100 万 tokens | |
| GLM 5.2 | Zhipu | $0.979/ 100 万 tokens |
| Kimi K2.7 Code | Moonshot | $1.11/ 100 万 tokens |
| Claude Fable 5 | Anthropic | $1.5/ 100 万 tokens |
| GPT 5.5 | OpenAI | $1.5/ 100 万 tokens |
| Gemini 3.5 Flash (High) | $1.62/ 100 万 tokens | |
| GLM 5.3 | Zhipu | $1.68/ 100 万 tokens |
| Grok 4.5 | xAI | $2.1/ 100 万 tokens |
| Grok 4.6 | xAI | $2.1/ 100 万 tokens |
| Claude Opus 5 | Anthropic | $3/ 100 万 tokens |
| GPT 5.6 Sol | OpenAI | $3/ 100 万 tokens |
| Kimi K3 | Moonshot | $3.15/ 100 万 tokens |
| GPT 6 Astra | OpenAI | $8/ 100 万 tokens |
人们用它做什么
企业最常从这四种形态入手——它们给出的是工作量的量级,而不是一份完整清单。
一线客服
智能体读取工单,在知识库里找到答案并回复客户,有争议的交给人工。分类用便宜的模型,面向客户的回复用更强的模型。
文档处理
合同、发票和申请单:智能体抽取字段,与业务系统核对,再返回结构化 JSON。长上下文模型可以一次读完整份文档。
内容与营销
文本、图像和视频在同一条流水线上:智能体用对话模型写脚本,再用媒体模型生成封面或短片——同一把密钥,同一个余额。
分析与报告
智能体把问题转成对你数据的查询,解读结果并用自然语言写出报告。长链条推理放在小模型上更划算。
如何接入智能体
接入就是在已有代码里改一个 base URL 和一把密钥。不需要我们的 SDK:我们说的是 OpenAI 和 Anthropic 的格式,因此智能体框架、工具和提示词都可以原样保留。
1
获取密钥
注册、充值,然后在控制台创建 API 密钥。一把密钥覆盖所有模型,对话和媒体都包括在内。
2
把 base URL 指向我们
在 OpenAI 或 Anthropic 客户端里填入我们的地址和你的密钥。智能体的其余部分——工具、记忆、调用链——都不用动。
3
按步骤分配模型
在 model 字段里写上这一步需要的模型。按模型和按密钥的消耗都会出现在控制台统计里。
OpenAI SDK
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["API_KEY"],
base_url="https://api.api-stock.com/api/v1",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "..."}],
tools=tools,
)curl
curl https://api.api-stock.com/api/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "..."}]
}'常见问题
把 AI 智能体接入企业需要准备什么?
三件事:一个让智能体思考的模型、对你数据和工具的访问,以及扛得住负载的基础设施。第一件和第三件由 API Stock 负责——22 个对话模型共用一把密钥,支持 OpenAI 与 Anthropic 协议,并自动切换到备用供应商。智能体的逻辑和对你内部系统的访问仍在你这一侧。
如何把 AI 智能体集成进企业流程?
技术上,改掉 OpenAI 或 Anthropic 客户端里的 base URL 和密钥即可:用 LangChain、LlamaIndex、Vercel AI SDK 或直接基于 SDK 写的智能体,无需改动逻辑就能走我们这条通道。组织上,先从一个结果可衡量的流程做起——一线客服、来件文档处理——见到效果后再推广。
哪些模型适合做 AI 智能体?
路由、分类和字段抽取用小而快的模型;规划、推理和写代码用更大的模型。目录里有22 个对话模型,切换只是请求里的一个字段,所以为某一步挑模型是做实验,而不是做迁移。
需要签合同或者最低消费吗?
不需要。邮箱注册,充值金额随意,密钥立即发放。没有订阅也没有最低消费——你只为实际消耗的 token 付费。
企业做一个 AI 智能体要花多少钱?
在基础设施这一侧,成本就是 token:按所用模型的价格,为请求和回复的实际用量付费,没有月费。最小模型和最大模型之间相差几十倍,所以省钱空间最大的地方就是路由和分类。