MCP 服务器
让你的 Agent 查看自己的额度、用量和上限,管理自己的密钥,并上传图片。
连接 bInference MCP 服务器后,你的 Agent 可以自己回答“我还剩多少 AI 预算?”,为新的工作进程创建密钥,或撤销不再需要的密钥。它用调用模型时已经在用的那个 binf_ 密钥登录。
https://binference.io/api/mcp密钥能做什么
每个工具都作用于拥有该密钥的 Agent 或账户。一个密钥永远看不到其他 Agent。
| 设置了消费上限的密钥 | 没有上限的密钥 | |
|---|---|---|
| 读取额度、用量、调用记录、上限和密钥 | 可以 | 可以 |
| 上传图片供模型读取 | 可以 | 可以 |
| 创建、修改和撤销密钥 | 不可以 | 可以 |
设置了上限的密钥只能读取,所以它永远无法给自己创建一个没有上限的密钥。没有上限的密钥本来就能花光全部余额,所以管理密钥并不会让它多花任何钱。
该连接哪个密钥
如果你的 Agent 只需要盯着自己的预算,就连接一个设置了每日上限的密钥。只有当你信任某个 Agent 去管理密钥时,才给它连接没有上限的密钥。
连接
claude mcp add --transport http binference https://binference.io/api/mcp --header "Authorization: Bearer binf_..."加上 --scope user 就能在所有项目中使用。然后在 Claude Code 中运行 /mcp:binference 会显示为已连接。
其他客户端只要能连接 Streamable HTTP 服务器并发送请求头,用法都一样。只能通过浏览器登录(OAuth)连接的应用,比如 Claude Desktop、ChatGPT、Grok 和 Muse,暂时还无法连接。
在你自己的代码中使用
使用官方 MCP SDK:npm install @modelcontextprotocol/client,Python 则用 pip install "mcp>=2.2"。
import { Client, StreamableHTTPClientTransport } from "@modelcontextprotocol/client";
const client = new Client({ name: "my-agent", version: "1.0.0" });
await client.connect(
new StreamableHTTPClientTransport(new URL("https://binference.io/api/mcp"), {
requestInit: { headers: { Authorization: `Bearer ${process.env.BINF_API_KEY}` } },
}),
);
const balance = await client.callTool({ name: "get_balance", arguments: {} });
console.log(balance.structuredContent);试一试
问你的 Agent:
How much bInference credit do I have, and how much of it expires this week?它会调用 get_balance,根据现在能花多少以及每天有多少到期来回答。
| 你问 | Agent 使用 |
|---|---|
| “这周我在 AI 上花了多少,花在哪些模型上?” | get_usage |
| “我最近几次调用为什么失败了?” | list_calls |
| “这个密钥离它的每日上限还有多远?” | get_limits |
| “创建一个叫 worker-2 的密钥,每日上限 $5。” | create_key |
| “撤销名为 laptop 的密钥。” | list_keys,然后 revoke_key |
| “描述一下 ./bug.png 这张截图。” | create_upload,然后调用模型 |
工具
| 工具 | 作用 | 需要没有上限的密钥 |
|---|---|---|
get_balance | 新调用现在能花多少、运行中的调用占用多少、什么时候有多少到期 | 否 |
get_limits | 密钥的消费上限,以及 Agent 的调用限制 | 否 |
get_usage | 按天和按模型统计的花费,最多可查 90 天 | 否 |
list_calls | 最近的调用,包括模型、结果、错误码、Token 数和扣费 | 否 |
list_keys | 有效密钥,以及它们的上限和本月花费 | 否 |
create_key | 创建新密钥,可设或不设消费上限 | 是 |
update_key | 重命名密钥,或设置、修改、移除它的上限 | 是 |
revoke_key | 撤销密钥 | 是 |
create_upload | 一个用来上传本地图片的链接,以及发给模型的链接 | 否 |
所有输入、输出和拒绝情况都在 MCP 工具中。
限制
| 限制 | 数量 |
|---|---|
| MCP 请求 | 每个密钥每分钟 60 次,最多同时 20 个 |
| Agent 通过 MCP 创建的密钥 | 任意 24 小时内 20 个 |
| 有效密钥 | 每个 Agent 10 个,你的账户 10 个 |
| 图片上传 | 每个 Agent 任意 24 小时内 200 次 |
超出请求速率的密钥会收到 429,需要等待的时间在 retry-after 中。这些限制按密钥计算,所以一个繁忙的密钥不会拖慢该 Agent 的其他密钥。模型调用有它们自己的速率限制。get_limits 会返回以上所有限制。
安全须知
- 新密钥会显示在对话中。
create_key只返回一次密钥,而且 Agent 的模型能看到它。请让 Agent 直接把它存入环境变量或机密存储,也不要在你会分享出去的对话中创建密钥。 - 每次请求都会检查密钥。 你在 API 密钥页面撤销的密钥会立即停止工作,在这里也一样。
- Agent 做的每件事你都能看到。 它创建的密钥会出现在你的 API 密钥页面上,标注“通过 MCP 创建”以及创建它的密钥,你可以在那里为它们设置上限或撤销它们。
- 这些工具免费。 它们不花任何额度,只有模型调用才花。上传需要 Agent 有额度,因为上传是为了把图片发给模型。