MCP 服务器

让你的 Agent 查看自己的额度、用量和上限,管理自己的密钥,并上传图片。

连接 bInference MCP 服务器后,你的 Agent 可以自己回答“我还剩多少 AI 预算?”,为新的工作进程创建密钥,或撤销不再需要的密钥。它用调用模型时已经在用的那个 binf_ 密钥登录。

https://binference.io/api/mcp

密钥能做什么

每个工具都作用于拥有该密钥的 Agent 或账户。一个密钥永远看不到其他 Agent。

设置了消费上限的密钥没有上限的密钥
读取额度、用量、调用记录、上限和密钥可以可以
上传图片供模型读取可以可以
创建、修改和撤销密钥不可以可以

设置了上限的密钥只能读取,所以它永远无法给自己创建一个没有上限的密钥。没有上限的密钥本来就能花光全部余额,所以管理密钥并不会让它多花任何钱。

该连接哪个密钥

如果你的 Agent 只需要盯着自己的预算,就连接一个设置了每日上限的密钥。只有当你信任某个 Agent 去管理密钥时,才给它连接没有上限的密钥。

连接

claude mcp add --transport http binference https://binference.io/api/mcp --header "Authorization: Bearer binf_..."

加上 --scope user 就能在所有项目中使用。然后在 Claude Code 中运行 /mcp:binference 会显示为已连接。

其他客户端只要能连接 Streamable HTTP 服务器并发送请求头,用法都一样。只能通过浏览器登录(OAuth)连接的应用,比如 Claude Desktop、ChatGPT、Grok 和 Muse,暂时还无法连接。

在你自己的代码中使用

使用官方 MCP SDK:npm install @modelcontextprotocol/client,Python 则用 pip install "mcp>=2.2"。

import { Client, StreamableHTTPClientTransport } from "@modelcontextprotocol/client";

const client = new Client({ name: "my-agent", version: "1.0.0" });
await client.connect(
  new StreamableHTTPClientTransport(new URL("https://binference.io/api/mcp"), {
    requestInit: { headers: { Authorization: `Bearer ${process.env.BINF_API_KEY}` } },
  }),
);

const balance = await client.callTool({ name: "get_balance", arguments: {} });
console.log(balance.structuredContent);

试一试

问你的 Agent:

How much bInference credit do I have, and how much of it expires this week?

它会调用 get_balance,根据现在能花多少以及每天有多少到期来回答。

你问Agent 使用
“这周我在 AI 上花了多少,花在哪些模型上?”get_usage
“我最近几次调用为什么失败了?”list_calls
“这个密钥离它的每日上限还有多远?”get_limits
“创建一个叫 worker-2 的密钥,每日上限 $5。”create_key
“撤销名为 laptop 的密钥。”list_keys,然后 revoke_key
“描述一下 ./bug.png 这张截图。”create_upload,然后调用模型

工具

工具作用需要没有上限的密钥
get_balance新调用现在能花多少、运行中的调用占用多少、什么时候有多少到期否
get_limits密钥的消费上限,以及 Agent 的调用限制否
get_usage按天和按模型统计的花费,最多可查 90 天否
list_calls最近的调用,包括模型、结果、错误码、Token 数和扣费否
list_keys有效密钥,以及它们的上限和本月花费否
create_key创建新密钥,可设或不设消费上限是
update_key重命名密钥,或设置、修改、移除它的上限是
revoke_key撤销密钥是
create_upload一个用来上传本地图片的链接,以及发给模型的链接否

所有输入、输出和拒绝情况都在 MCP 工具中。

限制

限制数量
MCP 请求每个密钥每分钟 60 次,最多同时 20 个
Agent 通过 MCP 创建的密钥任意 24 小时内 20 个
有效密钥每个 Agent 10 个,你的账户 10 个
图片上传每个 Agent 任意 24 小时内 200 次

超出请求速率的密钥会收到 429,需要等待的时间在 retry-after 中。这些限制按密钥计算,所以一个繁忙的密钥不会拖慢该 Agent 的其他密钥。模型调用有它们自己的速率限制。get_limits 会返回以上所有限制。

安全须知

  • 新密钥会显示在对话中。 create_key 只返回一次密钥,而且 Agent 的模型能看到它。请让 Agent 直接把它存入环境变量或机密存储,也不要在你会分享出去的对话中创建密钥。
  • 每次请求都会检查密钥。 你在 API 密钥页面撤销的密钥会立即停止工作,在这里也一样。
  • Agent 做的每件事你都能看到。 它创建的密钥会出现在你的 API 密钥页面上,标注“通过 MCP 创建”以及创建它的密钥,你可以在那里为它们设置上限或撤销它们。
  • 这些工具免费。 它们不花任何额度,只有模型调用才花。上传需要 Agent 有额度,因为上传是为了把图片发给模型。

本页目录