Agnes API 网关管理台

多 Key 智能调度 · 故障自动切换 · 熔断冷却 · 实时状态
已连接 · --:--:--
上游 Key
-
可用 -
累计调用
-
切换 -
成功率
-
失败 -
首字节延迟
-
平均响应
进行中
-
活跃流
冷却中
-
异常隔离
Token 消耗
-
提示 / 补全 -

模型调用统计

模型 调用次数 提示 Token 补全 Token 合计 Token

添加上游 Key

上游 Key 状态

#Key节点状态 成功失败并发 最近调用操作

OpenRouter 控制台

未接入

OpenRouter(openrouter.ai)的 API Key 与 Agnes 上游 Key 相互独立、互不通用: 在 openrouter.ai 注册后在 Keys 页面创建(sk-or- 开头)。
支持添加多个 Key 组成池子——系统会自动轮换分流, 某个 Key 被限流(429)时自动冷却并换下一个,等于给免费额度做了负载均衡与故障转移。

思考强度 · 由控制台控制

OpenRouter 免费模型 · 官方实时数据

加载中…

Agnes 文本模型 · 思考模式

已开启

控制台统一控制 Agnes 3.0 / 2.5 Flash 是否启用 Thinking 模式。调用方(含外部 API、聊天测试页)传入的 thinking 参数一律被服务端忽略,用户无法自行开关或调档。

平台 API Key

外部调用凭据 · API Key

每个 Key 独立统计调用次数与Token 消耗。列表中以星号遮蔽, 点击眼睛可临时查看、点击复制可反复复制;新建时明文仅展示一次,请立即保存。

名称Key调用 Token状态操作

聊天测试

进入独立聊天界面:可切换 3 个模型、实时展示 AI 的 思考过程 与输出,思考完成后自动折叠为聊天会话。 OpenRouter(Space Bunny Alpha)的思考强度、Agnes 文本模型的思考开关均由本控制台统一控制,用户无法自行调节。

Agent 编程工作台

超级编程智能体:多会话隔离工作区(数据盘),可执行 终端命令、联网搜索、AI 生图、 文件读写、git 克隆,任务结束自动交付最重要的 3 个文件(APK / 压缩包优先)。 内置 Skills:液态玻璃、安卓 Kotlin、网页前端。

调用日志

全部 API 调用 完成 切换 错误 开始

外部程序接入

OpenAI 兼容接口
支持任意 OpenAI SDK:把 base_url 指向上方地址、api_key 填平台 Key 即可。 流式响应切换上游时会下发 event: switched,客户端应据此丢弃已接收的半截内容。
模式开关写在请求头 X-Agnes-Mode 里:think 才思考、reply 普通回复(默认)、 vision 看图。不带头 = 不思考(最快)。三张卡片分别是三种模式的完整示例。

自定义请求头 X-Agnes-Mode 速查

请求头取值行为
AuthorizationBearer <平台Key>鉴权(必带)
Content-Typeapplication/json请求体类型(必带)
X-Agnes-Modethink思考模式,档位取控制台设定
X-Agnes-Modethink:max思考模式 + 指定档位(low / medium / high / xhigh / max)
X-Agnes-Modereply普通回复,关闭思考(默认,不带头即此模式)
X-Agnes-Modevision看图模式,自动路由到支持视觉的 space-bunny
X-Agnes-Modevision:max看图 + 思考(识图需要推理时用)
思考内容单独走 reasoning_content(兼容 reasoning / content 里的 <think>), 正文走 content,客户端可分别展示。

V2 接口 · 思考字段纯净版/v2

V2 是重写的独立服务(端口 3390),V1(/v1,端口 3388)继续保留、行为不变。 V1 会把思考塞进 content 并包 <think> 兜底,导致同一段思考出现两次; V2 彻底去掉这个包袱——思考只走 reasoning_content,content 保证不含 <think> 标签, 客户端不需要做任何解析。
端点说明
POST /v2/chat/completions对话补全(OpenAI 同款,支持 stream)
GET /v2/models模型列表
GET /v2/health健康检查:Key 数、可用数、当前默认档位、累计指标
GET /v2/test浏览器自测页:分栏看思考 / 正文 / 原始 SSE
请求头取值行为
AuthorizationBearer <平台Key>鉴权(必带)
Content-Typeapplication/json请求体类型(必带)
X-Agnes-Reasoninglow / medium / high / xhigh / max思考档位
X-Agnes-Reasoningoff关闭思考(最快)
不带 X-Agnes-Reasoning 时用服务端默认档位(控制台设定,默认 max)。 也可以在 body 里写 "reasoning":{"effort":"high"} 或 "reasoning_effort":"high",优先级:请求头 > body。 每次响应都会带 X-Agnes-V2-Think 与 X-Agnes-V2-Think-Source 诊断头, 方便确认实际生效的档位。
V2 接入示例