OpenRouter(openrouter.ai)的
API Key 与 Agnes 上游 Key 相互独立、互不通用:
在 openrouter.ai 注册后在 Keys 页面创建(sk-or- 开头)。
支持添加多个 Key 组成池子——系统会自动轮换分流,
某个 Key 被限流(429)时自动冷却并换下一个,等于给免费额度做了负载均衡与故障转移。
思考强度 · 由控制台控制
OpenRouter 免费模型 · 官方实时数据
加载中…
控制台统一控制 Agnes 3.0 / 2.5 Flash 是否启用 Thinking 模式。调用方(含外部 API、聊天测试页)传入的
thinking 参数一律被服务端忽略,用户无法自行开关或调档。
支持任意 OpenAI SDK:把 base_url 指向上方地址、api_key 填平台 Key 即可。
流式响应切换上游时会下发 event: switched,客户端应据此丢弃已接收的半截内容。
模式开关写在请求头 X-Agnes-Mode 里:think 才思考、reply 普通回复(默认)、
vision 看图。不带头 = 不思考(最快)。三张卡片分别是三种模式的完整示例。
自定义请求头 X-Agnes-Mode 速查
| 请求头 | 取值 | 行为 |
| Authorization | Bearer <平台Key> | 鉴权(必带) |
| Content-Type | application/json | 请求体类型(必带) |
| X-Agnes-Mode | think | 思考模式,档位取控制台设定 |
| X-Agnes-Mode | think:max | 思考模式 + 指定档位(low / medium / high / xhigh / max) |
| X-Agnes-Mode | reply | 普通回复,关闭思考(默认,不带头即此模式) |
| X-Agnes-Mode | vision | 看图模式,自动路由到支持视觉的 space-bunny |
| X-Agnes-Mode | vision:max | 看图 + 思考(识图需要推理时用) |
思考内容单独走 reasoning_content(兼容 reasoning / content 里的 <think>),
正文走 content,客户端可分别展示。
V2 是重写的独立服务(端口 3390),V1(/v1,端口 3388)继续保留、行为不变。
V1 会把思考塞进 content 并包 <think> 兜底,导致同一段思考出现两次;
V2 彻底去掉这个包袱——思考只走 reasoning_content,content 保证不含 <think> 标签,
客户端不需要做任何解析。
| 端点 | 说明 |
| POST /v2/chat/completions | 对话补全(OpenAI 同款,支持 stream) |
| GET /v2/models | 模型列表 |
| GET /v2/health | 健康检查:Key 数、可用数、当前默认档位、累计指标 |
| GET /v2/test | 浏览器自测页:分栏看思考 / 正文 / 原始 SSE |
| 请求头 | 取值 | 行为 |
| Authorization | Bearer <平台Key> | 鉴权(必带) |
| Content-Type | application/json | 请求体类型(必带) |
| X-Agnes-Reasoning | low / medium / high / xhigh / max | 思考档位 |
| X-Agnes-Reasoning | off | 关闭思考(最快) |
不带 X-Agnes-Reasoning 时用服务端默认档位(控制台设定,默认 max)。
也可以在 body 里写 "reasoning":{"effort":"high"} 或
"reasoning_effort":"high",优先级:请求头 > body。
每次响应都会带 X-Agnes-V2-Think 与 X-Agnes-V2-Think-Source 诊断头,
方便确认实际生效的档位。