GATEWAY OPERATIONS
总览
本地控制台
每一段回复,都有迹可循。
管理 Vertex 连接,查看流式传输与正文还原状态。
客户端接入
OPENAI COMPATIBLE将以下地址填入 SillyTavern 或其他兼容客户端。
API BASE URL
http://127.0.0.1:4781/v1API Key 使用本地网关密钥。刷新客户端模型列表后,选择保存的版本。
当前连接
已应用- 鉴权方式
- 未配置
- 项目 ID
- —
- 地区
- global
- 模型版本
- —
最近请求
配置你的连接
选择鉴权方式与服务等级,保存后立即用于新的请求。
一个模型,多种使用方式。
从 Google 目录添加模型,为每个版本保存独立的客户端名称。
01 选择上游模型
使用“连接配置”中当前填写的凭据读取 Google 模型目录,不发送推理请求。
尚未拉取。也可以手动填写模型 ID。
你的模型目录
填写连接凭据后,点击“拉取 Model List”。
支持 gemini-… 或 google/gemini-…;使用上方勾选的版本。
目录是 Google 发布的模型元数据,不代表项目、地区或 Flex / Priority 已获授权。Express 的目录接口可能不可用,可手动添加模型 ID 或使用服务账号拉取。
02 保存的模型版本
客户端通过名称选择可修改名称、上游模型和模式。保存后,客户端刷新模型列表即可选择。
已有工具调用、工具历史或结构化输出会跳过抗截断包装。流式参数支持取决于上游模型;失败时不会自动改换版本。
请求与还原记录
仅记录状态元数据。最近 200 条,关闭控制台后清空。
检查连接与流式还原
先确认配置,再按需发送一条短请求。
测试请求
最多 512 TOKENS固定提示词:写三行关于河流的短句。
测试将使用已应用的凭据与服务等级发送一次真实请求,可能产生 Google Cloud 费用。
响应结果
尚未测试测试完成后,在这里查看回复。