兼容 OPENAI · 浏览器直连

LLM API Tester

直接从此浏览器调用模型、聊天完成和响应 API。键、提示和响应不通过 ComUtil。

就绪
01

端点配置文件

已保存在此浏览器中
02

联系

已保存在此浏览器中
端点路径和自定义标头

自定义标头

03

要求

直接到目标API

留言

附加主体 JSON

添加特定于提供商的字段。无法覆盖托管表单字段。

请求预览

{}
浏览器边界

目标提供商直接接收请求。此源上的浏览器扩展和脚本仍然可以读取 localStorage。

CORS 和本地服务器

自定义和本地主机端点必须允许此页面来源、授权和内容类型标头以及选项请求。

检查员行为

不受支持的响应请求按原样报告,并且永远不会通过聊天完成重试。

什么是 LLM API 测试器?

LLM API 测试器会向模型端点发送真实请求,并原样展示返回的内容:HTTP 状态、流式返回的 token、原始事件日志,以及服务商报告的用量。它在浏览器中运行,因此请求会从你的设备直接发往你配置的端点,不经过需要保管密钥的中间服务器。

工作方式

先保存包含基础 URL、模型和凭据的配置,然后以 Chat Completions 或 Responses 模式发送请求。浏览器直接调用端点,按到达顺序渲染服务器发送事件,同时测量首个 token 时间和整体往返时间。配置和密钥只留在本浏览器的本地存储中,生成的 curl 命令会把 API 密钥和自定义请求头的值替换成占位符,可以放心粘贴到工单里。

常见使用场景
  • 在写入代码前确认新的 API 密钥、基础 URL 或网关路由是否有响应
  • 比较不同模型或服务商的首个 token 时间与每秒 token 数
  • 确认模型前面的代理是真的在流式返回,还是把整段回答缓冲后一次性给出
  • 用客户端实际发送的请求头复现 4xx 响应
  • 把可复现请求但已脱敏的 curl 命令交给同事
每次运行会报告什么
  • 端点返回的 HTTP 状态与响应头
  • 首个 token 时间、总耗时和每秒 token 数
  • 服务商报告的用量数据
  • 不只是拼好的答案,还有流式返回的原始事件日志
  • 已脱敏 API 密钥和自定义请求头值的 curl 命令
示例
输入: https://api.openai.com/v1 + gpt-4o-mini
输出: 200 OK,首个 token 480 毫秒,每秒 62 个 token
输入: X-Private-Test: HEADER-SECRET
输出: 随请求发送,但在 curl 输出中已脱敏
输入: stream: true
输出: 原始日志按到达顺序显示每个增量事件
常见问题

我的 API 密钥会发送到 ComUtil 服务器吗?

不会。请求从你的浏览器直接发往你配置的端点,密钥只保存在本浏览器的本地存储中,清除站点数据即可删除。

它支持哪些 API?

任何提供 Chat Completions 或 Responses 的 OpenAI 兼容端点都可以,包括自建的网关和代理,只要请求与响应结构一致。

密钥没错,为什么请求还是报网络错误?

浏览器发出的请求需要服务商允许跨域调用。如果端点不返回 CORS 响应头,浏览器会在你的代码看到响应之前就将其拦截。可以在模型前面加一层返回 CORS 头的网关,或者在终端里执行同样的 curl 命令。

看到的流式输出是真的流式吗?

是的。服务器发送事件按到达顺序渲染,原始日志保留每一个事件,因此你能分辨真正的流式返回和只是看起来渐进的缓冲响应。

如何安全地分享一个失败的请求?

复制生成的 curl 命令即可。API 密钥和自定义请求头的值会替换为占位符,因此命令能展示请求的结构而不泄露凭据。