LLM API Tester
直接从此浏览器调用模型、聊天完成和响应 API。键、提示和响应不通过 ComUtil。
端点配置文件
联系
端点路径和自定义标头
自定义标头
要求
留言
附加主体 JSON
添加特定于提供商的字段。无法覆盖托管表单字段。
请求预览
{}
响应检查员
目标提供商直接接收请求。此源上的浏览器扩展和脚本仍然可以读取 localStorage。
自定义和本地主机端点必须允许此页面来源、授权和内容类型标头以及选项请求。
不受支持的响应请求按原样报告,并且永远不会通过聊天完成重试。
LLM API 测试器会向模型端点发送真实请求,并原样展示返回的内容:HTTP 状态、流式返回的 token、原始事件日志,以及服务商报告的用量。它在浏览器中运行,因此请求会从你的设备直接发往你配置的端点,不经过需要保管密钥的中间服务器。
先保存包含基础 URL、模型和凭据的配置,然后以 Chat Completions 或 Responses 模式发送请求。浏览器直接调用端点,按到达顺序渲染服务器发送事件,同时测量首个 token 时间和整体往返时间。配置和密钥只留在本浏览器的本地存储中,生成的 curl 命令会把 API 密钥和自定义请求头的值替换成占位符,可以放心粘贴到工单里。
- 在写入代码前确认新的 API 密钥、基础 URL 或网关路由是否有响应
- 比较不同模型或服务商的首个 token 时间与每秒 token 数
- 确认模型前面的代理是真的在流式返回,还是把整段回答缓冲后一次性给出
- 用客户端实际发送的请求头复现 4xx 响应
- 把可复现请求但已脱敏的 curl 命令交给同事
- 端点返回的 HTTP 状态与响应头
- 首个 token 时间、总耗时和每秒 token 数
- 服务商报告的用量数据
- 不只是拼好的答案,还有流式返回的原始事件日志
- 已脱敏 API 密钥和自定义请求头值的 curl 命令
https://api.openai.com/v1 + gpt-4o-mini
200 OK,首个 token 480 毫秒,每秒 62 个 token
X-Private-Test: HEADER-SECRET
随请求发送,但在 curl 输出中已脱敏
stream: true
原始日志按到达顺序显示每个增量事件
我的 API 密钥会发送到 ComUtil 服务器吗?
不会。请求从你的浏览器直接发往你配置的端点,密钥只保存在本浏览器的本地存储中,清除站点数据即可删除。
它支持哪些 API?
任何提供 Chat Completions 或 Responses 的 OpenAI 兼容端点都可以,包括自建的网关和代理,只要请求与响应结构一致。
密钥没错,为什么请求还是报网络错误?
浏览器发出的请求需要服务商允许跨域调用。如果端点不返回 CORS 响应头,浏览器会在你的代码看到响应之前就将其拦截。可以在模型前面加一层返回 CORS 头的网关,或者在终端里执行同样的 curl 命令。
看到的流式输出是真的流式吗?
是的。服务器发送事件按到达顺序渲染,原始日志保留每一个事件,因此你能分辨真正的流式返回和只是看起来渐进的缓冲响应。
如何安全地分享一个失败的请求?
复制生成的 curl 命令即可。API 密钥和自定义请求头的值会替换为占位符,因此命令能展示请求的结构而不泄露凭据。