实用工具

大模型 SSE 流式响应解析器

粘贴 OpenAI、Anthropic、Gemini 或任意 OpenAI 兼容接口的原始流式响应,还原出完整回答、工具调用、推理内容和 Token 用量。

浏览器本地运行AI 开发工具1.1万
免费

输入

0 B

结果

结果会显示在这里。

流式调用出问题时,手里通常只有一份满是 data: 行的日志——几百个细碎的 JSON 片段,读起来非常痛苦。这个工具把它们重新拼起来。它按 openai-node(openai/openai-node,Apache-2.0)和 Anthropic SDK 实现的 WHATWG 规则解析事件流,识别每个事件的数据格式,然后给出拼好的回答、参数已拼接完整的工具调用、结束原因、模型名和 Token 用量。

它是怎么工作的

  • 支持四种格式:OpenAI Chat Completions 及所有兼容它的接口(DeepSeek、通义千问、Groq、vLLM、Ollama 的 /v1)、OpenAI Responses、Anthropic Messages,以及 Gemini 的 streamGenerateContent。
  • CR、LF、CRLF 三种换行,多行 data 字段,: keep-alive 这样的注释行,以及缺少最后一个空行的情况,都按标准处理。
  • 推理内容——DeepSeek 的 reasoning_content、Anthropic 的 thinking 增量、Gemini 的 thought 片段、OpenAI 的推理摘要——单独收集,打开开关后显示在回答上方。
  • 不是合法 JSON 的事件会连同行号列出来,而不会中断解析;丢失了事件间空行的日志也会被重新拆成独立事件。

你的数据去了哪里

哪也没去。本工具完全在你的浏览器里运行:你粘贴的文本由页面处理,不会传输到任何服务器,也不会写进任何日志。

本工具免费且无需登录,运行结果只存在于你当前的页面里,不会被保存到任何地方。

它要花多少

本工具完全免费,不需要登录,也不消耗积分。

常见问题

怎么拿到原始的流式响应?
用 curl 时在请求里加上 -N(关闭缓冲),把输出复制下来即可。在浏览器里,开发者工具的“网络”面板会显示该请求的 EventStream 视图或原始响应。在自己的代码里,可以在 SDK 解析之前把每一行打印出来。
为什么提示流不完整?
没有收到结束原因,也没有 [DONE] 或 message_stop,说明连接很可能在模型写完之前就断开、超时或被代理截断了。先看输出里有没有流错误,再检查代理和负载均衡的超时设置,它们常常在 60 秒时切断长时间的流。
为什么没有 Token 用量?
OpenAI 的 Chat Completions 接口只有在请求里设置 stream_options: {"include_usage": true} 时,才会在最后一个分块里带上用量,很多兼容接口也是如此。Anthropic 在 message_start 和 message_delta 里发送用量,Gemini 在 usageMetadata 里,Responses 接口在 response.completed 里,只要有就会显示。
n > 1 或有多个 choice 时会怎样?
只拼接 choice 0。一次流里请求多个结果时,它们会按 index 交错出现,混在一起只会得到乱码;如果需要其他结果,请先把对应 index 的行筛出来再粘贴。

背后的开源项目

本工具是独立实现,并未打包第三方库。openai/openai-node(Apache-2.0)在代码层面做的是同一件事——如果你需要在自己的程序里实现它,从那里开始,而不是调用一个网页。

openai/openai-node

也常被称作

  • sse 解析
  • 流式响应解析
  • openai stream 解析
  • server-sent events
  • 大模型流式输出调试
  • sse decoder