前面几篇讲的 “调 LLM” · 一直被当作 一个原子操作 : 1 response = call_llm(messages) 实际不是。 Anthropic API 用 Server-Sent Events(SSE) 流式返回 —— LLM 一边生成 · 一边把结果 分片 发给客户端。 用户在 Claude Code 里看到文字逐字冒出来 · 不是”整段生成完再展示” · 是 SSE 分片实时流…
前面几篇讲的 “调 LLM” · 一直被当作 一个原子操作 : 1 response = call_llm(messages) 实际不是。 Anthropic API 用 Server-Sent Events(SSE) 流式返回 —— LLM 一边生成 · 一边把结果 分片 发给客户端。 用户在 Claude Code 里看到文字逐字冒出来 · 不是”整段生成完再展示” · 是 SSE 分片实时流…
讨论
登录后参与讨论
还没有评论,来说第一句吧。