之前做 AI 问答接口时,我先用了普通 JSON 响应。模型生成十几秒后,页面一次性显示完整答案。接口没有报错,但等待期间没有任何输出,使用体验很差。 Spring AI 的 ChatClient 支持返回 Flux<String> ,配合 WebFlux 可以把模型增量内容通过 SSE 发送到浏览器。基础实现不长,部署时还要处理代理缓冲、连接断开和错误格式。 引入依赖 项目需要 Spring W…
之前做 AI 问答接口时,我先用了普通 JSON 响应。模型生成十几秒后,页面一次性显示完整答案。接口没有报错,但等待期间没有任何输出,使用体验很差。 Spring AI 的 ChatClient 支持返回 Flux<String> ,配合 WebFlux 可以把模型增量内容通过 SSE 发送到浏览器。基础实现不长,部署时还要处理代理缓冲、连接断开和错误格式。 引入依赖 项目需要 Spring W…
讨论
登录后参与讨论
还没有评论,来说第一句吧。