大模型应用系统篇
大约 1 分钟

大模型应用系统篇
前端、后端、大模型服务如何协同?从接口设计到多轮对话管理,搭建完整的 AI 应用。
本篇关注大模型应用的系统架构:基本架构设计、前后端协同、接口调用流程、流式输出(SSE vs WebSocket)、多轮对话历史管理、上下文长度优化、Prompt 模板系统、缓存策略,以及 AI 面试助手和知识库问答系统的实战设计。
本篇内容
| 序号 | 文章 | 状态 |
|---|---|---|
| 1 | 大模型应用系统的基本架构是什么? | 持续更新中 |
| 2 | 前端、后端、大模型服务如何协同? | 持续更新中 |
| 3 | 大模型接口调用流程应该怎么设计? | 持续更新中 |
| 4 | 流式输出 SSE 和 WebSocket 有什么区别? | 持续更新中 |
| 5 | 多轮对话历史应该怎么管理? | 持续更新中 |
| 6 | 上下文长度不够怎么办? | 持续更新中 |
| 7 | Prompt 模板系统应该怎么设计? | 持续更新中 |
| 8 | 大模型应用如何做缓存? | 持续更新中 |
| 9 | 如何设计一个 AI 面试助手? | 持续更新中 |
| 10 | 如何设计一个企业知识库问答系统? | 持续更新中 |
