原创系列 · AI 后端工程
沿着一条真实的 110 次提交时间线,拆解服务边界、数据管道、检索、工具、认证、工作流和生产化。文章弱化具体项目,重点解释可以迁移到普通 Web、数据平台与 AI 应用的工程方法。
这套系列沿着 2025 年 3 月至 5 月的 110 条真实提交,从服务入口一路走到工作流、多模型与生产维护。项目只提供演进证据,正文重点解释可以迁移到其他后端系统的方法。
25 篇文章按提交顺序安排在 2025-06-01 至 2025-09-29。每篇都有架构图、代码或协议切片、失败现场、跨场景迁移、练习和对应提交链接。
第一章 · 服务基础
- 01从一段脚本到一个服务:后端项目的最小骨架2025-06-01
从入口、配置、模型客户端、异常边界和测试五个位置,搭起一个能继续演进的后端骨架。
- 02数据库不是连上就完:模型、事务与迁移如何协作2025-06-06
数据库接入真正困难的是结构如何演进、失败如何回滚,以及开发环境和生产环境如何保持一致。
- 03Prompt 也需要工程化:组合、并行、追踪与访问边界2025-06-11
把提示词从字符串提升为可组合流程,并理解并行执行、调用追踪和浏览器访问边界分别解决什么问题。
- 04对话为什么会失忆:短期记忆、Token 预算与状态窗口2025-06-16
从会话历史和 Token 缓冲区出发,理解模型为什么没有天然记忆,以及应用应该保留什么。
第二章 · 知识与工具
- 05RAG 不只是向量库:从文档到答案的完整链路2025-06-21
串起装载、清洗、切片、嵌入、索引、检索与生成,解释每一环如何影响最终答案。
- 06当模型开始调用工具:从聊天链到可执行流程2025-06-26
模型提出结构化意图,应用验证并执行工具,再把结果放回对话;这才构成真正的闭环。
- 07工具一多就乱:分类、元数据、发现和测试2025-07-01
当工具从两个增长到几十个时,分类、描述、参数、图标和测试共同决定它们是否仍然可用。
- 08把 OpenAPI 变成可调用工具:Schema 是桥梁,不只是文档2025-07-06
解析接口规范、选择操作、补齐认证并生成工具定义,说明 Schema 如何连接模型意图与 HTTP API。
- 09动态工具管理:CRUD、分页、注册表与运行时装载2025-07-11
从管理接口走到运行时 Provider Manager,理解配置数据如何变成模型真正能够调用的能力。
第三章 · 数据管道
- 10文件上传只是入口:数据接入与日志可观测性2025-07-16
文件落盘只是第一步,还要记录所有者、类型、状态和调用轨迹,才能让后续处理可恢复、可追踪。
- 11异步知识库管道:任务队列、缓存、状态与密钥治理2025-07-21
把耗时文档处理移出请求线程,并用任务状态、缓存和配置边界承接失败与重试。
- 12一份文档如何变成可检索知识:解析、分词、切片与嵌入2025-07-26
沿数据进入索引前的路径,解释文件解析、中文分词、文本切片、嵌入和片段管理各自承担什么责任。
- 13混合检索如何落地:全文、语义、召回测试与可编辑片段2025-07-31
比较关键词检索与向量检索的互补关系,并用召回测试和片段编辑建立质量反馈回路。
第四章 · 会话与安全
- 14把一次对话当作事件流:消息、推理步骤与工具结果2025-08-05
将会话、消息、推理步骤和队列事件拆开建模,让流式输出、工具调用和失败恢复都有落点。
- 15小问题为什么会拖垮系统:编码、依赖与兼容性债务2025-08-10
从 UTF-8 读取失败和依赖版本整理出发,说明边界问题为什么总在换环境、换文件、换版本时爆发。
- 16登录之外的认证体系:账号、密码、JWT、OAuth 与资源隔离2025-08-15
从账号模型到密码哈希、令牌解析、第三方登录和资源所有权,建立一条完整认证链。
- 17可发布配置如何设计:草稿、版本、回滚与调试会话2025-08-20
把正在编辑、已经发布和历史版本分开,让配置既能频繁修改,又能稳定对外提供服务。