加载中...
  • AI 应用后端工程化:从原型到可交付系统loading

    原创系列 · AI 后端工程

    沿着一条真实的 110 次提交时间线,拆解服务边界、数据管道、检索、工具、认证、工作流和生产化。文章弱化具体项目,重点解释可以迁移到普通 Web、数据平台与 AI 应用的工程方法。

    这套系列沿着 2025 年 3 月至 5 月的 110 条真实提交,从服务入口一路走到工作流、多模型与生产维护。项目只提供演进证据,正文重点解释可以迁移到其他后端系统的方法。

    25 篇文章按提交顺序安排在 2025-06-01 至 2025-09-29。每篇都有架构图、代码或协议切片、失败现场、跨场景迁移、练习和对应提交链接。

    发布周期:2025-06-01 至 2025-09-29 文章数量:25 演进提交:110

    第一章 · 服务基础

    1. 01
      从一段脚本到一个服务:后端项目的最小骨架2025-06-01

      从入口、配置、模型客户端、异常边界和测试五个位置,搭起一个能继续演进的后端骨架。

    2. 02
      数据库不是连上就完:模型、事务与迁移如何协作2025-06-06

      数据库接入真正困难的是结构如何演进、失败如何回滚,以及开发环境和生产环境如何保持一致。

    3. 03
      Prompt 也需要工程化:组合、并行、追踪与访问边界2025-06-11

      把提示词从字符串提升为可组合流程,并理解并行执行、调用追踪和浏览器访问边界分别解决什么问题。

    4. 04
      对话为什么会失忆:短期记忆、Token 预算与状态窗口2025-06-16

      从会话历史和 Token 缓冲区出发,理解模型为什么没有天然记忆,以及应用应该保留什么。

    第二章 · 知识与工具

    1. 05
      RAG 不只是向量库:从文档到答案的完整链路2025-06-21

      串起装载、清洗、切片、嵌入、索引、检索与生成,解释每一环如何影响最终答案。

    2. 06
      当模型开始调用工具:从聊天链到可执行流程2025-06-26

      模型提出结构化意图,应用验证并执行工具,再把结果放回对话;这才构成真正的闭环。

    3. 07
      工具一多就乱:分类、元数据、发现和测试2025-07-01

      当工具从两个增长到几十个时,分类、描述、参数、图标和测试共同决定它们是否仍然可用。

    4. 08
      把 OpenAPI 变成可调用工具:Schema 是桥梁,不只是文档2025-07-06

      解析接口规范、选择操作、补齐认证并生成工具定义,说明 Schema 如何连接模型意图与 HTTP API。

    5. 09
      动态工具管理:CRUD、分页、注册表与运行时装载2025-07-11

      从管理接口走到运行时 Provider Manager,理解配置数据如何变成模型真正能够调用的能力。

    第三章 · 数据管道

    1. 10
      文件上传只是入口:数据接入与日志可观测性2025-07-16

      文件落盘只是第一步,还要记录所有者、类型、状态和调用轨迹,才能让后续处理可恢复、可追踪。

    2. 11
      异步知识库管道:任务队列、缓存、状态与密钥治理2025-07-21

      把耗时文档处理移出请求线程,并用任务状态、缓存和配置边界承接失败与重试。

    3. 12
      一份文档如何变成可检索知识:解析、分词、切片与嵌入2025-07-26

      沿数据进入索引前的路径,解释文件解析、中文分词、文本切片、嵌入和片段管理各自承担什么责任。

    4. 13
      混合检索如何落地:全文、语义、召回测试与可编辑片段2025-07-31

      比较关键词检索与向量检索的互补关系,并用召回测试和片段编辑建立质量反馈回路。

    第四章 · 会话与安全

    1. 14
      把一次对话当作事件流:消息、推理步骤与工具结果2025-08-05

      将会话、消息、推理步骤和队列事件拆开建模,让流式输出、工具调用和失败恢复都有落点。

    2. 15
      小问题为什么会拖垮系统:编码、依赖与兼容性债务2025-08-10

      从 UTF-8 读取失败和依赖版本整理出发,说明边界问题为什么总在换环境、换文件、换版本时爆发。

    3. 16
      登录之外的认证体系:账号、密码、JWT、OAuth 与资源隔离2025-08-15

      从账号模型到密码哈希、令牌解析、第三方登录和资源所有权,建立一条完整认证链。

    4. 17
      可发布配置如何设计:草稿、版本、回滚与调试会话2025-08-20

      把正在编辑、已经发布和历史版本分开,让配置既能频繁修改,又能稳定对外提供服务。

    第五章 · 产品化接口

    1. 18
      README 不是门面:让文档成为系统契约2025-08-25

      通过一轮文档新增、修正和更新,讨论 README 如何约束安装、配置、运行方式与维护入口。

    2. 19
      面向外部调用的 API:辅助 AI、API Key 与终端用户2025-08-30

      当能力从后台功能变成公开 API,需要重新处理密钥、调用者身份、应用配置、错误和响应协议。

    3. 20
      配置驱动的应用管理:复制、分页、内置模板与统一配置2025-09-04

      从读取草稿配置到复制、删除、分页和内置模板,解释产品能力如何沉淀为可管理的数据。

    第六章 · 编排与模型

    1. 21
      工作流引擎的最小模型:节点、边、变量、执行与校验2025-09-09

      用节点、边和变量表达执行图,再引入节点协议、数据传递和运行前校验,构成工作流引擎的核心。

    2. 22
      多模型接入如何不失控:Provider、参数模板与能力差异2025-09-14

      抽离模型实体、供应商配置和参数模板,在统一入口下保留不同模型的能力差异与默认策略。

    3. 23
      ReAct 的工程实现:思考、行动、观察与停止条件2025-09-19

      把 ReAct 从提示词名词还原为一个带消息协议、工具执行、错误反馈和停止条件的循环。

    第七章 · 生产化收束

    1. 24
      生产化收尾:工作流权限、应用凭证与会话 API2025-09-24

      把工作流校验、工具权限、应用凭证和会话管理串成一条生产请求路径,补齐跨模块边界。

    2. 25
      当系统开始变慢或变脆:日志、索引、向量库与依赖兼容2025-09-29

      从日志初始化、向量数据库替换、关系库索引和依赖兼容收束系统,建立持续维护的判断顺序。

    本文目录
    本文目录