动手实战 · 从能跑的 Demo 到能用的产品

本章从哪来:示例系统 开发实录

本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应

本页解决的问题

先给结论

「本章从哪来:示例系统 开发实录」要解决的关键问题是什么?

本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应

判断标准

让这个结论先证明自己值得留下。 把这一页当成决策工具,而不是需要背下来的定义。把概念连到一个真实任务、一个可观察结果,以及一个能改变你判断的失败上。

下一步

写下一个问题:试完这个方法后,你能用什么证据回答它?

常见误区

结论听起来很完整,却没有检查最关键的假设。

产品的另一面。 「记住你的偏好」「召集不同领域的专业 Agent」——官网上的每一句宣传语,背后都是一套真实的工程系统:长期记忆、多 Agent 协作、循环控制、上下文压缩、权限审批、MCP 双向生态。本章就是把这些系统逐一拆开给你看。
用数字认识 示例系统
~500,000
行代码规模
Electron + React + TypeScript
132
个内置工具
按需注入,不全塞
10+
家模型供应商接入
三协议适配 + 统一路由
8
大工程模块
与本章小节一一对应
本章 8 个小节 = 示例系统 的 8 个真实模块
🎨AI 生图
示例系统 的形象要靠生图保持一致——多模型降级链 + 垫图锚定角色,模型挂了自动切换,用户无感
🔄Agent Loop
主循环配了防卡死机制:流失败四级恢复(限流退避 → 换模型 → 断点续传 → 可区分报错)、工具失败熔断、会话防重复派单
🗜️上下文管理
五层压缩流水线:裁剪 → 掐除旧结果 → 微压缩 → 折叠 → 自动全量压缩,用户的原话最后才动
🧠长期记忆
「见面就记住你」的背后:守门员筛选什么值得记、向量检索 + LLM 判定新增 / 合并 / 冲突、检索命中才注入
🧩Prompt Harness
System Prompt 分层组装:身份、环境、工具指引各自独立;稳定层放前面最大化缓存命中;Skill 文件即配置
👥多 Agent
并行子代理 + 多角色脑暴 + 定时任务,示例系统 的「朋友」们就是一个 Agent 协作网络
🔐权限与安全
五级权限模式 + 风险分级审批弹窗,配套事件流日志和每条消息的 Token / 成本追踪
🔌MCP 实战
双向 MCP:既消费别人的工具(懒连接,不用不连),也把自己暴露成 MCP server,甚至能自己配置新连接
这一章你能学到什么
「调通 API」和「用户能用」之间差了什么?
以生图为例走一遍产品化清单:降级、兜底、一致性、体验,每一项都是 Demo 里看不到的。
Agent 为什么会卡死、跑飞、烧钱?
循环失控的典型模式,以及上限、检测、降级三类防呆设计——产品经理该在哪里画线。
对话越长越贵越笨,怎么办?
上下文压缩的决策框架:什么能删、什么不能删、什么要花钱压;长期记忆怎么筛选、冲突、注入。
Prompt 怎么从一坨文本变成可运营的架构?
分层管理、按需加载、Skill 模块化,以及提示词改动和 KV Cache 之间的微妙账本。
什么时候需要多个 Agent?代价是什么?
并行、脑暴、定时任务三种真实场景,以及并发安全与成本陷阱的判断方法。
怎么给 Agent 上缰绳、接生态?
权限分级与 Human-in-the-loop 的平衡点,可观测性,以及 MCP 双向生态的接入策略。
本章的每一个知识点,都在 示例系统 里真实跑着。所以你学到的不是「理论上应该这样」,而是「实际做下来是这样」——包括那些教程里不会写、只有上了生产环境才会遇到的坑。带着「如果是我的产品,我会怎么决策」的问题往下看,收获最大。

「用数字认识 示例系统」为什么能找到相关内容

「本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应」把检索问题从“把资料存起来”推进到“怎样找到真正相关的资料”。这一步决定了 RAG、推荐和以图搜图最后交给模型的输入质量。

相似度不是答案,召回之后还要核对

在「本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应」对应的流程里,Embedding 负责把对象放到可比较的语义空间,近邻索引负责减少搜索范围,最终的回答仍然依赖召回片段是否覆盖问题、距离指标是否合适,以及内容有没有过期。

先区分找得到和找得准

把「本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应」落成一次小测试:准备几条有明确答案的查询,记录召回的相关性、遗漏和无关结果,再决定是否需要换切分方式、索引或重排。

从「用数字认识 示例系统」走到「本章 8 个小节 = 示例系统 的 8 个真实模块」

「用数字认识 示例系统」先把问题落在「~500,000 行代码规模 Electron + React + TypeScript 132 个内置工具 按需注入,不全塞 10+ 家模型供应商接入 三协议适配 + 统一路由 8 大工程模块 与本章小节一一对应」上;到了「本章 8 个小节 = 示例系统 的 8 个真实模块」,讨论继续推进到「🎨 AI 生图 示例系统 的形象要靠生图保持一致—— 多模型降级链 + 垫图锚定角色 ,模型挂了自动切换,用户无感 🔄 Agent Loop 主循环配了 防卡死机制 :流失败四级恢复(限流退避 → 换模型 → 断点续传 → 可区分报错)、工具失败熔断、会话防重复派单 🗜️ 上下文管理 五层压缩流水线 :裁剪 → 掐除旧结果 → 微压缩 → 折叠 → 自动全量压缩,用户的原话最后才动 🧠 长期记忆 「见面就记住…」。两段连起来,重点就不只是记住一个结论,而是看清它成立所依赖的条件。

把这条判断带到下一个场景

检索系统也可以这样看:先确定什么算相关,再观察召回是否覆盖问题,最后检查排序、切分和时效性有没有把真正有用的内容挤出去。

  • 「用数字认识 示例系统」:~500,000 行代码规模 Electron + React + TypeScript 132 个内置工具 按需注入,不全塞 10+ 家模型供应商接入 三协议适配 + 统一路由 8 大工程模块 与本章小节一一对应
  • 「本章 8 个小节 = 示例系统 的 8 个真实模块」:🎨 AI 生图 示例系统 的形象要靠生图保持一致—— 多模型降级链 + 垫图锚定角色 ,模型挂了自动切换,用户无感 🔄 Agent Loop 主循环配了 防卡死机制 :流失败四级恢复(限流退避 → 换模型 → 断点续传 → 可区分报错)、工具失败熔断、会话防重复派单 🗜️ 上下文管理 五层压缩流水线 :裁剪 → 掐除旧结果 → 微压缩 → 折叠 → 自动全量压缩,用户的原话最后才动 🧠 长期记忆 「见面就记住…
  • 「这一章你能学到什么」:「调通 API」和「用户能用」之间差了什么? 以生图为例走一遍产品化清单:降级、兜底、一致性、体验,每一项都是 Demo 里看不到的。 Agent 为什么会卡死、跑飞、烧钱? 循环失控的典型模式,以及上限、检测、降级三类防呆设计——产品经理该在哪里画线。 对话越长越贵越笨,怎么办? 上下文压缩的决策框架:什么能删、什么不能删、什么要花钱压;长期记忆怎么筛选、冲突、注入。 Prompt 怎么从一坨文本变成可运营的架构?…

最后的「这一章你能学到什么」把讨论落到「「调通 API」和「用户能用」之间差了什么? 以生图为例走一遍产品化清单:降级、兜底、一致性、体验,每一项都是 Demo 里看不到的。 Agent 为什么会卡死、跑飞、烧钱? 循环失控的典型模式,以及上限、检测、降级三类防呆设计——产品经理该在哪里画线。 对话越长越贵越笨,怎么办? 上下文压缩的决策框架:什么能删、什么不能删、什么要花钱压;长期记忆怎么筛选、冲突、注入。 Prompt 怎么从一坨文本变成可运营的架构?…」。回看这条线索时,最值得保留的是:当输入、规模或风险改变,哪些判断需要重新做一遍。

标记为已学完 阅读进度会自动记录
← 上一篇下一篇 →

继续阅读

同一条线上的下一篇。

文章讨论

读到这里,留下一个判断。

把刚想明白的地方、还没想通的问题,留给下一位一起学习的人。

正在讨论 本章从哪来:示例系统 开发实录 从能跑的 Demo 到能用的产品
3条讨论文章讨论 · 与共学社区同步
在共学社区查看
AM
Asha Morgan内容编辑
观点实践记录

我把这篇文章里的一个判断改写成了今天可以验证的小实验。比记住结论更有用的是,知道下一步要观察什么。

文章讨论7 有帮助
LH
Lin Harper独立开发者
观点观点

读完以后我先回头找它成立的条件,而不是直接把方法搬进项目。这个顺序让后面的取舍清楚很多。

文章讨论5 有帮助
KM
Kiki Moore产品运营
问题问题

如果把这个判断放到真实工作里,最先需要补的约束是什么?我想知道从阅读到第一次实践之间,哪一步最值得先做。

文章讨论4 有帮助