动手实战
从能跑的 Demo 到能用的产品
沿着真实产品决策看清 Demo 和产品之间的距离:交互循环、上下文预算、记忆、权限、多 Agent 协作,以及模型跑偏后的恢复。
动手实战37篇札记
本页解决的问题
先给结论「从能跑的 Demo 到能用的产品」AI 学习路径适合解决什么问题?
沿着真实产品决策看清 Demo 和产品之间的距离:交互循环、上下文预算、记忆、权限、多 Agent 协作,以及模型跑偏后的恢复。 路线包含 37 篇免费札记,每篇聚焦一个可以独立搜索、理解和验证的问题。
判断标准
核心主题包括:开篇、AI 生图、Agent Loop、上下文管理。
下一步
从「本章从哪来:示例系统 开发实录」开始,再按当前任务选择下一篇。
常见误区
不要为了完成目录而跳过实践;能用自己的例子解释一个取舍,比读完更多标题更重要。
这条路径会练什么
从第一篇打开
每个章节都围绕一类真实决策展开。可以顺着走,也可以从正在处理的工作切入。
01本章从哪来:示例系统 开发实录本章是作者开发 AI Agent 桌面应用 示例系统 的经验总结:约 50 万行代码、132 个工具、8 大模块与本章 8 个小节一一对应↗02文生图 vs 垫图:两种完全不同的事一个从文字出发,一个从图片出发。产品经理要分清什么时候用哪种↗03用 AI 给 AI 写 Prompt用户说「画个夕阳下的猫」,生图模型需要的是完全不同的描述,解法是用 LLM 做翻译↗04角色一致性:最难的产品问题同一个 IP 每次画都长不一样。为什么难、产品上怎么思考这个问题↗05模型会挂,然后呢?多模型降级链的产品逻辑:优先级、白名单、探活、全挂时的体验兜底↗06生图的产品化清单从「调通了 API」到「用户能用」之间还差哪些东西,一张 checklist 数清楚↗07教科书的 3 步 vs 真实的 N 步ReAct 不止 Think-Act-Observe 三步,生产环境每轮还要做什么↗08为什么 Agent 会卡死真实场景中循环挂掉的几种典型模式,以及用户会看到什么↗09防呆设计:怎么让循环自己停下来上限、检测、降级三类策略的思路,产品经理该在哪里画线↗10流式体验:别让用户干等工具在后台跑 30 秒,用户看到的应该是什么?进度感设计↗11一条消息背后的真实成本用户发一句话,底层可能跑 10+ 轮循环、几十条 API 消息,由此建立成本意识↗12对话越长越贵、越长越笨费用递增 + 注意力衰减 + 窗口有限,三个必须管理上下文的理由↗13压缩是一门取舍的艺术有的能删、有的不能删、有的要花钱压,这是产品经理的决策框架↗14用户说的话能不能删?「圣物」问题:AI 的输出可以压缩,但用户的原话删了就回不来↗15本地压缩 vs LLM 压缩零成本快但粗 vs 有成本慢但精,什么时候用哪种↗16上下文 ≠ 记忆白板(上下文窗口)和笔记本(长期记忆)的区别,为什么需要两套系统↗17什么值得记、什么不值得记不是所有对话都有价值:守门员思路与筛选逻辑↗18记忆冲突:用户改了主意怎么办新旧记忆冲突的四种处理策略:新增 / 合并 / 冲突标记 / 跳过↗19记忆注入的成本问题记了 1000 条,每次全塞进去?还是按需检索?两种策略的代价↗20System Prompt 不是一坨文本分层管理的必要性:身份、环境、工具指引各自独立,互不干扰↗21不用的东西别给 AI 看100 个工具全塞 system?Token 爆炸。这就需要按需加载的设计思路↗22Skill:可运营的 Prompt 模块文件即配置、版本可追溯,让 Prompt 也能像代码一样管理↗23提示词和缓存的微妙关系改一个字 System Prompt,整条 KV Cache 作废。怎么减少手抖的成本↗24什么时候需要多个 Agent并行加速、角色分工、风险隔离,三种真实场景↗25并发的代价:谁能同时跑「看」可以并行,「改」必须排队,为什么以及怎么判断↗26脑暴:让多个 AI 吵架同一问题多角度独立思考,汇总共识与分歧,这是群体智慧的 AI 版↗27定时任务的成本陷阱Agent 定时跑任务,上下文是累积还是重建?一个选择差 10 倍成本↗28AI 该有多大的自由完全自主 vs 每步审批,五种权限模式和适用场景↗29弹窗太多用户烦,不弹又不安全Human-in-the-loop 的平衡点:风险分级思路↗30Agent 干了什么你知道吗事件流与 Token 追踪。不看日志你永远不知道出了什么错↗31MCP 不只是「调工具」同一个协议两个方向:消费别人的工具 vs 把自己暴露给别人↗32懒连接:不用别连注册了 10 个 MCP 服务,启动时全连一遍?还是用到再连?↗33AI 自己加工具Agent 运行时发现需要新工具,自己配置 MCP 连接,这就是自配置思路↗34实战全景图生图、循环、记忆、Prompt、多 Agent、安全、MCP,一张图串起来↗35聊天套壳 vs 真正的 Agent 产品同一个 Loop 支撑 N 种场景,差异不在代码,在产品决策↗36接上第一个真工具工具调用闭环四段演示;三档任务:选定工具、写三行描述、跑通闭环并故意搞一次破坏↗37实战 · 从 Demo 到产品 · 30 道灵魂拷问每题附考察意图、答题框架与加分点:Demo 到上线的差距 / Agent 卡死 / 上下文压缩 / 记忆设计 / 多 Agent / MCP / 成本账单↗