Harness 核心

模型周围的 Harness

理解上下文、Prompt、工具、检索、输出格式和安全检查如何把模型变成一个能工作的系统。把 Harness 当成产品架构,而不是 Prompt 技巧的集合。

61 篇札记开放阅读 · 无需登录
Harness 核心61篇札记

本页解决的问题

先给结论

「模型周围的 Harness」AI 学习路径适合解决什么问题?

理解上下文、Prompt、工具、检索、输出格式和安全检查如何把模型变成一个能工作的系统。把 Harness 当成产品架构,而不是 Prompt 技巧的集合。 路线包含 61 篇免费札记,每篇聚焦一个可以独立搜索、理解和验证的问题。

判断标准

核心主题包括:上下文工程、Prompt 工程、Prompt 安全、Agent 工程。

下一步

从「上下文窗口:AI 的工作记忆」开始,再按当前任务选择下一篇。

常见误区

不要为了完成目录而跳过实践;能用自己的例子解释一个取舍,比读完更多标题更重要。

这条路径会练什么

从第一篇打开

每个章节都围绕一类真实决策展开。可以顺着走,也可以从正在处理的工作切入。

61篇札记
01上下文窗口:AI 的工作记忆窗口构成可视化,拖动模拟溢出效果,主流模型容量对比交互3 min02上下文溢出:三种处理策略直接截断 / 摘要压缩 / 选择性保留,可视化对比每种策略的利弊交互3 min03为什么大模型选择 Markdown纯文本模型 + 排版需求 = MD 成为首选,逐步推演 HTML/Word/LaTeX 为何不行动画3 min04Markdown 语法与渲染 Pipeline常用语法速查 + 实时编辑器 + marked.js / markdown-it 渲染方案交互3 min05你说什么,它就变什么五种角色实时切换,输出格式控制,System Prompt 核心原理交互3 min06Prompt 进阶技巧Few-Shot / CoT / 约束条件 / 任务拆解,好坏对比交互演示交互3 min07输出格式取舍纯文本 / JSON / Markdown / YAML / XML,场景适配度对比与权衡交互3 min08流式返回与格式配合JSON 全文才能解析 / MD 逐字显示 / XML 捕获标签即渲染,动态演示交互3 min09Prompt Injection:为什么会被攻击SQL 注入类比 → Message List 本质 → 缺乏参数化 → 5 大攻击类型概览安全3 min10Prompt Injection:12 个攻击案例越权指令 / 角色扮演 / Few-Shot / 结构注入 / 隐喻伪装,中招版 vs 防御版安全3 min11Prompt 防御:三层拦截实战输入层正则 → 提示词层约束 → 输出层泄漏检测 → 二次审核,可模拟攻击全链路实战3 min12AI 安全红线:四条底线不能做的事、做了会怎样,产品经理必须守住的四类安全边界安全3 min13风险分级与责任:谁来管、怎么管AI 输出的风险分级模型,各角色的责任分工与治理框架安全3 min14Agent:能干活的 AI四大能力 Plan / Tool / Memory / Act,点击查看真实案例交互3 min15工具调用的秘密模型输出 JSON → 框架解析执行 → 结果注回,四步流程可视化交互3 min16一次对话背后的 5 条消息拆解 Function Calling 真实链路:用户看到 1 条回复,背后是 5 条 API 消息深入3 min17工具描述的学问同样功能,好描述 vs 坏描述成功率差 3 倍,对比实验深入3 min18多工具编排:并发 vs 串行isConcurrencySafe 决定工具能否并行,调度策略可视化深入3 min19MCP 协议:工具的 USB 接口stdio / SSE / Streamable HTTP 三种传输方式对比,数据流动画深入3 min20ReAct 实战:查询天气完整链路Thought / Action / Observation 逐步演示,7 步完整 Agent 链路动画3 min21短期记忆 = 上下文窗口消息列表可视化,每条消息的 Token 占用和角色标记深入3 min22上下文压缩:四层防线60% 裁剪 → 75% 微压缩 → 85% 折叠 → 95% 紧急,拖动滑块看压缩过程深入3 min23长期记忆:向量检索Embedding → 向量数据库 → 语义搜索,topK 与 minScore 的设计决策深入3 min24从 Embedding 到 Milvus语义相似度、ANN 与向量数据库的职责边界深入3 min25Milvus 心智模型Collection、Schema、Entity、Index、Search、Query 与 Load深入3 min26Milvus 实操连接、建表、批量写入、索引、搜索、查询和删除实战3 min27从检索到 RAG切分、过滤、混合检索、RRF、重排与评测深入3 min28ReAct 循环:思考→行动→观察一个删除 console.log 的任务经历 14 轮循环,含自我纠错深入3 min29Agent 卡死的 5 种模式参数格式错误、幻觉工具、无限递归、信息不足、API 异常深入3 min30权限与安全5 种权限模式 + LLM 风险分级 + Human-in-the-loop 设计深入3 min31Skill:让 Agent 少走弯路Skill = 流程说明 + 工具调用指引,用「阳台收衣服」类比好循环 vs 差循环交互3 min32Skill 的本质好循环 vs 差循环升级版,Skill 如何改变 Agent 执行路径深入3 min33脚手架工程:从试验品到产品模拟 Agent 查机票订酒店,无脚手架 vs 有脚手架完整对比,5 大能力详解交互3 min345 道工程护栏迭代上限、输出截断、超时控制、中断恢复、上下文急救深入3 min35多 Agent 协作子 Agent 调度、Worker Thread、并行 vs 串行执行策略深入3 min36可观测性事件流可视化、Token 追踪、OpenTelemetry 集成深入3 min37Agent 工程全景图从四大能力到工程落地,一页看清 Agent 的完整知识地图汇总3 min38多轮对话为什么越来越贵Token 累积成本可视化,拖动轮次查看费用如何指数增长交互3 min39KV Cache:用空间换时间(和钱)类比理解 + 节省效果计算器,拖动轮次查看节省比例交互3 min40显式缓存:实战对比cache_control 写法、缓存命中判断、价格折扣对比,真实省钱效果演示交互3 min41动态时间戳:最贵的 System Prompt错误设计 vs 正确设计,三种时间处理方案对比切换反例3 min42综合成本优化:从系统角度省钱5 层优化策略,成本构成可视化,节省 70-90% 的系统设计系统设计3 min43图片 Token:像素也在烧钱图片计费公式、缩放机制、分辨率陷阱、按任务分级策略多模态3 min44按任务匹配分辨率高/中/低三档分辨率策略,不同场景的 Token 消耗对比与选型建议多模态3 min45语法层优化:写给机器的提示词YAML vs JSON、CSV vs 数组、压缩 JSON 输出,格式性 Token 省 10-30%提示词工程3 min46语义层优化:不要把上下文当垃圾桶动态 Few-Shot、LLMLingua-2 压缩、关键信息放首尾,提升信息密度RAG3 min47输出层 + KV Cache 进阶负向约束、Diff 润色、停止序列;KV Cache 的工具陷阱与滑动窗口问题架构3 min48模型选型:能力 vs 成本主流模型能力/成本矩阵、选型决策树、不同场景的模型匹配策略选型3 min49大道至简:坚守第一性原理AI Harness 的本质 / 做 vs 不做的取舍 / 会被时代淘汰的 Harness / 终极问题收官3 min50人机知识边界:四象限策略什么交给 AI、什么自己来,用四象限快速判断任务分配技巧3 min51好提问 vs 坏提问上下文决定输出质量,同一个问题好坏对比演示技巧3 min52AI 说的能信吗?找出幻觉三种快速验证方法,识别 AI 自信说错的场景技巧3 min53迭代的艺术:知道何时收手从粗到精的迭代节奏,以及何时该停止追问 AI技巧3 min54场景速查:什么时候放心用高可信 / 需验证 / 慎用 / 不用,AI 适用场景四分类技巧3 min55汇总(上)· Prompt 工程 + Agent上下文溢出策略 / Prompt 六要素 / 工具调用真相 / Skill + 脚手架汇总3 min56汇总(下)· 成本优化 + PM 视角五层成本体系 / KV Cache 原理 / 图片 Token / 课程完整能力清单汇总3 min57课程总结 · 产品经理的第一节 AI 课从大模型原理到工程落地,完整课程一页回顾汇总3 min58总结(上)· 原理 + Harness大模型认知框架 / 幻觉应对 / Prompt 与 Agent 核心要点汇总3 min59总结(下)· 实战 + 成本安全防御 / 成本优化 / 用 AI 的正确姿势 / 下一步学习路径汇总3 min60让它连跑五次都能用同一输入五连跑演示;三档任务:写第一版提示词、给不稳定归类、加示例与违禁项重跑对比实战3 min61AI Harness · 30 道灵魂拷问每题附考察意图、答题框架与加分点:上下文溢出 / Prompt 工程 / 注入防御 / 工具调用 / 成本账单 / KV Cache / 输出格式考察5 min