
以尺度尺,用方法改进方法
系列:破而后立的 TDD 流程迭代(第二篇) 上一篇:失之东隅,收之桑榆的实验 · 下一篇:看不见的空白层——Phase 7 诞生 TL;DR: TDD Pipeline 自己教的是"给原则不给步骤",但自己却长成了步骤驱动的工具。把阶段一到阶段五的操作步骤删掉,只保留原则、风险提示和反面例子。模型自己推导出了被删掉的步骤,输出质量不降。原因:阶段一到阶段五是创作阶段,需要发散空间,去掉固定轨道反而更好。同样的策略用在阶段六上失败了——下一篇讲为什么。 ...

系列:破而后立的 TDD 流程迭代(第二篇) 上一篇:失之东隅,收之桑榆的实验 · 下一篇:看不见的空白层——Phase 7 诞生 TL;DR: TDD Pipeline 自己教的是"给原则不给步骤",但自己却长成了步骤驱动的工具。把阶段一到阶段五的操作步骤删掉,只保留原则、风险提示和反面例子。模型自己推导出了被删掉的步骤,输出质量不降。原因:阶段一到阶段五是创作阶段,需要发散空间,去掉固定轨道反而更好。同样的策略用在阶段六上失败了——下一篇讲为什么。 ...

技巧卡:格式约束速查 花 10 秒在 Prompt 里指定格式,省下 10 分钟的二次整理。 以下是 6 种最常用的格式约束,每种附一句可以直接用的 Prompt 模板。 1. Markdown 表格 适合:需要对比、汇总的结构化信息。 ...

系列:破而后立的 TDD 流程迭代(第一篇) TL;DR: 把 TDD Pipeline 的阶段六(预发布测试)从"步骤驱动"精炼为"原则驱动",预设目标没达到——精炼版在单个 bug 的追问深度、证据链完整度上都比原版差。但对比两组输出发现了维度差异:精炼版在组件缝隙检查、跨 bug 模式扫描上比原版强。这些差异指向一个判断——阶段六不需要被精炼,而是缺了一个阶段六没有定义的任务,后来被定义为阶段七。 ...

技巧卡:什么时候该让 AI「一步步思考」? 在 Prompt 末尾加一句"请一步步推理"——这就是 Chain-of-Thought(CoT)。简单到不像话,但在合适的场景下效果惊人。 ...

RBGO(角色-背景-目标-输出)框架上一篇已经讲过。但知道框架和会用框架之间,隔着一道坎:怎么把"我想要……“翻译成四要素? ...

TL;DR: 展示 Why Articulation 模板升级前后的对比,以及三条可迁移建议:给原则不给示例、关键步骤用强制语气、相信模型的自我组织能力。实验局限也已说明。 前两篇回顾 第一篇从 Anthropic 的对齐研究出发:教模型"为什么"比只教它"正确答案",误对齐率从 22% 降到 3%(约 7 倍),而且用 1/28 的数据量就能达到同等效果[1]。我把这个发现移植到 prompt 设计里,造出了 Why Articulation 模板——要求 AI 动手前先说清目的、风险和方案。 ...

今日实践 回忆一下你今天(或最近一次)问 AI 的第一个问题——越随意越好,不用挑。 把那个原问题原封不动地再问一遍,把回答存下来。 然后,用 RBGO 框架重写同一个问题: ...

📖 本文是「AI 之路初阶升级指南」系列的第 2 篇(共 5 篇)。 第一篇:理解你手里的工具 · 第二篇:从模糊提问到精确指令 · 第三篇:把 AI 变成协作伙伴(即将发布) · 第四篇:建立个人体系(即将发布) · 第五篇:毕业考核与下一步(即将发布) ...

TL;DR: 四变量 A/B 实验测试 Why Articulation 的结构、语气、位置和示例。正面示例反而有害——模型倾向模仿而非独立思考。开放式 prompt 方向性提升质量,同时节省 33% token。 系列:为什么让 AI 动手之前先说 why(第二篇) 上一篇:从 Anthropic 的对齐研究到一个 Prompt 设计思路 ...

技巧卡:选 AI,看场景不看排名 试了一圈 ChatGPT、Claude、Gemini,最后还是不知道该用哪个? 别纠结了——这个问题本身就问错了。不存在"最好的 AI",只有"最适合当前任务的"。 ...