水彩风格:一座半建成的塔楼被木质脚手架环绕,未完工的楼层透出暖光,旁边立着细长的起重机剪影

Day 0|L3 启航:从工作台到极简与元架构的 Harness 演进史

上一篇是 Day 16|L2 完结!下一站 Harness:驾驭工程的演进与 L3 蓝图预告。 确认你已经了解或掌握了 Day 16 所讨论的所有技能后,让我们从这里开始 L3 的学习吧。 ...

2026-08-27 · 11 分钟 · Alex Wang
发光的浏览器窗口,右侧停靠 AI 审稿面板,前方散落被划掉的批注纸条,一张被圈选保留

96 条审稿意见,84 条是错的

被 AI 审稿折磨了三天,它给我的一篇英文博客提了 96 条修改意见,我采纳了 12 条。剩下 84 条里,一半是它没看原文就开炮,一半是它想把我的文章改成它自己的腔调。 ...

2026-08-18 · 9 分钟 · Alex Wang

omo vs oms:Fallback 链深度解析

本文是《当你的 AI 编程工具需要三套配置》的下篇。上篇介绍了三套配置的方案设计、文件结构和编排理念,本文聚焦 fallback 链的机制差异和配置实践。 文中 omo = oh-my-openagent,oms = oh-my-opencode-slim。模型和 provider 名称已脱敏为 provider-a/model-x 等泛化名称。 ...

2026-06-07 · 12 分钟 · Alex Wang

当你的 AI 编程工具需要三套配置

为什么我需要三套 OpenCode 配置 我的 ~/.config/opencode/ 目录下有三个 opencode.json。起因很简单:我想同时跑 oh-my-openagent(以下简称 omo)和 oh-my-opencode-slim(以下简称 oms),对比着用,搞清楚各自的边界在哪。 ...

2026-06-05 · 8 分钟 · Alex Wang
一排暗淡的审查维度插槽只有一格亮起,加入新模块后全部亮起——但右边加了数学符号的版本反而变暗

维度实验:30多年前的奇书能搞定审查维度?

系列:用经典理论指导 Agent 实践(第三篇) 第一篇:双轮审查:召回和精确为什么不能兼得 · 第二篇:策略基因:借遗传算法思路精简审查 prompt TL;DR: 两组对照实验。代码审查维度从 8 个加到 11 个,已知问题的发现率从 1/6 升到 6/6。设计审查引入公理化设计维度,发现率同样从 1/6 升到 6/6。但加了数学公式的版本证明维度不是越多越好——计算过程挤掉了审查注意力,发现数掉 35%。做对照实验,用已知问题做参照,才知道哪个维度有效。 ...

2026-05-25 · 8 分钟 · Alex Wang
一段臃肿的 prompt 被修剪成紧凑的策略基因结构,冗余内容散落在旁边,核心约束被保留下来

策略基因:借遗传算法思路精简审查 prompt

系列:用经典理论指导 Agent 实践(第二篇) 上一篇:双轮审查:召回和精确为什么不能兼得 下一篇:维度实验:30多年前的奇书能搞定审查维度? TL;DR: 审查 prompt 从 317 行砍到 135 行(-58%),审查质量反升 29%。删掉的不是流程步骤,是模型自己能推导出来的冗余内容。留下的才是策略基因——不可替代的约束、反面例子和语气锁。 ...

2026-05-24 · 9 分钟 · Alex Wang
两个漏斗并排——左边宽口承接大量候选问题,右边窄口过滤出真正有价值的发现

级联检索,借信息检索领域 15 年前的方法治审查 agent 的病

系列:用经典理论指导 Agent 实践(第一篇) TL;DR: 设计审查的 agent 既要找得全又要找得准,一个 agent 难以两全。借鉴信息检索 15 年前的级联检索思路,拆成两个 agent——一个只管找全(Recall Pass),一个只管找准(Precision Pass)。设计方案的缺陷更早暴露,开发阶段返工的风险降低了。 ...

2026-05-22 · 8 分钟 · Alex Wang
上下文腐烂:AI编程中一个容易被忽视的问题

上下文腐烂:AI编程中一个容易被忽视的问题

昨天某技术群里有朋友说 GPT-5.4 的表现还不如豆包,问问题常常不读题就瞎回复。追问了一下,得知对方喂了很多文档,对话轮次也很长了。这大概率不是模型的问题——是上下文腐烂(context rot)了。 ...

2026-04-18 · 14 分钟 · Alex Wang
七种人机协作模式:Aristotle项目的回顾与反思

回顾与反思:Aristotle 项目中的七种人机协作模式

五篇文章之后,我想退一步,看看脚下的路。 Aristotle:让 AI 学会从错误中反思 讲了设计理念和初版实现。claude-code-reflect:同样的元认知,落在不同的土壤 讲了跨平台移植的坎坷。信任边界:同一个想法在开放系统和受限系统上的实现实验 提出了信任分层模型。从四道伤疤到一套铠甲:Aristotle 改造中的驾驭工程实践 用改造过程验证了理论。一份 Markdown 的三次生命:从静态规则到 Git 版本管理的 MCP Server 把反思规则从 append-only 推进到了 GEAR 协议。 ...

2026-04-16 · 10 分钟 · Alex Wang
一份Markdown的三次生命:从静态规则到Git版本管理的MCP Server

一份 Markdown 的三次生命:从静态规则到 Git 版本管理的 MCP Server

上一篇文章 从四道伤疤到一套铠甲:Aristotle 改造中的驾驭工程实践 的结尾处,Aristotle 有了一份精简的路由器(SKILL.md 从 371 行压缩到 84 行),一个按需加载的 Progressive Disclosure 架构,和一个还算能用的反思→审核→确认流程。 ...

2026-04-16 · 21 分钟 · Alex Wang