同一个模型差了 6 个百分点——Auggie 和 Cursor 的成绩差距揭示了一个被忽略的事实:决定 AI 编程工具能力上限的是 Harness 框架而非底层模型。Context Rot、中间遗忘、工具歧义,三重问题全是 Harness 的工程挑战。评估 AI 工具,该问「Context Engine 怎么设计」,不是「用了什么模型」。
让 AI 写完代码再自己审查,它对明显错误视而不见。问题不是模型不够聪明,而是上下文窗口被自己的输出占满了。分离上下文窗口是解法。
OpenClaw 不是又一个聊天 AI,而是能走出沙箱、到你电脑上干活的「管家」。顾问 vs 管家的核心隐喻、龙虾适用三角判断法、三文件最小起步——帮你判断要不要养一只龙虾。
Claude Code 每天产生 13.5 万次 GitHub 提交,占所有公开提交的 4%。当 Coding Agent 开始批量给开源项目提 PR,代码质量、版权归属、社区治理都面临重新定义。
Agent 工程不是玄学,是工程。本文给出从 ReAct 到 Skills 模块化到 Supervisor 编排到 MCP 集成的四段位进阶框架,每个 Level 对应一个可复用的设计模式。
Vibe Coding 让你写代码更快,但也在把你训练成 AI 工作流中最没价值的环节。这篇文章划出 AI 时代工程师的分水岭:你是在驾驭 AI,还是在被 AI 驾驭?