文章

记录构建过程中的思考与实践

  1. 2026.07.17 · 技术自动驾驶为什么走向「端到端」——从高精地图到 VLA 的技术演进、架构之争与量产现实从高精地图到 VLA 的技术演进、两段式与一段式的架构之争、Diffusion 与 AR 两类轨迹生成,再到强化学习与量产闭环——把端到端自动驾驶的整条主线,整理成一张能一次读完的全景图。2026-07 修订:17 篇论文附 arXiv 链接、25 道自测题附参考答案,并配套交互式复习速查页。
  2. 2026.06.26 · AI · 工具Loop Engineering:当你的工作从「提示 Agent」变成「设计提示 Agent 的系统」精读 Addy Osmani 等人提出的 Loop Engineering:当生成几乎免费,工程师的价值从「指挥 Agent」上移到「设计自运行的循环」——拆解五个动作、生成器/评估器分离,以及为什么真正稀缺的是能说「不」的判断力。
  3. 2026.05.01 · AI · 工具当 AI 学会"用手指点着图思考"——解读 DeepSeek《Thinking with Visual Primitives》解读 DeepSeek《Thinking with Visual Primitives》如何用 box 和 point 缝合多模态模型的指代鸿沟,并把视觉原语变成推理过程的一部分。
  4. 2026.04.24 · AI · 工具用评测找 Bug:一次 Agent 能力测试如何从分数变成显微镜一次 Agent 能力评测从补 case 开始,最终暴露出测试污染、App live 写入边界、断言过拟合和 Dashboard 刷新等问题,展示评测如何成为调试系统的显微镜。
  5. 2026.04.21 · AI · 工具5000 行够不够写一个 Claude Code——读 Helixent 源码的七个意外发现MagicCube 开源的 Helixent 用不到 5000 行 TypeScript 复刻了 Claude Code 80% 的核心骨架——本文拆解它的七个架构巧思:AsyncGenerator 主 API、累积快照流式协议、8-hook Middleware、tool-result-policy 上下文经济学等。
  6. 2026.04.21 · AI · 工具让另一个 AI 来审你刚写的代码——/codex-audit 的设计与安装用 OpenAI Codex 给 Claude 刚 commit 的代码做对抗式 review——拆解 threadId 多轮续跑、symmetric application、TDD 铁律等五个关键巧思,附手把手安装教程。
  7. 2026.04.19 · AI · 工具拆开 Hermes 的「自我进化」:不是黑魔法,是个会反思的夜班值班员读完 Hermes Agent v0.10 源码后拆解它的「自我进化」机制:不是模型微调,而是三层叠加的工程设计——常驻系统提示、每 10 次工具调用的周期性 nudge、后台 fork 一个独立 LLM 专门做反思。自动化但透明。
  8. 2026.04.19 · AI · 工具为什么 2026 年的 AI Agent 突然「不一样」了——关于「解耦」这件事用「餐厅后厨」的类比拆解 Anthropic Managed Agents 的 Brain/Harness/Sandbox/Tools/Session 五件套,佐以 Hermes 的学习闭环、OpenClaw 的泳道队列、Claude Code 四月 Ultraplan 等新特性,四件事拼出 AI Agent 走出 demo、走进生产的门票。
  9. 2026.04.18 · AI · 工具开启 Claude Code Computer Use:一份普通用户真的能看懂的指南从资格门到 macOS 系统授权,完整拆解 Computer Use 的四层闸门——为什么 Team 订阅用不了、为什么 /mcp 里看不到它、为什么授权后还要完全退出重启。官方文档没讲透的每个「为什么」,加上我踩过的四个坑。
  10. 2026.04.18 · AI · 工具OpenAI vs AgentZero:Computer Use 深度对比拆解 OpenAI 三层 Computer Use 栈(CU API、Codex App、CLI)与 AgentZero 的设计哲学差异——闭源黑盒 vs 开源白盒、系统级授权 vs 七层安全闸门、责任外包 vs 用户亲眼监督。
  11. 2026.04.12 · AI · 工具从 CC-OS 到 CC-GEB:我如何用一张截图重构了整个 AI 编程配置体系一个 Claude Code 配置体系的进化史——从 120 行全局宪法到 20 行极简配置,四刀精简砍掉 87% context 开销,融合 AI Coding 方法论的六层 workflow,最终收敛为一个 /cc-geb Skill 命令和三档渐进式配置。
  12. 2026.04.12 · AI · 工具当 Eval 全线飘红:一次 Live 模式调试的四层洋葱一个"测试全挂"的 bug report,剥开后是四个独立问题的完美叠加:fixture 未播种到隔离目录、mode 过滤缺失让 mock-only case 被错误执行、latency 阈值不适配中转 API、断言太死板惩罚了高质量输出。每层修复不超过 10 行代码。
  13. 2026.04.12 · AI · 工具"做点有用的事" —— 一句话如何在跨模型场景下引发灾难同一条守卫模式 system prompt,Claude 理解为"没事就休息",GLM 理解为"给我表演一段"。从真实事故出发,拆解跨模型指令遵循的光谱差异,提炼四条 Agent prompt 设计原则:禁止优先、决策树结构、弱模型测试、默认不行动。
  14. 2026.04.11 · AI · 工具Claude Code 的多 Agent 机制:从 subagent 到 Agent Teams 的源码解读基于 Claude Code 2.1.88 还原源码,拆解多 Agent 的两条主线——subagent 是一次性任务委派,Agent Teams 是基于 mailbox 的持续协作,底层都复用同一个 query() 推理引擎。核心洞察:多 Agent 不是 prompt 模板,而是围绕 query() 构建的完整运行时系统,靠 ToolUseContext 隔离、Task framework 管生命周期、fork 优化 prompt cache。
  15. 2026.04.10 · AI · 工具给 AI 评测平台做体检:8 小时拆了 7 个连环坑从 benchmark 质量审计意外演变成数据库架构深度清理——43% 的测试其实什么都没测、一个沉默的 loader bug 让两种断言从未被激活、测试套件偷偷污染生产数据库、9 张从未写过的"愿景式"死表、以及单例模式关闭后的静默回退陷阱。一个完整的 7 层连环坑剥洋葱故事。
  16. 2026.04.03 · AI · 工具KAIROS — Claude Code 源码中隐藏的「始终在线 AI 助手」全解析通过逆向 Claude Code 源码,发现了代号 KAIROS 的 Assistant Mode:一个 24 小时运行的 AI 守护进程,具备自主行动、定时任务、事件监听、主动推送、长期记忆和远程查看六大能力。
  17. 2026.04.03 · AI · 工具从串行到并行:Agent Teams 多智能体调度优化实战深入分析 Agent Teams 串行执行的根因(SDK 黑盒 + 缺少编排层),通过 auto-resume 机制和 SubAgent 委派 prompt 两个策略实现并行优化,附完整实验数据验证。
  18. 2026.04.02 · AI · 工具105 行代码激活多智能体:一次需求审计引发的架构觉醒逐行核对 AgentZero 需求文档时发现——我们以为的多智能体协作只是 SDK 的展示层。读竞品源码找到根因,105 行代码完成修复。
  19. 2026.04.02 · AI · 工具一个"简单" Bug 修了 4 轮:AI 编程的认知陷阱复盘 AgentZero 集成 Claude Agent SDK AskUserQuestion 工具的踩坑全过程——因为猜测代替阅读,30分钟能解决的问题膨胀到 4 轮迭代,以及如何用三道关卡防范。
  20. 2026.04.01 · AI · 工具让 AI 操控你的电脑:四个项目,四种哲学从 Claude Code 源码逆向到三个开源项目,深度对比 Computer Use 的四种技术实现——像素驱动、结构驱动、极简跨平台、Provider 模式,揭示安全模型、坐标精度和自动化哲学的根本分野。
  21. 2026.04.01 · AI · 工具我给 Claude Code 写了一套“宪法”——为什么 AI 编程需要约束系统从真实踩坑案例出发,探讨 AI 编程的核心矛盾——能力强但无记忆,以及如何通过分形文档、自动化约束和记忆衰减来管理 AI 的上下文。
  22. 2026.03.28 · AI · 工具Agent Eval 调研报告系统梳理 Agent 评测方法论(Hamel、Anthropic EDD、Harness Design)与六大平台(Scale、LangSmith、BrainTrust、Phoenix、DeepEval、Langfuse)深度对比,为自建评测平台提供架构设计参考。
  23. 2026.03.28 · AI · 工具Claude Cowork 模式专属工具深度解析:从命令行到桌面的能力跃迁系统梳理 Cowork 模式独有的九大工具类别——Computer Use、Chrome 控制、教学模式、定时任务等,探讨每类工具存在的必要性及真实使用场景。
  24. 2026.03.08 · AI · 工具AI工具提效:三个工具覆盖80%的重复性脑力劳动ChatGPT、NotebookLM、Claude Code 三个工具的高阶用法,分别解决信息获取、知识管理、任务执行。
  25. 2026.02.23 · AI · 工具OpenClaw 全新安装 + 避坑指南安装5次的血泪教训 — 前置项、模型API、浏览器插件、机器人渠道、搜索工具,全流程踩坑记录。