文章是我整理判断
与保留意见的方式。
深度文章用于沉淀方法论与项目复盘,记录在 AI 工程化过程中的判断与取舍。
2026.07
为什么大多数 RAG 系统都过不了第一版验收
问题往往不在模型,而在切片策略、上下文组织,以及没有事先约定"什么叫答对了"。
阅读全文
2026.05
Agent 工程化:从 demo 到生产的距离
demo 阶段的惊艳感来自可控输入,生产阶段的灾难来自不可控输入。这两者之间隔着一整套工程实践。
阅读全文
2026.03
评测体系:AI 产品不可见的护城河
模型人人能调,prompt 人人能写,但能不能持续证明"这次改动真的更好",才是长期壁垒。
阅读全文
2026.01
FDE 实践:用工程的方式做产品判断
FDE 不是销售前置,也不是工程后置。它的核心是把产品判断变成可验证的工程动作。
阅读全文
2025.11
把 prompt 当代码,而不是当咒语
版本管理、diff、回归测试、code review —— prompt 工程化的真正门槛不在写,在管。
阅读全文
2025.09
一个 RAG 项目的复盘:我们高估了检索,低估了切片
花了两周调 rerank 模型,最后发现真正解决问题的是重新设计切片边界。
阅读全文