AI PM NOTES · PRODUCT JUDGMENT
AI 产品观点
与项目方法
不做概念词典,重点回答真实产品问题:什么时候需要Agent、如何验证效果、怎样控制风险,以及技术能力如何转化为用户价值。
为什么Agent Eval不是一张排行榜:我从智驾场景化评测中迁移出的六步闭环
从8款车型、47个场景与112项指标的项目实践出发,说明如何把复杂体验转成Task、Metric、Trace、Bad Case和持续回归。
阅读文章 → AGENT · PRODUCT JUDGMENTAgent的价值,不是替用户做更多,而是让用户少做一次复杂决策
从ChargeFlow复盘:为什么“找充电站”不需要Agent,而任务约束下的补能决策可能需要。
阅读文章 → EVAL · BAD CASEAgent评测不应只看“回答对不对”
从任务结果、节点Trace到严重错误闸门,建立可定位、可回归的Agent评测闭环。
阅读文章 → ENTERPRISE AGENT · GOVERNANCEAI能力越强,产品越需要状态、权限、证据和失败恢复
从Elo Automation复盘:真正影响企业用户信任的,不只是模型回答质量。
阅读文章 → RAG · GRAPHRAG什么时候需要GraphRAG?先问问题需要什么证据
从AnalystCopilot复盘:事实问题、关系问题与两跳证据扩展应该如何分流。
阅读文章 →TECHNICAL ARCHIVE