Hacker News · AI· somrout·· 6 小时前AI 评分53
causeval 在 DeepEval 之上为 LLM 应用评估补上不确定性、因果干预与 judge 审计三层证据
Causeval – statistically rigorous, causal evaluation for LLM apps
AI 摘要
causeval 是 @routsom 创建并维护、构建于 DeepEval 之上的 LLM 应用评估层,它保留 DeepEval 的指标作为测量仪器,另加不确定性。
来源:Hacker News · AI · github.com