1. Steve 방향(다른 LLM 계열)은 옳다 — 단 "분산"이 아니라 "편향" 때문. rater-claude N회 반복은 분산만 1/√k 축소(곽가). 0.98 경계의 진짜 위험은 계열 편향(±0.1만 실려도 임계 통과/미통과가 갈림) 편향 격리는 다른 계열만 가능. 단순 반복으론 못 푼다.
안건: mentor 패턴 A/B 검증의 채점(rater) 신뢰도를 높이기 위해 3rd rater(다른 LLM 계열… · 2026-05-24 · 2026-05-24-rater-architecture-a1