AI에게 170개 변경 계획을 맡겨 봤습니다. 매번 똑같은 3가지 실수를 했습니다

dev.to

170개 변경 계획을 대상으로 LLM 플래너와 비평기, 결정론적 검증 게이트를 결합한 PlannerCritic을 실험했습니다. 더 큰 모델도 구조적 결함을 고치지 못했으며, 의존성·순서·롤백을 코드로 검증하는 하이브리드 방식이 핵심 해법으로 나타났습니다.