Nobody wants to review the robot's 600-line pull request

개요

AI 에이전트가 생성한 600라인의 코드 변경 사항이 담긴 풀 리퀘스트(Pull Request) 검토 시 발생하는 문제점과, 이를 해결하기 위한 새로운 접근 방식을 제시합니다.

주요 내용

* AI 코드 생성 능력 향상: 2026년 현재 AI 에이전트는 코드 계획, 코드베이스 읽기, 테스트 실행, 실패 시 되돌리기, 풀 리퀘스트 생성 등 코딩 능력이 상당 수준으로 향상되어, 코드의 품질 자체에 대한 논쟁은 거의 끝났습니다.
* 병목 현상 이동: 코드 생성 속도가 빨라짐에 따라, 엔지니어의 코드 검토 능력이 상대적으로 병목 현상이 되고 있습니다. AI 에이전트는 점심시간 전에도 여러 개의 풀 리퀘스트를 생성할 수 있지만, 시니어 엔지니어는 자신의 업무와 병행하며 여러 풀 리퀘스트를 깊이 있게 검토하기 어렵습니다.
* 검토 깊이 저하: 늘어난 풀 리퀘스트의 양에 비해 검토 역량이 증가하지 않아, 코드 검토의 깊이가 얕아지는 현상이 발생합니다. 엔지니어들은 시간이 부족하여 코드를 제대로 읽지 않고도 합리적으로 보이면 승인하게 되며, 이는 명백한 거버넌스 실패로 이어집니다.
* AI 풀 리퀘스트 검토의 어려움: AI 에이전트가 생성한 풀 리퀘스트는 인간 동료와 달리 사전 공유된 맥락(standup, 스레드 등)이 부족합니다. 코드 자체만으로 의도를 재구성해야 하므로 검토에 더 많은 시간과 노력이 필요하며, 코드의 맥락적 오류는 발견하기 어렵습니다.
* 근본적인 해결책의 부재: "이전처럼 모든 것을 신중하게 검토"하거나 "AI를 신뢰"하는 방식, 또는 "CI 규칙 추가"는 늘어난 양과 맥락적 오류를 해결하기 어렵습니다.
* 새로운 검토 패러다임 제시: 검토 대상인 코드의 차이(diff)를 먼저 보기보다, 작업이 생성된 이유, 의존한 결정, 제약 조건, 주어진 맥락, 마주친 질문과 답변, 시도하고 되돌린 접근 방식 등 작업의 맥락과 의도에 대한 설명(Story)을 먼저 제공해야 합니다.
* Branch Story의 역할: Branch Story는 풀 리퀘스트의 배경이 되는 의도를 재구성하여, 검토자가 코드를 읽기 전에 작업의 흐름과 결정을 이해하도록 돕습니다. 이는 인간이 작성한 코드에도 동일하게 적용되어 검토의 일관성을 높입니다.
* 핵심 자원은 '명확한 의도': AI가 코드를 작성하는 비중이 늘어남에 따라, 희소한 자원은 코드가 아니라 '이해하기 쉬운 의도(legible intent)'이며, 이것이 가치 있는 빌드 대상입니다.

시사점

AI 코드 생성의 진화로 인한 검토 병목 현상은 기존의 검토 방식을 재고하게 만들며, 작업의 '왜'를 명확히 하는 것이 코드의 '무엇'을 검토하는 것만큼, 혹은 그 이상으로 중요해지고 있습니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions