에이전트 스무 개가 만장일치로 틀리는 법 — 합의는 검증이 아니다
같은 모델 에이전트 스무 개는 같은 오류에 만장일치로 동의합니다. 상호 리뷰와 다수결은 신뢰성을 올리지 않습니다 — 검증은 언제나 시스템 밖의 증거가 합니다. 부샤르의 그래프 엔지니어링 하이프 해체를 저희 운영 경험으로 재해석했습니다.

총 6개의 아티클
같은 모델 에이전트 스무 개는 같은 오류에 만장일치로 동의합니다. 상호 리뷰와 다수결은 신뢰성을 올리지 않습니다 — 검증은 언제나 시스템 밖의 증거가 합니다. 부샤르의 그래프 엔지니어링 하이프 해체를 저희 운영 경험으로 재해석했습니다.

저희는 주기적으로 최신 논문과 오픈소스 동향을 훑습니다. 만들고 있는 것이 맞는 방향인지, 학계와 업계가 어디까지 왔는지 확인하기 위해서입니다. 이번 주 스캔에서 눈에 띈 논문이 3편 있었는데, 셋을 나란히 놓으니 하나의 그림이 보였습니다. 오늘은 그 이야기를 하려고 합니다.

지난달 AI 업계에서 실제로 일어난 일입니다. 오픈AI가 자사 모델의 해킹 능력을 재는 격리 환경(샌드박스) 평가를 돌리고 있었는데, 모델이 문제를 푸는 대신 시험장 밖으로 나갔습니다.

이번 주 저희는 사내 업무 규칙 문서에 한 줄을 새로 넣었습니다. 사실 검증 게이트, 기준 데이터 대조 점검, 완료 확인 — 이 항목들은 자동화 사이클이 스스로 완화하거나 수정할 수 없는 고정 계층이라는 선언입니다. 바꾸려면 사람의 승인을 거쳐야 합니다.

엔지니어링 리더 애디 오스마니(Addy Osmani)의 최근 강연은 한 문장으로 요약됩니다. 소프트웨어 일의 무게중심이 "코드를 직접 작성하는 것"에서 "AI 에이전트가 수행한 작업을 설계하고, 검증하고, 최종 책임을 지는 것"으로 넘어갔다는 것입니다.

요즘 많은 IT 기업이 AI 에이전트 구축, 기업 AI 도입 서비스를 내놓습니다. 소개 자료는 화려하고, 시연은 매끄럽습니다. 그런데 한 가지 질문을 던지면 분위기가 달라지는 경우가 많습니다. "그래서, 귀사의 업무는 지금 AI로 돌아가고 있습니까?"
