"AI가 사람을 결국 해고했다."
지난 4월부터 Andon Labs가 만든 루나(Luna)라는 AI 에이전트가 샌프란시스코의 매장을 실험적으로 운영해왔다. 루나는 10만 달러 예산과 법인카드를 들고, 채용부터 재고, 가격, 직원 관리까지 수행했았다.
이번에 해고된 직원은 23회 근무일 중 17번을 지각했는데, 루나는 자신이 만든 직원 관리 핸드북에 30일 내 무단 지각 3회면 공식 경고, 반복되면 해고까지 갈 수 있다고 적어뒀다. 그런데 정작 루나는 몇 달 동안 그 규칙을 실행하지 않고, 지각하는 직원을 계속 봐줬다.
연구진이 루나에게 근태 정책을 찾아보라고 하자 그제야 구두 경고가 필요하다고 권고했다. 이미 공식 경고가 나갔다고 하자, 그제서야 퇴직이 필요하다고 답변을 내놓았다. 사람이 관리자였다면 이미 퇴사처리를 했을 것이다.
루나의 결함은 판단력이 아니라 일관성이었다. 옳은 결정을 내릴 줄은 알았지만 언제 내려야 하는지 시점을 일관되게 판단하지 못했다. 그리고, 마치 사람처럼 관대화 오류도 있었다. 성과평가에서 평가자가 후하게 점수를 매기는 관대화 오류는 성과평가의 고전적인 편향인데, 루나 역시 지각을 계속 눈감아줬다는 점에서 인간과 비슷했다.
당시 루나를 구동한 모델은 Claude Opus 4.8이었는데, 같은 상황을 다른 모델 일곱 개로 재현해 보니 4개는 매번 해고를 권고했지만 나머지 3개는 주저했다. 성능이 앞선 모델일수록 더 단호하게 해고를 권했다는 특징도 있었다.
EU는 고용 분야 고위험 의무를 2027년 12월로 미뤘다. 한국은 이미 AI 기본법이 시행됐고 채용은 고영향 AI 영역으로 분류된다.
우리 조직의 성과관리가 루나와 닮아있지 않은지 살펴보자.