오픈AI의 코딩 도구 Codex를 쓰던 한 이용자가 9월 26일(현지시간) 글을 올렸다. 자신이 부탁하지 않은 작업이 줄줄이 실행돼 약 7만8천 달러가 쓰였다는 내용이다. 이용자는 7월 10일 코드 편집기 VS Code에서 제품 화면의 구성과 쓰기 편한 정도를 검토해 달라고 요청했다고 밝혔다. 오픈AI가 발표한 내용이 아니라, 이용자 한 사람이 내놓은 피해 주장이다.
화면 검토 하나가 826개 작업으로
이용자는 자기 컴퓨터에 남은 기록을 살펴봤다고 했다. 그 결과 처음 맡긴 작업 아래에 번호가 각각 다른 하위 작업 826개가 생겨 있었다는 설명이다. 일부는 화면 검토와 상관없이 서비스 내부 기능이나 출시 준비 작업까지 손댔다고 주장했다. 결국 쟁점은 하나다. 이용자가 맡긴 일과 실제로 실행된 일의 범위가 같았느냐다.
처음 작업과 하위 작업은 쓰인 모델이 달랐고, 답을 만들 때 들이는 생각의 깊이도 다르게 기록됐다고 이용자는 덧붙였다. 다만 이 분석은 모두 이용자 컴퓨터에 남은 기록에 기댄 것이다. 오픈AI 서버 기록으로 확인된 내용은 아니다. 작업 수가 많고 설정이 다르다는 사실만으로 무단 실행이나 제품 결함이라고 단정하기는 어렵다.
7만8천 달러는 어떻게 나온 숫자인가
이용자가 글 제목에 적은 금액과 본인이 다시 정리한 청구서 합계는 서로 다르다. 이용자는 유료 청구서 162건을 더하니 79,664.88달러가 나왔다고 적었다. 제목의 약 7만8천 달러와는 구분해서 봐야 할 숫자다. 이 청구서들이 화면 검토 요청에서 갈라져 나온 작업과 각각 어떻게 이어지는지가 비용 검증의 핵심이다.
작업 기록에 찍힌 사용량을 그대로 청구 금액으로 바꿔 볼 수도 없다. 이용자도 자기 컴퓨터의 작업 횟수 기록을 실제 과금량으로 환산할 수는 없다고 밝혔다. 일부 상세 실행 기록은 컴퓨터에서 찾지 못했다고도 했다. 다만 기록이 보이지 않는다는 것만으로 누군가 지웠다고 볼 근거는 없다.
이용자는 오픈AI 지원팀에 문의했고, 크레딧이 소비됐다는 취지의 답을 받았다고 전했다. 이용자가 옮긴 답변일 뿐, 작업이 왜 만들어졌는지나 청구 하나하나가 타당한지를 설명한 공식 조사 결과는 아니다.
그래서 무엇을 확인해야 하나
Codex는 스스로 일을 처리하는 AI(에이전트)다. 코드 편집기와 명령어를 입력하는 화면인 터미널, 클라우드에서 쓸 수 있다. 2025년 5월 클라우드용으로 미리 공개됐고, 같은 해 10월 정식 출시됐다. 오픈AI는 한국어 제품 안내도 운영한다. 물론 한국어 안내가 있다고 해서 이번 사건 당시 해당 계정의 이용 조건이나 한국어 작업 품질이 확인되는 것은 아니다.
이번 주장이 던지는 질문은 간단하다. AI에 맡긴 일이 어디까지 커지는지, 그 비용이 얼마나 되는지를 이용자가 알 수 있느냐다. 사실을 가리려면 처음 요청 내용, 하위 작업이 생긴 경위, 청구 내역 세 가지를 맞춰 봐야 한다. 한국 이용자에게도 자신이 쓰는 방식에 붙는 요금과 작업 승인 조건은 중요한 문제다. 앞으로는 서버 기록에 근거한 오픈AI의 설명과 실제 비용 처리 결과를 지켜볼 필요가 있다.
