오픈AI 모델 개선 업무를 맡은 계약직 가운데 여러 명이 AI를 사용해 업무를 처리하다 해고된 것으로 확인됐다. 404미디어가 현지 시각 9월 22일 내부 문서와 계약직 3명의 증언을 근거로 보도했다.
오픈AI는 실제 이용자의 프롬프트와 대화를 사람이 읽고 챗GPT의 응답을 평가하는 방식으로 모델을 개선해 왔다. 404미디어가 확보한 내부 문서 중 하나에는 여러 프로젝트에 계약직 1만 명 이상이 참여한다고 적혀 있다.
다른 계약직의 작업을 검수하는 인력을 대상으로 한 문서에는 AI 사용 금지 지침이 명시됐다. 문서는 “AI 탐지 도구를 사용하지 말고, 검수자 본인도 AI를 사용하지 말라”고 적고 GPTZero를 비롯한 탐지 도구와 그래머리, AI 번역을 함께 금지했다. 이어 “왜 AI로 의심하는지 평가자에게 알리지 말라. 알게 되면 숨기기가 쉬워진다. 단서 하나가 아니라 전체 양상으로 판단하라”고 적었다.
검수자가 확인하는 단서로는 반복되는 단어, 엠대시를 지나치게 많이 쓰는 문장 부호 습관, 업무를 지나치게 빨리 끝내는 양상이 제시됐다. 한 계약직은 “그런 사례를 늘 본다. 그래서 제외되는 일도 늘 있다. 여기서 가장 빨리 배제되는 사유가 이것”이라며 “수천 명 가운데 상당수가 적발됐다”고 말했다.
AI를 사용했다는 계약직 한 명은 해고 통보서를 404미디어에 제공했다. 통보서에는 업무의 진정성에 문제가 확인됐다고 적혀 있었다. 당사자는 “나는 나쁜 사람도, 나쁜 노동자도 아니다. 잠깐 도움이 필요해 AI를 썼고 그것이 문제가 됐다”며 “업무에서 즐거움을 느끼지 못했고 사회에 기여한다는 느낌도 없었다”고 말했다.
이들 중 두 명이 소속된 머코(Mercor)의 대변인은 “우리 전문가는 전문성과 판단력을 보고 채용된다. 계약상 LLM을 사용해 프로젝트를 수행하는 것을 엄격히 금지하며 이를 집행한다”며 “AI 사용이 확인되면 즉시 프로젝트에서 제외한다”고 밝혔다. 404미디어는 여러 AI 기업의 모델 학습에 참여한 네 번째 계약직이 일부러 가장 나쁜 응답을 고른다고 말했다고 전했다. 오픈AI는 논평을 거부했다.
이 문제가 주목받는 이유는 모델 붕괴 때문이다. 모델 붕괴는 AI가 생성한 글로 다시 학습한 모델의 성능이 점점 떨어지는 현상을 가리킨다.
자세한 내용은 404미디어에서 확인할 수 있다.
이미지 출처: 오픈AI
AI Matters 뉴스레터 구독하기



