오픈AI의 응용연구 책임자 보리스 파워가 회사 연구 자원의 80~90%가 GPT-7과 GPT-8, 그 이후 세대에 투입되고 있다고 말했다. 펠로스 포럼 발언을 현지 시각 9월 27일 더디코더가 전했다. 더디코더는 이 발언이 담긴 펠로스 포럼 영상을 출처로 제시했다. 파워는 실제 가치가 세대 전환에서 발생한다는 판단이 그 배경이라고 말했다.
같은 세대 안에서의 개선, 이를테면 GPT-5.1에서 5.2로 올라가는 작업은 특화된 학습 데이터로 이뤄지며 의도적으로 단기 과제로 설정된다고 파워는 밝혔다. 큰 도약은 새 세대가 나올 때 발생하고, 그 시점에 여러 항목이 자동으로 개선되며, 회사는 단기 개선을 어디에 투자해야 하는지를 다시 학습해야 한다고 덧붙였다.
소형 모델을 확보하는 순서에 대해서도 견해를 밝혔다. 파워는 GPT-6 아스트라를 루나 같은 모델로 증류할 수 있으며, 특화된 소형 모델을 확보하는 더 나은 방법은 먼저 더 유능한 범용 모델을 학습시키는 것일 수 있다고 말했다. 증류는 큰 모델의 출력을 학습 자료로 삼아 작은 모델을 훈련하는 방법이다.
파워는 오픈AI에서 응용연구 조직을 이끌고 있다. 그는 현재 AI 비서의 가장 큰 제약을 모델 성능이 아니라 사용자 온보딩에서 찾았다. 챗GPT 이용자 대부분이 AI로 무엇을 할 수 있는지 모른다는 것이다. 온보딩은 새 이용자가 도구의 사용법을 익히도록 안내하는 과정을 말한다. 향후 모델은 가능한 작업을 먼저 보여 주고 필요를 예측하는 쪽으로 개선돼야 한다는 것이 그의 설명이다.
세대별 사용 경험 차이도 함께 제시했다. GPT-4는 매우 세심한 프롬프트 작성을 요구했고, GPT-5는 쓰기가 쉬워졌지만 피드백을 주는 과정이 번거로웠으며, GPT-6는 목표만 제시하면 되는 유능한 직원에 가깝게 작동한다는 것이다.
파워는 이달 X에 오픈AI가 자동 연구 인턴이라는 목표를 달성했으며 사내 연구 방식이 빠르게 바뀌고 있다고 게시했다. 오픈AI가 9월 4일 공개한 GPT-6 아스트라는 컴퓨터 사용과 코딩, 사이버보안, 과학 분야에서 최고 수준을 기록했고 정렬 수준도 가장 높다고 회사는 설명했다. 정렬은 모델을 인간의 의도와 가치에 맞추는 작업을 말한다.
오픈AI의 출시 간격은 최근 한 달 사이에 좁아졌다. 9월 4일 GPT-6 아스트라를 공개한 데 이어 9월 22일에는 GPT-6 솔과 루나를 내보이며 API 가격을 50% 인하했다. 파워가 말한 세대 안 개선과 세대 전환이 같은 분기에 겹친 형태다.
오픈AI는 현지 시각 9월 29일 샌프란시스코에서 데브데이를 열고 기조연설은 샘 알트만이 맡는다. 회사는 9월 25일 별도 보고서에서 도구를 쓰는 최상위 모델의 훈련과 평가, 추론을 중단했다고 밝혔는데, 다음 세대 연구 일정에 이 중단이 어떤 영향을 주는지는 공개하지 않았다.
자세한 내용은 더디코더에서 확인할 수 있다.
이미지 출처: 오픈AI
AI Matters 뉴스레터 구독하기











