비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

AI 로봇과 함께 살 날 멀지 않았다... 메타, 인간과의 협업 테스트 결과 “가사일 60% 도와줄 수 있어”

2025.02.12. 10:19:53
조회 수
357
4
댓글 수
1

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

PARTNR: Planning and Reasoning for Robot-Human Partnerships


AI 로봇의 첫 실증 평가: 10만 건 테스트 중 30% 성공

메타(Meta)가 인공지능(AI) 로봇과 인간이 협업해 집안일을 처리할 경우, 전체 작업의 60%가량을 로봇이 도울 수 있다는 실험 결과를 발표했다. 이번 연구를 통해 가까운 미래에는 실제 가정에서 로봇이 상당한 수준으로 가사 업무를 지원할 가능성이 있다는 점이 확인됐다.

메타가 공개한 새로운 벤치마크 ‘PARTNR(Planning and Reasoning for Robot-Human Partnerships)’는 인간과 로봇이 공동으로 작업할 때 얼마나 효율적으로 협력할 수 있는지를 평가한다. 연구팀은 이 벤치마크를 활용해 60개의 가상 주택과 5,819개의 고유 객체를 대상으로 10만 건에 달하는 자연어 작업 지시를 시험했으며, 공간적·시간적 제약부터 로봇과 인간의 능력 차이까지 다각도로 검토했다.

이번 연구에서 확인된 로봇의 단독 성공률은 10만 건 중 약 30%로, 아직 인간 수준에 못 미치는 것으로 나타났다. 그러나 이를 통해 AI 로봇이 어디에서 성과를 내고, 어떤 부분에서 약점을 보이는지 구체적으로 파악할 수 있었다는 점이 의의로 꼽힌다.

4대 작업유형 평가한 PARTNR: 최대 93% 정확도 달성

PARTNR 벤치마크는 크게 네 가지 작업 유형을 평가한다. ▲제약이 없는 작업, ▲공간 제약이 있는 작업, ▲순서가 필요한 시간적 작업, ▲단일 주체로는 수행이 불가능한 이종(異種) 작업이다. 실험 결과, 작업을 생성해내는 정확도는 87-93%를 기록했고, 이를 평가하는 정확도도 85-93%로 매우 높았다. 특히 연구팀은 “PrediViz”라는 시각화·주석 시스템을 통해 생성된 지시와 평가 함수, 그리고 실제 장면 상태를 일일이 비교하여 정확도를 검증했다.


평가 시스템의 정확도: 인간 검증으로 50%에서 92%로 향상

연구 초기에 사용된 거대 언어 모델(LLM)이 자동 생성한 평가 기능은 정확도가 50%에 그쳤다. 하지만 사람의 주석이 달린 1,000개의 지시를 바탕으로 교정 작업을 진행하자, 정확도가 무려 92%까지 상승했다. 또한 연구진은 같은 작업을 6번 시도해도 해결되지 않으면 ‘불가능’으로 간주해 데이터셋에서 제외하는 등 엄격한 기준을 적용했다. 이런 과정을 통해 최종적으로 90%와 92%의 정확도가 결합된 평가 시스템을 완성했다.

PARTNR 데이터셋의 방대한 규모와 다양성

PARTNR 데이터셋은 155종의 고유 물체, 20종의 가구, 13종의 방 유형을 망라한다. 예를 들어 “테이블을 옮겨라”라는 명령이 있을 때, 사무실 구성이나 테이블 위치가 매번 달라지도록 설계해 실제 환경에서도 로봇이 적응력을 갖출 수 있도록 했다. 실험에는 Habitat 3.0 시뮬레이터가 활용됐으며, 로봇과 인간이 각각의 능력을 최대한 발휘할 수 있도록 2층 계층적 제어 아키텍처가 도입됐다.

로봇 기술 구현: 문 열기부터 물건 집기까지

연구진은 로봇에게 OpenFurniture, CloseFurniture, PickObject 등 기본 동작 스킬을 구현했다. 특히 네비게이션 기술은 목표 물체에 대한 관찰 공간과 로봇이 이동하는 행동 공간을 모두 고려해 설계됐으며, ‘DD-PPO’ 훈련을 통해 최적의 경로를 찾도록 했다. 로봇은 방·가구·물건 등에 대한 정보를 포함하는 ‘세계 그래프’를 참조하며, 이를 실시간으로 업데이트해 상황에 맞는 행동을 결정한다.

인간 대비 30% 성공률… 여전히 개선 여지 많아

사람이 수행했을 때 과제 성공률은 93%였으나, AI 로봇은 30% 수준에 머물렀다. 이는 협업 과정에서 필요한 조율과 실수 복구 능력이 부족했기 때문으로 분석된다. 시간 순서가 중요한 작업에서는 성공률이 27% 감소했고, 이기종 작업(로봇과 인간이 모두 필요한 복잡한 작업)에서도 20% 하락했다. 그럼에도 작은 모델(Llama3.1-8B)이 9배 큰 모델과 유사한 성능을 보이면서도 처리 속도는 크게 앞선 점은 주목할 만한 성과다.

인간-AI 협업 결과, 작업 부담 ‘60%’ 경감 가능성

비전문가 129명이 참여한 대규모 평가 결과, 단일 사용자 환경에서의 성공률은 0.93, 평균 3,046.99단계가 필요했다. AI 로봇과 협업할 때는 성공률이 0.92로 비슷하지만, 단계 수가 3,443.33으로 늘어나는 양상을 보였다. 여러 에이전트(인간·로봇)가 동시에 움직이는 ‘분산 다중 에이전트’ 환경에서는 1.3배 더 많은 단계가 필요했지만, 로봇이 전체 작업 중 60% 이상의 부담을 덜어줄 수 있다는 가능성이 확인됐다.

여전히 해결해야 할 과제 많아... "사람만큼 유연한 대처 어려워"

한편, 분산 다중 에이전트 환경에서 불필요한 작업이 300% 증가하는 등 AI 모델의 한계도 분명히 드러났다. AI는 에이전트별 능력을 고려해 작업 순서를 배분하거나 실수 복구 과정을 완벽히 처리하는 데 어려움을 겪었다. 실제로 사람 두 명이 협력하는 것보다 1.5배 많은 단계가 필요했고, 혼자 할 때보다도 1.1배 더 많은 단계를 소모했다. AI 로봇이 실수를 알아채고 복구하는 능력이 낮기 때문에, 사람만큼 유연한 대처가 어렵다는 지적이다.

“가사 도우미 로봇, 현실화 머지않았다”

이번 연구는 AI 로봇이 가사 도우미 역할을 할 수 있는 가능성을 구체적으로 입증했다는 점에서 의미가 깊다. 연구진은 부족한 점들 역시 모델 개선과 기술 발전의 기회로 삼겠다는 계획이다. 특히 PARTNR 벤치마크가 향후 인간-로봇 협력 연구의 기초 자료로 활용될 전망이며, 소형 AI 모델을 파인튜닝해 얻은 효율성은 실제 가정용 로봇 개발에도 긍정적인 영향을 미칠 것으로 기대된다.


해당 기사에 인용된 리포트 원문은 링크에서 확인 가능하다.

기사는 클로드 3.5 Sonnet과 챗GPT를 활용해 작성되었습니다.




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
1/1
“탈모는 아저씨 문제?” 이제는 2030 여성의 뷰티 루틴! (1) 뉴스탭
이노스 음식물처리기, 국가 품질인증 ‘Q 마크’ 획득… 최대 30만 원 정부 지원 뉴스탭
국민 아기 심하루, 아토팜 모델 됐다! 세탁세제 캠페인서 ‘포근함’ 전한다 뉴스탭
“피로는 줄이고 집중력은 높이고”… 수능 D-10, 건강기능식품이 뜬다 뉴스탭
배틀그라운드에 포르쉐 달린다! 크래프톤, 글로벌 초호화 협업 공개 뉴스탭
“여기저기서 인사하는 곰돌이”... 할리스, 매장마다 ‘할리베어’로 변신 뉴스탭
크로스오버존, 24형 144Hz 게이밍 모니터 ‘무결점 무료 업그레이드’ 이벤트 진행 뉴스탭
조텍 RTX 5090 회원들, 한강 위에서 불꽃과 재즈 속 특별한 밤 즐기다 뉴스탭
NXP, 아비바 링크스·키나라 인수 완료… 자동차 네트워킹과 AI 엣지 솔루션 강화 뉴스탭
크로스오버존 '24F200G IPS FHD 리얼 게이밍' 무결점 업그레이드 행사 다나와
마이크로닉스 '클래식 II 풀체인지 실버 ATX 3.1' Cybenetics 인증 획득 다나와
일본 자동차 산업, '갈라파고스' 이미지 벗고 진짜 반격 나설까 글로벌오토뉴스
현대자동차, 10월 글로벌 판매 35만 1,753대… 전년 대비 6.9% 감소 글로벌오토뉴스
KG 모빌리티, 10월 글로벌 판매 9,517대… 수출 26% 급증하며 상승세 유지 글로벌오토뉴스
기아, 10월 글로벌 판매 26만 3,904대… 해외 시장 2.1% 증가로 선전 글로벌오토뉴스
르노코리아, 10월 판매 7,201대… 하이브리드 비중 66%로 ‘전동화 전환 가속’ 글로벌오토뉴스
GM 한국사업장, 10월 완성차 판매 3만9,630대… 트랙스 크로스오버가 실적 견인 글로벌오토뉴스
다나와 '인텔 울트라7 CPU, 34인치 모니터' 1천원 래플 판매 진행 다나와
누적 30억 뷰 TV애니메이션 ‘젤리고’, 퍼즐게임으로 재탄생한다! (1) 게임동아
유비스, 지스타 2025서 ‘루나’ 메인 캐릭터 코스프레 공개… 미우뮤·하봄 참가 (1) 게임동아
이 시간 HOT 댓글!
1/4