AI 로봇과 함께 살 날 멀지 않았다... 메타, 인간과의 협업 테스트 결과 “가사일 60% 도와줄 수 있어” : 다나와 DPG는 내맘을 디피지

PARTNR: Planning and Reasoning for Robot-Human Partnerships

AI 로봇의 첫 실증 평가: 10만 건 테스트 중 30% 성공

메타(Meta)가 인공지능(AI) 로봇과 인간이 협업해 집안일을 처리할 경우, 전체 작업의 60%가량을 로봇이 도울 수 있다는 실험 결과를 발표했다. 이번 연구를 통해 가까운 미래에는 실제 가정에서 로봇이 상당한 수준으로 가사 업무를 지원할 가능성이 있다는 점이 확인됐다.

메타가 공개한 새로운 벤치마크 ‘PARTNR(Planning and Reasoning for Robot-Human Partnerships)’는 인간과 로봇이 공동으로 작업할 때 얼마나 효율적으로 협력할 수 있는지를 평가한다. 연구팀은 이 벤치마크를 활용해 60개의 가상 주택과 5,819개의 고유 객체를 대상으로 10만 건에 달하는 자연어 작업 지시를 시험했으며, 공간적·시간적 제약부터 로봇과 인간의 능력 차이까지 다각도로 검토했다.

이번 연구에서 확인된 로봇의 단독 성공률은 10만 건 중 약 30%로, 아직 인간 수준에 못 미치는 것으로 나타났다. 그러나 이를 통해 AI 로봇이 어디에서 성과를 내고, 어떤 부분에서 약점을 보이는지 구체적으로 파악할 수 있었다는 점이 의의로 꼽힌다.

4대 작업유형 평가한 PARTNR: 최대 93% 정확도 달성

PARTNR 벤치마크는 크게 네 가지 작업 유형을 평가한다. ▲제약이 없는 작업, ▲공간 제약이 있는 작업, ▲순서가 필요한 시간적 작업, ▲단일 주체로는 수행이 불가능한 이종(異種) 작업이다. 실험 결과, 작업을 생성해내는 정확도는 87-93%를 기록했고, 이를 평가하는 정확도도 85-93%로 매우 높았다. 특히 연구팀은 “PrediViz”라는 시각화·주석 시스템을 통해 생성된 지시와 평가 함수, 그리고 실제 장면 상태를 일일이 비교하여 정확도를 검증했다.

평가 시스템의 정확도: 인간 검증으로 50%에서 92%로 향상

연구 초기에 사용된 거대 언어 모델(LLM)이 자동 생성한 평가 기능은 정확도가 50%에 그쳤다. 하지만 사람의 주석이 달린 1,000개의 지시를 바탕으로 교정 작업을 진행하자, 정확도가 무려 92%까지 상승했다. 또한 연구진은 같은 작업을 6번 시도해도 해결되지 않으면 ‘불가능’으로 간주해 데이터셋에서 제외하는 등 엄격한 기준을 적용했다. 이런 과정을 통해 최종적으로 90%와 92%의 정확도가 결합된 평가 시스템을 완성했다.

PARTNR 데이터셋의 방대한 규모와 다양성

PARTNR 데이터셋은 155종의 고유 물체, 20종의 가구, 13종의 방 유형을 망라한다. 예를 들어 “테이블을 옮겨라”라는 명령이 있을 때, 사무실 구성이나 테이블 위치가 매번 달라지도록 설계해 실제 환경에서도 로봇이 적응력을 갖출 수 있도록 했다. 실험에는 Habitat 3.0 시뮬레이터가 활용됐으며, 로봇과 인간이 각각의 능력을 최대한 발휘할 수 있도록 2층 계층적 제어 아키텍처가 도입됐다.

로봇 기술 구현: 문 열기부터 물건 집기까지

연구진은 로봇에게 OpenFurniture, CloseFurniture, PickObject 등 기본 동작 스킬을 구현했다. 특히 네비게이션 기술은 목표 물체에 대한 관찰 공간과 로봇이 이동하는 행동 공간을 모두 고려해 설계됐으며, ‘DD-PPO’ 훈련을 통해 최적의 경로를 찾도록 했다. 로봇은 방·가구·물건 등에 대한 정보를 포함하는 ‘세계 그래프’를 참조하며, 이를 실시간으로 업데이트해 상황에 맞는 행동을 결정한다.

인간 대비 30% 성공률… 여전히 개선 여지 많아

사람이 수행했을 때 과제 성공률은 93%였으나, AI 로봇은 30% 수준에 머물렀다. 이는 협업 과정에서 필요한 조율과 실수 복구 능력이 부족했기 때문으로 분석된다. 시간 순서가 중요한 작업에서는 성공률이 27% 감소했고, 이기종 작업(로봇과 인간이 모두 필요한 복잡한 작업)에서도 20% 하락했다. 그럼에도 작은 모델(Llama3.1-8B)이 9배 큰 모델과 유사한 성능을 보이면서도 처리 속도는 크게 앞선 점은 주목할 만한 성과다.

인간-AI 협업 결과, 작업 부담 ‘60%’ 경감 가능성

비전문가 129명이 참여한 대규모 평가 결과, 단일 사용자 환경에서의 성공률은 0.93, 평균 3,046.99단계가 필요했다. AI 로봇과 협업할 때는 성공률이 0.92로 비슷하지만, 단계 수가 3,443.33으로 늘어나는 양상을 보였다. 여러 에이전트(인간·로봇)가 동시에 움직이는 ‘분산 다중 에이전트’ 환경에서는 1.3배 더 많은 단계가 필요했지만, 로봇이 전체 작업 중 60% 이상의 부담을 덜어줄 수 있다는 가능성이 확인됐다.

여전히 해결해야 할 과제 많아... "사람만큼 유연한 대처 어려워"

한편, 분산 다중 에이전트 환경에서 불필요한 작업이 300% 증가하는 등 AI 모델의 한계도 분명히 드러났다. AI는 에이전트별 능력을 고려해 작업 순서를 배분하거나 실수 복구 과정을 완벽히 처리하는 데 어려움을 겪었다. 실제로 사람 두 명이 협력하는 것보다 1.5배 많은 단계가 필요했고, 혼자 할 때보다도 1.1배 더 많은 단계를 소모했다. AI 로봇이 실수를 알아채고 복구하는 능력이 낮기 때문에, 사람만큼 유연한 대처가 어렵다는 지적이다.

“가사 도우미 로봇, 현실화 머지않았다”

이번 연구는 AI 로봇이 가사 도우미 역할을 할 수 있는 가능성을 구체적으로 입증했다는 점에서 의미가 깊다. 연구진은 부족한 점들 역시 모델 개선과 기술 발전의 기회로 삼겠다는 계획이다. 특히 PARTNR 벤치마크가 향후 인간-로봇 협력 연구의 기초 자료로 활용될 전망이며, 소형 AI 모델을 파인튜닝해 얻은 효율성은 실제 가정용 로봇 개발에도 긍정적인 영향을 미칠 것으로 기대된다.

해당 기사에 인용된 리포트 원문은 링크에서 확인 가능하다.

기사는 클로드 3.5 Sonnet과 챗GPT를 활용해 작성되었습니다.

AI Matters 뉴스레터 구독하기

“탈모는 아저씨 문제?” 이제는 2030 여성의 뷰티 루틴! (1)	뉴스탭
이노스 음식물처리기, 국가 품질인증 ‘Q 마크’ 획득… 최대 30만 원 정부 지원	뉴스탭
국민 아기 심하루, 아토팜 모델 됐다! 세탁세제 캠페인서 ‘포근함’ 전한다	뉴스탭
“피로는 줄이고 집중력은 높이고”… 수능 D-10, 건강기능식품이 뜬다	뉴스탭
배틀그라운드에 포르쉐 달린다! 크래프톤, 글로벌 초호화 협업 공개	뉴스탭
“여기저기서 인사하는 곰돌이”... 할리스, 매장마다 ‘할리베어’로 변신	뉴스탭
크로스오버존, 24형 144Hz 게이밍 모니터 ‘무결점 무료 업그레이드’ 이벤트 진행	뉴스탭
조텍 RTX 5090 회원들, 한강 위에서 불꽃과 재즈 속 특별한 밤 즐기다	뉴스탭
NXP, 아비바 링크스·키나라 인수 완료… 자동차 네트워킹과 AI 엣지 솔루션 강화	뉴스탭
크로스오버존 '24F200G IPS FHD 리얼 게이밍' 무결점 업그레이드 행사	다나와
마이크로닉스 '클래식 II 풀체인지 실버 ATX 3.1' Cybenetics 인증 획득	다나와
일본 자동차 산업, '갈라파고스' 이미지 벗고 진짜 반격 나설까	글로벌오토뉴스
현대자동차, 10월 글로벌 판매 35만 1,753대… 전년 대비 6.9% 감소	글로벌오토뉴스
KG 모빌리티, 10월 글로벌 판매 9,517대… 수출 26% 급증하며 상승세 유지	글로벌오토뉴스
기아, 10월 글로벌 판매 26만 3,904대… 해외 시장 2.1% 증가로 선전	글로벌오토뉴스
르노코리아, 10월 판매 7,201대… 하이브리드 비중 66%로 ‘전동화 전환 가속’	글로벌오토뉴스
GM 한국사업장, 10월 완성차 판매 3만9,630대… 트랙스 크로스오버가 실적 견인	글로벌오토뉴스
다나와 '인텔 울트라7 CPU, 34인치 모니터' 1천원 래플 판매 진행	다나와
누적 30억 뷰 TV애니메이션 ‘젤리고’, 퍼즐게임으로 재탄생한다! (1)	게임동아
유비스, 지스타 2025서 ‘루나’ 메인 캐릭터 코스프레 공개… 미우뮤·하봄 참가 (1)	게임동아
세계 최고 권위 '2026 유럽 올해의 차' 최종 후보에 오른 유일한 국산차	오토헤럴드
현대차그룹, 싱가포르 과학기술청과 미래 모빌리티·첨단 기술 협력 체결	오토헤럴드
많게는 500만원, 길게는 36개월 무이자... 현대차·기아, 역대급 ‘세일페스타’	오토헤럴드
현대차그룹, 협력사와 구직자 연결하는 ‘2025 온라인 채용박람회’ 개최	오토헤럴드
2026년형 ‘스카니아 슈퍼’ 출시, 진보된 기술력과 스마트한 운행 경험 구현 (1)	오토헤럴드
현대차그룹, 싱가포르 정부와 수소 중심 저탄소 기술 개발 협력 MOU	오토헤럴드
현대차그룹, 기발한 모빌리티 아이디어 발굴 ‘미래기술공모과제’ 접수	오토헤럴드
현대차, 어린이들의 상상 속 미래도시 '제10회 현대키즈모터쇼 공모전' 개최	오토헤럴드
현대차, 서비스엔지니어 채용 전환형 인턴십 '하이테크 탤런트 트랙' 모집	오토헤럴드
현대차그룹-엔비디아, 블랙웰 기반 AI 팩토리로 차세대 자율주행·로보틱스 혁신 가속	글로벌오토뉴스
테슬라, 연말까지 ‘트레이드인 프로모션’ 진행	글로벌오토뉴스
하우엔지니어링웍스, KOLAS로부터 ISO 26262 공인 검사기관 인정	글로벌오토뉴스
한국앤컴퍼니그룹, 노먼 포스터 설계 '테크노플렉스' 일반에 공개... 공간 철학 통한 혁신 강조	글로벌오토뉴스
현대자동차그룹, 협력사 600여 곳 참여 '온라인 채용박람회' 개최... 동반성장 및 고용 활성화 지원	글로벌오토뉴스
현대차·기아, 코리아 세일 페스타 맞아 대규모 할인 공세... 개소세 종료 전 '구매 최적기'	글로벌오토뉴스
현대차그룹, 싱가포르 정부와 '모빌리티 혁신 기술 협력' 본격화	글로벌오토뉴스
테슬라, 사이버캡에 스티어링 휠과 페달 추가 가능성 시사	글로벌오토뉴스
폭스바겐 파워코, 캐나다 전기차 배터리 기가팩토리 본관 건설 착수	글로벌오토뉴스
토요타, 2027년 또는 2028년 전고체 배터리 전기차 출시 일정 재확인	글로벌오토뉴스
BMW, 중국 정보통신기술원 산하 오픈소스 혁신개발촉진센터 가입... 중국 R&D 협력 강화	글로벌오토뉴스
BYD, 2025년 3분기 매출 및 순이익 감소... 전기차 시장 경쟁 심화가 원인	글로벌오토뉴스
엔비디아와 우버, 대대적인 레벨 4 자율 주행 네트워크 확장	글로벌오토뉴스
현대차 및 기아, 포비아와 글로벌 시장 차량에 시트 기술 공급 계약 체결	글로벌오토뉴스
포르쉐, 전략적 구조조정 여파로 3분기 실적 '직격탄'... 장기 수익성 확보 집중	글로벌오토뉴스
MINI 코리아, 창립 20주년 기념 ‘2025 MINI 유나이티드’ 성황리 개최	글로벌오토뉴스
혼다코리아, 11월 모터사이클 구매 프로모션 실시	글로벌오토뉴스
볼보자동차코리아, 쏘카와 손잡고 XC40 무료 시승 프로그램 운영	글로벌오토뉴스
혼다코리아, 어코드 하이브리드·터보 11월 구매 프로모션 연장 운영	글로벌오토뉴스
메르세데스-벤츠 코리아, ‘AMG CLE 53 4MATIC+ 카브리올레 리미티드 에디션’ 15대 한정 출시	글로벌오토뉴스
현대자동차, 서비스엔지니어 육성 위한 ‘하이테크 탤런트 트랙’ 인턴 모집	글로벌오토뉴스
현대자동차, ‘제10회 현대키즈모터쇼’ 공모전 개최	글로벌오토뉴스
현대자동차그룹, 미래 모빌리티 혁신 위한 ‘미래기술공모과제’ 접수 시작	글로벌오토뉴스
캐딜락, ‘2025 코리아세일페스타’ 참여… 리릭 최대 1,700만 원 할인 프로모션 진행	글로벌오토뉴스
렉서스코리아, ‘2025 렉서스 마스터즈’ 성황리 종료	글로벌오토뉴스
한국타이어, 포뮬러 E 시즌 12 프리시즌 테스트 성공적 마무리	글로벌오토뉴스
현대차그룹, 싱가포르 정부와 수소 중심 저탄소 기술 협력 MOU 체결	글로벌오토뉴스
스카니아코리아, 2026년형 ‘스카니아 슈퍼’ 출시	글로벌오토뉴스
쉐보레, ‘쉐비 빅 페스타’ 11월 한 달간 진행	글로벌오토뉴스
현대오토에버, ‘2024 동반성장지수 평가’ 2년 연속 최우수 등급 획득	글로벌오토뉴스
폭스바겐 ‘골프 트레펜 코리아’, 세대를 잇는 오너 축제로 성황리 마무리	글로벌오토뉴스
자동차 산업계·노동계, “급격한 전동화보다 현실적 감축 목표와 실질적 지원 시급”	글로벌오토뉴스
미·중 정상회담, 넥스페리아 수출 규제 완화 합의	글로벌오토뉴스
아우디 디자인의 또 다른 변화가 시작된 걸까?	글로벌오토뉴스
380. 생태계 주도권 다툼의 현장, 젠슨 황과 정의선의 만남	글로벌오토뉴스
마세라티, 전기 SUV ‘그레칼레 폴고레’ 9천만원 대로 구매 가능	글로벌오토뉴스
테슬라 로드스터, 8년째 ‘공중 부양 중’… 이제는 접어야 할 때	글로벌오토뉴스
신규 지역 공개, 명일방주: 엔드필드 28일 2차 테스트 시작	게임메카
교주도 같이 먹어! 트릭컬X빼빼로 컬래버레이션 개시	게임메카
최신 게이밍 노트북을 체험하고 경품도 받을 수 있는 MSI 노트북 팝업스토어 오픈	노트포럼
연말연시 목표, 테라리아에 공식 한국어 자막이 추가된다	게임메카
[매장탐방] 포켓몬 레전드 Z-A 열풍, 스위치1에 더 몰렸다	게임메카
네오위즈-강원랜드, ‘슬롯머신' 공동개발키로.. '소프트웨어 공급 계약’	게임동아
채널당 수용 인원 1,000명으로, 메이플랜드 2.0 만든다	게임메카
위메이드플레이 ‘애니팡4’과 깨꾹이 콜라보.. 6종 이벤트 진행	게임동아
그라비티, 신작 ‘라그나로크3’ GVG 영상 공개.. 7일만에 조회수 150만 돌파	게임동아
컴투스 'SWC2025' 월드 파이널, 세계 팬 함께 한 축제의 장으로 펼쳐지다	게임동아
이엠텍아이엔씨 유통 브랜드 PALIT, 엔비디아 지포스 게이머 페스티벌 뜨거운 열기 속 성료	다나와
조텍, 지포스 게이머 페스티벌에서 강력한 RTX 5090 올인원 수냉 그래픽카드 선보여	다나와
엔비디아, 대한민국 정부·주요 기업들과 함께 AI 인프라와 생태계 구축	다나와
[오늘의 스팀] 동접 26만, 아크 레이더스 ‘매우 긍정적’	게임메카
SWC2025, ‘푸(PU)’ 선수 세계최강자로 등극! 컴투스는 新 업데이트 공개	게임동아
[SWC2025 월드 파이널] 4강 2경기: 신성 거츠를 무너뜨린 락사즈 선수, 결승 진출	게임동아
[SWC2025 월드 파이널] 4강 1경기: 압도적인 화력으로 판달릭을 탈락시킨 푸 선수, 결승 진출	게임동아
[SWC2025 월드 파이널] 8강2R 3경기: 풀세트 접전 끝에 4강에 오른 유럽 대표 락사즈 선수	게임동아
[SWC2025 월드 파이널] 8강2R 4경기: 거츠더베르세르크 선수, 우승후보 캉징 선수를 무너뜨리다	게임동아
[SWC2025 월드 파이널] 8강2R 2경기: 3대0으로 압도적 승리를 거둔 판달릭 선수 '4강 진출'	게임동아
[이구동성] '내로남불' 저작권 관리	게임메카
[SWC2025 월드 파이널] 8강2R 1경기: 대역전극을 펼치며 레스트 선수를 꺾은 푸 선수, 4강 진출	게임동아
[SWC2025 월드 파이널] 8강 4경기: 우승후보 커리안바오를 무너뜨린 거츠더베르세르크 선수, 2라운드로	게임동아
[SWC2025 월드 파이널] 8강 3경기: 제자스 선수, 유연한 공략으로 승리 2라운드로 진출	게임동아
[SWC2025 월드 파이널] 8강 2경기: 판달릭 선수, 풍 오라클의 강력함으로 2라운드 합류	게임동아
[SWC2025 월드 파이널] 8강 1경기: 레스트 선수, 신출귀몰 전략으로 4강 진출	게임동아
서머너즈워 e스포츠의 날! 프랑스 파리를 달군 'SWC2025' 월드 파이널 현장	게임동아
컴투스 '서머너즈 워', 올해 세계 챔피언은 누구? 프랑스 파리에 '시선 집중'	게임동아
e스포츠의 전설을 추억하다. ‘스타크래프트 리유니언’ 행사로 한국 방문한 팀리퀴드	게임동아
[한주의게임소식] 예상 이상의 성과 ‘아키텍트’, 논란에 주춤한 ‘카제나’	게임동아
체코 국영 맥주 ‘부드바르’, 서울브루어리에서 생맥주로 만난다	뉴스탭
T1 한정판 게이밍 이어폰이 공짜?! 스틸시리즈, LoL 팬 위한 역대급 이벤트 연다	뉴스탭
ASUS, ‘빅스마일데이’서 고성능 게이밍 노트북 대거 출격… 최신 AMD·인텔 CPU 탑재	뉴스탭
AI 노트북의 진화, 갤럭시북5 프로 ‘빅스마일데이’서 파격 혜택	뉴스탭

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI 로봇과 함께 살 날 멀지 않았다... 메타, 인간과의 협업 테스트 결과 “가사일 60% 도와줄 수 있어”

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI 로봇과 함께 살 날 멀지 않았다... 메타, 인간과의 협업 테스트 결과 “가사일 60% 도와줄 수 있어”

공유하기

공감/비공감