비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

모션 캡처가 필요 없다! 걷고, 앉고, 기타 치고...AI가 스스로 배우는 자연스러운 동작 생성 기술

2024.12.31. 09:47:40
조회 수
308
6
댓글 수
3

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

ZeroHSI: Zero-Shot 4D Human-Scene Interaction by Video Generation



모션 캡처 없이도 자연스러운 가상 캐릭터 움직임 구현

북경대학교 Hongjie Li 연구원과 스탠포드대학교 Hong-Xing Yu 연구원이 공동 1저자로 참여한 연구팀이 3D 가상공간에서 사람과 환경의 자연스러운 상호작용을 생성하는 혁신적인 기술을 개발했다. 이 기술은 엠바디드 AI(Embodied AI), 가상현실(VR), 로봇공학 분야의 핵심 과제인 인간-환경 상호작용(Human-Scene Interaction, HSI) 생성 문제를 해결했다는 평가를 받고 있다.

기존 가상 캐릭터 기술의 한계점 극복

기존의 HSI 생성 연구는 크게 두 가지 방향으로 진행됐다.

첫째는 정적인 3D 공간에서의 상호작용에 초점을 맞춘 연구로, 모션 디퓨전 모델(Motion Diffusion Model)을 활용해 3D 공간과 모션 캡처 데이터를 학습시켰다. 그러나 이 방식은 흔한 동작인 걷기나 앉기조차도 다른 환경에 일반화하기 어려웠다.

둘째는 동적 물체 조작에 중점을 둔 연구다. 이 접근법은 같은 종류의 물체 내에서는 일반화가 가능했지만, 형태가 크게 다른 물체는 다루지 못했다. 두 방향 모두 3D 공간과 모션 캡처 데이터가 쌍으로 구성된 데이터셋에 의존한다는 근본적 한계가 있었다.

영상 생성 AI와 3D 기술의 혁신적 결합

연구진이 개발한 'ZeroHSI'는 기존 방식과 달리 최신 영상 생성 AI 모델이 학습한 풍부한 동작 정보를 활용한다. 이 모델들은 방대한 양의 자연스러운 인간 동작과 상호작용이 포함된 영상을 학습했기 때문에, 다양한 3D 환경에서 맥락에 맞는 자연스러운 동작을 생성할 수 있다.

이 기술은 3D 가우시안 스플래팅(3D Gaussian Splatting) 기술을 기반으로 구현됐다. 시스템은 먼저 3D 공간을 입력받아 애니메이션이 가능한 아바타를 초기화하고, 프레임별로 상대적 카메라 변환을 순차적으로 추정한다. 이후 생성된 비디오를 참조하여 프레임별로 인간 포즈 파라미터를 최적화하고, VPoser를 활용한 인간 포즈 사전 정보를 통해 자연스러운 동작을 생성한다. 이 방식으로 정적인 환경뿐 아니라 움직이는 물체와의 상호작용도 자연스럽게 구현할 수 있다.

12개 실내외 환경에서 입증된 자연스러운 상호작용

연구진은 기술 평가를 위해 "AnyInteraction"이라는 새로운 벤치마크 데이터셋을 구축했다. 이 데이터셋은 침실, 거실, 체육관, 바, 놀이터, 온실, 카페, 상점 등 총 12개의 서로 다른 3D 환경으로 구성되었으며, 이 중 7개는 실내 환경, 5개는 실외 환경이다. 특히 Mip-NeRF 360과 Tanks and Temples 데이터셋의 실제 장면을 활용하여 현실감을 높였다.

정량적 평가에서 ZeroHSI는 TRUMANS와 LINGO 등 기존 방식들보다 더 나은 의미론적 정렬(Semantic Alignment)과 동작 다양성, 물리적 타당성을 보여줬다. 실제 구현된 상호작용은 정적 환경에서의 걷기, 앉기, 청소하기부터 동적 물체와의 상호작용인 식물 물주기, 꽃병 들기, 잔디깎기, 기타 연주에 이르기까지 다양했다. 특히 동적 물체와의 상호작용에서 ZeroHSI는 CHOIS와 LINGO 대비 높은 접촉률과 낮은 물체 관통률을 기록했다. 400명의 참가자를 대상으로 한 평가에서도 정적 및 동적 시나리오 모두에서 기존 방식들보다 더 자연스럽고 의도한 동작과 잘 부합한다는 평가를 받았다.



메타버스와 로봇공학의 새 지평을 열다

현재 ZeroHSI는 동작 시퀀스당 약 1시간의 처리 시간이 필요해 실시간 응용에는 제약이 있으며, 미세한 물체와의 상호작용에서는 신뢰할 수 있는 시각적 감독이 어렵다는 한계가 있다. 또한 생성된 동작의 품질이 영상 생성 모델의 성능에 의존적이나, 비디오 생성 기술의 빠른 발전으로 이러한 한계는 점차 극복될 것으로 예상된다.

이 기술은 VR/AR에서 더 자연스러운 아바타 움직임 구현, 로봇공학에서의 동작 계획 수립, 메타버스의 실감형 캐릭터 제어 등 다양한 분야에서 활용될 수 있다. 특히 모션 캡처 데이터 없이도 자연스러운 인간-환경 상호작용을 생성할 수 있다는 점에서, 가상 환경에서의 인간 행동 시뮬레이션 분야에 새로운 지평을 열었다는 평가를 받고 있다.

해당 논문의 원문은 링크에서 확인할 수 있다.

기사는 클로드 3.5 Sonnet과 챗GPT-4o를 활용해 작성되었습니다. 





AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 기획뉴스 전체 둘러보기
1/1
10년 전에 구매한 SSD, 이제 놓아줘야 할까요? [이젠 바꿨으면 좋겠네] 다나와
[2025 서울모빌리티쇼] 현대차, 2세대 넥쏘 등 친환경차 풀라인업 공개 오토헤럴드
[2025 서울모빌리티쇼] 제네시스 'X 그란 쿠페 및 컨버터블' 세계 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] 현대차, ‘디 올 뉴 넥쏘’·‘더 뉴 아이오닉 6’ 세계 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] 월드프리이머 5종... 신차부터 미래 기술까지 총망라 오토헤럴드
[2025 서울모빌리티쇼] 포르쉐, ‘신형 911 카레라 4 GTS' 국내 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] 벤츠,극강의 퍼포먼스 신형 AMG GT 국내 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] HD현대, 40톤·24톤급 스마트 굴착기 세계 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] BMW, 뉴 i4 M50 xDrive 그란 쿠페 국내 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] 미니, ‘JCW·쿠퍼 컨버터블’ 국내 최초 공개 오토헤럴드
[2025 서울모빌리티쇼] BMW 모토라드, ‘뉴 S 1000 RR’과 ‘M 1000 XR’ 공개 오토헤럴드
[2025 서울모빌리티쇼] 기아, 혁신적 모빌리티 라이프’ 제시… ‘PV5’ 첫 공개 오토헤럴드
[2025 서울모빌리티쇼] BYD, 중형 전기세단 '씰' 공개... 사전예약 돌입 오토헤럴드
도쿄 숙소 고민 끝! 후회 없을 프린스 호텔 3 트래비
페이데이보다 높은 자유도로 하이스트 정상 노린다 (1) 게임메카
샤오미 SU7 사고 직후 폭발로 20대 여성 3명 불에 타 숨져 동영상 있음 오토기어
애플의 새 혁신 아이패드 긴급 공수 동영상 있음 UnderKG
[2025 서울모빌리티쇼] 봄 나들이, 아이와 함께 딱 좋은 체험형 콘텐츠 주목 (1) 오토헤럴드
8년 만에 결국 도산한 카누와 전기차에 진심이었던 BMW 동영상 있음 오토기어
[자동차와 法] 모빌리티 시대, 우리가 미처 몰랐던 도로교통 관련 규정 (1) IT동아
이 시간 HOT 댓글!
1/4