비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

엔비디아의 '컨시스토리', 캐릭터 일관성 유지하며 생성 속도 20배 향상

2024.12.31. 17:45:22
조회 수
384
18
댓글 수
2

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

Training-Free Consistent Text-to-Image Generation



AI가 그리는 이야기, 더 일관되고 빠르게!

우리는 이제 AI를 이용해 텍스트만으로 이미지를 생성할 수 있는 시대에 살고 있다. 예를 들어, "초록색 모자를 쓴 강아지가 공원에서 놀고 있는 모습"이라고 입력하면, AI는 그에 맞는 이미지를 만들어낸다. 하지만 같은 강아지를 다른 상황에서 표현하려면? 예를 들어, "강아지가 집 안에서 신문을 읽는 모습"이나 "자동차 창문 밖으로 머리를 내미는 모습"을 생성하려면, AI가 이 강아지를 일관되게 표현하기가 쉽지 않다.

컨시스토리(ConsiStory)는 바로 이 문제를 해결하기 위해 등장했다. 놀라운 점은, 이 기술이 AI 모델을 새로 훈련시키거나 수정할 필요 없이, 주제를 일관되게 그릴 수 있다는 것이다.

훈련 없이 캐릭터 일관성 확보한 새로운 이미지 생성 기술

엔비디아(NVIDIA)와 텔아비브 대학교가 협력하여 개발한 '컨시스토리'의 연구논문에 따르면, 해당 모델은 텍스트 기반 이미지 생성에서 캐릭터의 일관성을 유지하는 혁신적인 기술을 선보였다. 기존 AI 모델의 재학습 없이도 동일한 캐릭터를 다양한 상황에서 일관되게 표현할 수 있는 것이 특징이다. 연구진이 개발한 '주제 중심 공유 주의(Subject-centric Shared Attention)' 기술을 통해 이미지 생성 시간을 13분에서 30초로 대폭 단축했다.

컨시스토리는 사전 훈련된 AI 모델의 내부 작동 방식을 활용해 텍스트로 설명된 주제의 일관성을 유지한다. 특히 하나의 캐릭터를 여러 장면에서 표현할 때도 동일한 특징을 유지하며, 다양한 배경과 스타일에서도 주제의 일관성을 잃지 않는다. 더불어 여러 캐릭터가 등장하는 복잡한 장면에서도 각 주제의 특징을 안정적으로 표현할 수 있다.

콘텐츠 제작 효율성 대폭 향상

컨시스토리는 기존의 이미지 생성 방식과는 다르게 AI 모델을 새로 학습시키지 않는다. 대신, 사전 훈련된 AI 모델의 내부 작동 방식을 활용해, 텍스트로 설명된 주제를 일관되게 유지한다. 이 기술은 특히 다음과 같은 장점을 가지고 있다:

1. 일관성 있는 이미지 생성
컨시스토리는 같은 강아지가 다른 상황에서도 동일한 모습으로 표현되도록 AI의 내부 정보를 공유한다. 이를 통해 다양한 장면에서도 동일한 캐릭터를 유지할 수 있다.

2. 다양한 배경과 스타일
"강아지가 공원에서 뛰어노는 모습"과 "집 안에서 신문을 읽는 모습"처럼 주제는 동일하지만 배경이 완전히 다른 이미지를 생성할 때도, 일관성을 잃지 않는다. 배경과 주제를 분리해 AI가 더 창의적으로 이미지를 생성하도록 했다.

3. 다중 주제도 문제없다
예를 들어, "소년과 그의 강아지가 함께 산책하는 모습" 같은 다중 주제 이미지도 컨시스토리를 사용하면 두 주제가 모두 일관되게 표현된다. 기존 기술은 한 주제를 일관되게 표현하는 데 초점이 맞춰졌지만, 컨시스토리는 여러 주제를 동시에 다룰 수 있다.



AI 그림 속도 20배 업! 컨시스토리의 놀라운 효율성

기존 이미지 생성 기술이 하나의 주제를 학습하는 데 수 시간에서 며칠까지 소요된 것과 달리, 컨시스토리는 별도 훈련 없이 즉시 결과물을 만들어낸다. 기존 기술보다 약 20배 빠르게 이미지를 생성하며, 창작자들에게 시간을 절약할 뿐 아니라 컴퓨팅 자원을 아끼는 데도 큰 도움을 준다.

이는 그래픽 노블, 동화책, 게임 개발 등 캐릭터의 일관성이 중요한 분야에서 제작 효율을 크게 높일 것으로 기대된다. 또한 유명 AI 모델과의 통합이 가능해 사용자가 원하는 포즈나 설정을 더 정교하게 지정할 수 있다. 뿐만 아니라, 컨시스토리는 특별한 훈련 없이도 기존의 유명 AI 모델과 통합되어 사용될 수 있다. 사용자는 특정 포즈나 설정을 더 디테일하게 지정할 수 있어, 원하는 이미지를 더 정교하게 제작할 수 있다.

한계는 있지만, 가능성은 무궁무진

컨시스토리는 기존 AI 기술의 한계를 넘어섰지만, 아직 완벽하지는 않다. 특정 스타일에서는 주제를 완벽히 구분하지 못하거나, AI가 기존 데이터에 편향되어 특정한 외형을 더 자주 생성하는 경우도 있다. 그러나 이는 모델의 개선과 사용자의 세부 설정을 통해 점진적으로 해결될 수 있는 문제다.

컨시스토리는 AI를 활용한 이미지 생성의 새로운 장을 열었다. 별도의 학습 없이도 텍스트만으로 창의적이고 일관된 이미지를 생성할 수 있는 이 기술은, 앞으로 디지털 콘텐츠 제작과 예술 창작에서 점점 더 큰 역할을 할 것이다. AI를 활용해 더 빠르고, 더 나은 창작을 꿈꾸는 모두에게 컨시스토리는 강력한 도구가 될 것이다.

해당 논문의 원문은 링크에서 확인할 수 있다.

기사는 클로드 3.5 Sonnet과 챗GPT-4o를 활용해 작성되었습니다. 




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
1/1
황유민, KLPGA 챔피언십 첫날 선두…박현경·이예원 추격 연합뉴스
창안자동차, 상하이 모터쇼서 미래 전략 발표…신에너지·지능화·글로벌 확장 '삼각편대' 구축 (2) 글로벌오토뉴스
닛산, 중국 우한 공장 생산 중단…실적 부진 및 경쟁 심화 영향 (1) 글로벌오토뉴스
BYD, 1분기 순이익 두 배 증가…전기차·하이브리드 판매 호조 (1) 글로벌오토뉴스
메르세데스-마이바흐 S-클래스의 품격, 가장 안락한 퍼스트클래스급 승차감을 제공한다 (1) 글로벌오토뉴스
스트라드비젼-악세라, 자율주행 혁신 가속 위한 전략적 협력 체결 글로벌오토뉴스
중국 자율주행 스타트업 모멘타, 상하이 모터쇼서 글로벌 자동차 브랜드와 대규모 협력 계약 글로벌오토뉴스
비스테온-퀄컴, AI 기반 차세대 콕핏 시스템 공동 개발 글로벌오토뉴스
일렉트로비트-메톡, 소프트웨어 기반 차량 혁신 위해 전략적 파트너십 체결 글로벌오토뉴스
비스테온-볼케이노 엔진, AI 기반 스마트 콕핏 솔루션 공개…차량 내 경험 혁신 예고 글로벌오토뉴스
중국 세레스, 상하이 모터쇼서 지능형 안전 생태계 공개…미래 자동차 안전 표준 제시 글로벌오토뉴스
현대차, 'ACT 엑스포 2025'서 북미 수소 물류시장 본격 공략 (1) 글로벌오토뉴스
로터스자동차, 지난해 글로벌 차량 인도대수 74% 증가 글로벌오토뉴스
폴스타, 2025년형 폴스타 2 출시...300대 한정 신규 트림 추가, 4390만원부터 글로벌오토뉴스
프랑스, 전기차 등록 혜택 종료 임박…지역별 최대 750유로 부담 우려 글로벌오토뉴스
유럽연합, 'FULL-MAP' 프로젝트 출범…AI 기반 차세대 배터리 개발 박차 글로벌오토뉴스
메르세데스-벤츠 트럭, eActros 600으로 100km 후진 기네스 기록 도전 글로벌오토뉴스
빈패스트, 4분기 전기차 출하량 143% 급증…글로벌 성장 가속 글로벌오토뉴스
BYD, 초대형 운반선 '선전'호 출항…글로벌 전기차 시장 공략 가속 글로벌오토뉴스
BYD, 1분기 순이익 100% 폭증…해외 시장 공략 가속화 글로벌오토뉴스
이 시간 HOT 댓글!
1/4