'오픈AI와 구글보다 빠르고 유연한 비전 인코더' UCSC 'OpenVision' 공개 : 다나와 DPG는 내맘을 디피지

[출처 : UCSC 깃허브 프로젝트 페이지]

캘리포니아 대학교 산타크루즈(UCSC)가 오픈소스 비전 인코더 모델군인 '오픈비전(OpenVision)'을 발표했다. 비전 인코더(vision encoder)는 이미지 같은 시각 자료를 숫자 데이터로 변환해 주는 AI 모델이다.

이렇게 변환된 데이터는 시각 정보 처리 기능이 없는 대형 언어 모델(LLM) 등 다른 AI 모델이 이해할 수 있다. 즉, LLM이 이미지 속의 사물, 색상, 위치 등의 다양한 특징을 인식할 수 있도록 도와주는 핵심 구성 요소다.

'오픈비전'은 Apache 2.0 라이선스 하에 공개되며, 총 26개의 다양한 모델로 구성되어 있어 용도와 기기 크기에 맞게 자유롭게 선택이 가능하다. 덕분에 건설 현장 사진부터 세탁기 이미지까지 어떤 시각 자료든 처리할 수 있으며, 이를 통해 AI 모델이 사용자에게 다양한 서비스를 제공할 수 있다. 따라서 이 모델은 4년 전 출시된 OpenAI의 'CLIP'과 작년 공개된 Google의 'SigLIP'을 대체할 수 있는 새로운 대안으로 주목받고 있다.

'오픈비전'은 특히 다양한 유형의 데이터를 통합적으로 이해하고 처리하는 '멀티모달(multimodal) 벤치마크'에서 강력한 성능을 보여줬다. 전통적인 벤치마크 도구(ImageNet, MSCOCO)도 사용됐지만, '오픈비전' 개발팀은 단순 이미지 분류나 검색 성능만으로 모델의 실제 능력을 판단해선 안 된다고 경고하며 대신 더 다양한 벤치마크와 개방형 평가 프로토콜을 통해 '실제 사용 환경에 가까운' 성능을 평가해야 한다고 제안했다.

테스트는 두 종류의 표준 멀티모달 프레임워크(LLaVA-1.5 및 Open-LLaVA-Next)를 사용하여 이뤄졌으며,

그 결과 '오픈비전' 모델이 TextVQA, ChartQA, MME 및 OCR과 같은 고차원 멀티모달 과제에서 CLIP 및 SigLIP을 능가하는 성능을 보였다.

[출처 : UCSC 깃허브 프로젝트 페이지]

'오픈비전' 인코더는 224×224 해상도 기준으로 CLIP보다 높은 분류 및 검색 성능을 보였으며, SEED, SQA, POPE 같은 후속 과제에서도 우위를 점했다. 고해상도(336×336) 환경에서는 OpenVision-L/14가 CLIP-L/14보다 대부분의 과제에서 더 나은 성능을 기록했으며 소형 모델조차도 파라미터 수는 훨씬 적으면서도 경쟁력 있는 정확도를 유지했다.

'오픈비전'의 또 다른 강점은 CLIPA에서 차용한 '점진적 해상도 학습 방식'이다. 학습은 저해상도 이미지로 시작해 고해상도로 점차 정교해지며, 이는 전체 학습 비용을 CLIP이나 SigLIP 대비 1/2~1/3배로 효율적으로 만들어준다. 특히 고해상도 세부 정보가 중요한 OCR이나 차트 기반 질문응답 과제에서 가장 큰 성능 향상이 관찰되었다.

'오픈비전'은 SLM(소형 언어 모델) 및 엣지 컴퓨팅 환경과의 결합도 고려해 설계됐다. 전체 모델 크기를 250M 이하의 작은 크기로 구성해도 다양한 VQA, 문서 이해, 추론 과제에서 강력한 성능을 유지했으며 이 기능은 스마트폰, 센서 등 연산 자원이 제한적인 환경에서도 실용적이라는 점을 시사한다.

또 완전한 오픈소스이자 모듈형으로 설계되어, AI 엔지니어링, 오케스트레이션, 데이터 인프라, 보안 등 다양한 전략적 가치를 제공한다. 예를 들어 LLM 개발 및 운영 엔지니어는 '오픈비전'을 활용해 외부 API나 제한된 라이선스 없이도 고성능 비전 기능을 통합할 수 있으며 기밀 데이터를 외부로 보내지 않아도 된다.

[출처 : chatGPT 생성 이미지]

'오픈비전'의 등장은, AI 시각 인식 기술에 있어서의 중요한 전환점이라고 말할 수 있다. 지금까지 비전 인코더 시장은 OpenAI의 CLIP나 Google의 SigLIP 등, 일부 대기업이 제공하는 「블랙 박스」 모델이 지배하고 있었다고 해도 과언이 아니다. 하지만 '오픈비전'은 이름처럼 "완전히 오픈"된 모델이라 트레이닝 데이터, 코드, 모델의 가중치까지 모든 것이 공개되어 있어 Apache 2.0 라이센스하에서 상업 이용도 자유롭게 할 수 있다.

글 / 홍정민 news@cowave.kr

대원씨티에스, ASRock 메인보드 사용자 위한 '안심 케어' 서비스 시행	다나와
“AI가 가짜뉴스 잡는다”… X, 커뮤니티 노트에 AI 챗봇 투입 (1)	AI matters
아마존, 창고 로봇 누적 100만 대 배치… AI 모델로 창고 자율주행 10% 향상	AI matters
네이버·KAIST가 발견한 AI 학습 비밀? 50% 난도로 훈련하면 성능 10배 향상	AI matters
"아니야, 그 명령은 위험해" AI가 인간의 명령을 거부해야만 하는 이유	AI matters
메타 AI, 인간처럼 보고 듣는 AI 로봇 공개... 구체화 AI 에이전트 시대 개막	AI matters
[Q&AI] 걸스데이 혜리 열애설… 상대는 누구?	AI matters
대학생 47% "생성형 AI로 과제 작성"… AI 탐지 검출률은 88%뿐	AI matters
"AI 의사가 인간 의사보다 4배 정확"... MS 의료 AI, 80% 진단 성공률 달성	AI matters
챗GPT 사용량 2배 증가한 호주... 오픈AI, 연 102조 원 경제효과 발생 청사진	AI matters
AI 시대 뜨거운 감자 '보안 문제', 84%가 찾는 해결책은 엣지-클라우드 통합	AI matters
북한 해커들, 핵무기 자금 조달 위해 美 IT기업 직원으로 위장… 69억원 훔치려다 적발	AI matters
챗GPT 출시 후, 신입 일자리 1/3 감소… 소매업 78%, 다른 일자리도 절반 수준 (1)	AI matters
2025년 기술업계 해고 계속된다... 상반기에만 2만 2천 명 감원	AI matters
메타, 2025년 7월 '초지능' 연구소 신설... 알렉산더 왕이 이끈다	AI matters
美 의회, 주 정부의 ‘AI 규제 권한’ 5년간 제한하는 법안 재추진… 찬반 격돌	AI matters
애플, 이번엔 시리에 챗GPT-클로드 탑재 검토… 자체 기술 한계 직면	AI matters
한국어는 챗GPT보다 낫다? 네이버, 추론 강화한 'HyperCLOVA X THINK' 공개	AI matters
구글, 교육용 AI 도구 30여 종 무료 제공... "AI 보조 교사 만든다"	AI matters
플리토와 협력 나선 퓨리오사AI, AI 반도체는 왜 언어 데이터가 필요할까?	IT동아
세컨드팀, "슈퍼코더, AI가 면접관이 되는 시대 연다”	IT동아
에누리닷컴, 에어컨 구매 고객에 e머니 0.8% 적립 이벤트 진행	뉴스탭
후지필름, 글로벌 사진·영상 작가 발굴 위한 ‘GFX 챌린지 그랜트 2025’ 참가자 모집	뉴스탭
설빙, 시그니처 메뉴 ‘팥인절미설빙’ 컵빙수 형태로 재해석 (2)	뉴스탭
RTX 5060 Ti를 10만원에... 조텍코리아, 래플 이벤트 진행 (1)	뉴스탭
퍼플랩, 11번가 '에브리데이 십일절'서 최신 AMD·NVIDIA 그래픽카드 탑재 게이밍PC 선보여	뉴스탭
알리익스프레스, 국내 월간 사용자 900만 명 돌파…한국 맞춤 전략 통했다 (1)	뉴스탭
거주 중 교체 수요 공략한 삼성전자, 상반기 시스템에어컨 판매 40%↑	뉴스탭
에이서, 롯데하이마트 163개 매장에 '니트로 V 16' 입점…오프라인 유통망 확대	뉴스탭
당근페이, 동네 편의점·카페에서도 결제 가능…현장 결제 서비스 본격 도입	뉴스탭
제주신화월드 신화워터파크, 7월 5일 전면 개장…아시아 최초 슬라이드부터 해양안전 교육까지	뉴스탭
마이크로소프트, 서피스 신제품 2종 사전 예약 시작…Copilot+ PC 국내 본격 상륙	뉴스탭
클로버게임즈, 신작 수집형 RPG ‘아야카시 라이즈’ CBT 참가자 모집	뉴스탭
다이슨코리아, 여름철 맞아 '쿨 스트레이트 캠페인' 전개…에어스트레이트 신제품 비주얼 공개	뉴스탭
로지텍, 젠지의 게이밍 공간 ‘GGX’ 전 좌석에 게이밍 기어 공급…국내 최대 규모	뉴스탭
한화 이글스 홈구장부터 성심당 빵지순례까지…대전, 아시아 실속 여행지 9위 올라	뉴스탭
"익숙한 관광은 그만"…현지인과 함께하는 몰입형 체험, 여행 트렌드로 부상	뉴스탭
플레이엑스포 화제작 유비스의 ‘루나’, 서브컬쳐 팬들 유혹하는 티징 영상 공개	게임동아
“니어오토마타 합류!” 1주년 맞은 '퍼디' 풍성한 콘텐츠 공개	게임동아
한국자동차모빌리티안전학회, AI 자율주행차 안전기준 국제조화 선도 나선다	글로벌오토뉴스
초경량 고성능 게이밍 노트북 ‘ASUS TUF A14’, 쿠팡 단독 사전 예약 시작	뉴스탭
벤큐, 프리미엄 조명 ‘스크린바 헤일로’ 쿠팡 골드박스 단독 특가 판매	뉴스탭
웨스틴 조선 서울, 111년 전통 재해석한 '헤리티지 인 조선' 패키지 출시	뉴스탭
폭스바겐코리아 공식딜러 지엔비오토모빌, 창원 전시장·서비스센터 신규 오픈… 경남·울산 지역 본격 공략	뉴스탭
쿠거 PC케이스 포함 완제 PC 구매 시 사은품 2종 제공…서린씨앤아이, 이달 말까지 프로모션 진행	뉴스탭
래쉬가드부터 아쿠아 슈즈까지…스노우피크 어패럴, 기능성과 감각 모두 잡은 여름 컬렉션 선보여	뉴스탭
디디에 두보, 뮤즈 고윤정과 함께한 ‘2025 센슈얼 컬렉션’ 광고 캠페인 추가 공개	뉴스탭
놀유니버스, ‘놀데이’ 국내여행편 출시… 호텔·항공·렌터카까지 통합 할인	뉴스탭
그리티 ‘감탄’, 4주년 맞아 여름 신제품 ‘쿨커빙 브라’ 출시… 공식몰 단독 행사 진행	뉴스탭
한솥도시락, 돼지불백 시리즈 7종 출시…정식과 덮밥으로 선택폭 넓혀 (1)	뉴스탭
스팀, 실시간 성능 모니터링 기능 추가…FPS부터 DLSS 비교까지 지원	뉴스탭
유니씨앤씨, 삼성 올인원 프로 대상 ‘갤럭시 위크’ 진행… 최대 30만원 할인 및 사은품 증정	뉴스탭
캐논코리아, RF 렌즈 사용자 맞춤 플랫폼 ‘RF 렌즈 월드’ 전면 리뉴얼	뉴스탭
“성과 따라 정규직 전환”… 커넥트 현대 청주, 청소로봇 ‘휠리’ 근무 시작	뉴스탭
니콘이미징코리아, 미러리스 카메라 및 렌즈 최대 90만원 캐시백 이벤트 진행	뉴스탭
시원한 아이스 티와 디저트의 조화…포트넘 앤 메이슨, 여름 한정 ‘그린티 페어링’ 선봬 (1)	뉴스탭
체온 낮추고 스타일 살린다…냉감 의류, 출근복의 새 기준 (1)	뉴스탭
막걸리부터 육회·요거트까지…야구장 푸드, ‘쿨’하게 진화 중 (1)	뉴스탭
할리스, 미피와 협업한 여름 MD 완판 행진…양우산부터 텀블러까지 품절 대란	뉴스탭
하림, ‘더미식 오징어 초빔면’ 구매 고객 대상 100% 경품 이벤트 진행 (1)	뉴스탭
마이크로닉스, 다나와 히트브랜드 9년 연속 수상 기념 고객 감사 이벤트 실시	뉴스탭
로지텍, 노브랜드 키보드숍 2호점 입점…MZ세대 겨냥한 체험 마케팅 강화	뉴스탭
MSI, 메인보드 등 구매 시 최대 9만 원 스팀 코드 증정 이벤트 진행	뉴스탭
홍콩 디즈니랜드 리조트, 20주년 맞아 역대급 마법 축제 펼쳐	뉴스탭
브리츠, 여름 맞이 최대 65% 할인 ‘썸머 페스타’ 네이버 단독 진행	뉴스탭
하이네켄코리아, 이탈리아 판매 1위 맥주 ‘비라 모레띠’ 국내 유통 확대 (1)	뉴스탭
조텍코리아, RTX 5090·5080 AMP Extreme Infinity 특가 행사 진행... 최대 50만원 할인	뉴스탭
SAP, 국내 고객과 AI 전략 공유…‘SAP 나우 AI 투어 코리아’ 7월 15일 서울서 열린다	뉴스탭
전기차 충전도 교통카드처럼…티머니 ‘모바일티머니 전기차 멤버십’ 서비스 시작	뉴스탭
블루죤, 고성능 AI 노트북 ‘GIGABYTE AERO X16’ 쿠팡 단독 사전예약 실시	뉴스탭
MSI, ‘클로 8 AI+’ 화이트 에디션 출시…스타필드 하남서 체험 행사 진행	뉴스탭
밀리의서재, 웹소설 전용 플랫폼 ‘밀리 스토리’ 정식 론칭… 오리지널 콘텐츠부터 인기작까지 선보여	뉴스탭
JCB와 신한카드, 일본 여행 특화 '신한카드 Haru (Hoshino Resorts)' 출시	뉴스탭
부산 커피쇼서 주목받은 ‘한글과자’… 한글을 먹고 즐기는 색다른 경험	뉴스탭
에이수스, 성수동에 젠북 체험형 팝업존 오픈… AI 노트북 감성 입히다	뉴스탭
하이원리조트 여자오픈 10일 개막…고지우 등 108명 출전	연합뉴스
춘천 라비에벨 "골프 치고 신나는 EDM 파티 즐기세요"	연합뉴스
넷마블 '신의 탑: 새로운 세계', 2주년 전야제 업데이트	게임동아
세상을 움직이는 목소리가 된다. '편집장' 개발한 데카트리게임즈	게임동아
2025 인디크래프트, 인디게임 개발자와 함께함 네트워킹 데이 성료	게임동아
'Sky – 빛의 아이들' 8월 16일 6주년 맞아 8크리에이터 시상식 개최	게임동아
자동차 6월 실적 총 69만 855대로 0.4%↑... 내수 5.7%↑, 수출 0.6%↓	오토헤럴드
'참 안팔리네?… 가속 올려버려' 테슬라, 판매 부진 중국에 특단의 조치	오토헤럴드
"위기를 기회로" 현대차·기아, 미국서 상반기 역대 최다 판매 실적 달성	오토헤럴드
아우디 '더 뉴 A5ㆍQ5' 출시 기념 서울과 부산서 전시 및 시승 행사 개최	오토헤럴드
벤틀리, 한국인이 디자인한 새로운 '윙드 B' 공개... 날렵한 매의 날개 영감	오토헤럴드
[오토포토] '실물이 더 만족스러운' 볼보 신형 XC90 · S90 국내 출시	오토헤럴드
GM 한국사업장, 상반기 25만대 판매…트랙스 크로스오버 수출 견인	글로벌오토뉴스
르노코리아, 6월 총 8,568대 판매…내수 전년 대비 145% 증가	글로벌오토뉴스
현대차, 6월 글로벌 35만 8,891대 판매…국내외 모두 전년 대비 증가	글로벌오토뉴스
KG 모빌리티, 6월 수출 증가세…총 9,231대 판매	글로벌오토뉴스
기아, 6월 글로벌 26만 9,652대 판매…상반기 역대 최대 실적 달성	글로벌오토뉴스
로터스, “공장 안 옮긴다”…미국 생산설에 입 열었다	글로벌오토뉴스
‘컵홀더가 왜 문제?’…JD파워 소비자 불만 3위에 오른 이유는?	글로벌오토뉴스
테슬라, 로보택시 이어 무인 배송도 시작…자율 배송 주행 영상 공개	글로벌오토뉴스
메르세데스-AMG, 2027년 차세대 V8 엔진 출시 예고…“고객 원하면 계속 간다”	글로벌오토뉴스
700시간 걸린 단 하나의 911…포르쉐가 만든 진짜 예술 작품	글로벌오토뉴스
2025년 6월, 완성차 5사 국내외 총 67만대 판매…기아·현대차 중심 성장세 유지	글로벌오토뉴스
닛산, 인력 감축 및 공급업체 대금 지급 연기… 회복 계획 '난항' 시사	글로벌오토뉴스
포드 CEO, 테슬라 FSD 라이선스 루머 일축… "웨이모가 더 나은 해결책"	글로벌오토뉴스

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

'오픈AI와 구글보다 빠르고 유연한 비전 인코더' UCSC 'OpenVision' 공개

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

'오픈AI와 구글보다 빠르고 유연한 비전 인코더' UCSC 'OpenVision' 공개

공유하기

공감/비공감