AI, 이제 과학 이미지도 전문가처럼 분석... 코넬대가 만든 새로운 AI 프레임워크 : 다나와 DPG는 내맘을 디피지

AISCIVISION: A FRAMEWORK FOR SPECIALIZING LARGE MULTIMODAL MODELS
IN SCIENTIFIC IMAGE CLASSIFICATION

과학 연구를 위한 맞춤형 AI 시스템의 등장

코넬 대학교 연구진이 과학 연구에서 AI의 신뢰성과 해석 가능성을 높인 새로운 프레임워크 'AISciVision'을 개발했다. 최근 OpenAI의 GPT, Google의 Gemini, Meta의 Llama 등 대규모 멀티모달 모델(Large Multimodal Models, LMMs)의 등장으로 AI와의 의미 있는 대화가 일상이 되었지만, 의학, 법률, 과학 연구와 같은 전문 분야에서는 더 깊은 도메인 특화 추론이 필요했다. LMM에 내장된 일반 지식만으로는 이러한 전문 분야의 세밀한 전문성을 충족시키기 어렵다는 한계가 있었다.

맥락 학습을 통한 전문성 확보

AISciVision은 LMM의 넓은 맥락 창(context window)을 활용해 인-콘텍스트 학습을 통한 유연한 특화가 가능하다. 풍부한 프롬프트와 특정 작업 관련 맥락을 제공함으로써 LMM이 도메인별 요구사항에 적응할 수 있게 했다. 이는 검색 증강 생성(RAG) 분야의 흥미로운 연구 발전을 이끌고 있다. RAG 기술은 작업별 예시를 검색하여 LMM의 예측을 향상시키고, 맥락을 기반으로 모델의 응답을 세분화함으로써 해당 작업에 특화시킨다.

전문가의 작업 방식을 모사한 혁신적 구조

AISciVision은 시각적 검색 기반 생성(Visual Retrieval-Augmented Generation, VisRAG)과 도메인별 특화 도구를 결합했다. 사용자가 제공한 학습 데이터는 특징 공간에 임베딩되어 긍정 및 부정 클래스 예시가 별도로 구성된다. 분류 도구는 기본적인 이미지 조정부터 위성 이미지 확대와 같은 도메인별 작업까지 포함한다. 추론 시에는 코사인 유사도를 기반으로 훈련 세트에서 가장 유사한 긍정 및 부정 이미지 예시를 검색하여 LMM의 분석 맥락으로 활용한다.

AISciVision은 4단계의 추론 과정을 거친다. 먼저 입력 이미지가 주어지면 VisRAG가 유사한 이미지들을 검색한다. 이후 LMM이 최대 4라운드에 걸쳐 도구들을 선택하고 적용하며 분석을 수행한다. 각 라운드마다 신뢰도 점수를 함께 제공하여 예측의 확실성을 평가할 수 있게 했다. 예를 들어 {Yes:80,No:20}와 같은 형식으로 결과를 표현하여 판단의 근거를 명확히 한다.

실제 데이터셋에서 입증된 우수한 성능

연구팀은 세 가지 실제 과학 이미지 분류 데이터셋에서 AISciVision의 성능을 검증했다. 첫째로 론도니아 브라질의 양식장 탐지를 위한 799개의 이미지(640×640), 둘째로 워싱턴 주의 잘피 질병 탐지를 위한 9,887개의 이미지(128×128), 마지막으로 태양광 패널 탐지를 위한 11,814개의 이미지(320×320) 데이터셋을 활용했다. 테스트 결과 저표지 데이터 환경(20%)과 전체 레이블 데이터 환경(100%) 모두에서 기존의 완전 감독 학습 모델들과 제로샷 방식을 능가하는 성능을 보였다.

AISciVision은 k-NN, CLIP-ZeroShot, CLIP+MLP 등 여러 베이스라인 모델과 비교 실험을 진행했다. 양식장 데이터셋의 경우 20% 데이터 환경에서 AISciVision이 정확도 0.90, F1 스코어 0.78, AUC 0.95를 기록하며 가장 높은 성능을 보였다. 특히 CLIP-ZeroShot이 양식장 데이터셋에서 F1 스코어 0.0을 기록한 것과 대조적으로, AISciVision은 저표지 환경에서도 안정적인 성능을 보여주었다. 이는 도메인 특화 구조의 효과성을 입증하는 결과다.

도구 활용 분석 결과

연구팀은 각 데이터셋별로 도구 사용 빈도와 정확도에 대한 분석을 실시했다. 모든 데이터셋에서 'MLToolPredict' 도구가 가장 자주 사용되었지만, 단순히 이 도구의 결과에만 의존하지 않는다는 점이 흥미롭다. 양식장 데이터셋의 경우 지리공간 도구들이 높은 빈도로 사용되었으며, 이는 주변 지역의 추가 정보를 얻는 데 도움을 주었다. AdjustBrightness 도구는 거의 사용되지 않았고, HistogramEqualization은 제한적으로 사용되는 등 도구별 활용도의 차이도 관찰되었다.

전문가와 상호작용하는 웹 애플리케이션 구현

AISciVision은 양식업 연구를 위한 웹 애플리케이션으로 실제 배포되었다. 전문가들은 ChatGPT 스타일의 인터페이스를 통해 추론 트랜스크립트와 상호작용하고, 명확한 질문을 하거나 수정/피드백을 제공할 수 있다. 향후 연구에서는 이러한 피드백을 VisRAG에 통합하여 전문가들이 대화하면서 지속적으로 모델을 개선할 수 있도록 할 예정이다.

프레임워크는 각 데이터셋의 특성에 맞는 도구들을 제공한다. 위성 이미지를 다루는 양식장 데이터셋의 경우 확대/축소와 이동 도구를 제공하며, 잘피와 태양광 패널 데이터셋의 경우 대비 조정과 선명도 향상 등 이미지 향상 도구를 제공한다. 이러한 도구들은 도메인 전문가들의 이미지 분석 과정을 모사하여 설계되었으며, 각 추론마다 예측과 함께 자연어 트랜스크립트를 통해 추론 과정의 투명성을 보장한다.

연구의 한계와 향후 과제

LMM을 활용한 추론의 높은 비용은 이 프레임워크의 주요 한계점이다. 연구팀은 실험 비용을 고려해 각 데이터셋당 100개의 테스트 샘플만을 사용했다. 향후 연구에서는 도구 선택을 최적화하고 다른 과학 분야로의 확장 가능성을 탐구할 예정이다. 또한 전문가들의 피드백을 시스템 개선에 효과적으로 활용하는 방안도 연구 중이다.

해당 기사에서 인용한 논문 원문은 링크에서 확인할 수 있다.

기사는 클로드 3.5 Sonnet과 챗GPT-4o를 활용해 작성되었습니다.

AI Matters 뉴스레터 구독하기

오픈AI, 챗GPT '슈퍼 AI 비서' 발전 계획 공개… "헬스장 가입부터 변호사 연락까지" (1)	AI matters
24시간 만에 업무 활용 가능 수준 AI 솔루션 완성하는 로봇? MS 차세대 에이전트 기술 공개	AI matters
"AI 때문에 망했다" vs "AI로 대박났다"... 성패를 가르는 이것	AI matters
AI 뒤처진 애플, iOS 19 대거 개편… “AI보다 디자인 변화가 핵심”	AI matters
내 캐릭터로 애니메이션 제작 가능… 캐릭터AI, 씬·아바타FX·스트림 등 멀티모달 창작 기능 공개	AI matters
이번엔 모바일서 통할까… 어도비, 생성형 AI 기능 탑재 포토샵 안드로이드 버전 출시	AI matters
美 빅3 음반사, AI 기업과 음악 활용 라이선스 협상 추진	AI matters
폭스바겐 노조 2만명 해고 동의, 볼프스부르크 공장 '4일 근무제' 전환도 (1)	오토헤럴드
'치열한 경쟁 속 BYD 압도적' 5월 中 신에너지차 판매 꾸준한 상승 중	오토헤럴드
폭스바겐, 미국에 수십억 달러 투자로 상호관세 판도 바꿀 특혜에 기대감	오토헤럴드
볼보 전기 SUV 'EX30', EV 어워즈 2025 ‘심사위원 선정 혁신 전기차’ 등극	오토헤럴드
폴스타, 'EV 어워즈 2025'서 폴스타4 '심사위원 선정 혁신 전기차' 수상	오토헤럴드
폴스타 4, EV 어워즈 2025 ‘심사위원 선정 혁신 전기차’ 수상	글로벌오토뉴스
기아 EV4, ‘대한민국 올해의 전기차’ 선정…아이오닉9은 소비자 선택상 수상	글로벌오토뉴스
한국타이어, 미국 청소년 단체 설립에 2만 달러 기부…지역 사회 지원 활동 지속	글로벌오토뉴스
볼보 EX30, ‘EV 어워즈 2025’ 심사위원 선정 올해의 전기차 수상	글로벌오토뉴스
포드·현대차, 美 5월 판매 증가…관세 우려에 소비자 구매 앞당겨	글로벌오토뉴스
중국의 희토류 수출 규제, 글로벌 자동차 산업 생산 차질 우려	글로벌오토뉴스
독일 자동차 산업, 바닥 뚫나…업황지수 또 하락	글로벌오토뉴스
젬블로컴퍼니, 라온, 쿠키런 보드게임 앞세워 천안 K-컬처 박람회 참가	게임동아
젠슨 황 CEO, 스위치 2 휴대용 기기 중 가장 강력하다 (1)	게임메카
대한민국 21대 대통령 된 이재명의 게임 공약은? (1)	게임메카
PS5에서 60FPS로 오픈월드를, 위쳐 4 테크 데모 공개	게임메카
350만 장 판매, 엘든 링 밤의 통치자 2인 모드 추가한다	게임메카
발더스 3 흥행 후, 위자드 오브 더 코스트 D&D 신작 발표 (1)	게임메카
'로스트아크' 스마일게이트알피지, 1~2월 매출 858억 원	게임메카
"진짜 M은 여기에" BMW M FEST 2025, 고성능 차 저변 확대로 대 성황	오토헤럴드
'여전히 취약한 산업 생태계' 볼보, EX90 부품 부족으로 美 생산 중단	오토헤럴드
5월 국내 완성차 판매 '흔들 흔들'… 위태로운 내수 불안한 수출	오토헤럴드
현대차, 美 J.D.파워 EV 앱 평가 2년 연속 1위…'디지털 경험' 선도 입증	오토헤럴드
현대차ㆍ기아 "첫 출발하기 좋은 차" 14개 중 7개 부문 싹쓸이 기염	오토헤럴드
"도요타보다 10년 빨랐다" 현대차, 39년만에 美 누적 1700만대 돌파	오토헤럴드
“기술의 경계를 넓히다”… 현대차그룹, FISITA서 미래 모빌리티 비전 천명	오토헤럴드
제네시스, 브랜드 역사상 가장 빠른 'GV60 마그마' 3분기 양산 돌입	오토헤럴드
EV 트렌드 코리아 2025 개막… 올해의 전기차 어워즈 '기아 EV9' 수상	오토헤럴드
도요타, 그룹의 시작 '도요타 직기' 비상장화 추진... 1조 7000억원 투입	오토헤럴드
[EV 트렌드] '유럽 확장에 나선 中 전기차' 니오, EU 7개국으로 추가 진출	오토헤럴드
"닛산 역사상 가장 공기역학적"... 원조 전기차 '리프' 3세대 버전 디자인 공개	오토헤럴드
"아이오닉 5 적수가 온다" 르노 세닉 E-Tech, 443km 국내 인증 완료	오토헤럴드
속도보다 연비 중심 경제운전 '2025 강원 국제 모터 페스타 에코랠리’ 개최	오토헤럴드
“무쏘 EV 전기 픽업 시장 노크”…KGM, EV 트렌드 코리아 2025 참가	오토헤럴드
GM 한국사업장, 5월 판매 5만 대 돌파…트랙스 크로스오버 실적 견인	글로벌오토뉴스
기아, 5월 글로벌 판매 27만 대 육박…스포티지 최다 판매	글로벌오토뉴스
트럼프의 시간은 끝났다. 그리고...	글로벌오토뉴스
현대·기아 주춤, 르노코리아·KGM 반등… 5월 완성차 실적 희비 엇갈려	글로벌오토뉴스
5월 자동차 판매 순위, 쏘렌토 1위 탈환… 팰리세이드만 유일하게 증가세	글로벌오토뉴스
테슬라, 오스틴에서 무인 모델 Y 로보택시 테스트 순항… 6월 첫 인도 예정	글로벌오토뉴스
토요타, 영국 공장에서 GR 코롤라 생산 결정… 유럽 시장 공략 강화	글로벌오토뉴스
토요타, 4월 글로벌 판매 12% 증가… 다이하츠 회복세 뚜렷	글로벌오토뉴스
스카니아, 20억 유로 규모 중국 생산 허브 2025년 4분기 가동	글로벌오토뉴스
중국 NEV, 소비자 만족도 '역대 최고'...여성 구매자 증가세 '두드러져'	글로벌오토뉴스
BYD, 5월 NEV 판매 보합세 속 해외 판매 '고공 성장'...배터리 탑재량 '두 배' 증가	글로벌오토뉴스
토요타, 액체 수소 엔진차로 24시간 내구레이스 완주… 실증 성공	글로벌오토뉴스
쉘, 함부르크에 메가와트급 충전 인프라 테스트 센터 건설...상용차 및 선박 전기화 박차	글로벌오토뉴스
기아 EV4, 한국에서만 생산...미국 관세 장벽 넘을까?	글로벌오토뉴스
노르웨이 5월 신차 등록 급증, 전기차 93.9%...테슬라 1위, 중국차 약진	글로벌오토뉴스
한국타이어, TBX 고객 대상 ‘지갑든든 혜택두둑’ 프로모션	글로벌오토뉴스
KG모빌리티, ‘EV 트렌드 코리아 2025’ 참가… 무쏘 EV 등 전기차 3종 전시	글로벌오토뉴스
캐딜락, ‘2025 디오니소스 와인페어’서 리릭 전시	글로벌오토뉴스
람보르기니, ‘드림핵 댈러스 2025’ 참가	글로벌오토뉴스
한국타이어, WRC 사르데냐 랠리 타이어 독점 공급	글로벌오토뉴스
현대차, 세계 최대 모빌리티 컨퍼런스서 '넥쏘' 공개	글로벌오토뉴스
혼다코리아, '더 고'에서 고객 참여형 토크쇼 개최	글로벌오토뉴스
현대자동차그룹, U.S. 뉴스 '10대를 위한 최고의 차량' 최다 선정...4년 연속 기록	글로벌오토뉴스
현대차그룹, ‘10대를 위한 최고의 차량’ 7개 부문 수상	글로벌오토뉴스
식음료업계, 사상 최장 폭염 앞두고 여름 한정 메뉴 경쟁 본격화 (1)	뉴스탭
AMD, 하이엔드 GPU 시장 재도전 예고…RX 9080 XT와 RDNA 4 강화 모델 준비 중	뉴스탭
블랙베리 클래식, 중국 기업 손에서 부활…'Zinwa Q25'로 재탄생	뉴스탭
로스트아크,단독 미디어아트 전시 ‘빛의 여정’ 개최한다	게임동아
메타, 기존 통념 뒤집는 연구 결과 공개… “추론 시간 짧으면 LLM 정확도 34.5% 향상”	AI matters
'젠지', 발로란트 마스터스 토론토 스위스 스테이지 출전	게임동아
단 2,400개 예제로 17만개 학습 능력 압도한다? 아마존이 만든 검색 혁명 's3' 뭐 길래	AI matters
클래스 ‘뇌신’ 리부트! 엔씨 리니지M, ‘라이징 스톰’ 사전예약 진행	게임동아
[Q&AI] 21대 대선 당선자 확정 시간 예측, 어디가 정확할까? ‘그록 vs. 퍼플렉시티’	AI matters
"정답 몰라도 괜찮다"... AI 강화학습의 상식을 뒤엎은 워싱턴대 연구	AI matters
AI 에이전트 24개 모아 놨더니 신기한 일이… “AI끼리 대화하면서 '암묵적 룰' 만들어”	AI matters
한국, 생성형 AI 유료 구독자 7배 급증… 과기부 ‘AI 이용자 조사’ 결과 충격	AI matters
로봇에게 "왼쪽 물건 가져와"라고 하면 정말 이해할까? 로봇의 공간 인지 기술	AI matters
삼성, 갤럭시 S26에 퍼플렉시티 AI 탑재 제휴 임박... 구글 의존도 탈피 시도	AI matters
‘인터넷의 여왕’ 메리 미커, 5년 만에 AI 리포트 발표… “AI는 기술이 아닌 인프라”	AI matters
권익위, 문체부에 스크린골프장 안전 높이 강화 권고	연합뉴스
초기 AI 투자자 엘라드 길, 다음 대형 투자처로 'AI 기반 롤업' 선택	AI matters
트럼프 행정부, 중국 대상 반도체 설계 소프트웨어 수출 통제 강화	AI matters
메타, AI로 제품 위험 평가 자동화한다... "90% 업데이트 검토 맡길 것"	AI matters
백악관, 트럼프 비서실장 휴대전화 해킹 조사 착수… AI 음성 조작으로 고위관리들 속여	AI matters
구글, 지메일 모바일 앱에 AI 요약 기능 추가... 긴 이메일도 한눈에	AI matters
[체험기] “소리 지르며 플레이했다”. 새로운 방식의 협동 공포 게임 ‘백룸 컴퍼니’	게임동아
크래프톤, 인도 최고 권위의 광고 시상식 ‘큐리어스’에서 본상 수상	게임동아
데브시스터즈 '쿠키런 킹덤', ‘다시 열정의 전장으로’ 업데이트 진행	게임동아
‘우크라이나 침공 묘사 담겼다’, 러시아 군사 선전 게임이 스팀에 출시	게임동아
러시아 법원, 워게이밍 '극단주의 단체' 가담 승인	게임동아
현직 치과의사가 US오픈 골프대회 출전…예선 합격	연합뉴스
‘FC 모바일’의 한국 대표 2인, EA 글로벌 행사 ‘FC 모바일 페스티벌’ 출전	게임동아
‘블루 아카’, 무신사와 컬래버레이션 예고	게임동아
쿠로게임즈 ‘명조' 일산 킨텍스 제2전시장에서 ‘띵조 페스티벌’ 개최	게임동아
[한주의게임소식] "아직은 지켜봐야?" 중국 첫발 내디딘 '니케'	게임동아
스마일게이트 에픽세븐에 신규 한정 영웅 ‘로빈’ 등장!	게임동아
‘크래시 피버’ 애니메이션 ‘불꽃소방대 3장’과 컬래버레이션 진행	게임동아
[겜덕연구소] 성능 구더기 수준! 먹는 순간 짜증이 샘솟는 레트로 게임 속 무기들!! (1)	게임동아
웹젠, ‘드래곤소드’ CBT 해보니...스킬 액션과 오픈월드 콘텐츠 인상적	게임동아

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI, 이제 과학 이미지도 전문가처럼 분석... 코넬대가 만든 새로운 AI 프레임워크

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI, 이제 과학 이미지도 전문가처럼 분석... 코넬대가 만든 새로운 AI 프레임워크

공유하기

공감/비공감