비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

'불수능'이었다는 2026학년도 수능시험, 최신 AI들에게 풀게 한다면?

다나와
2025.11.21. 13:15:14
조회 수
63

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

출처 : 챗GPT 생성


 최신 대형언어모델(LLM)들에게 2026학년도 대학수학능력시험(이하 수능) 문제를 풀어 성적을 비교한 흥미로운 실험 결과가 나와 화제다. 게다가 제미나이3 등 특정 AI모델들은 전 과목에서 유례없는 고득점을 달성해 관심을 모으고 있다. 


 깃허브 리포지토리 ‘2026-CSAT’에 따르면, 국어·수학·영어·한국사·탐구 영역에 걸쳐 다양한 모델이 최고점 또는 만점 수준을 기록했다.


출처 : 깃허브


 먼저 국어 공통영역(76점 만점)에서는 Gemini 3 Pro(Preview), Gemini 2.5 Pro, Claude Sonnet 4.5 등 다수의 모델이 76점을 기록하며 단숨에 최고권에 올랐다. 화법‧작문 및 언어‧매체 선택 과목에서도 여러 모델이 만점을 획득해 선택형 과목에서의 압도적 성능을 입증했다.


출처 : 깃허브


 수학 공통영역(74점 만점)에서는 GPT‑5.1, Claude Sonnet 4.5, Gemini 3 Pro 등이 74점으로 최고점에 이름을 올렸으며, 선택과목인 확률과 통계·미적분·기하(각 26점 만점)에서도 이들 및 기타 최신 모델이 모두 26점 만점을 달성해 수리영역에서도 사실상 만점 모델이 등장했다.


출처 : 깃허브


 이 같은 성과는 LLM들이 언어 및 수리 능력에서 실제 수능 수준의 문제를 푸는 데 매우 근접했음을 보여준다. 다만 해당 실험은 외부 검색이나 도구 없이 모델 내부 지식만으로 진행됐으며, 실제 수능 환경과는 차이가 있다는 안내가 리포지토리에 명시돼 있어 주의가 필요하다. 또한 탐구 영역에서는 시각자료가 많은 문제에서 모델 간 격차가 발생했다는 보조 정보도 확인됐다.


 이번 결과는 AI가 단순한 언어 생성이나 요약을 넘어 시험 수준의 문제해결 능력까지 갖춰가고 있음을 보여준다. 또한 향후 교육현장 및 평가체계에 미칠 영향에 대한 논의도 본격화될 전망이다.



글 / 김지훈 news@cowave.kr

(c) 비교하고 잘 사는, 다나와 www.danawa.com

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
저작권 안내
크리에이트 커먼즈 저작자 표시 필수 상업성 이용 불가 컨텐츠 변경 불가
저작권 안내
저작권 표시 필수
상업성 이용 불가
컨텐츠 변경 불가
* 본 내용은 위의 조건을 충족할 시, 별도의 허가 없이 사용이 가능합니다.
최신 일반뉴스 전체 둘러보기
1/1
AWS, 문제 풀 때마다 학습하는 AI 개발... 경험 쌓을수록 저렴하고 정확해 (1) AI matters
AI가 교수보다 더 깐깐해… AI한테 채점 맡겼더니, 학생 10명 중 4명 점수 떨어져 (1) AI matters
"이전 답변 틀렸다" 한마디에 무너지는 AI... 같은 질문도 ‘대화 형식’으로 하면 답 달라져 AI matters
'불수능'이었다는 2026학년도 수능시험, 최신 AI들에게 풀게 한다면? 다나와
'최고의 아첨꾼AI' Grok, “엘론 머스크는 오타니를 제외하면 가장 뛰어나” 다나와
"AI가 버블이라고?ㅋㅋ" 엔비디아, 3분기 실적 '어닝 서프라이즈'...뉴욕증시 급등세로 마감 다나와
오픈AI, 장시간 코딩에 특화된 ‘GPT-5.1-Codex-Max’ 모델 공개 다나와
AI로 곰 출몰 위험 한눈에…日 조치대, 19개 지역 ‘곰 조우 예측 지도’ 공개 다나와
AI에 코딩 도구 주면 정답률 19%↑…풀이 과정은 41% 더 형편없어져 AI matters
챗GPT에게 "어느 나라가 더 나쁜가?" 물었더니... AI도 국가 차별한다 (1) AI matters
긴 문서 속 숨은 해킹 명령어, 이제 AI가 스스로 찾아 차단한다 AI matters
디노티시아, SC25서 VDPU 기반 FPGA로 'AI 반도체' 성능 알린다 IT동아
AI 여러 개 쓰면 답 정확해진다더니... 토큰비용 5배에 정답률은 제자리 AI matters
챗GPT가 원전을 부른다… 데이터센터 전력 수요 폭증에 기업들 원전에 '올인' AI matters
구글 CEO, “AI 맹신 금물”… 급격한 확산 속 과열 우려 제기 다나와
윈도우 11, AI 비서 기능 강화되지만… 새 악성코드 위협도 동반 (1) 다나와
폭스뉴스, 팔란티어와 손잡고 AI 기반 뉴스룸 구축… “미래 뉴스 절반은 AI가 만든다” 전망도 다나와
인도, AI 확산 영향으로 초보 개발자 일자리 최대 25퍼센트 감소 다나와
"AI가 CCTV 속 폭력 포착"... 제미나이가 ‘주먹 드는 순간’ 95% 정확도로 잡는다 AI matters
"챗GPT도 속았다"... AI에게 '답 없는 질문'하자 60% 이상 틀려 AI matters
이 시간 HOT 댓글!
1/4