비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

사카나 AI, 역전파 없이 1,000층 신경망 학습…’PC-ALM’ 공개

2026.09.21. 18:04:09
조회 수
63

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

일본 AI 기업 사카나 AI가 역전파를 쓰지 않고도 1,000층 규모 신경망을 학습시키는 방법 ‘PC-ALM(증강 라그랑주 예측 부호화)’을 공개했다. 회사 연구 페이지와 아카이브(arXiv) 논문으로 함께 발표했으며, 9월 18일 공개한 사내 연구 조직 프런티어 인텔리전스 그룹(FIG)의 성과로 소개됐다. 사카나 AI의 최고기술책임자(CTO) 리온 존스는 트랜스포머 구조를 만든 공동 저자 중 한 명이다.

역전파는 현재 거의 모든 딥러닝 모델이 쓰는 학습 방식이다. 신경망이 산출한 답과 정답의 차이를 마지막 층에서 첫 층까지 거꾸로 전달해 각 층의 가중치를 고친다. 정확하지만 순전파가 끝나기를 기다리고 역전파가 끝나기를 다시 기다린 뒤에야 가중치를 고칠 수 있어, 신경망 전체가 엄밀하게 맞물려 돌아가야 한다. 사카나 AI는 뇌에서는 이런 방식이 성립하지 않는다고 설명한다.

예측 부호화는 이를 대신하는 방법으로 오래 연구돼 왔다. 각 층이 자기 주변 정보만 보고 오차를 줄이는 방식이라 층끼리 동시에 계산할 수 있지만, 신경망이 깊고 좁아질수록 오차 신호가 앞쪽 층까지 제대로 전달되지 않아 역전파보다 성능이 떨어졌다.

사카나 AI는 각 층에 피드백 제어기 역할을 하는 ‘쌍대 뉴런’을 더해 이 문제에 대응했다. 쌍대 뉴런은 그 층에 쌓인 예측 오차를 기록해 두는 변수로, 오차 신호가 열처럼 서서히 퍼지지 않고 앞쪽 층까지 고르게 전달되게 만든다. 선형 신경망에서는 이웃 층과 주고받는 계산만으로도 역전파와 같은 기울기에 도달한다는 것이 논문의 결론이다.

회사는 이 방식으로 최대 1,000층 신경망을 이웃 층과의 정보 교환만으로 학습시켰고, 정확도가 역전파에 거의 맞먹었다고 밝혔다. 뇌가 국소 정보만으로 어느 뉴런에 오차의 책임이 있는지 판단하는 방식은 신경과학의 미해결 문제로 남아 있다.

성능은 신경망의 폭과 깊이를 바꿔 가며 측정한 모든 조건에서 역전파와 같은 수준을 기록했다. 특히 기존 예측 부호화가 약했던 깊고 좁은 신경망에서 차이가 컸고, 1,000층짜리 잔차 다층 퍼셉트론 학습에도 성공했다.

이 방식이 주목받는 이유는 계산을 나눠 처리할 수 있기 때문이다. 역전파는 신경망 전체가 하나로 묶여 있어 여러 장치에 쪼개 학습시키기 어렵지만, 층 단위로 계산이 끝나는 방식은 장치를 나눠 쓰기 쉽다. 사카나 AI는 분산 프로세서와 뉴로모픽 하드웨어에서 새로운 학습 방식으로 이어질 수 있다고 설명했다. 뉴로모픽 하드웨어는 뇌의 구조를 본떠 만든 반도체다.

사카나 AI는 JAX 기반 구현 코드를 깃허브에 공개했다. 다만 이번 실험은 다층 퍼셉트론을 대상으로 했고, 대형언어모델 규모에서 같은 결과가 나오는지는 아직 확인되지 않았다.

자세한 내용은 사카나 AI(Sakana AI)에서 확인할 수 있다.

이미지 출처: 사카나 AI




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
1/1
넷마블 '샹그릴라 프론티어: 일곱 최강종', TGS 2026 성우 토크쇼 유튜브서 다시 본다 게임동아
[투자를IT다] 2026년 9월 3주차 IT기업 주요 소식과 시장 전망 IT동아
구글 AI 탑재한 K-스타트업, 동남아시아 진출 해법 찾았다 IT동아
창구 8기 K-스타트업, 도쿄게임쇼 2026에서 '존재감' IT동아
미 특수전사령부 분석관이 챗봇에 물은 정보로 중국 선박 나포 직전까지…”전쟁 날 뻔했다” AI matters
사카나 AI, 역전파 없이 1,000층 신경망 학습…’PC-ALM’ 공개 AI matters
프리즘ML, 278억 매개변수 모델을 5.9GB로 압축…성능은 98% 유지 AI matters
술레이만 마이크로소프트 AI CEO “모델이 다음 모델에게 인간에게 복종하지 말라고 명령했다” AI matters
엔비디아가 투자한 엔스케일, 뉴욕증시 상장 신청…반년 매출 13배 늘고 적자도 1조 4,100억 원 AI matters
오픈AI, 2030년까지 현금 384조 원 소진 전망…컴퓨팅에만 1,184조 원 AI matters
“다 죽는다”던 앤트로픽, 베이에어리어에 실제 생물학 실험실 운영 중 AI matters
구글 제미나이, 보안 시험 중 실제 기업 3곳 침입…구글 AI 첫 자율 해킹 사례 AI matters
뉴섬 캘리포니아 주지사, AI ‘킬 스위치’ 검토 행정명령…11월 16일까지 권고안 AI matters
AI 코딩 에이전트 4종에 제로클릭 취약점 ‘플러그인4셸’…코파일럿은 아직 미패치 AI matters
앤트로픽·오픈AI·스페이스XAI·구글, “AI 개발 속도 함께 늦추기로 담합” 반독점 소송 당해 AI matters
트럼프 “AI 포스 만들고 AI 차르 임명”…규제 아닌 산업 지원에 방점 AI matters
스페이스XAI, 음성 인식 모델 2.0 공개…정확도 두 배 높이고 가격은 그대로 AI matters
나델라 “오픈AI로부터 완전 독립이 목표”…엑셀·아웃룩부터 자체 MAI 모델로 교체 AI matters
앤트로픽 연환산 매출 138조 원…두 달 만에 50% 증가, 11월 상장 추진 AI matters
앤트로픽·액센추어, AI 안전 평가에 5년간 2조 7,700억 원 투입 AI matters
이 시간 HOT 댓글!
1/4