“AI 치명적 망각 극복” GIST-한화비전, 국제 음향 AI 경진대회 ‘1위’

- 새 환경에서도 기존 지식 유지 ‘음향 연속학습 기술’ 개발


GIST-한화비전 공동연구팀. (뒷줄 왼쪽부터) 김홍국 GIST 교수, 박종연 석박통합과정생, 박상원, 임도현 석사과정생, 고경득(화면 속 왼쪽부터) 한화비전 R&D센터 AI연구소 책임연구원, 임정은 AI연구소장, 금형철 선임연구원.[GIST 제공]


[헤럴드경제=구본혁 기자] 광주과학기술원(GIST)은 전기전자컴퓨터공학과 김홍국 교수 연구팀과 한화비전 R&D센터 AI연구소 공동연구팀이 국제 음향 인공지능(AI) 경진대회 ‘디케이스 2026 챌린지’에서 공식 팀 랭킹 1위를 차지했다고 14일 밝혔다.

이번 성과는 새로운 환경의 소리를 추가로 학습하면서도 기존에 익힌 소리 정보를 잃지 않는 ‘연속 학습’ 기반 음향 AI 기술력을 세계적으로 인정받은 결과다.

공동연구팀은 대회 7개 과제(Task) 중 과제 7인 ‘도메인 비의존 오디오 분류를 위한 점진 학습’ 부문에 참가했다.

입력 소리가 어떤 환경에서 수집된 것인지 알려주지 않는 ‘도메인 비의존’ 조건에서 아기 울음소리, 개 짖는 소리, 화재 경보음 등 10종의 소리를 정확하게 분류해야 하는 과제다.

기존 오디오 인식 AI는 녹음 장비나 장소, 주변 소음 등 환경이 달라지면 성능이 저하되거나, 새로운 데이터를 학습하는 과정에서 이전에 학습한 내용을 잊어버리는 ‘치명적 망각’ 문제를 겪어와 현장 적용에 한계가 있었다.

이 같은 문제를 해결하기 위해 새로운 환경을 학습하면서도 기존에 학습한 소리 인식 능력을 유지할 수 있는 ‘연속 학습(Continual Learning)’ 기술을 개발했다.

연구팀은 각 학습 단계에서 학습한 AI 모델을 그대로 보존해 새로운 학습이 기존 지식을 훼손하지 않도록 했다.

특히 원본 데이터를 반복 저장하거나 재학습하지 않고도 과거에 학습한 소리의 특징을 재현해 활용하는 ‘딥인버전 기반 생성형 리플레이’ 기법을 적용, 새로운 환경을 학습하는 과정에서도 기존 지식이 사라지는 문제를 최소화했다.

그 결과 최종 제출 시스템이 평균 정확도 79.62%를 기록하며 공식 팀 랭킹 1위를 차지했다.

또 3개의 단일 시스템과 이를 결합한 앙상블 시스템 등 제출한 4개 시스템이 공식 시스템 랭킹 1위부터 4위까지를 모두 차지하며 기술 완성도를 입증했다.

김홍국 교수는 “이번 성과는 새로운 환경의 소리를 추가로 학습하면서도 기존에 익힌 소리 정보를 잃지 않는 ‘연속 학습’ 기반 음향 AI 기술력을 세계적으로 인정받은 결과”라며 “한화비전의 지능형 영상보안 기술과 결합해 영상과 음향 정보를 동시에 분석하는 차세대 AI 보안 솔루션으로 발전할 수 있을 것”이라고 말했다.