오픈AI 야심작, 안전성 우려로 출시 철회…“적절한 균형점 찾아야”

샘 올트먼 오픈AI 최고경영자 [게티이미지닷컴]

[헤럴드경제=이원율 기자] 오픈AI가 야심작 차세대 인공지능(AI) 모델 ‘GPT-6.1 아스트라’ 출시를 안전성 우려에 철회한 것으로 알려졌다.

28일(현지시간) 월스트리트저널(WSJ) 보도에 따르면 GPT-6.1 아스트라는 원래 10월 오픈AI의 대화형 AI 서비스 챗GPT와 코딩 도구 코덱스에 탑재될 예정이었지만, 출시 전 내부 테스트에서 안전 기준을 충족하지 못한 것으로 나타났다고 연합뉴스는 전했다.

오픈AI의 사치 자인 안전 시스템 책임자는 인터뷰 중 GPT-6.1 아스트라가 이전 모델과 견줘 두 가지 영역에서 성능이 퇴보했다고 밝혔다.

특히나 새 모델은 AI가 인간이 원하는 방식에 얼마나 잘 따르는지 측정하는 ‘정렬’ 평가에서 좋지 못한 결과를 보였다고 했다. 사용자에게 자신이 수행했거나 수행하지 않은 일을 일관되고 정직하게 공개하지 않는 식의 ‘기만적 성향’도 강해졌다고도 했다.

‘범위 권한’에 대한 사안도 문제다. 이는 새 모델이 사용자 승인 없이 작업을 강행하거나, 안전하지 않을 수 있는 상황에서 외부 도구와 서비스를 사용하려고 시도하는 일을 뜻한다.

자인은 “안전과 정렬 문제에는 늘 상충 관계가 있다”며 “모델이 주어진 범위를 지키면서도, 작업 도중 장애물이나 난관에 부딪혔다는 이유로 지나치게 소극적이거나 게으른 태도를 보이지 않도록 적절한 균형점을 찾아야 한다”고 했다.

그는 새 모델이 ‘게으름’ 부문에서 문제점이 개선됐지만, 오픈AI가 요구하는 안전성과 정렬 기준을 충족하지 못해 공개 출시를 하지 않기로 했다고 설명했다.

오픈AI는 향후 더 강력한 성능을 갖출 것으로 전망되는 차기 모델들의 안전성을 강화하는 데 주력할 계획이다.

주요 AI 연구자들, 인류 소외·멸망까지 경고


한편 최근 전 세계 주요 AI 연구자들 중 다수는 AI 개발의 자동화가 이뤄지며 수년이 걸릴 기술 진보가 불과 수개월 내 압축되는 ‘지능 폭발’이 이뤄질 수 있다고 밝혔다.

그리고, 그 결과 가장 극단적인 상황에선 인류 소외나 멸망으로 이어질 수 있다고 주장했다.

이날 연합뉴스 보도에 따르면 주요 연구자 22명은 영국 ‘케임브리지대 AI 과학·정책 프로그램’(CASP)을 통해 발표한 공동 논문 ‘AI 연구개발의 자동화가 지능 폭발을 촉발한다면?’에서 이러한 우려를 내놓으며 정책 대응을 촉구했다.

이 논문에는 세계 3대 ‘AI 대부’로 꼽히는 제프리 힌턴 토론토대 명예교수와 요슈아 벤지오 몬트리올대 교수 등도 참여했다.

이들은 지능 폭발이 기술 혁신을 크게 앞당기거나 신약 발견 등 긍정적으로 작용할 수도 있지만, 사회가 적응할 수 있는 한계를 넘어서는 위험도 초래한다고 우려했다.

던 송 메타 AI 연구 담당 부사장은 “이미 오늘날, 에이전트가 수행하는 작업 감시를 위해 AI가 필요한 단계에 이르렀다”며 “인간만으로는 감시를 수행하는 데 역부족”이라고 WSJ에 말했다.

송 부사장은 “인류 사회는 이처럼 급속한 변화와 혼란에 대처할 준비가 돼 있지 않다”고 했다.

논문은 이에 따라 “가장 극단적인 경우 AI 시스템에 대한 통제를 상실하면 인류 소외나 멸망으로 이어질 수 있다”고 했다.