스튜어트 러셀의 경고 "LLM 정렬 불가능…모방 학습과 RLHF 한계"
AI를 인간의 목표에 맞추는 '정렬(Alignment)'이 사실상 불가능할 수도 있다는 경고가 나왔다. 세계적인 AI 분야 석학이자 대표 교과서 '인공지능: 현대적 접근방식'의 공동 저자인 스튜어트 러셀 캘리포니아대학교 버클리캠퍼스(UC 버클리) 컴퓨터과학과 교수가 현재 방식의 LLM 정렬 연구가 근본적인 한계에 부딪혔으며, 인간의 목표에 AI를 완벽히 일치시키는 것은 구조적으로 불가능할 수 있다고 밝혔다.러셀 교수는 5일(현지시간) 공개된 디 인포메이션의 팟캐스트에 출연, 빅테크 기업들이 추진하는 현재의 LLM 중심 AI 개발 전
AI타임스 · 2026. 10. 08. 오전 02:35