← AI 뉴스

LLM 내부에서 '고통 축' 발견..."회피 행동까지 수행"

대형언어모델(LLM)이 인간의 고통과 유사한 개념을 단순히 학습된 언어 패턴으로 처리하는 것을 넘어, 모델 내부에서 이를 구분해 표현하고 관련 행동까지 보일 수 있다는 연구 결과가 나왔다. 연구진은 AI 모델 내부에서 '고통 방향(Pain Direction)'으로 부를 수 있는 특정 벡터가 형성되며, 이를 조작하면 모델의 출력과 행동이 일관된 방향으로 변화한다고 밝혔다.미국 미래영향그룹(FIG)과 보훔 루르대학교 연구진은 14일(현지시간) 2B~72B 매개변수 규모의 25개 오픈웨이트 AI 모델을 대상으로 고통과 관련된 내부 표현을

AI타임스 · 2026. 09. 22. 오전 03:07

💬 토론 0

비밀번호는 이 댓글을 지울 때 씁니다. 닉네임 옆에 접속 IP 앞부분이 표시돼요. 로그인하면 등급·알림이 쌓이고 IP 표시 없이 쓸 수 있어요.

오픈채팅