인공지능 언어모델의 상식적 판단

How AI Language Models Judge Common Senence

초록

인공지능에 탑재되는 언어모델은 지난 몇 년간 눈부신 발전을 거듭하였다. 그결과, 분야에 따라서는 자연어 이해 및 생성에서 사람에 필적할만한 성과를 내고있다. 그러나 아직 인공지능이 사람과 비교하여 큰 성과를 내지 못하는 영역도존재하는데, 대표적인 것이 상식적 판단이다. 사람들은 암묵적인 지식 체계인 상식을 공유하기 때문에, 어떠한 상황에 대해 보편적인 판단을 내린다. 예컨대, 날이 아주 화창한데도 비나 눈이 곧 내릴 것이라고 예상하는 사람은 없을 것이다. 그러나 이러한 상식이 항상 학습 데이터에 명시적으로 표현된 것은 아니기 때문에, 언어 인공지능이 취약성을 보일 가능성이 크다. 이러한 이유에서 최근 몇 년간 인공지능 언어모델에서 상식은 중요하게 연구되었다. 본고는 그 흐름을 개괄하고 전망을 논의한다.

키워드

인공지능; 언어모델; 상식; 가추 추론; 학습 데이터; artificial intelligence; language model; common sense; abductive reasoning; training data
제목
인공지능 언어모델의 상식적 판단
제목 (타언어)
How AI Language Models Judge Common Senence
저자
송상헌
DOI
10.15811/jkl.2023..105.011
발행일
2023-03
저널명
國語學
호
105
페이지
375 ~ 400