상세 보기
KoBiNLI - 자연어 추론 기반 한국어 성 편향성 벤치마크 데이터세트
KoBiNLI - Korean Gender Bias Evaluation Benchmark datasets based on NLI
- 이수빈;
- 정유남;
- 송상헌
초록
본 연구는 언어모델의 성 편향성을 평가하기 위해 자연어 추론 형식으로 설계된 한국어 데이터세트(KoBiNLI: Korean Gender Bias Evaluation Benchmark datasets based on NLI) 구축 과정을 소개하고 데이터 특징을 분석하는 데에 목적이 있다. 특히, 한국의 사회문화적 맥락 내에서 언어적, 감정적 특징이 고정 관념적 직업과 성별화된 형용사를 중심으로 하는 성 편향성 추론 데이터를 구축하였다. AI 분야에서 성 편향성과 관련한 윤리적 우려에 대응하기 위해 자연어추론(NLI) 형식의 1076개 문장으로 구성된 데이터세트를 구축하고 이를 공개하였다. 이 데이터 분석 결과, 남성 및 여성과 연관된 어휘와 감정 표현에서 성 편향성이 명시적으로 드러났다. 본 연구에서는 공정하고 윤리적인 AI 시스템 개발을 위한 필수적인 한국어문화 기반의 성 편향성 데이터세트의 중요성을 강조하였다.
키워드
Gender Bias; Natural Language Inference; Korean Language Dataset; Sociocultural Context; Ethical AI; 성 편향성; 자연어 추론; 한국어 데이터세트; 사회문화적 맥락; AI 윤리
- 제목
- KoBiNLI - 자연어 추론 기반 한국어 성 편향성 벤치마크 데이터세트
- 제목 (타언어)
- KoBiNLI - Korean Gender Bias Evaluation Benchmark datasets based on NLI
- 저자
- 이수빈; 정유남; 송상헌
- 발행일
- 2026-04
- 유형
- Y
- 권
- 22
- 페이지
- 217 ~ 248