SMARTACT연구소디지털미디어리터러시 아카이브스마택트 홈 ↗
← 논문 목록

딥러닝 기술을 활용한 차별 및 혐오 표현 탐지 : 어텐션 기반 다중 채널 CNN 모델링

Bias & Hate Speech Detection Using Deep Learning: Multi-channel CNN Modeling with Attention

발행
2020 등록이 논문은 발행 시점을 확인하지 못해 원문 등록일을 적었습니다. KCI가 2005~2008년에 옛 논문을 몰아서 올린 탓에, 그 시기 등록분은 발행보다 평균 3~5년 늦습니다. 실제 발행연도는 더 이를 수 있습니다.
소속·발행
계명대학교
출처
국내 KCI
DOI
10.6109/jkiice.2020.24.12.1595
원문
원문 보기
개념
키워드

차별 및 혐오 표현, CNN, 다중채널, 어텐션, 인터넷 뉴스 댓글, Bias and hate expressions, CNN, Multi-channel, Attention, Internet news comments

초록

포털 사이트의 인터넷 뉴스 댓글, SNS, 커뮤니티 사이트 등의 온라인상에서 명예 훼손 사건이 최근 점점 증가하고 있다. 온라인상의 차별 및 혐오 표현은 명예 훼손 문제뿐만 아니라 사생활 침해, 인신 공격 등 다양한 형태로 온라인 서비스 이용자들을 위협하고 있다. 지난 몇 년간 산업계와 학계는 이러한 문제를 해결하고자 다양한 방법으로 연구해왔다. 하지만 한국어 대상으로 수행된 딥러닝 기반 혐오 표현 탐지 연구는 아직까지 부족한 상황이다. 본 연구의 목적은 혐오 표현뿐만 아니라 다양한 차별적 표현에 대한 탐지를 위해 데이터셋을 구축하고 이를 분류하기 위한 딥러닝 모델링을 실험하는 것이다. 데이터셋 구축은 10명의 인원이 교차적으로 검토를 하면서 7개 항목에 대한 라벨링 기준을 확립했다. 본 연구는 약 137,111개에 해당하는 한국어 인터넷 뉴스 댓글 데이터셋에 대해 7개의 항목을 각각 이진 분류하고, 이를 딥러닝 기법을 통해 분석한다. 본 연구에서 제안하는 기법은 어텐션 기반 다중 채널 CNN 모델링 기법이다. 실험 결과 7개 항목에 대해 가중 평균 f1 점수를 평가했을 때, 70.32%의 성능을 달성했다.

같은 개념의 다른 논문
이 개념이 나오는 강연