대표적인 대화형 감정인식 데이터셋인 MELD: Multimodal EmotionLines Dataset이 있다. 이번 글에서는 MELD: Multimodal EmotionLines Dataset의 정보 및 다운로드 링크를 공유하겠다.
목차
MELD 데이터셋 정보
MELD데이터셋은 대화형 감정인식 데이터셋이며 audio, visual, text 모달리티로 구성되어있다.
유명한 미국드라마인 Friends에서부터 데이터가 추출 되었다.
1400개의 dialogue와 13000개의 utterance로 구성되어있다.
각각의 utterance에 대한 감정은 7개 (Anger, Disgust, Sadness, Joy, Neutral, Surprise, Fear)로 라벨링 되어있다.
MELD는 positive, negative, neutral 세가지에 대해서도 라벨링 되어있다.
| 통계 | Train | Dev | Test |
| 모달리티 | audio, visual, text | audio, visual, text | audio, visual, text |
| word 수 | 10,643 | 2,384 | 4,361 |
| 평균 utterance 길이 | 8.03 | 7.99 | 8.28 |
| 최대 utterance 길이 | 69 | 37 | 45 |
| dialogue당 감정의 평균 갯수 | 3.30 | 3.35 | 3.24 |
| dialogue 갯수 | 1039 | 114 | 280 |
| utterance 갯수 | 9989 | 1109 | 2610 |
| speakers 숫자 | 260 | 47 | 100 |
| emotion shift 횟수 | 4003 | 427 | 1003 |
| utterance의 durance의 평균 | 3.59s | 3.59s | 3.58s |
MELD 데이터셋 다운로드 링크
Linux에서 다운 받기
wget https://web.eecs.umich.edu/~mihalcea/downloads/MELD.Raw.tar.gz
wget https://huggingface.co/datasets/declare-lab/MELD/resolve/main/MELD.Raw.tar.gz
댓글