Skip to content
Closed
Show file tree
Hide file tree
Changes from 3 commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
1 change: 1 addition & 0 deletions mteb/tasks/Audio/AudioClassification/__init__.py
Original file line number Diff line number Diff line change
@@ -1,5 +1,6 @@
from __future__ import annotations

from .eng.AESDD import *
from .eng.AmbientAcousticContext import *
from .eng.BeijingOpera import *
from .eng.CommonLanguageAgeDetection import *
Expand Down
49 changes: 49 additions & 0 deletions mteb/tasks/Audio/AudioClassification/eng/AESDD.py
Original file line number Diff line number Diff line change
@@ -0,0 +1,49 @@
from __future__ import annotations

from mteb.abstasks.Audio.AbsTaskAudioClassification import (
AbsTaskAudioClassification,
)
from mteb.abstasks.TaskMetadata import TaskMetadata


class AESDDClassification(AbsTaskAudioClassification):
metadata = TaskMetadata(
name="AESDD",
description="Speech Emotion Recognition Dataset.",
reference="https://m3c.web.auth.gr/research/aesdd-speech-emotion-recognition/",
dataset={
"path": "mteb/AESDD",
"revision": "afbff14d927de14412d8124502313ea6d9d140e0",

Copy link
Copy Markdown
Collaborator

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

I was not able to find this dataset. I was only able to find this one.

},
type="AudioClassification",
category="a2t",
eval_splits=["train"],
Comment thread
isaac-chung marked this conversation as resolved.
eval_langs=["eng-Latn"],
main_score="accuracy",
date=("2018-01-01", "2019-01-01"),
domains=["Spoken"],
task_subtypes=["Emotion recognition"],
license="cc-by-sa-4.0",
annotations_creators="human-annotated",
dialect=[],
modalities=["audio"],
sample_creation="found",
bibtex_citation="""@article{vryzas2018speech,
title={Speech emotion recognition for performance interaction},
author={Vryzas, Nikolaos and Kotsakis, Rigas and Liatsou, Aikaterini and Dimoulas, Charalampos A and Kalliris, George},
journal={Journal of the Audio Engineering Society},
volume={66},
number={6},
pages={457--467},
year={2018},
publisher={Audio Engineering Society}
}""",
descriptive_stats={
"n_samples": {"train": 3200},
},
)

audio_column_name: str = "audio"
label_column_name: str = "label"
samples_per_label: int = 16
is_cross_validation: bool = True
1 change: 0 additions & 1 deletion mteb/tasks/Audio/Clustering/__init__.py
Original file line number Diff line number Diff line change
@@ -1,6 +1,5 @@
from __future__ import annotations


from .eng.AmbientAcousticContextClustering import *
from .eng.CREMA_DClustering import *
from .eng.ESC50Clustering import *
Expand Down