Speech Separation: Asymmetric Encoder-Decoder
CS470 수업 프로젝트 (5인 팀)
2024.07 - 2024.12
ML/DL
PyTorch, SepReformer, pydub
Overview
사람-동물·동물-동물 혼합 오디오 음원 분리 프로젝트입니다. 혼합 데이터 32,000개를 구축한 후 SepReformer를 재학습했습니다.
Results
- Si-SNRi +2.3dB 향상
- SDRi +1.96dB 향상
Features
- 사람-동물, 동물-동물 혼합 오디오 음원 분리
- 32,000개 혼합 데이터셋 구축
- SepReformer 모델 재학습 및 성능 개선