GitHub - FurKan7/speaker-recognition at e55933d4eb10c500a081e2b5dbd5ea1996c14bca

Branches Tags

Name		Name	Last commit message	Last commit date
Latest commit History 247 Commits
data		data
doc		doc
log		log
src		src
.gitignore		.gitignore
README.md		README.md
complete-report.pdf		complete-report.pdf
demo.avi		demo.avi
presentation.pdf		presentation.pdf

Repository files navigation

About

This is a Speaker Recognition system with GUI, served as an SRT project for the course Signal Processing (2013Fall) in Tsinghua University.

For more details of this project, please see:

Our presentation slides
Our complete report

Dependencies

Algorithms Used

Voice Activity Detection(VAD):

Long-Term Spectral Divergence (LTSD)

Feature:

Mel-Frequency Cepstral Coefficient (MFCC)
Linear Predictive Coding (LPC)

Model:

Gaussian Mixture Model (GMM)
Universal Background Model (UBM)
Continuous Restricted Boltzman Machine (CRBM)
Joint Factor Analysis (JFA)

GUI demo

Our GUI not only has basic functionality for recording, enrollment, training and testing, but also has a visualization of real-time speaker recognition:

See our demo video (in Chinese) for more details.

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Repository files navigation

About

Dependencies

Algorithms Used

GUI demo

About

Releases

Packages

Languages

FurKan7/speaker-recognition

Folders and files

Latest commit

History

Repository files navigation

About

Dependencies

Algorithms Used

GUI demo

About

Resources

Stars

Watchers

Forks

Releases

Packages 0

Languages

Packages