Artwork

Το περιεχόμενο παρέχεται από το Brian Carter. Όλο το περιεχόμενο podcast, συμπεριλαμβανομένων των επεισοδίων, των γραφικών και των περιγραφών podcast, μεταφορτώνεται και παρέχεται απευθείας από τον Brian Carter ή τον συνεργάτη της πλατφόρμας podcast. Εάν πιστεύετε ότι κάποιος χρησιμοποιεί το έργο σας που προστατεύεται από πνευματικά δικαιώματα χωρίς την άδειά σας, μπορείτε να ακολουθήσετε τη διαδικασία που περιγράφεται εδώ https://el.player.fm/legal.
Player FM - Εφαρμογή podcast
Πηγαίνετε εκτός σύνδεσης με την εφαρμογή Player FM !

Scottish AI: Laughter Detection in Machine Learning

5:49
 
Μοίρασέ το
 

Manage episode 445652460 series 3605861
Το περιεχόμενο παρέχεται από το Brian Carter. Όλο το περιεχόμενο podcast, συμπεριλαμβανομένων των επεισοδίων, των γραφικών και των περιγραφών podcast, μεταφορτώνεται και παρέχεται απευθείας από τον Brian Carter ή τον συνεργάτη της πλατφόρμας podcast. Εάν πιστεύετε ότι κάποιος χρησιμοποιεί το έργο σας που προστατεύεται από πνευματικά δικαιώματα χωρίς την άδειά σας, μπορείτε να ακολουθήσετε τη διαδικασία που περιγράφεται εδώ https://el.player.fm/legal.

Recognizing laughter in audio is actually a very difficult ML problem, filled with failure. Much like most comedians' jokes. Let's hope some good stuff survives.

This is a review of a student's final year project for a University of Edinburgh computer science course. The project focused on creating a machine learning model to detect laughter in video calls, aiming to improve engagement and reduce muting by automatically unmuting users when laughter is detected. However, the project faced challenges, including poor model performance and the discovery that many non-transcribed regions in the ICSI corpus are not actually silence, but quieter speech by other participants. The student detailed the process of evaluating an existing laughter recognition model, training their own model on the ICSI corpus, investigating the impact of training data on model performance, and examining the practicality of real-time laughter detection. Despite the project's ultimate failure to achieve its original goal, it provided valuable insights, generated a publicly available codebase for future research, and highlighted the importance of analyzing non-transcribed regions in audio data for improved accuracy.

Read Lasse Wolter's paper here: https://project-archive.inf.ed.ac.uk/ug4/20222999/ug4_proj.pdf

  continue reading

71 επεισόδια

Artwork
iconΜοίρασέ το
 
Manage episode 445652460 series 3605861
Το περιεχόμενο παρέχεται από το Brian Carter. Όλο το περιεχόμενο podcast, συμπεριλαμβανομένων των επεισοδίων, των γραφικών και των περιγραφών podcast, μεταφορτώνεται και παρέχεται απευθείας από τον Brian Carter ή τον συνεργάτη της πλατφόρμας podcast. Εάν πιστεύετε ότι κάποιος χρησιμοποιεί το έργο σας που προστατεύεται από πνευματικά δικαιώματα χωρίς την άδειά σας, μπορείτε να ακολουθήσετε τη διαδικασία που περιγράφεται εδώ https://el.player.fm/legal.

Recognizing laughter in audio is actually a very difficult ML problem, filled with failure. Much like most comedians' jokes. Let's hope some good stuff survives.

This is a review of a student's final year project for a University of Edinburgh computer science course. The project focused on creating a machine learning model to detect laughter in video calls, aiming to improve engagement and reduce muting by automatically unmuting users when laughter is detected. However, the project faced challenges, including poor model performance and the discovery that many non-transcribed regions in the ICSI corpus are not actually silence, but quieter speech by other participants. The student detailed the process of evaluating an existing laughter recognition model, training their own model on the ICSI corpus, investigating the impact of training data on model performance, and examining the practicality of real-time laughter detection. Despite the project's ultimate failure to achieve its original goal, it provided valuable insights, generated a publicly available codebase for future research, and highlighted the importance of analyzing non-transcribed regions in audio data for improved accuracy.

Read Lasse Wolter's paper here: https://project-archive.inf.ed.ac.uk/ug4/20222999/ug4_proj.pdf

  continue reading

71 επεισόδια

Όλα τα επεισόδια

×
 
Loading …

Καλώς ήλθατε στο Player FM!

Το FM Player σαρώνει τον ιστό για podcasts υψηλής ποιότητας για να απολαύσετε αυτή τη στιγμή. Είναι η καλύτερη εφαρμογή podcast και λειτουργεί σε Android, iPhone και στον ιστό. Εγγραφή για συγχρονισμό συνδρομών σε όλες τις συσκευές.

 

Οδηγός γρήγορης αναφοράς