How to put it into words - using random forests to extract symbol level descriptions from audio content for concept detectionPo-Sen Huang, Mark Hasegawa‐Johnson, Ajay Divakaran et al.|Unknown|2012Cited by 4
On the Applicability of Speaker Diarization to Audio Indexing of Non-Speech and Mixed Non-Speech/Speech Video SoundtracksRobert Mertens, Mark Hasegawa‐Johnson, Po-Sen Huang et al.|International Journal of Multimedia Data Engineering and Management|2012Cited by 3