Look, Listen and Learn — A Multimodal LSTM for Speaker Identification
Jimmy Ren(Group Sense (China)), Qiong Yan(Guizhou University), Yu‐Wing Tai(Group Sense (China)), Li Xu(Group Sense (China)), Wenxiu Sun(Group Sense (China)), Chuan Wang(Chinese Academy of Sciences), Yongtao Hu(University of Hong Kong)
Cited by 73
Related Papers
Hierarchical Saliency Detection
|Unknown|2013|1.8k
Structure extraction from texture via relative total variation
|ACM Transactions on Graphics|2012|890
Hierarchical Image Saliency Detection on Extended CSSD
|IEEE Transactions on Pattern Analysis and Machine Intelligence|2015|595
Cascade Residual Learning: A Two-Stage Convolutional Neural Network for Stereo Matching
|Unknown|2017|504
Accurate Single Stage Detector Using Recurrent Rolling Convolution
|Unknown|2017|289