← All conferences

ICASSP 2019 Accepted Papers

The full list of 1,730 papers accepted at ICASSP 2019 (IEEE International Conference on Acoustics, Speech and Signal Processing). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

  1. "Hello? Who Am I Talking to?" A Shallow CNN Approach for Human vs. Bot Speech Classification
  2. 1-D Convolutional Neural Networks for Signal Processing Applications
  3. 2.5D Multizone Reproduction with Active Control of Scattered Sound Fields
  4. 2D Beamforming on Sparse Arrays with Sparse Bayesian Learning
  5. 3D AOA Target Tracking with Two-step Instrumental-variable Kalman Filtering
  6. 3D Coprime Arrays in Sparse Sensing
  7. 3D Point Cloud Denoising via Deep Neural Network Based Local Surface Estimation
  8. 3D Reconstruction Using Single-photon Lidar Data Exploiting the Widths of the Returns
  9. 3D Visual Speech Animation Using 2D Videos
  10. A Bayesian Approach to Inter-task Fusion for Speaker Recognition
  11. A Bayesian Attention Neural Network Layer for Speaker Recognition
  12. A Bayesian Framework for Intent Prediction in Object Tracking
  13. A Calibrated Learning Approach to Distributed Power Allocation in Small Cell Networks
  14. A Cascade of CNN and LSTM Network with 3D Anchors for Mitotic Cell Detection in 4D Microscopic Image
  15. A Case of Distributed Optimization in Adversarial Environment
  16. A Characterization of Stochastic Mirror Descent Algorithms and Their Convergence Properties
  17. A Clustering Approach to Construct Multi-scale Overcomplete Dictionaries for ECG Modeling
  18. A Compact Framework for Voice Conversion Using Wavenet Conditioned on Phonetic Posteriorgrams
  19. A Comparison of Five Multiple Instance Learning Pooling Functions for Sound Event Detection with Weak Labeling
  20. A Comparison of Lattice-free Discriminative Training Criteria for Purely Sequence-trained Neural Network Acoustic Models
  21. A Convex Lifting Approach to Image Phase Unwrapping
  22. A Data-centric Approach to Unsupervised Texture Segmentation Using Principle Representative Patterns
  23. A Data-selective LS Solution to TDOA-based Source Localization
  24. A Deep Dictionary Model to Preserve and Disentangle Key Features in a Signal
  25. A Deep Dual-path Network for Improved Mammogram Image Processing
  26. A Deep Generative Model of Speech Complex Spectrograms
  27. A Deep Learning Based Binaural Speech Enhancement Approach with Spatial Cues Preservation
  28. A Deep Neural Network Based End to End Model for Joint Height and Age Estimation from Short Duration Speech
  29. A Deep Neural Network Based Maneuvering-target Tracking Algorithm
  30. A Deep-narma Filter for Unusual Behavior Detection from Visual, Thermal and Wireless Signals
  31. A Denoising Autoencoder for Speaker Recognition. Results on the MCE 2018 Challenge
  32. A Deterministic Annealing Approach to Switched Predictor Design for Adaptive Compression Systems
  33. A Differential-geometric Approach for Globally Solving a Non-convex, Discontinuous Depth Estimation Problem for Plenoptic Camera Images
  34. A Discrete Signal Processing Framework for Meet/join Lattices with Applications to Hypergraphs and Trees
  35. A Double K-best Viterbi-sphere Decoder for Trellis-coded Generalized Spatial Modulation with Multiple Code Rates
  36. A Double-cross-correlation Processor for Blind Sampling Rate Offset Estimation in Acoustic Sensor Networks
  37. A Factorial Deep Markov Model for Unsupervised Disentangled Representation Learning from Speech
  38. A Fair and Scalable Power Control Scheme in Multi-cell Massive MIMO
  39. A Fast Method of Computing Persistent Homology of Time Series Data
  40. A Fast and Robust Paradigm for Fourier Compressed Sensing Based on Coded Sampling
  41. A Format-compliant Selective Secret 3D Object Sharing Scheme Based on Shamir's Scheme
  42. A Fully Convolutional Neural Network for Complex Spectrogram Processing in Speech Enhancement
  43. A Fuzzy-based Two-stage Biometric Sample Quality Evaluation System
  44. A Geometry-aware Framework for Compressing 3D Mesh Textures
  45. A Gridless CS Approach for Channel Estimation in Hybrid Massive MIMO Systems
  46. A Hierarchical Decoding Model for Spoken Language Understanding from Unaligned Data
  47. A Hierarchical Neural Summarization Framework for Spoken Documents
  48. A Highly Adaptive Acoustic Model for Accurate Multi-dialect Speech Recognition
  49. A History-based Stopping Criterion in Recursive Bayesian State Estimation
  50. A Hybrid Method for Blind Estimation of Frequency Dependent Reverberation Time Using Speech Signals
  51. A Joint Auditory Attention Decoding and Adaptive Binaural Beamforming Algorithm for Hearing Devices
  52. A LSTM and CNN Based Assemble Neural Network Framework for Arrhythmias Classification
  53. A Large Scale Analysis of Logistic Regression: Asymptotic Performance and New Insights
  54. A Learning Approach for Wavelet Design
  55. A Learning Approach to Wireless Information and Power Transfer Signal and System Design
  56. A Learning Based Depth Estimation Framework for 4D Densely and Sparsely Sampled Light Fields
  57. A Learning-based Framework for Line-spectra Super-resolution
  58. A Low-latency Sparse-Winograd Accelerator for Convolutional Neural Networks
  59. A Map Framework for Support Recovery of Sparse Signals Using Orthogonal Least Squares
  60. A Markerless Body Motion Capture System for Character Animation Based on Multi-view Cameras
  61. A Method Based on L-bfgs to Solve Constrained Complex-valued Ica
  62. A Modified Frank-wolfe Algorithm for Tensor Factorization with Unimodal Signals
  63. A Multi-radar Joint Beamforming Method
  64. A Multi-spike Approach for Robust Sound Recognition
  65. A Music Structure Informed Downbeat Tracking System Using Skip-chain Conditional Random Fields and Deep Learning
  66. A Needle in a Haystack? Harnessing Onomatopoeia and User-specific Stylometrics for Authorship Attribution of Micro-messages
  67. A Neighbor-aware Approach for Image-text Matching
  68. A Neural Network Based Ranking Framework to Improve ASR with NLU Related Knowledge Deployed
  69. A New Fusion Framework for Multimodal Medical Image Based on GRWT
  70. A New Quadratic Matrix Inequality Approach to Robust Adaptive Beamforming for General-rank Signal Model
  71. A New Separation Method for Galaxy Spectra Based on Data Fusion between Two Grism Orders in Slitless Spectroscopy
  72. A New Spatial Steganographic Scheme by Modeling Image Residuals with Multivariate Gaussian Model
  73. A Noise Robust Hearable Device with an Adaptive Noise Canceller and Its DSP Implementation
  74. A Non-convex Approach to Non-negative Super-resolution: Theory and Algorithm
  75. A Novel Approach for Feedforward Control of Noise in Ducts Using Simplified Multichannel Inverse Filters
  76. A Novel Approximate Lloyd-max Quantizer and Its Analysis
  77. A Novel Binaural Beamforming Scheme with Low Complexity Minimizing Binaural-cue Distortions
  78. A Novel Deep Hashing Method with Top Similarity for Image Retrieval
  79. A Novel Deterministic Sensing Matrix Based on Kasami Codes for Cluster Structured Sparse Signals
  80. A Novel Fractional Order Derivate Based Log-demons with Driving Force for High Accurate Image Registration
  81. A Novel Framework for Designing Directional Linear Transforms with Application to Video Compression
  82. A Novel Framework of Hand Localization and Hand Pose Estimation
  83. A Novel Progressive Gaussian Approximate Filter with Variable Step Size Based on a Variational Bayesian Approach
  84. A Novel Repetition Normalized Adversarial Reward for Headline Generation
  85. A Novel Resource-aware Tensor Decomposition Design Based on Reinforcement Learning
  86. A Novel Super-resolution Method Based on Patch Reconstruction with Simk Clustering and Nonlinear Mapping
  87. A Novel Three Dimensional Probability-based Classifier for Improving Motor Imagery-based BCI
  88. A Penalized Autoencoder Approach for Nonlinear Independent Component Analysis
  89. A Pipeline for Lung Tumor Detection and Segmentation from CT Scans Using Dilated Convolutional Neural Networks
  90. A Pitch-aware Approach to Single-channel Speech Separation
  91. A Privacy-preserving Diffusion Strategy over Multitask Networks
  92. A Projected Newton-type Algorithm for Nonnegative Matrix Factorization with Model Order Selection
  93. A Proper Version of Synthesis-based Sparse Audio Declipper
  94. A Quantitative Comparison of Epoch Extraction Algorithms for Telephone Speech
  95. A Quasi-Newton Algorithm on the Orthogonal Manifold for NMF with Transform Learning
  96. A Recurrent Graph Neural Network for Multi-relational Data
  97. A Recursive Bayesian Model for Extreme Values
  98. A Recursive Least-squares Algorithm Based on the Nearest Kronecker Product Decomposition
  99. A Region Based Attention Method for Weakly Supervised Sound Event Detection and Classification
  100. A Riemannian Distance Approach to MIMO Radar Signal Design
  101. A Robust Text-independent Speaker Verification Method Based on Speech Separation and Deep Speaker
  102. A Rotation Invariant HOG Descriptor for Tire Pattern Image Classification
  103. A Sequential Guiding Network with Attention for Image Captioning
  104. A Simple Bound on the BER of the Map Decoder for Massive MIMO Systems
  105. A Simple Way of Multimodal and Arbitrary Style Transfer
  106. A Sparse Encoding and Phaseless Decoding Approach for Fast Mmwave Beam Alignment
  107. A Sparsity Measure for Echo Density Growth in General Environments
  108. A Spectral Glottal Flow Model for Source-filter Separation of Speech
  109. A Spectral-change-aware Loss Function for DNN-based Speech Separation
  110. A Spectro-temporal Technique for Estimating Aperiodicity and Voiced/unvoiced Decision Boundaries of Speech Signals
  111. A Spelling Correction Model for End-to-end Speech Recognition
  112. A Spiking Neural Network Approach to Auditory Source Lateralisation
  113. A Spiking Neural Network with Local Learning Rules Derived from Nonnegative Similarity Matching
  114. A Streamlined Encoder/decoder Architecture for Melody Extraction
  115. A Study on How Pre-whitening Influences Fundamental Frequency Estimation
  116. A Study on Robustness of Articulatory Features for Automatic Speech Recognition of Neutral and Whispered Speech
  117. A Subband Energy Modification Method for Elevation Control in Median Plane
  118. A Subject-to-subject Transfer Learning Framework Based on Jensen-Shannon Divergence for Improving Brain-computer Interface
  119. A Tighter Bayesian CramÉR-rao Bound
  120. A Time-frequency Based Multivariate Phase-amplitude Coupling Measure
  121. A Topology-aware Coding Framework for Distributed Graph Processing
  122. A Training Method Using DNN-guided Layerwise Pretraining for Deep Gaussian Processes
  123. A Training Procedure for Quantum Random Vector Functional-link Networks
  124. A Two-class Hyper-spherical Autoencoder for Supervised Anomaly Detection
  125. A Two-stage Single-channel Speaker-dependent Speech Separation Approach for Chime-5 Challenge
  126. A Unified Framework for Feature-based Domain Adaptation of Neural Network Language Models
  127. A Unified Framework for Neural Speech Separation and Extraction
  128. A Unified Neural Architecture for Instrumental Audio Tasks
  129. A Variational Adaptive Population Importance Sampler
  130. A Variational Bayes Approach to Adaptive Channel-gain Cartography
  131. A Video Camera Model Identification System Using Deep Learning and Fusion
  132. A Vocoder Based Method for Singing Voice Extraction
  133. A Weight-shared Dual-branch Convolutional Neural Network for Unsupervised Dense Depth Prediction and Camera Motion Estimation
  134. A Windowed Digraph Fourier Transform
  135. ADMM for ND Line Spectral Estimation Using Grid-free Compressive Sensing from Multiple Measurements with Applications to DOA Estimation
  136. ADMM-based Beamforming Optimization for Physical Layer Security in a Full-duplex Relay System
  137. ADMM-based Bipartite Graph Approximation
  138. APE-GAN: Adversarial Perturbation Elimination with GAN
  139. ATTS2S-VC: Sequence-to-sequence Voice Conversion with Attention and Context Preservation Mechanisms
  140. AUC Optimization for Deep Learning Based Voice Activity Detection
  141. Accelerating Iterative Hard Thresholding for Low-rank Matrix Completion via Adaptive Restart
  142. Accuracy Evaluation Based on Simulation for Finite Precision Systems Using Inferential Statistics
  143. Accurate Reconstruction of Finite Rate of Innovation Signals on the Sphere
  144. Accurate Target Annotation in 3D from Multimodal Streams
  145. Accurate Vehicle Detection Using Multi-camera Data Fusion and Machine Learning
  146. Acoustic Equalization for Headphones Using a Fixed Feed-forward Filter
  147. Acoustic Event Detection from Weakly Labeled Data Using Auditory Salience
  148. Acoustic Impulse Responses for Wearable Audio Devices
  149. Acoustic Modeling for Distant Multi-talker Speech Recognition with Single- and Multi-channel Branches
  150. Acoustic Modeling for Overlapping Speech Recognition: Jhu Chime-5 Challenge System
  151. Acoustic Scene Generation with Conditional Samplernn
  152. Acoustic and Lexical Sentiment Analysis for Customer Service Calls
  153. Acoustically Grounded Word Embeddings for Improved Acoustics-to-word Speech Recognition
  154. Active Anomaly Detection with Switching Cost
  155. Active Learning for Efficient Audio Annotation and Classification with a Large Amount of Unlabeled Data
  156. Active Learning with Label Proportions
  157. Active Noise Control Using Finite Element-based Virtual Sensors
  158. Active Sampling for Approximately Bandlimited Graph Signals
  159. Ad-net: Attention Guided Network for Optical Flow Estimation Using Dilated Convolution
  160. AdaFlow: Domain-adaptive Density Estimator with Application to Anomaly Detection and Unpaired Cross-domain Translation
  161. Adaptation of Multiple Sound Source Localization Neural Networks with Weak Supervision and Domain-adversarial Training
  162. Adapting End-to-end Neural Speaker Verification to New Languages and Recording Conditions with Adversarial Training
  163. Adaptive Adjustment with Semantic Feature Space for Zero-shot Recognition
  164. Adaptive Blind Sparse Source Separation Based on Shear and Givens Rotations
  165. Adaptive Brightness Learning for Active Object Recognition
  166. Adaptive Dereverberation Using Multi-channel Linear Prediction with Deficient Length Filter
  167. Adaptive Filtering for Event Recognition from Noisy Signal: an Application to Earthquake Detection
  168. Adaptive Graph Formulation for 3D Shape Representation
  169. Adaptive Reduced-Dimensional Beamspace Beamformer Design by Analogue Beam Selection
  170. Adaptive Scenario Discovery for Crowd Counting
  171. Adaptive Sensing Matrix Design for Greedy Algorithms in Mmv Compressive Sensing
  172. Adaptive Subspace Detector in High Dimensional Space with Insufficient Training Data
  173. Adaptive Waveform Design for Automotive Joint Radar-communications System
  174. Adaptively Weighted Multi-task Learning Using Inverse Validation Loss
  175. Adversarial Examples for Improving End-to-end Attention-based Small-footprint Keyword Spotting
  176. Adversarial Inpainting of Medical Image Modalities
  177. Adversarial Learning of Label Dependency: A Novel Framework for Multi-class Classification
  178. Adversarial Learning-based Data Augmentation for Rotation-robust Human Tracking
  179. Adversarial Multi-label Prediction for Spoken and Visual Signal Tagging
  180. Adversarial Multi-task Deep Features and Unsupervised Back-end Adaptation for Language Recognition
  181. Adversarial Multi-user Bandits for Uncoordinated Spectrum Access
  182. Adversarial Speaker Adaptation
  183. Adversarial Speaker Verification
  184. Adversarial Training of End-to-end Speech Recognition Using a Criticizing Language Model
  185. Adversarial Variational Bayes Methods for Tweedie Compound Poisson Mixed Models
  186. Adversarial Watermarking to Attack Deep Neural Networks
  187. Adversarially Trained Autoencoders for Parallel-data-free Voice Conversion
  188. Adversarially-enriched Acoustic Code Vector Learned from Out-of-context Affective Corpus for Robust Emotion Recognition
  189. Aggregation Graph Neural Networks
  190. Aggregation and Embedding for Group Membership Verification
  191. Air-tissue Boundary Segmentation in Real Time Magnetic Resonance Imaging Video Using a Convolutional Encoder-decoder Network
  192. Algebraic Solution for Tdoa Localization in Modified Polar Representation
  193. Algebraically-initialized Expectation Maximization for Header-free Communication
  194. All for One: Frame-wise Rank Loss for Improving Video-based Person Re-identification
  195. All-neural Online Source Separation, Counting, and Diarization for Meeting Analysis
  196. Alternately Guided Depth Super-resolution Using Weighted Least Squares and Zero-order Reverse Filtering
  197. Alternating Direction Method of Multipliers for Semi-blind Astronomical Image Deconvolution
  198. Alternating Phase Projected Gradient Descent with Generative Priors for Solving Compressive Phase Retrieval
  199. An Admm Algorithm for Peak Transmission Energy Minimization in Symbol-level Precoding
  200. An Algorithm Unrolling Approach to Deep Image Deblurring
  201. An Alternating Projection Algorithm for Approximate Simultaneous Diagonalization
  202. An Analysis of Noise-aware Features in Combination with the Size and Diversity of Training Data for DNN-based Speech Enhancement
  203. An Antipodally Symmetric Optimal Dimensionality Sampling on the Sphere
  204. An Attention-aware Bidirectional Multi-residual Recurrent Neural Network (Abmrnn): A Study about Better Short-term Text Classification
  205. An Attention-based Neural Network Approach for Single Channel Speech Enhancement
  206. An Attribute-invariant Variational Learning for Emotion Recognition Using Physiology
  207. An Audio Scene Classification Framework with Embedded Filters and a DCT-based Temporal Module
  208. An Autoencoder-based Approach for Recognizing Null Class in Activities of Daily Living In-the-wild via Wearable Motion Sensors
  209. An Educational Tool for Hearing Aid Compression Fitting via a Web-based Adjusted Smartphone App
  210. An Efficiency-improved Tdoa-based Direct Position Determination Method for Multiple Sources
  211. An Efficient Algorithm for Hyperspectral Image Clustering
  212. An Empirical Study of Speech Processing in the Brain by Analyzing the Temporal Syllable Structure in Speech-input Induced EEG
  213. An End-to-end Network to Synthesize Intonation Using a Generalized Command Response Model
  214. An Enhanced Hierarchical Extreme Learning Machine with Random Sparse Matrix Based Autoencoder
  215. An Ensemble of Deep Recurrent Neural Networks for P-wave Detection in Electrocardiogram
  216. An Event-contrastive Connectome Network for Automatic Assessment of Individual Face Processing and Memory Ability
  217. An Heterogeneous Compiler of Dataflow Programs for Zynq Platforms
  218. An Image Coding Approach Based on Mixture-of-experts Regression Using Epanechnikov Kernel
  219. An Improved Air Tissue Boundary Segmentation Technique for Real Time Magnetic Resonance Imaging Video Using Segnet
  220. An Improved Approach to Weakly Supervised Semantic Segmentation
  221. An Improved Low Rank Detector in the High Dimensional Regime
  222. An Improved Method for Parametric Spectral Estimation
  223. An Improved Uncertainty Propagation Method for Robust I-vector Based Speaker Recognition
  224. An Information-theoretic Approach for Automatically Determining the Number of State Groups When Aggregating Markov Chains
  225. An Integrated Framework for Field Recording, Localization, Classification and Annotation of Birdsongs Using Robot Audition Techniques - Harkbird 2.0
  226. An Interaction-aware Attention Network for Speech Emotion Recognition in Spoken Dialogs
  227. An Investigation of Multilingual ASR Using End-to-end LF-MMI
  228. An Iterative Time Domain Denoising Method
  229. An LS Localisation Method for Massive MIMO Transmission Systems
  230. An Online Multiple-speaker DOA Tracking Using the CappÉ-Moulines Recursive Expectation-maximization Algorithm
  231. An Unsupervised Learning Approach to Neural-net-supported Wpe Dereverberation
  232. Analysis Dictionary Learning: an Efficient and Discriminative Solution
  233. Analysis and Mitigation of Vocal Effort Variations in Speaker Recognition
  234. Analysis of Broadband GEVD-based Blind Source Separation
  235. Analysis of Coprime Arrays on Moving Platform
  236. Analysis of Information Diffusion with Irrational Users: A Graphical Evolutionary Game Approach
  237. Analysis of Multichannel Virtual Sensing Active Noise Control to Overcome Spatial Correlation and Causality Constraints
  238. Analysis of Reverberation via Teager Energy Features for Replay Spoof Speech Detection
  239. Analysis of Sparse-integer Measurement Matrices in Compressive Sensing
  240. Analytic Properties of Downsampling for Bandlimited Signals
  241. Analyzing Human Reaction Time for Talker Change Detection
  242. Analyzing Uncertainties in Speech Recognition Using Dropout
  243. Anarchic Urban Expansion Detection and Monitoring with Integration of Expert Knowledge
  244. Anomaly Detection Based on an Ensemble of Dereverberation and Anomalous Sound Extraction
  245. Anomaly Detection and Tracking Based on Mean-Reverting Processes with Unknown Parameters
  246. Anomaly Detection in Raw Audio Using Deep Autoregressive Networks
  247. Anomaly Detection in Single Subject vs Group Using Manifold Learning
  248. Anomaly Imaging for Structural Health Monitoring Exploiting Clustered Sparsity
  249. Artificial Bandwidth Extension Using a Conditional Generative Adversarial Network with Discriminative Training
  250. Asymmetric Cyclegan for Unpaired NIR-to-RGB Face Image Translation
  251. Asymptotic Kullback-Leibler Increment to Characterize Experiment-induced Stress
  252. Asymptotic Performance of Linear Discriminant Analysis with Random Projections
  253. Asymptotically Optimal Quickest Change Detection under a Nuisance Change
  254. Asymptotically Optimal Recovery of Gaussian Sources from Noisy Stationary Mixtures: the Least-noisy Maximally-separating Solution
  255. Asynchronous Neighbor Discovery Using Coupled Compressive Sensing
  256. Atom Selection in Continuous Dictionaries: Reconciling Polar and SVD Approximations
  257. Atrous Convolution for Binary Semantic Segmentation of Lung Nodule
  258. Attacks on Digital Watermarks for Deep Neural Networks
  259. Attention in Recurrent Neural Networks for Ransomware Detection
  260. Attention-augmented End-to-end Multi-task Learning for Emotion Prediction from Speech
  261. Attention-based Atrous Convolutional Neural Networks: Visualisation and Understanding Perspectives of Acoustic Scenes
  262. Attention-based Graph Convolutional Network for Recommendation System
  263. Attention-based Transfer Learning for Brain-computer Interface
  264. Attention-based Wavenet Autoencoder for Universal Voice Conversion
  265. Attentive Adversarial Learning for Domain-invariant Training
  266. Attentive Filtering Networks for Audio Replay Attack Detection
  267. Attitude Recognition Using Multi-resolution Cochleagram Features
  268. Audio Caption: Listen and Tell
  269. Audio Coding Based on Spectral Recovery by Convolutional Neural Network
  270. Audio Feature Generation for Missing Modality Problem in Video Action Recognition
  271. Audio Replay Spoof Attack Detection Using Segment-based Hybrid Feature and DenseNet-LSTM Network
  272. Audio Texture Synthesis with Random Neural Networks: Improving Diversity and Quality
  273. Audio Watermarking over the Air with Modulated Self-correlation
  274. Audio-based Identification of Beehive States
  275. Audio-linguistic Embeddings for Spoken Sentences
  276. Audiovisual Speaker Conversion: Jointly and Simultaneously Transforming Facial Expression and Acoustic Characteristics
  277. Auditory Inspired Spatial Differentiation for Replay Spoofing Attack Detection
  278. Augmented Time-frequency Mask Estimation in Cluster-based Source Separation Algorithms
  279. Augmenting Dysphonia Voice Using Fourier-based Synchrosqueezing Transform for a CNN Classifier
  280. Auralization of Omnidirectional Room Impulse Responses Based on the Spatial Decomposition Method and Synthetic Spatial Data
  281. Autoencoding HRTFS for DNN Based HRTF Personalization Using Anthropometric Features
  282. Automatic Assessment of Spoken Language Proficiency of Non-native Children
  283. Automatic Diagnosis of Alzheimer's Disease Using Neural Network Language Models
  284. Automatic Grammar Augmentation for Robust Voice Command Recognition
  285. Automatic Grammatical Error Detection of Non-native Spoken Learner English
  286. Automatic Kernel Weighting for Multikernel Adaptive Filtering: Multiscale Aspects
  287. Automatic Lyrics-to-audio Alignment on Polyphonic Music Using Singing-adapted Acoustic Models
  288. Automatic Radar-based Gesture Detection and Classification via a Region-based Deep Convolutional Neural Network
  289. Automatic Segmentation of Common Carotid Artery in Longitudinal Mode Ultrasound Images Using Active Oblongs
  290. Automatic Segmentation of Nuclei in Histopathology Images Using Encoding-decoding Convolutional Neural Networks
  291. Automatic Segmentation of Optic Disc Using Affine Snakes in Gradient Vector Field
  292. Automatic Singing Evaluation without Reference Melody Using Bi-dense Neural Network
  293. Automatic Singing Transcription Based on Encoder-decoder Recurrent Neural Networks with a Weakly-supervised Attention Mechanism
  294. Automatic Transcription of Diatonic Harmonica Recordings
  295. Automating the Classification of Urban Issue Reports: an Optimal Stopping Approach
  296. Autonomous Detection and Disambiguation of Martian Ion Trails Using Geometric Signal Processing Techniques
  297. BLHUC: Bayesian Learning of Hidden Unit Contributions for Deep Neural Network Speaker Adaptation
  298. BLP - Boundary Likelihood Pinpointing Networks for Accurate Temporal Action Localization
  299. Background Adaptation for Improved Listening Experience in Broadcasting
  300. Baseline Wander Removal and Isoelectric Correction in Electrocardiograms Using Clustering
  301. Bayesian Drum Transcription Based on Nonnegative Matrix Factor Decomposition with a Deep Score Prior
  302. Bayesian Fusion of Asynchronous Inertial, Speed and Position Data for Object Tracking
  303. Bayesian Image Restoration under Poisson Noise and Log-concave Prior
  304. Bayesian Neural Networks for Sparse Coding
  305. Bayesian Non-parametric Multi-source Modelling Based Determined Blind Source Separation
  306. Bayesian and Gaussian Process Neural Networks for Large Vocabulary Continuous Speech Recognition
  307. Bayesian-optimized Bidirectional LSTM Regression Model for Non-intrusive Load Monitoring
  308. Beamformer Design under Time-correlated Interference and Online Implementation: Brain-activity Reconstruction from EEG
  309. Beamforming Design for Coexistence of Full-duplex Multi-cell MU-MIMO Cellular Network and MIMO Radar
  310. Beamforming Optimization for Intelligent Reflecting Surface with Discrete Phase Shifts
  311. Belief Condensation Filtering for RSSI-Based State Estimation in Indoor Localization
  312. Beyond Word-level to Sentence-level Sentiment Analysis for Financial Reports
  313. Bhattacharyya Distance-based Transfer Learning for a Hybrid EEG-FTCD Brain-computer Interface
  314. Bi-directional Lattice Recurrent Neural Networks for Confidence Estimation
  315. Bias Mitigation Post-processing for Individual and Group Fairness
  316. Bidirectional Quaternion Long Short-term Memory Recurrent Neural Networks for Speech Recognition
  317. Bilinear Dictionary Update via Linear Least Squares
  318. Bilinear Representation for Language-based Image Editing Using Conditional Generative Adversarial Networks
  319. Binary Classification Only from Unlabeled Data by Iterative Unlabeled-unlabeled Classification
  320. Binaural Beamforming Based on Automatic Interferer Selection
  321. Blind Calibration of Sparse Arrays for DOA Estimation with Analog and One-bit Measurements
  322. Blind Denoising of Mixed Gaussian-impulse Noise by Single CNN
  323. Blind Motion Deblurring via Inceptionresdensenet by Using GAN Model
  324. Blind Quality Assessment for 3D-synthesized Images by Measuring Geometric Distortions and Image Complexity
  325. Blind Quality Evaluator for Screen Content Images via Analysis of Structure
  326. Blind Room Volume Estimation from Single-channel Noisy Speech
  327. Blind Signal Processing for Time-varying Convolutive Mixing Systems Based on Sequence Estimation on Partly Smooth Manifolds
  328. Blind Super-resolution in Two-dimensional Parameter Space
  329. Block Alternating Optimization for Non-convex Min-max Problems: Algorithms and Applications in Signal Processing and Communications
  330. Block-randomized Stochastic Proximal Gradient for Constrained Low-rank Tensor Factorization
  331. Bluetooth Based Indoor Localization Using Triplet Embeddings
  332. Boolean CP Decomposition of Binary Tensors: Uniqueness and Algorithm
  333. Bootstrap-based Bias Reduction for the Estimation of the Self-similarity Exponents of Multivariate Time Series
  334. Bootstrapping Graph Convolutional Neural Networks for Autism Spectrum Disorder Classification
  335. Bootstrapping Single-channel Source Separation via Unsupervised Spatial Clustering on Stereo Mixtures
  336. Boundary Discriminative Large Margin Cosine Loss for Text-independent Speaker Verification
  337. Boundary Information Matters More: Accurate Temporal Action Detection with Temporal Boundary Network
  338. Brain Correlates of Task-Load and Dementia Elucidation with Tensor Machine Learning Using Oddball BCI Paradigm
  339. Breast Cancer Detection Based on Merging Four Modes MRI Using Convolutional Neural Networks
  340. Breast Cancer Image Classification on WSI with Spatial Correlations
  341. Burst-survive Temporal Matching Kernel with Fibonacci Periods
  342. Bytes Are All You Need: End-to-end Multilingual Speech Recognition and Synthesis with Bytes
  343. Byzantine-resilient Distributed Large-scale Matrix Completion
  344. CAN: Contextual Aggregating Network for Semantic Segmentation
  345. CMU Wilderness Multilingual Speech Dataset
  346. CNN Based Two-stage Multi-resolution End-to-end Model for Singing Melody Extraction
  347. CNN-RNN-CTC Based End-to-end Mispronunciation Detection and Diagnosis
  348. COLA: Communication-censored Linearized ADMM for Decentralized Consensus Optimization
  349. CONV-codes: Audio Hashing for Bird Species Classification
  350. COVER: A Cluster-based Variance Reduced Method for Online Learning
  351. CRF-based Single-stage Acoustic Modeling with CTC Topology
  352. Can Automatic Facial Expression Analysis Be Used for Treatment Outcome Estimation in Schizophrenia?
  353. Can We Predict Self-reported Customer Satisfaction from Interactions?
  354. Can We Use Speaker Recognition Technology to Attack Itself? Enhancing Mimicry Attacks Using Automatic Target Speaker Selection
  355. Canonical Correlation Based Feature Extraction with Application to Anomaly Detection in Electric Appliances
  356. Canonical Polyadic Decomposition of a Tensor That Has Missing Fibers: A Monomial Factorization Approach
  357. Capsule Networks for Brain Tumor Classification Based on MRI Images and Coarse Tumor Boundaries
  358. Capsule-forensics: Using Capsule Networks to Detect Forged Images and Videos
  359. Cascaded Point Network for 3D Hand Pose Estimation
  360. Casting to Corpus: Segmenting and Selecting Spontaneous Dialogue for Tts with a Cnn-lstm Speaker-dependent Breath Detector
  361. Causality and Robustness in the Remote Sensing of Acoustic Pressure, with Application to Local Active Sound Control
  362. Centroid-based Deep Metric Learning for Speaker Recognition
  363. Chained Compressed Sensing for Iot Node Security
  364. Channel Adversarial Training for Cross-channel Text-independent Speaker Recognition
  365. Channel Estimation Using 1-Bit Quantization and Oversampling for Large-scale Multiple-antenna Systems
  366. Channel Estimation and Low-complexity Beamforming Design for Passive Intelligent Surface Assisted MISO Wireless Energy Transfer
  367. Channel Impulsive Noise Mitigation for Linear Video Coding Schemes
  368. Channel Protection Using Random Modulation
  369. Class-conditional Embeddings for Music Source Separation
  370. Classification of Bioacoustic Signals with Tangent Singular Spectrum Analysis
  371. Classification of Chinese Dialect Regions from L2 English Speech
  372. Classification of Hyperspectral and Lidar with Deep Rotation Forest
  373. Cleaning Adversarial Perturbations via Residual Generative Network for Face Verification
  374. Clonability of Anti-counterfeiting Printable Graphical Codes: A Machine Learning Approach
  375. Clustering by Orthogonal Non-negative Matrix Factorization: A Sequential Non-convex Penalty Approach
  376. Co-attention Network and Low-rank Bilinear Pooling for Aspect Based Sentiment Analysis
  377. Co-clustering of High-order Data via Regularized Tucker Decompositions
  378. Co-prime Circular Microphone Arrays and Their Application to Direction of Arrival Estimation of Speech Sources
  379. Coding Tree Early Termination for Fast HEVC Transrating Based on Random Forests
  380. Cognitive-driven Binaural LCMV Beamformer Using EEG-based Auditory Attention Decoding
  381. Coherent Radar Imaging Using Unsynchronized Distributed Antennas
  382. Collaboration between Bordeaux-inp and Utp, from Research to Education, in the Field of Signal Processing
  383. Collaborative Sensor Caching via Sequential Compressed Sensing
  384. Combating Jamming in Wireless Networks: A Bayesian Game with Jammer's Channel Uncertainty
  385. Combining Linear Estimation with Scalar Widely Linear Estimation
  386. Combining Linear Spatial Filtering and Non-linear Parametric Processing for High-quality Spatial Sound Capturing
  387. Combining Matrix Design for 2D DoA Estimation with Compressive Antenna Arrays Using Stochastic Gradient Descent
  388. Combining Phone Posteriorgrams from Strong and Weak Recognizers for Automatic Speech Assessment of People with Aphasia
  389. Common Mode Patterns for Supervised Tensor Subspace Learning
  390. Common Randomized Shortest Paths (C-RSP): A Simple Yet Effective Framework for Multi-view Graph Embedding
  391. Communication Standards for Distributed Renewable Energy Sources Integration in Future Electricity Distribution Networks
  392. Communications under the Constraint of de-chirp Channel Distortion
  393. Community Detection in Sparse Realistic Graphs: Improving the Bethe Hessian
  394. Community Inference from Graph Signals with Hidden Nodes
  395. Compact Convolutional Recurrent Neural Networks via Binarization for Speech Emotion Recognition
  396. Compact Network for Speakerbeam Target Speaker Extraction
  397. Comparing CQT and Reassignment Based Chroma Features for Template-based Automatic Chord Recognition
  398. Comparison of Data Augmentation and Adaptation Strategies for Code-switched Automatic Speech Recognition
  399. Complementary Sequence Encoding for 1D and 2D Constant-modulus OFDM Transmission at Millimeter Wave Frequencies
  400. Complementary Siamese Networks for Robust Visual Tracking
  401. Completely Blind Image Quality Assessment Using Latent Quality Factor from Image Local Structure Representation
  402. Complex Spectral Mapping with a Convolutional Recurrent Network for Monaural Speech Enhancement
  403. Component Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System
  404. Composite Singer Arrays with Hole-free Coarrays and Enhanced Robustness
  405. Compound Variational Auto-encoder
  406. Compressed Randomized Utv Decompositions for Low-rank Matrix Approximations in Data Science
  407. Compressing Deep Neural Networks Using Toeplitz Matrix: Algorithm Design and Fpga Implementation
  408. Compression Improvement via Reference Organization for 2D-multiview Content
  409. Compressive Sensing with Applications to Millimeter-wave Architectures
  410. Compressive Single-pixel Fourier Transform Imaging Using Structured Illumination
  411. Computation Scheduling for Distributed Machine Learning with Straggling Workers
  412. Computational Analysis of Gaze Behavior in Autism During Interaction with Virtual Agents
  413. Computational Cognitive Assessment: Investigating the Use of an Intelligent Virtual Agent for the Detection of Early Signs of Dementia
  414. Computing the Largest Eigenvalue Distribution for Non-central Wishart Matrices
  415. Concrete: A Per-layer Configurable Framework for Evaluating DNN with Approximate Operators
  416. Condition-transforming Variational Autoencoder for Conversation Response Generation
  417. Conditional Teacher-student Learning
  418. Connectionist Temporal Localization for Sound Event Detection with Sequential Labeling
  419. Consensus-based Distributed Total Least-squares Estimation Using Parametric Semidefinite Programming
  420. Consistency Constrained Reconstruction of Depth Maps from Epipolar Plane Images
  421. Constructing and Compressing Frames in Blockchain-based Verifiable Multi-party Computation
  422. Construction of Overcomplete Multiscale Dictionary of Slepian Functions on the Sphere
  423. Content Adaptive Wavelet Lifting for Scalable Lossless Video Coding
  424. Content Placement Learning for Success Probability Maximization in Wireless Edge Caching Networks
  425. Context Modelling Using Hierarchical Attention Networks for Sentiment and Self-assessed Emotion Detection in Spoken Narratives
  426. Context-aware Deep Learning for Multi-modal Depression Detection
  427. Context-aware Neural-based Dialog Act Classification on Automatically Generated Transcriptions
  428. Contextual Out-of-domain Utterance Handling with Counterfeit Data Augmentation
  429. Contextual Speech Recognition with Difficult Negative Training Examples
  430. Continual Learning for Anomaly Detection with Variational Autoencoder
  431. Control Aware Communication Design for Time Sensitive Wireless Systems
  432. Convergence Bounds for Compressed Gradient Methods with Memory Based Error Compensation
  433. Convex Combination of Constraint Vectors for Set-membership Affine Projection Algorithms
  434. Convex Energy Optimization of Streaming Applications for MPSoCs
  435. Convex Relaxations of Convolutional Neural Nets
  436. Convexity-edge-preserving Signal Recovery with Linearly Involved Generalized Minimax Concave Penalty Function
  437. Convolutional Dictionary Regularizers for Tomographic Inversion
  438. Convolutional Neural Network on Embedded Platform for People Presence Detection in Low Resolution Thermal Images
  439. Convolutional Neural Networks for Video Intra Prediction Using Cross-component Adaptation
  440. Convolutional-sparse-coded Dynamic Mode Decomposition and Its Application to River State Estimation
  441. Cooperative Deep Reinforcement Learning for Multiple-group NB-IoT Networks Optimization
  442. Cooperative Detection via Direct Localization in Mobile Multi-agent Networks
  443. Coordinated Pilot Design for Massive MIMO
  444. Coprime Array Design with Minimum Lag Redundancy
  445. Coupled Ista Network for Multi-modal Image Super-resolution
  446. Coupled Tensor Low-rank Multilinear Approximation for Hyperspectral Super-resolution
  447. CramÉr-rao Bound for DOA Estimators under the Partial Relaxation Framework
  448. Crime Event Embedding with Unsupervised Feature Selection
  449. Cross Evaluation of Speech Enhancement Methods under Different Noise Conditions
  450. Cross Modal Audio Search and Retrieval with Joint Embeddings Based on Text and Audio
  451. Cross-culture Multimodal Emotion Recognition with Adversarial Learning
  452. Cross-gender Voice Conversion with Constant F0-Ratio and Average Background Conversion Model
  453. Cross-language Speech Dependent Lip-synchronization
  454. Cross-lingual Speech-based Tobi Label Generation Using Bidirectional Lstm
  455. Cross-lingual Text-independent Speaker Verification Using Unsupervised Adversarial Discriminative Domain Adaptation
  456. Cross-lingual Transfer Learning for Spoken Language Understanding
  457. Cross-lingual Voice Conversion with Bilingual Phonetic Posteriorgram and Average Modeling
  458. Cross-view Identical Part Area Alignment for Person Re-identification
  459. Crownn: Human-in-the-loop Network with Crowd-generated Inputs
  460. Curiosity-driven Reinforcement Learning for Dialogue Management
  461. Cutensor-tubal: Optimized GPU Library for Low-tubal-rank Tensors
  462. Cycle-GANs for Domain Adaptation of Acoustic Features for Speaker Recognition
  463. Cycle-consistency Training for End-to-end Speech Recognition
  464. Cycle-consistent Adversarial Networks for Non-parallel Vocal Effort Based Speaking Style Conversion
  465. Cyclegan Bandwidth Extension Acoustic Modeling for Automatic Speech Recognition
  466. Cyclegan-VC2: Improved Cyclegan-based Non-parallel Voice Conversion
  467. D2PGGAN: Two Discriminators Used in Progressive Growing of GANS
  468. DADA: Deep Adversarial Data Augmentation for Extremely Low Data Regime Classification
  469. DNN Training Based on Classic Gain Function for Single-channel Speech Enhancement and Recognition
  470. DNN-based Emotion Recognition Based on Bottleneck Acoustic Features and Lexical Features
  471. DNN-based Speaker-adaptive Postfiltering with Limited Adaptation Data for Statistical Speech Synthesis Systems
  472. DOD-CNN: Doubly-injecting Object Information for Event Recognition
  473. DSNET: Accelerate Indoor Scene Semantic Segmentation
  474. DSSLIC: Deep Semantic Segmentation-based Layered Image Compression
  475. Data Augmentation Strategies for Neural Network F0 Estimation
  476. Data Augmentation for Low Resource Sentiment Analysis Using Generative Adversarial Networks
  477. Data Driven Vessel Trajectory Forecasting Using Stochastic Generative Models
  478. Data Efficient Voice Cloning for Neural Singing Synthesis
  479. Data Poisoning Attacks against MRMR
  480. Data-driven Design of Perfect Reconstruction Filterbank for DNN-based Sound Source Enhancement
  481. Data-driven Simulation Using the Nuclear Norm Heuristic
  482. Data-selective LMS-Newton and LMS-Quasi-Newton Algorithms
  483. Dead Time Compensation for High-flux Depth Imaging
  484. Decision Feedback Semi-blind Estimation Algorithm for Specular OFDM Channels
  485. Decoding Homomorphically Encrypted Flac Audio without Decryption
  486. Decoupling Category-wise Independence and Relevance with Self-attention for Multi-label Image Classification
  487. Deep CNN for Wideband Mmwave Massive Mimo Channel Estimation Using Frequency Correlation
  488. Deep Complex-valued Neural Beamformers
  489. Deep Convolutional Feature Histograms for Visual Object Tracking
  490. Deep Convolutional Robust PCA with Application to Ultrasound Imaging
  491. Deep Counting Model Extensions with Segmentation for Person Detection
  492. Deep Embeddings for Rare Audio Event Detection with Imbalanced Data
  493. Deep Graph Regularized Learning for Binary Classification
  494. Deep Griffin-Lim Iteration
  495. Deep Hidden Analysis: A Statistical Framework to Prune Feature Maps
  496. Deep Hybrid Networks Based Response Selection for Multi-turn Dialogue Systems
  497. Deep Joint Source-channel Coding for Wireless Image Transmission
  498. Deep Latent Factor Model for Predicting Drug Target Interactions
  499. Deep Learning Based Online Power Control for Large Energy Harvesting Networks
  500. Deep Learning Based Phase Reconstruction for Speaker Separation: A Trigonometric Perspective
  501. Deep Learning Based on Orthogonal Approximate Message Passing for CP-Free OFDM
  502. Deep Learning Features for Robust Detection of Acoustic Events in Sleep-disordered Breathing
  503. Deep Learning Propagation Models over Irregular Terrain
  504. Deep Learning for Classroom Activity Detection from Audio
  505. Deep Learning for Fast Adaptive Beamforming
  506. Deep Learning for Minimal-context Block Tracking through Side-channel Analysis
  507. Deep Learning for Super-resolution Vascular Ultrasound Imaging
  508. Deep Learning for Tube Amplifier Emulation
  509. Deep Learning for Vertex Reconstruction of Neutrino-nucleus Interaction Events with Combined Energy and Time Data
  510. Deep Learning the EEG Manifold for Phonological Categorization from Active Thoughts
  511. Deep Neural Networks for Appliance Transient Classification
  512. Deep Neural Networks for Low-resolution Photon-limited Imaging
  513. Deep Polyphonic ADSR Piano Note Transcription
  514. Deep Ptych: Subsampled Fourier Ptychography Using Generative Priors
  515. Deep Quantization for MIMO Channel Estimation
  516. Deep Recurrent Neural Networks with Layer-wise Multi-head Attentions for Punctuation Restoration
  517. Deep Reinforcement Learning for Financial Trading Using Price Trailing
  518. Deep Reinforcement Learning-based Rate Adaptation for Adaptive 360-Degree Video Streaming
  519. Deep Signal Recovery with One-bit Quantization
  520. Deep Speaker Embedding Learning with Multi-level Pooling for Text-independent Speaker Verification
  521. Deep Speaker Representation Using Orthogonal Decomposition and Recombination for Speaker Verification
  522. Deep Spline Networks with Control of Lipschitz Regularity
  523. Deep Synthesizer Parameter Estimation
  524. Deep Temporal Logistic Bag-of-features for Forecasting High Frequency Limit Order Book Time Series
  525. Deep Temporal Pyramid Design for Action Recognition
  526. Deep Variational Filter Learning Models for Speech Recognition
  527. Deepwalk-assisted Graph PCA (DGPCA) for Language Networks
  528. DenXFPN: Pulmonary Pathologies Detection Based on Dense Feature Pyramid Networks
  529. Denoising Convolutional Autoencoder Based B-mode Ultrasound Tongue Image Feature Extraction
  530. Denoising Gravitational Waves with Enhanced Deep Recurrent Denoising Auto-encoders
  531. Denoising of 3D Point Clouds Constructed from Light Fields
  532. Dense Multimodal Fusion for Hierarchically Joint Representation
  533. Densely Connected Network with Time-frequency Dilated Convolution for Speech Enhancement
  534. Deriving Spectro-temporal Properties of Hearing from Speech Data
  535. Design of Optimal Linear Differential Microphone Arrays Based Array Geometry Optimization
  536. Designing (In)finite-alphabet Sequences via Shaping the Radar Ambiguity Function
  537. Designing Sar Images Change-point Estimation Strategies Using an Mse Lower Bound
  538. Designing an Effective Metric Learning Pipeline for Speaker Diarization
  539. Detectability of Denial-of-service Attacks on Communication Systems
  540. Detecting Attention Shift from Neural Response Based on Beat-frequency-modulated Musical Excerpts
  541. Detecting Cyber Attacks Using Anomaly Detection with Explanations and Expert Feedback
  542. Detecting Gas Vapor Leaks through Uncalibrated Sensor Based CPS
  543. Detecting and Classifying Rail Corrugation Based on Axle Bearing Vibration
  544. Detection and Amplification of Molecular Signals Using Cooperating Nano-devices
  545. Detection and Estimation of Delays in Bivariate Self-similarity: Bootstrapped Complex Wavelet Coherence
  546. Detection of Grid Voltage Anomalies via Broadband Subspace Decompositon
  547. Detection of Non Random Phase Signal in Additive Noise with Surrogate Analysis
  548. Detection of Pilot-hopping Sequences for Grant-free Random Access in Massive Mimo Systems
  549. Detection of Real-world Fights in Surveillance Videos
  550. Detection of Row-sparse Matrices with Row-structure Constraints
  551. Detection of Sleep Apnea/hypopnea Events Using Synchrosqueezed Wavelet Transform
  552. Detection of Voice Transformation Spoofing Based on Dense Convolutional Network
  553. Development and Evaluation of Japanese Text-to-speech Middleware for 32-Bit Microcontrollers
  554. Dialogue State Tracking with Convolutional Semantic Taggers
  555. Differentiable Consistency Constraints for Improved Deep Speech Enhancement
  556. Differentially Private Compressive K-means
  557. Differentially Private Greedy Decision Forest
  558. Diffusion Learning in Non-convex Environments
  559. Digitally Annealed Solution for the Vertex Cover Problem with Application in Cyber Security
  560. Dilated Residual Network with Multi-head Self-attention for Speech Emotion Recognition
  561. Dimensional Analysis of Laughter in Female Conversational Speech
  562. Direct Estimation of Weights and Efficient Training of Deep Neural Networks without SGD
  563. Direct-to-reverberant Energy Ratio Estimation Based on Interaural Coherence and a Joint ITD/ILD Model
  564. Direction Preserving Wiener Matrix Filtering for Ambisonic Input-output Systems
  565. Directional Interference Suppression Using a Spatial Relative Transfer Function Feature
  566. Discovering Optimal Variable-length Time Series Motifs in Large-scale Wearable Recordings of Human Bio-behavioral Signals
  567. Discrete Constant Envelope Transceiver Design for Multiuser Massive MIMO Downlink
  568. Discriminate Natural versus Loudspeaker Emitted Speech
  569. Discriminative Feature Selection Guided Deep Canonical Correlation Analysis
  570. Discriminative Features Reconstruction Network for Semantic Segmentation
  571. Discriminative Saliency-pose-attention Covariance for Action Recognition
  572. Discriminative Video Representation with Temporal Order for Micro-expression Recognition
  573. Discriminatively Re-trained I-vector Extractor for Speaker Recognition
  574. Disentangling Correlated Speaker and Noise for Speech Synthesis via Data Augmentation and Adversarial Factorization
  575. Disjunct Matrices for Compressed Sensing
  576. Distance-dependent Modeling of Head-related Transfer Functions
  577. Distributed Bayesian Estimation with Low-rank Data: Application to Solar Array Processing
  578. Distributed Convex Optimization with Limited Communications
  579. Distributed Deep Learning Strategies for Automatic Speech Recognition
  580. Distributed Differentially-private Canonical Correlation Analysis
  581. Distributed Gradient Descent with Coded Partial Gradient Computations
  582. Distributed Inference over Networks under Subspace Constraints
  583. Distributed Joint Transmitter Design and Selection Using Augmented Admm
  584. Distributed Network Caching via Dynamic Programming
  585. Distributed Noncoherent Transmit Beamforming for Dense Small Cell Networks
  586. Distributed Power Allocation for Spectral Coexisting Multistatic Radar and Communication Systems Based on Stackelberg Game
  587. Distributed Quickest Detection of Significant Events in Networks
  588. Distributed Signal Recovery Based on In-network Subspace Projections
  589. Distributed Tracking of Maneuvering Target: A Finite-time Algorithm
  590. Distributed UAV Placement Optimization for Cooperative Line-of-sight MIMO Communications
  591. Distribution Preserving Network Embedding
  592. Divergence Based Weighting for Information Channels in Deep Convolutional Neural Networks for Bird Audio Detection
  593. Diving Deep onto Discriminative Ensemble of Histological Hashing & Class-Specific Manifold Learning for Multi-class Breast Carcinoma Taxonomy
  594. Dnn-based Spectral Enhancement for Neural Waveform Generators with Low-bit Quantization
  595. Domain Adaptation Using Riemannian Geometry of Spd Matrices
  596. Domain Adversarial Training for Improving Keyword Spotting Performance of ESL Speech
  597. Domain Attentive Fusion for End-to-end Dialect Identification with Unknown Target Domain
  598. Domain Mismatch Robust Acoustic Scene Classification Using Channel Information Conversion
  599. Drawing Order Recovery for Handwriting Chinese Characters
  600. Dual Domain Learning of Optimal Resource Allocations in Wireless Systems
  601. Dual-modality Seq2Seq Network for Audio-visual Event Localization
  602. Dual-stream CNN for Structured Time Series Classification
  603. Dynamic Joint PHY-MAC Waveform Design for IoT Connectivity
  604. Dynamic Joint Resource Allocation and User Assignment in Multi-access Edge Computing
  605. Dynamic Metasurfaces for Massive MIMO Networks
  606. Dynamic Point Cloud Geometry Compression via Patch-wise Polynomial Fitting
  607. Dynamic Resource Optimization for Decentralized Signal Estimation in Energy Harvesting Wireless Sensor Networks
  608. Dynamic Selection of Classifiers for Fusing Imbalanced Heterogeneous Data
  609. Dynamic Temporal Alignment of Speech to Lips
  610. Dynamic Texture Recognition Using 3D Random Features
  611. Dynamic Weight Alignment for Temporal Convolutional Neural Networks
  612. Dynamical Component Analysis (DYCA) and Its Application on Epileptic EEG
  613. Dynamically Context-sensitive Time-decay Attention for Dialogue Modeling
  614. E-CNN: Accurate Spherical Camera Rotation Estimation via Uniformization of Distorted Optical Flow Fields
  615. EDUQA: Educational Domain Question Answering System Using Conceptual Network Mapping
  616. EE-AE: An Exclusivity Enhanced Unsupervised Feature Learning Approach
  617. EMG Wrist-hand Motion Recognition System for Real-time Embedded Platform
  618. ENF Signal Extraction for Rolling-shutter Videos Using Periodic Zero-padding
  619. ENLLVM: Ensemble Based Nonlinear Bayesian Filtering Using Linear Latent Variable Models
  620. Early Wildfire Smoke Detection Based on Motion-based Geometric Image Transformation and Deep Convolutional Generative Adversarial Networks
  621. Eco-panda: A Computationally Economic, Geometrically Converging Dual Optimization Method on Time-varying Undirected Graphs
  622. Edge Detection Evaluation: A New Normalized Figure of Merit
  623. Effect of Data Reduction on Sequence-to-sequence Neural TTS
  624. Effective and Stable Neuron Model Optimization Based on Aggregated CMA-ES
  625. Effects of Lombard Reflex on the Performance of Deep-learning-based Audio-visual Speech Enhancement Systems
  626. Efficient Arabic Emotion Recognition Using Deep Neural Networks
  627. Efficient Belief Propagation Detection Based on Channel Hardening for Massive MIMO
  628. Efficient Constrained Signal Reconstruction by Randomized Epigraphical Projection
  629. Efficient Convolutional Neural Network Weight Compression for Space Data Classification on Multi-fpga Platforms
  630. Efficient Indoor Localization via Reinforcement Learning
  631. Efficient Keyword Spotting Using Dilated Convolutions and Gating
  632. Efficient Lossless Compression Scheme for Multi-channel ECG Signal
  633. Efficient Multi-agent Cooperative Navigation in Unknown Environments with Interlaced Deep Reinforcement Learning
  634. Efficient Nonlinear Acoustic Echo Cancellation by Dual-stage Multi-channel Kalman Filtering
  635. Efficient Randomized Defense against Adversarial Attacks in Deep Convolutional Neural Networks
  636. Efficient Sampling through Variable Splitting-inspired Bayesian Hierarchical Models
  637. Efficient Signal Reconstruction via Distributed Least Square Optimization on a Systolic FPGA Architecture
  638. Efficient Stochastic Subgradient Descent Algorithms for High-dimensional Semi-sparse Graphical Model Selection
  639. Ego-motion Estimation for Low-cost Freehand Ultrasound Scanner
  640. Embedding Physical Augmentation and Wavelet Scattering Transform to Generative Adversarial Networks for Audio Classification with Limited Training Resources
  641. Empirical Evaluation and Combination of Punctuation Prediction Models Applied to Broadcast News
  642. Empirical Wavelet Transform Based Lung Sound Removal from Phonocardiogram Signal for Heart Sound Segmentation
  643. Encrypted Speech Recognition Using Deep Polynomial Networks
  644. End-to-end Anchored Speech Recognition
  645. End-to-end Audio Visual Scene-aware Dialog Using Multimodal Attention-based Video Features
  646. End-to-end Binaural Sound Localisation from the Raw Waveform
  647. End-to-end Change Detection Using a Symmetric Fully Convolutional Network for Landslide Mapping
  648. End-to-end Code-switched TTS with Mix of Monolingual Recordings
  649. End-to-end Contextual Speech Recognition Using Class Language Models and a Token Passing Decoder
  650. End-to-end Dysarthric Speech Recognition Using Multiple Databases
  651. End-to-end Feedback Loss in Speech Chain Framework via Straight-through Estimator
  652. End-to-end Language Recognition Using Attention Based Hierarchical Gated Recurrent Unit Models
  653. End-to-end Lyrics Alignment for Polyphonic Music Using an Audio-to-character Recognition Model
  654. End-to-end Monaural Multi-speaker ASR System without Pretraining
  655. End-to-end Sound Source Separation Conditioned on Instrument Labels
  656. End-to-end Speech Recognition Using a High Rank LSTM-CTC Based Model
  657. End-to-end Speech Recognition with Adaptive Computation Steps
  658. End-to-end Streaming Keyword Spotting
  659. Energy Blowup of Sampling-based Approximation Methods
  660. Energy Minimization of Multi-user Latency-constrained Binary Computation Offloading
  661. Energy-efficient Design for Underlay Cognitive Radio Using Improper Signaling
  662. English Broadcast News Speech Recognition by Humans and Machines
  663. Enhanced Hierarchical Music Structure Annotations via Feature Level Similarity Fusion
  664. Enhanced Recurrent Neural Network for Combining Static and Dynamic Features for Credit Card Default Prediction
  665. Enhanced Streaming Based Subspace Clustering Applied to Acoustic Scene Data Clustering
  666. Enhanced Virtual Singers Generation by Incorporating Singing Dynamics to Personalized Text-to-speech-to-singing
  667. Enhancing Acoustic Sensory Responsiveness by Exploiting Bio-inspired Feedback Computation
  668. Enhancing Beamformed Fingerprint Outdoor Positioning with Hierarchical Convolutional Neural Networks
  669. Enhancing HEVC Spatial Prediction by Context-based Learning
  670. Enhancing Hybrid Self-attention Structure with Relative-position-aware Bias for Speech Synthesis
  671. Enhancing Music Features by Knowledge Transfer from User-item Log Data
  672. Enhancing Sound Texture in CNN-based Acoustic Scene Classification
  673. Ensemble Additive Margin Softmax for Speaker Verification
  674. Entropy-regularized Optimal Transport Generative Models
  675. Epoch Extraction from Speech Signals Using Temporal and Spectral Cues by Exploiting Harmonic Structure of Impulse-like Excitations
  676. Equation-Error Model Based Active Noise Cancellation Systems
  677. Error Bounds for Spectral Clustering over Samples from Spherical Gaussian Mixture Models
  678. Estimating Viewed Image Categories from Human Brain Activity via Semi-supervised Fuzzy Discriminative Canonical Correlation Analysis
  679. Estimating the Number of Correlated Components Based on Random Projections
  680. Estimation of Gaze Region Using Two Dimensional Probabilistic Maps Constructed Using Convolutional Neural Networks
  681. Estimation of Guitar String, Fret and Plucking Position Using Parametric Pitch Estimation
  682. Estimation of Network Processes via Blind Graph Multi-filter Identification
  683. Estimation of Sampling Frequency Mismatch between Distributed Asynchronous Microphones under Existence of Source Movements with Stationary Time Periods Detection
  684. Estimation of Widely Factorizable Hypercomplex Signals with Uncertain Observations
  685. Evaluating Salience Representations for Cross-modal Retrieval of Western Classical Music Recordings
  686. Evaluation Measures for Depression Prediction and Affective Computing
  687. Evaluation of Non-intrusive Load Monitoring Algorithms for Appliance-level Anomaly Detection
  688. Evaluation of Source-wise Missing Data Techniques for the Prediction of Parkinson's Disease Using Smartphones
  689. Event-driven Pipeline for Low-latency Low-compute Keyword Spotting and Speaker Verification System
  690. Every Rating Matters: Joint Learning of Subjective Labels and Individual Annotators for Speech Emotion Classification
  691. Evolutionary Subspace Clustering: Discovering Structure in Self-expressive Time-series Data
  692. Exact Discrete-time Realizations of the Gammatone Filter
  693. Exact Distribution and High-dimensional Asymptotics for Improperness Test of Complex Signals
  694. Exact Recovery by Semidefinite Programming in the Binary Stochastic Block Model with Partially Revealed Side Information
  695. Exact Sparse Signal Recovery via Orthogonal Matching Pursuit with Prior Information
  696. Exactly Decoding a Vector through Relu Activation
  697. Excess Cyclic Prefix Window Optimization for High Doppler MIMO OFDM Capacity
  698. Expectation-propagation Algorithms for Linear Regression with Poisson Noise: Application to Photon-limited Spectral Unmixing
  699. Exploiting Acoustic and Lexical Properties of Phonemes to Recognize Valence from Speech
  700. Exploiting Uncertainty of Deep Neural Networks for Improving Segmentation Accuracy in MRI Images
  701. Exploring Attention Mechanism for Acoustic-based Classification of Speech Utterances into System-directed and Non-system-directed
  702. Exploring Complex Time-series Representations for Riemannian Machine Learning of Radar Data
  703. Exploring Deep Complex Networks for Complex Spectrogram Enhancement
  704. Exploring Retraining-free Speech Recognition for Intra-sentential Code-switching
  705. Exponential Collapse of Social Beliefs over Weakly-connected Heterogeneous Networks
  706. Exposing Deep Fakes Using Inconsistent Head Poses
  707. Expression-identity Fusion Network for Facial Expression Recognition
  708. Extraction of Independent Vector Component from Underdetermined Mixtures through Block-wise Determined Modeling
  709. F0 Contour Estimation Using Phonetic Feature in Electrolaryngeal Speech Enhancement
  710. FRI Modelling of Fourier Descriptors
  711. FRI Sensing: Sampling Images along Unknown Curves
  712. Face Landmark-based Speaker-independent Audio-visual Speech Enhancement in Multi-talker Environments
  713. Facial Micro-expression Spotting and Recognition Using Time Contrasted Feature with Visual Memory
  714. Factors Affecting Enf Based Time-of-recording Estimation for Video
  715. Fast Coding Unit Decision for Intra Screen Content Coding Based on Ensemble Learning
  716. Fast Compressive Sensing Recovery Using Generative Models with Structured Latent Variables
  717. Fast Edge Preserving 2D Smoothing Filter Using Indicator Function
  718. Fast First-order Methods for the Massive Robust Multicast Beamforming Problem with Interference Temperature Constraints
  719. Fast Implementation of Double-coupled Nonnegative Canonical Polyadic Decomposition
  720. Fast Inter-prediction Based on Decision Trees for AV1 Encoding
  721. Fast MVAE: Joint Separation and Classification of Mixed Sources Based on Multichannel Variational Autoencoder with Auxiliary Classifier
  722. Fast Optimization of Boolean Quadratic Functions via Iterative Submodular Approximation and Max-flow
  723. Fast Sampling of Graph Signals with Noise via Neumann Series Conversion
  724. Fast and Communication-efficient Distributed Pca
  725. Fast and Efficient Distributed Matrix-vector Multiplication Using Rateless Fountain Codes
  726. Fast and Global Optimal Nonconvex Matrix Factorization via Perturbed Alternating Proximal Point
  727. FastMNMF: Joint Diagonalization Based Accelerated Algorithms for Multichannel Nonnegative Matrix Factorization
  728. Feature Selection for Mutlti-labeled Variables via Dependency Maximization
  729. Federated Learning for Keyword Spotting
  730. Feedback-controlled Channel Estimation with Low-resolution Adcs in Multiuser Mimo Systems
  731. Feedforward Spatial Active Noise Control Based on Kernel Interpolation of Sound Field
  732. Fine-tuning Approach to NIR Face Recognition
  733. Fire Detection from Images Using Faster R-CNN and Multidimensional Texture Analysis
  734. Fire Detection in H.264 Compressed Video
  735. FirmNet: A Sparsity Amplified Deep Network for Solving Linear Inverse Problems
  736. Flexible Design of Finite Blocklength Wiretap Codes by Autoencoders
  737. Flexible Non-negative Matrix Factorization with Adaptively Learned Graph Regularization
  738. Flexible Spectral Precoding for Sidelobe Suppression in OFDM Systems
  739. Forked Recurrent Neural Network for Hand Gesture Classification Using Inertial Measurement Data
  740. Formant-gaps Features for Speaker Verification Using Whispered Speech
  741. Frequency Domain Multi-channel Acoustic Modeling for Distant Speech Recognition
  742. Frequency Separation Method Based on Sparse Coding
  743. Frequency-domain Adaptive Filtering: from Real to Hypercomplex Signal Processing
  744. Frequency-domain Based Waveform Design for Binary Extended-target Classification
  745. Frequency-domain Decoupling for MIMO-GFDM Spatial Multiplexing
  746. Frequency-selective Hybrid Precoding and Combining for Mmwave Mimo Systems with Per-antenna Power Constraints
  747. From Gene Expression to Drug Response: A Collaborative Filtering Approach
  748. From Local to Global Subspace Clustering for Image Data
  749. From TV-L1 to Gated Recurrent Nets
  750. Fully Data-driven Convolutional Filters with Deep Learning Models for Epileptic Spike Detection
  751. Fully Supervised Speaker Diarization
  752. Function Designable Beamformer Based on Probabilistic Assumptions on Filter and Its Auxiliary Variables
  753. Fundamental Frequency Contour Classification: A Comparison between Hand-crafted and CNN-based Features
  754. Furcax: End-to-end Monaural Speech Separation Based on Deep Gated (De)convolutional Neural Networks with Adversarial Example Training
  755. FuseLoc: A CCA Based Information Fusion for Indoor Localization Using CSI Phase and Amplitude of Wifi Signals
  756. Fusing Eigenvalues
  757. Fuzzy Personalized Scoring Model for Recommendation System
  758. GPU-based Implementation of Belief Propagation Decoding for Polar Codes
  759. Gaussian Process Lstm Recurrent Neural Network Language Models for Speech Recognition
  760. Gaussian-constrained Training for Speaker Verification
  761. Generalisation in Environmental Sound Classification: The 'Making Sense of Sounds' Data Set and Challenge
  762. Generalized Boundary Detection Using Compression-based Analytics
  763. Generalized Dantzig Selector for Low-tubal-rank Tensor Recovery
  764. Generalized Distributed Dual Coordinate Ascent in a Tree Network for Machine Learning
  765. Generalized Interval Valued Nonnegative Matrix Factorization
  766. Generalized and Differential Likelihood Ratio Tests with Quantum Signal Processing
  767. Generating Pseudo-relevant Representations for Spoken Document Retrieval
  768. Generative Adversarial Networks Based Error Concealment for Low Resolution Video
  769. Generative Adversarial Speaker Embedding Networks for Domain Robust End-to-end Speaker Verification
  770. Generative Graph Convolutional Network for Growing Graphs
  771. Generative Moment Matching Network-based Random Modulation Post-filter for DNN-based Singing Voice Synthesis and Neural Double-tracking
  772. Geometric Invariants for Sparse Unknown View Tomography
  773. Geometry of Deep Learning for Magnetic Resonance Fingerprinting
  774. Global Energy Efficiency Maximization in Non-orthogonal Interference Networks
  775. Global and Local Mode-domain Adaptive Algorithms for Spatial Active Noise Control Using Higher-order Sources
  776. Globally Convergent Accelerated Proximal Alternating Maximization Method for L1-Principal Component Analysis
  777. Glottal Instants Extraction from Speech Signal Using Generative Adversarial Network
  778. Glottographic and Aerodynamic Analysis on Consonant Aspiration and Onset F0 in Mandarin Chinese
  779. Gradient Image Super-resolution for Low-resolution Image Recognition
  780. Gradient-based Active Learning Query Strategy for End-to-end Speech Recognition
  781. Graph Filtering with Multiple Shift Matrices
  782. Graph Regularized Nonnegative Tucker Decomposition for Tensor Data Representation
  783. Graph Signal Representation with Wasserstein Barycenters
  784. Graph Signal Sampling via Reinforcement Learning
  785. Graph Spectral Clustering of Convolution Artefacts in Radio Interferometric Images
  786. Graph Spectral Domain Blind Watermarking
  787. Graph-based RGB-D Image Segmentation Using Color-directional-region Merging
  788. Graphic Delay Equalizer
  789. Graphical Lasso for High-dimensional Complex Gaussian Graphical Model Selection
  790. Grayscale-thermal Tracking via Canonical Correlation Analysis Based Inverse Sparse Representation
  791. Gridless Angle and Range Estimation for FDA-MIMO Radar Based on Decoupled Atomic Norm Minimization
  792. Gridless DOA Estimation via. Alternating Projections
  793. Gridless Super-resolution Doa Estimation with Unknown Mutual Coupling
  794. Group Action Equivariance and Generalized Convolution in Multi-layer Neural Networks
  795. Group Sparsity Based Target Localization for Distributed Sensor Array Networks
  796. Guided-spatio-temporal Filtering for Extracting Sound from Optically Measured Images Containing Occluding Objects
  797. HCU400: an Annotated Dataset for Exploring Aural Phenomenology through Causal Uncertainty
  798. HMM-based Approaches to Model Multichannel Information in Sign Language Inspired from Articulatory Features-based Speech Processing
  799. Hadamard Product Perspective on Source Resolvability of Spatial-smoothing-based Subspace Methods
  800. Hand Graph Representations for Unsupervised Segmentation of Complex Activities
  801. Hardware-friendly LDPC Decoding Scheduling for 5G HARQ Applications
  802. Hardware-oriented Memory-limited Online Fastica Algorithm and Hardware Architecture for Signal Separation
  803. Harmonic-band Complex Wavelet Transform Audio Analysis and Synthesis
  804. Head Related Impulse Response Interpolation and Extrapolation Using Deep Belief Networks
  805. Hearing Aid-controlled Beamformer for Binaural Speech Enhancement Using a Model-based Approach
  806. Heart Rate Estimation from Phonocardiogram Signals Using Non-negative Matrix Factorization
  807. Heterogeneous Information Fusion for Multitarget Tracking Using the Sum-product Algorithm
  808. Hierarchical Residual-pyramidal Model for Large Context Based Media Presence Detection
  809. Hierarchical Two-level Modelling of Emotional States in Spoken Dialog Systems
  810. Hierarchy-aware Loss Function on a Tree Structured Label Space for Audio Event Detection
  811. High Accuracy Image Rotation and Scale Estimation Using Radon Transform and Sub-pixel Shift Estimation
  812. High-quality Speech Coding with Sample RNN
  813. Higher-order Nonnegative CANDECOMP/PARAFAC Tensor Decomposition Using Proximal Algorithm
  814. Homography Estimation Based on Error Elliptical Distribution
  815. Horizontal 3D Sound Field Recording and 2.5D Synthesis with Omni-directional Circular Arrays
  816. Hotword Cleaner: Dual-microphone Adaptive Noise Cancellation with Deferred Filter Coefficients for Robust Keyword Spotting
  817. How Transferable Are Features in Convolutional Neural Network Acoustic Models across Languages?
  818. How Video Object Tracking Is Affected by In-capture Distortions?
  819. How to Globally Solve Non-convex Optimization Problems Involving an Approximate ℓ0 Penalization
  820. How to Improve Your Speaker Embeddings Extractor in Generic Toolkits
  821. Human Behaviour Recognition Using Wifi Channel State Information
  822. Human Perception Oriented Image Enhancement
  823. Hybrid Beamforming with Sub-arrayed MIMO Radar: Enabling Joint Sensing and Communication at mmWave Band
  824. Hybrid Beamforming: Where Should the Analog Power Amplifiers Be Placed?
  825. Hybrid Deep Neural Network Model for Remaining Useful Life Estimation
  826. Hybrid Sparse Array Design for Under-determined Models
  827. Hyper-parameter Learning for Sparse Structured Probabilistic Models
  828. Hypercomplex Low Rank Matrix Completion with Non-negative Constraints via Convex Optimization
  829. Hyperspectral Image Super-resolution Using Generative Adversarial Network and Residual Learning
  830. Hyperspectral and Multispectral Data Fusion by a Regularization Considering
  831. ILP-based Compressive Speech Summarization with Content Word Coverage Maximization and Its Oracle Performance Analysis
  832. Identifying Structural Brain Networks from Functional Connectivity: A Network Deconvolution Approach
  833. Image Captioning with Two Cascaded Agents
  834. Image Compression Using GMM Model Optimization
  835. Image Correction in Emission Tomography Using Deep Convolution Neural Network
  836. Image Demosaicking via Chrominance Images with Parallel Convolutional Neural Networks
  837. Image Reconstruction by Orthogonal Moments Derived by the Parity of Polynomials
  838. Image Reflection Removal Using the Wasserstein Generative Adversarial Network
  839. Image Restoration Using Total Variation Regularized Deep Image Prior
  840. Image Super-resolution via Deep Aggregation Network
  841. Imitation Refinement for X-ray Diffraction Signal Processing
  842. Immersive Audio Coding for Virtual Reality Using a Metadata-assisted Extension of the 3GPP EVS Codec
  843. Imperceptible Audio Communication
  844. Implementing Prosodic Phrasing in Chinese End-to-end Speech Synthesis
  845. Implicit Fusion by Joint Audiovisual Training for Emotion Recognition in Mono Modality
  846. Importance of Analytic Phase of the Speech Signal for Detecting Replay Attacks in Automatic Speaker Verification Systems
  847. Improper Gaussian Signaling for the Two-user Broadcast Channel Treating Interference as Noise
  848. Improve Diverse Text Generation by Self Labeling Conditional Variational Auto Encoder
  849. Improved Estimation of the Distance between Covariance Matrices
  850. Improved Gesture Recognition Based on sEMG Signals and TCN
  851. Improved Hyperspectral Unmixing with Endmember Variability Parametrized Using an Interpolated Scaling Tensor
  852. Improved Latency-communication Trade-off for Map-shuffle-reduce Systems with Stragglers
  853. Improved Measurement Noise Covariance Estimation for N-channel Feedback Cancellation Based on the Frequency Domain Adaptive Kalman Filter
  854. Improved Metrical Alignment of Midi Performance Based on a Repetition-aware Online-adapted Grammar
  855. Improved Multipath Time Delay Estimation Using Cepstrum Subtraction
  856. Improvements to N-gram Language Model Using Text Generated from Neural Language Model
  857. Improvements to the Matching Projection Decoding Method for Ambisonic System with Irregular Loudspeaker Layouts
  858. Improving ASR Robustness to Perturbed Speech Using Cycle-consistent Generative Adversarial Networks
  859. Improving Audio-visual Speech Recognition Performance with Cross-modal Student-teacher Training
  860. Improving Binaural Ambisonics Decoding by Spherical Harmonics Domain Tapering and Coloration Compensation
  861. Improving CTC Using Stimulated Learning for Sequence Modeling
  862. Improving Children Speech Recognition through Feature Learning from Raw Speech Signal
  863. Improving Content-based Audio Retrieval by Vocal Imitation Feedback
  864. Improving Deep Models of Speech Quality Prediction through Voice Activity Detection and Entropy-based Measures
  865. Improving Emotion Classification through Variational Inference of Latent Variables
  866. Improving End-to-end Speech Recognition with Pronunciation-assisted Sub-word Modeling
  867. Improving Eye Movement Biometrics Using Remote Registration of Eye Blinking Patterns
  868. Improving Facial Attractiveness Prediction via Co-attention Learning
  869. Improving Graph Trend Filtering with Non-convex Penalties
  870. Improving Human-computer Interaction in Low-resource Settings with Text-to-phonetic Data Augmentation
  871. Improving Layer Trajectory LSTM with Future Context Frames
  872. Improving Noise Robustness of Automatic Speech Recognition via Parallel Data and Teacher-student Learning
  873. Improving Object Detection with Relation Graph Inference
  874. Improving Sequence-to-sequence Voice Conversion by Adding Text-supervision
  875. Improving Speech Emotion Recognition with Unsupervised Representation Learning on Unlabeled Speech
  876. Improving Speech Recognition Error Prediction for Modern and Off-the-shelf Speech Recognizers
  877. Improving the Prediction of Therapist Behaviors in Addiction Counseling by Exploiting Class Confusions
  878. Improving the Rate-distortion Model of HEVC Intra by Integrating the Maximum Absolute Error
  879. In Search of the Optimal Walsh-hadamard Transform for Streamed Parallel Processing
  880. In-Car Driver Authentication Using Wireless Sensing
  881. Inaudible Speech Watermarking Based on Self-compensated Echo-hiding and Sparse Subspace Clustering
  882. Incorporate User Representation for Personal Question Answer Selection Using Siamese Network
  883. Increase Apparent Public Speaking Fluency by Speech Augmentation
  884. Incremental Binarization on Recurrent Neural Networks for Single-channel Source Separation
  885. Incremental Transfer Learning in Two-pass Information Bottleneck Based Speaker Diarization System for Meetings
  886. Indoor Time Reversal Wireless Communication: Experimental Results for Localization and Signal Coverage
  887. Inductive Conformal Predictor for Sparse Coding Classifiers: Applications to Image Classification
  888. Inference about Causality from Cardiotocography Signals Using Gaussian Processes
  889. Inferring Private Information in Wireless Sensor Networks
  890. Information Constrained Control for Visual Detection of Important Areas
  891. Information Theoretic Lower Bound of Restricted Isometry Property Constant
  892. Information-bottleneck Based on the Jensen-shannon Divergence with Applications to Pairwise Clustering
  893. Informed Ego-noise Suppression Using Motor Data-driven Dictionaries
  894. Inpainting in Omnidirectional Images for Privacy Protection
  895. Integrating Spectrotemporal Context into Features Based on Auditory Perception for Classification-based Speech Separation
  896. Intelligent Environments Based on Ultra-massive Mimo Platforms for Wireless Communication in Millimeter Wave and Terahertz Bands
  897. Inter- and Intra- Patient ECG Heartbeat Classification for Arrhythmia Detection: A Sequence to Sequence Deep Learning Approach
  898. Interactive Deep Colorization Using Simultaneous Global and Local Inputs
  899. Interactive Learning of Teacher-student Model for Short Utterance Spoken Language Identification
  900. Interactive Subjective Study on Picture-level Just Noticeable Difference of Compressed Stereoscopic Images
  901. Interference Exploitation Precoding for Multi-level Modulations
  902. Interpolation and Denoising of Graph Signals Using Plug-and-play Admm
  903. Intonation: A Dataset of Quality Vocal Performances Refined by Spectral Clustering on Pitch Congruence
  904. Intrasystem Entanglement Generator and Unambiguos Bell States Discriminator on Chip
  905. Introducing Machine Learning in Undergraduate DSP Classes
  906. Introducing Undergraduates to Pattern Recognition and Machine Learning through Speech Processing
  907. Introducing the Orthogonal Periodic Sequences for the Identification of Functional Link Polynomial Filters
  908. Investigating Context Features Hidden in End-to-end TTS
  909. Investigating Domain Sensitivity of DNN Embeddings for Speaker Recognition Systems
  910. Investigating End-to-end Speech Recognition for Mandarin-english Code-switching
  911. Investigating the Effects of Word Substitution Errors on Sentence Embeddings
  912. Investigation into Joint Optimization of Single Channel Speech Enhancement and Acoustic Modeling for Robust ASR
  913. Investigation of Enhanced Tacotron Text-to-speech Synthesis Systems with Self-attention for Pitch Accent Language
  914. Investigation of Modeling Units for Mandarin Speech Recognition Using Dfsmn-ctc-smbr
  915. Investigation of Sampling Techniques for Maximum Entropy Language Modeling Training
  916. Investigation of Sequence-level Knowledge Distillation Methods for CTC Acoustic Models
  917. Investigation on Neural Bandwidth Extension of Telephone Speech for Improved Speaker Recognition
  918. Investigations of Real-time Gaussian Fftnet and Parallel Wavenet Neural Vocoders with Simple Acoustic Features
  919. Ising Model Formulation of Outlier Rejection, with Application in WiFi Based Positioning
  920. Ising-dropout: A Regularization Method for Training and Compression of Deep Neural Networks
  921. Iterative Approximation of Analytic Eigenvalues of a Parahermitian Matrix EVD
  922. Iterative Hessian Sketch with Momentum
  923. Iterative Mirror Decomposition for Signal Representation
  924. Iteratively Reweighted Linear Least Squares for Frequency Estimation in Unbalanced Three-phase Power System
  925. Iteratively Reweighted Penalty Alternating Minimization Methods with Continuation for Image Deblurring
  926. JSR-Net: A Deep Network for Joint Spatial-radon Domain CT Reconstruction from Incomplete Data
  927. Joint Acoustic and Class Inference for Weakly Supervised Sound Event Detection
  928. Joint Codebook Design for Multi-cell Noma
  929. Joint Design for MIMO Radar and Downlink Communication Systems Coexistence
  930. Joint Endpointing and Decoding with End-to-end Models
  931. Joint Estimation of RETF Vector and Power Spectral Densities for Speech Enhancement Based on Alternating Least Squares
  932. Joint On-line Learning of a Zero-shot Spoken Semantic Parser and a Reinforcement Learning Dialogue Manager
  933. Joint Optimization of Neural Network-based WPE Dereverberation and Acoustic Model for Robust Online ASR
  934. Joint Optimization of Quantization and Structured Sparsity for Compressed Deep Neural Networks
  935. Joint Separation and Dereverberation of Reverberant Mixtures with Multichannel Variational Autoencoder
  936. Joint Structured Graph Learning and Clustering Based on Concept Factorization
  937. Joint Structured Graph Learning and Unsupervised Feature Selection
  938. Joint Training of Complex Ratio Mask Based Beamformer and Acoustic Model for Noise Robust Asr
  939. Joint Transaction Transmission and Channel Selection in Cognitive Radio Based Blockchain Networks: A Deep Reinforcement Learning Approach
  940. Joint Transcription of Lead, Bass, and Rhythm Guitars Based on a Factorial Hidden Semi-Markov Model
  941. Jointly Predicting Future Sequence and Steering Angles for Dynamic Driving Scenes
  942. Jointly Sparse Convolutional Neural Networks in Dual Spatial-winograd Domains
  943. Just Noticeable Difference Model for Asymmetrically Distorted Stereoscopic Images
  944. K-edge Coded Apertures for Compressive Spectral X-ray Tomography
  945. Kernel Random Matrices of Large Concentrated Data: the Example of GAN-Generated Images
  946. Kernel Regression for Graph Signal Prediction in Presence of Sparse Noise
  947. Knowledge Distillation Using Output Errors for Self-attention End-to-end Models
  948. Knowledge Distillation for Recurrent Neural Network Language Modeling with Trust Regularization
  949. Knowledge Distillation for Small Foot-print Deep Speaker Embedding
  950. Kullback-Leibler Divergence Frequency Warping Scale for Acoustic Scene Classification Using Convolutional Neural Network
  951. L2 Learners' Emotion Production in Video Dubbing Practices
  952. LMS to Deep Learning: How DSP Analysis Adds Depth to Learning
  953. LMS: Past, Present and Future
  954. LPCNET: Improving Neural Speech Synthesis through Linear Prediction
  955. Labelled Non-zero Particle Flow for SMC-PHD Filtering
  956. LadderNet: Knowledge Transfer Based Viewpoint Prediction in 360◦ Video
  957. Langevin-based Strategy for Efficient Proposal Adaptation in Population Monte Carlo
  958. Language Model Integration Based on Memory Control for Sequence to Sequence Speech Recognition
  959. Language Person Search with Mutually Connected Classification Loss
  960. Language-invariant Bottleneck Features from Adversarial End-to-end Acoustic Models for Low Resource Speech Recognition
  961. Lapped Transforms: A Graph-based Extension
  962. Large Context End-to-end Automatic Speech Recognition via Extension of Hierarchical Recurrent Encoder-decoder Models
  963. Large-pose Face Alignment via Shape-aware Heatmap
  964. Latency Driven Fronthaul Bandwidth Allocation and Cooperative Beamforming for Cache-enabled Cloud-based Small Cell Networks
  965. Latent Heterogeneous Multilayer Community Detection
  966. Latent Representation Learning for Artificial Bandwidth Extension Using a Conditional Variational Auto-encoder
  967. Latent Schatten TT Norm for Tensor Completion
  968. Layer-wise Deep Neural Network Pruning via Iteratively Reweighted Optimization
  969. Layout-aware Subfigure Decomposition for Complex Figures in the Biomedical Literature
  970. Learned in Speech Recognition: Contextual Acoustic Word Embeddings
  971. Learning Affective Correspondence between Music and Image
  972. Learning Bandwidth Expansion Using Perceptually-motivated Loss
  973. Learning Comment Generation by Leveraging User-generated Data
  974. Learning Compact Partial Differential Equations for Color Images with Efficiency
  975. Learning Convolutional Neural Networks with Deep Part Embeddings
  976. Learning Discriminative Features from Spectrograms Using Center Loss for Speech Emotion Recognition
  977. Learning Discriminative Features in Sequence Training without Requiring Framewise Labelled Data
  978. Learning Discriminative Finger-knuckle-print Descriptor
  979. Learning Disentangled Representation in Latent Stochastic Models: A Case Study with Image Captioning
  980. Learning Dynamic Stream Weights for Linear Dynamical Systems Using Natural Evolution Strategies
  981. Learning Efficient Sparse Structures in Speech Recognition
  982. Learning Efficient Tensor Representations with Ring-structured Networks
  983. Learning Laplacian Matrix from Bandlimited Graph Signals
  984. Learning Latent Representations for Style Control and Transfer in End-to-end Speech Synthesis
  985. Learning Low Rank and Sparse Models via Robust Autoencoders
  986. Learning Motion Disfluencies for Automatic Sign Language Segmentation
  987. Learning Pose-aware 3D Reconstruction via 2D-3D Self-consistency
  988. Learning Requirements for Stealth Attacks
  989. Learning Search Path for Region-level Image Matching
  990. Learning Semantic-preserving Space Using User Profile and Multimodal Media Content from Political Social Network
  991. Learning Shallow Neural Networks via Provable Gradient Descent with Random Initialization
  992. Learning Shared Vector Representations of Lyrics and Chords in Music
  993. Learning Sheaf Laplacians from Smooth Signals
  994. Learning Similarity-specific Dictionary for Zero-shot Fine-grained Recognition
  995. Learning Sound Event Classifiers from Web Audio with Noisy Labels
  996. Learning Spatially-correlated Temporal Dictionaries for Calcium Imaging
  997. Learning Stochastic Representations of Geophysical Dynamics
  998. Learning Temporal Information from Spatial Information Using CapsNets for Human Action Recognition
  999. Learning Voice Source Related Information for Depression Detection
  1000. Learning by Inertia: Self-supervised Monocular Visual Odometry for Road Vehicles

Looking for submission deadlines instead? See the conference deadline calendar.