← All conferences

ICML 2018 Accepted Papers

The full list of 620 papers accepted at ICML 2018 (International Conference on Machine Learning). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Oral: 618
  1. Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic ActorOral11,352 citations
  2. Addressing Function Approximation Error in Actor-Critic MethodsOral7,345 citations
  3. Obfuscated Gradients Give a False Sense of Security: Circumventing Defenses to Adversarial ExamplesOral3,860 citations
  4. CyCADA: Cycle-Consistent Adversarial Domain AdaptationOral3,795 citations
  5. Efficient Neural Architecture Search via Parameters SharingOral3,645 citations
  6. QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement LearningOral3,090 citations
  7. Deep One-Class ClassificationOral2,927 citations
  8. Representation Learning on Graphs with Jumping Knowledge NetworksOral2,591 citations
  9. Attention-based Deep Multiple Instance LearningOral2,439 citations
  10. Interpretability Beyond Feature Attribution: Quantitative Testing with Concept Activation Vectors (TCAV)Oral2,433 citations
  11. Image TransformerOral2,292 citations
  12. Noise2Noise: Learning Image Restoration without Clean DataOral2,251 citations
  13. Synthesizing Robust Adversarial ExamplesOral2,125 citations
  14. Byzantine-Robust Distributed Learning: Towards Optimal Statistical RatesOral1,979 citations
  15. MentorNet: Learning Data-Driven Curriculum for Very Deep Neural Networks on Corrupted LabelsOral1,917 citations
  16. Disentangling by FactorisingOral1,869 citations
  17. IMPALA: Scalable Distributed Deep-RL with Importance Weighted Actor-Learner ArchitecturesOral1,853 citations
  18. Junction Tree Variational Autoencoder for Molecular Graph GenerationOral1,850 citations
  19. Learning to Reweight Examples for Robust Deep LearningOral1,831 citations
  20. Provable Defenses against Adversarial Examples via the Convex Outer Adversarial PolytopeOral1,817 citations
  21. Which Training Methods for GANs do actually Converge?Oral1,800 citations
  22. Learning Representations and Generative Models for 3D Point CloudsOral1,771 citations
  23. Mutual Information Neural EstimationOral1,758 citations
  24. GradNorm: Gradient Normalization for Adaptive Loss Balancing in Deep Multitask NetworksOral1,623 citations
  25. GAIN: Missing Data Imputation using Generative Adversarial NetsOral1,573 citations
  26. Black-box Adversarial Attacks with Limited Queries and InformationOral1,523 citations
  27. BOHB: Robust and Efficient Hyperparameter Optimization at ScaleOral1,488 citations
  28. A Reductions Approach to Fair ClassificationOral1,454 citations
  29. Overcoming Catastrophic Forgetting with Hard Attention to the TaskOral1,374 citations
  30. Born Again Neural NetworksOral1,313 citations
  31. signSGD: Compressed Optimisation for Non-Convex ProblemsOral1,258 citations
  32. GraphRNN: Generating Realistic Graphs with Deep Auto-regressive ModelsOral1,213 citations
  33. RLlib: Abstractions for Distributed Reinforcement LearningOral1,200 citations
  34. Adafactor: Adaptive Learning Rates with Sublinear Memory CostOral1,122 citations
  35. Neural Relational Inference for Interacting SystemsOral1,115 citations
  36. Efficient Neural Audio SynthesisOral1,097 citations
  37. Progress & Compress: A scalable framework for continual learningOral1,080 citations
  38. Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech SynthesisOral1,059 citations
  39. Parallel WaveNet: Fast High-Fidelity Speech SynthesisOral1,053 citations
  40. Preventing Fairness Gerrymandering: Auditing and Learning for Subgroup FairnessOral1,028 citations
  41. PDE-Net: Learning PDEs from DataOral983 citations
  42. Adversarial Attack on Graph Structured DataOral981 citations
  43. Bilevel Programming for Hyperparameter Optimization and Meta-LearningOral932 citations
  44. Understanding and Simplifying One-Shot Architecture SearchOral932 citations
  45. Generalization without Systematicity: On the Compositional Skills of Sequence-to-Sequence Recurrent NetworksOral930 citations
  46. Conditional Neural ProcessesOral906 citations
  47. Mean Field Multi-Agent Reinforcement LearningOral902 citations
  48. Towards Fast Computation of Certified Robustness for ReLU NetworksOral866 citations
  49. Learning Adversarially Fair and Transferable RepresentationsOral851 citations
  50. Accurate Uncertainties for Deep Learning Using Calibrated RegressionOral813 citations
  51. Learning to Explain: An Information-Theoretic Perspective on Model InterpretationOral808 citations
  52. Graph Networks as Learnable Physics Engines for Inference and ControlOral794 citations
  53. The Hidden Vulnerability of Distributed Learning in ByzantiumOral788 citations
  54. Fully Decentralized Multi-Agent Reinforcement Learning with Networked AgentsOral786 citations
  55. Global Convergence of Policy Gradient Methods for the Linear Quadratic RegulatorOral765 citations
  56. Fairness Without Demographics in Repeated Loss MinimizationOral757 citations
  57. Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with TacotronOral749 citations
  58. Stronger Generalization Bounds for Deep Nets via a Compression ApproachOral748 citations
  59. Machine Theory of MindOral732 citations
  60. Implicit Quantile Networks for Distributional Reinforcement LearningOral713 citations
  61. Adversarial Risk and the Dangers of Evaluating Against Weak AttacksOral706 citations
  62. PredRNN++: Towards A Resolution of the Deep-in-Time Dilemma in Spatiotemporal Predictive LearningOral706 citations
  63. Stochastic Training of Graph Convolutional Networks with Variance ReductionOral685 citations
  64. Detecting and Correcting for Label Shift with Black Box PredictorsOral684 citations
  65. Beyond Finite Layer Neural Networks: Bridging Deep Architectures and Numerical Differential EquationsOral677 citations
  66. A Hierarchical Latent Vector Model for Learning Long-Term Structure in MusicOral676 citations
  67. Not All Samples Are Created Equal: Deep Learning with Importance SamplingOral652 citations
  68. Differentiable Abstract Interpretation for Provably Robust Neural NetworksOral648 citations
  69. Learning Semantic Representations for Unsupervised Domain AdaptationOral644 citations
  70. Fixing a Broken ELBOOral634 citations
  71. Stochastic Video Generation with a Learned PriorOral629 citations
  72. Asynchronous Decentralized Parallel Stochastic Gradient DescentOral627 citations
  73. Delayed Impact of Fair Machine LearningOral626 citations
  74. A Semantic Loss Function for Deep Learning with Symbolic KnowledgeOral619 citations
  75. On the Optimization of Deep Networks: Implicit Acceleration by OverparameterizationOral609 citations
  76. On the Generalization of Equivariance and Convolution in Neural Networks to the Action of Compact GroupsOral602 citations
  77. Neural Autoregressive FlowsOral588 citations
  78. Learning Continuous Hierarchies in the Lorentz Model of Hyperbolic GeometryOral568 citations
  79. Multicalibration: Calibration for the (Computationally-Identifiable) MassesOral564 citations
  80. Augmented CycleGAN: Learning Many-to-Many Mappings from Unpaired DataOral563 citations
  81. Learning by Playing Solving Sparse Reward Tasks from ScratchOral549 citations
  82. Improving the Gaussian Mechanism for Differential Privacy: Analytical Calibration and Optimal DenoisingOral545 citations
  83. Optimizing the Latent Space of Generative NetworksOral543 citations
  84. Decomposition of Uncertainty in Bayesian Deep Learning for Efficient and Risk-sensitive LearningOral541 citations
  85. Representation Tradeoffs for Hyperbolic EmbeddingsOral540 citations
  86. To Understand Deep Learning We Need to Understand Kernel LearningOral539 citations
  87. Automatic Goal Generation for Reinforcement Learning AgentsOral530 citations
  88. Characterizing Implicit Bias in Terms of Optimization GeometryOral522 citations
  89. Essentially No Barriers in Neural Network Energy LandscapeOral509 citations
  90. NetGAN: Generating Graphs via Random WalksOral505 citations
  91. Canonical Tensor Decomposition for Knowledge Base CompletionOral500 citations
  92. Programmatically Interpretable Reinforcement LearningOral497 citations
  93. Dimensionality-Driven Learning with Noisy LabelsOral494 citations
  94. Competitive Caching with Machine Learned AdviceOral489 citations
  95. Visualizing and Understanding Atari AgentsOral464 citations
  96. Gradient-Based Meta-Learning with Learned Layerwise Metric and SubspaceOral455 citations
  97. $D^2$: Decentralized Training over Decentralized DataOral441 citations
  98. Explicit Inductive Bias for Transfer Learning with Convolutional NetworksOral415 citations
  99. Dynamical Isometry and a Mean Field Theory of CNNs: How to Train 10,000-Layer Vanilla Convolutional Neural NetworksOral412 citations
  100. Hierarchical Multi-Label Classification NetworksOral411 citations
  101. An Alternative View: When Does SGD Escape Local Minima?Oral404 citations
  102. Using Reward Machines for High-Level Task Specification and Decomposition in Reinforcement LearningOral397 citations
  103. Self-Imitation LearningOral393 citations
  104. Adversarially Regularized AutoencodersOral391 citations
  105. High-Quality Prediction Intervals for Deep Learning: A Distribution-Free, Ensembled ApproachOral374 citations
  106. Rapid Adaptation with Conditionally Shifted NeuronsOral366 citations
  107. The Power of Interpolation: Understanding the Effectiveness of SGD in Modern Over-parametrized LearningOral365 citations
  108. Computational Optimal Transport: Complexity by Accelerated Gradient Descent Is Better Than by Sinkhorn’s AlgorithmOral362 citations
  109. Trainable Calibration Measures for Neural Networks from Kernel Mean EmbeddingsOral351 citations
  110. Deep Variational Reinforcement Learning for POMDPsOral350 citations
  111. Inference Suboptimality in Variational AutoencodersOral350 citations
  112. Bounding and Counting Linear Regions of Deep Neural NetworksOral347 citations
  113. Does Distributionally Robust Supervised Learning Give Robust Classifiers?Oral347 citations
  114. The Mechanics of n-Player Differentiable GamesOral346 citations
  115. Fast and Scalable Bayesian Deep Learning by Weight-Perturbation in AdamOral339 citations
  116. SBEED: Convergent Reinforcement Learning with Nonlinear Function ApproximationOral336 citations
  117. PixelSNAIL: An Improved Autoregressive Generative ModelOral335 citations
  118. Implicit Regularization in Nonconvex Statistical Estimation: Gradient Descent Converges Linearly for Phase Retrieval and Matrix CompletionOral334 citations
  119. Hyperbolic Entailment Cones for Learning Hierarchical EmbeddingsOral332 citations
  120. Learning Equations for Extrapolation and ControlOral331 citations
  121. Spurious Local Minima are Common in Two-Layer ReLU Neural NetworksOral327 citations
  122. Universal Planning Networks: Learning Generalizable Representations for Visuomotor ControlOral325 citations
  123. Bayesian Uncertainty Estimation for Batch Normalized Deep NetworksOral309 citations
  124. More Robust Doubly Robust Off-policy EvaluationOral308 citations
  125. On the Power of Over-parametrization in Neural Networks with Quadratic ActivationOral303 citations
  126. Semi-Amortized Variational AutoencodersOral302 citations
  127. LaVAN: Localized and Visible Adversarial NoiseOral300 citations
  128. Curriculum Learning by Transfer Learning: Theory and Experiments with Deep NetworksOral293 citations
  129. Learning Steady-States of Iterative Algorithms over GraphsOral293 citations
  130. Analyzing Uncertainty in Neural Machine TranslationOral292 citations
  131. DRACO: Byzantine-resilient Distributed Training via Redundant GradientsOral287 citations
  132. Path-Level Network Transformation for Efficient Architecture SearchOral287 citations
  133. Error Compensated Quantized SGD and its Applications to Large-scale Distributed OptimizationOral286 citations
  134. Measuring abstract reasoning in neural networksOral283 citations
  135. Learning Memory Access PatternsOral278 citations
  136. Synthesizing Programs for Images using Reinforced Adversarial LearningOral274 citations
  137. The Uncertainty Bellman Equation and ExplorationOral272 citations
  138. Noisy Natural Gradient as Variational InferenceOral266 citations
  139. SGD and Hogwild! Convergence Without the Bounded Gradients AssumptionOral266 citations
  140. Modeling Others using Oneself in Multi-Agent Reinforcement LearningOral264 citations
  141. Learning to BranchOral261 citations
  142. Shampoo: Preconditioned Stochastic Tensor OptimizationOral259 citations
  143. Gradient Descent Learns One-hidden-layer CNN: Don’t be Afraid of Spurious Local MinimaOral258 citations
  144. Extracting Automata from Recurrent Neural Networks Using Queries and CounterexamplesOral255 citations
  145. Hierarchical Imitation and Reinforcement LearningOral251 citations
  146. prDeep: Robust Phase Retrieval with a Flexible Deep NetworkOral250 citations
  147. Learning Longer-term Dependencies in RNNs with Auxiliary LossesOral246 citations
  148. Tighter Variational Bounds are Not Necessarily BetterOral246 citations
  149. Anonymous Walk EmbeddingsOral244 citations
  150. Latent Space Policies for Hierarchical Reinforcement LearningOral235 citations
  151. Meta-Learning by Adjusting Priors Based on Extended PAC-Bayes TheoryOral227 citations
  152. Transfer in Deep Reinforcement Learning Using Successor Features and Generalised Policy ImprovementOral224 citations
  153. Gradient Coding from Cyclic MDS Codes and Expander GraphsOral223 citations
  154. Stochastic Variance-Reduced Policy GradientOral220 citations
  155. Autoregressive Convolutional Neural Networks for Asynchronous Time SeriesOral216 citations
  156. A Progressive Batching L-BFGS Method for Machine LearningOral214 citations
  157. Time Limits in Reinforcement LearningOral213 citations
  158. Compressing Neural Networks using the Variational Information BottleneckOral211 citations
  159. Iterative Amortized InferenceOral211 citations
  160. Investigating Human Priors for Playing Video GamesOral210 citations
  161. Knowledge Transfer with Jacobian MatchingOral207 citations
  162. Learning Independent Causal MechanismsOral206 citations
  163. Dissecting Adam: The Sign, Magnitude and Variance of Stochastic GradientsOral205 citations
  164. Communication-Computation Efficient Gradient CodingOral203 citations
  165. Policy Optimization with DemonstrationsOral203 citations
  166. Disentangled Sequential AutoencoderOral199 citations
  167. Yes, but Did It Work?: Evaluating Variational InferenceOral199 citations
  168. Stability and Generalization of Learning Algorithms that Converge to Global OptimaOral198 citations
  169. Tropical Geometry of Deep Neural NetworksOral198 citations
  170. Differentiable plasticity: training plastic neural networks with backpropagationOral195 citations
  171. Batch Bayesian Optimization via Multi-objective Acquisition Ensemble for Automated Analog Circuit DesignOral194 citations
  172. GEP-PG: Decoupling Exploration and Exploitation in Deep Reinforcement Learning AlgorithmsOral194 citations
  173. Lipschitz Continuity in Model-based Reinforcement LearningOral193 citations
  174. Self-Consistent Trajectory Autoencoder: Hierarchical Reinforcement Learning with Trajectory EmbeddingsOral193 citations
  175. Stagewise Safe Bayesian Optimization with Gaussian ProcessesOral190 citations
  176. A Theoretical Explanation for Perplexing Behaviors of Backpropagation-based VisualizationsOral189 citations
  177. Blind Justice: Fairness with Encrypted Sensitive AttributesOral189 citations
  178. Deep Models of Interactions Across SetsOral189 citations
  179. Escaping Saddles with Stochastic GradientsOral186 citations
  180. Semi-Implicit Variational InferenceOral186 citations
  181. Data-Dependent Stability of Stochastic Gradient DescentOral182 citations
  182. TAPAS: Tricks to Accelerate (encrypted) Prediction As a ServiceOral182 citations
  183. Transfer Learning via Learning to TransferOral182 citations
  184. BOCK : Bayesian Optimization with Cylindrical KernelsOral180 citations
  185. Bayesian Optimization of Combinatorial StructuresOral179 citations
  186. Analyzing the Robustness of Nearest Neighbors to Adversarial ExamplesOral177 citations
  187. Limits of Estimating Heterogeneous Treatment Effects: Guidelines for Practical Algorithm DesignOral177 citations
  188. Deep Linear Networks with Arbitrary Loss: All Local Minima Are GlobalOral176 citations
  189. On Nesting Monte Carlo EstimatorsOral175 citations
  190. Residual Unfairness in Fair Machine Learning from Prejudiced DataOral174 citations
  191. Differentiable Dynamic Programming for Structured Prediction and AttentionOral170 citations
  192. Online Linear Quadratic ControlOral169 citations
  193. State Abstractions for Lifelong Reinforcement LearningOral166 citations
  194. Hierarchical Long-term Video Prediction without SupervisionOral164 citations
  195. Structured Evolution with Compact Architectures for Scalable Policy OptimizationOral164 citations
  196. The Mirage of Action-Dependent Baselines in Reinforcement LearningOral164 citations
  197. Thompson Sampling for Combinatorial Semi-BanditsOral164 citations
  198. Bayesian Coreset Construction via Greedy Iterative Geodesic AscentOral163 citations
  199. Orthogonal Recurrent Neural Networks with Scaled Cayley TransformOral162 citations
  200. A Spline Theory of Deep LearningOral160 citations
  201. Gradient descent with identity initialization efficiently learns positive definite linear transformations by deep residual networksOral158 citations
  202. Deep k-Means: Re-Training and Parameter Sharing with Harder Cluster Assignments for Compressing Deep ConvolutionsOral157 citations
  203. Probabilistic Recurrent State-Space ModelsOral157 citations
  204. Practical Contextual Bandits with Regression OraclesOral156 citations
  205. Least-Squares Temporal Difference Learning for the Linear Quadratic RegulatorOral154 citations
  206. Coded Sparse Matrix MultiplicationOral153 citations
  207. Learning Policy Representations in Multiagent SystemsOral153 citations
  208. Dynamic Evaluation of Neural Sequence ModelsOral152 citations
  209. SparseMAP: Differentiable Sparse Structured InferenceOral152 citations
  210. Geometry Score: A Method For Comparing Generative Adversarial NetworksOral151 citations
  211. Reviving and Improving Recurrent Back-PropagationOral150 citations
  212. Fair and Diverse DPP-Based Data SummarizationOral149 citations
  213. Fast Decoding in Sequence Models Using Discrete Latent VariablesOral149 citations
  214. Is Generator Conditioning Causally Related to GAN Performance?Oral149 citations
  215. Bandits with Delayed, Aggregated Anonymous FeedbackOral148 citations
  216. Stabilizing Gradients for Deep Neural Networks via Efficient SVD ParameterizationOral148 citations
  217. Nonconvex Optimization for Regression with Fairness ConstraintsOral140 citations
  218. Pathwise Derivatives Beyond the Reparameterization TrickOral140 citations
  219. Constant-Time Predictive Distributions for Gaussian ProcessesOral139 citations
  220. Spectrally Approximating Large Graphs with Smaller GraphsOral139 citations
  221. Comparing Dynamics: Deep Neural Networks versus Glassy SystemsOral138 citations
  222. Asynchronous Byzantine Machine Learning (the case of SGD)Oral136 citations
  223. Characterizing and Learning Equivalence Classes of Causal DAGs under InterventionsOral134 citations
  224. Dynamical Isometry and a Mean Field Theory of RNNs: Gating Enables Signal Propagation in Recurrent Neural NetworksOral133 citations
  225. Efficient Bias-Span-Constrained Exploration-Exploitation in Reinforcement LearningOral132 citations
  226. Adversarial Time-to-Event ModelingOral130 citations
  227. Spotlight: Optimizing Device Placement for Training Deep Neural NetworksOral130 citations
  228. Submodular Hypergraphs: p-Laplacians, Cheeger Inequalities and Spectral ClusteringOral127 citations
  229. AutoPrognosis: Automated Clinical Prognostic Modeling via Bayesian Optimization with Structured Kernel LearningOral125 citations
  230. Dynamic Regret of Strongly Adaptive MethodsOral122 citations
  231. Optimization Landscape and Expressivity of Deep CNNsOral121 citations
  232. Generalized Robust Bayesian Committee Machine for Large-scale Gaussian Process RegressionOral120 citations
  233. Neural Inverse Rendering for General Reflectance Photometric StereoOral120 citations
  234. Rates of Convergence of Spectral Methods for Graphon EstimationOral120 citations
  235. Discovering Interpretable Representations for Both Deep Generative and Discriminative ModelsOral119 citations
  236. Improving the Privacy and Accuracy of ADMM-Based Distributed AlgorithmsOral119 citations
  237. Stein PointsOral117 citations
  238. TACO: Learning Task Decomposition via Temporal Alignment for ControlOral117 citations
  239. Improved Regret Bounds for Thompson Sampling in Linear Quadratic Control ProblemsOral115 citations
  240. Open Category Detection with PAC GuaranteesOral115 citations
  241. Been There, Done That: Meta-Learning with Episodic RecallOral114 citations
  242. DiCE: The Infinitely Differentiable Monte Carlo EstimatorOral114 citations
  243. Exploiting the Potential of Standard Convolutional Autoencoders for Image Restoration by Evolutionary SearchOral114 citations
  244. End-to-end Active Object Tracking via Reinforcement LearningOral113 citations
  245. On the Theory of Variance Reduction for Stochastic Gradient Monte CarloOral113 citations
  246. Beyond 1/2-Approximation for Submodular Maximization on Massive Data StreamsOral112 citations
  247. Continual Reinforcement Learning with Complex SynapsesOral112 citations
  248. A Spectral Approach to Gradient Estimation for Implicit DistributionsOral109 citations
  249. Decoupled Parallel Backpropagation with Convergence GuaranteeOral109 citations
  250. Policy and Value Transfer in Lifelong Reinforcement LearningOral109 citations
  251. Semi-Supervised Learning via Compact Latent Space ClusteringOral109 citations
  252. Classification from Pairwise Similarity and Unlabeled DataOral108 citations
  253. Deep Predictive Coding Network for Object RecognitionOral108 citations
  254. On Acceleration with Noise-Corrupted GradientsOral108 citations
  255. High Performance Zero-Memory Overhead Direct ConvolutionsOral107 citations
  256. Learning to search with MCTSnetsOral107 citations
  257. Fitting New Speakers Based on a Short Untranscribed SampleOral106 citations
  258. Learning unknown ODE models with Gaussian processesOral106 citations
  259. Stochastic Wasserstein BarycentersOral106 citations
  260. Gated Path Planning NetworksOral105 citations
  261. An Optimal Control Approach to Deep Learning and Applications to Discrete-Weight Neural NetworksOral104 citations
  262. Message Passing Stein Variational Gradient DescentOral104 citations
  263. A Simple Stochastic Variance Reduced Algorithm with Fast Convergence RatesOral103 citations
  264. Contextual Graph Markov Model: A Deep and Generative Approach to Graph ProcessingOral102 citations
  265. MAGAN: Aligning Biological ManifoldsOral101 citations
  266. Transformation Autoregressive NetworksOral100 citations
  267. Geodesic Convolutional Shape OptimizationOral99 citations
  268. Understanding the Loss Surface of Neural Networks for Binary ClassificationOral99 citations
  269. DVAE++: Discrete Variational Autoencoders with Overlapping TransformationsOral98 citations
  270. Modeling Sparse Deviations for Compressed Sensing using Generative ModelsOral98 citations
  271. Differentiable Compositional Kernel Learning for Gaussian ProcessesOral97 citations
  272. Structured Variational Learning of Bayesian Neural Networks with Horseshoe PriorsOral97 citations
  273. Celer: a Fast Solver for the Lasso with Dual ExtrapolationOral96 citations
  274. Learning K-way D-dimensional Discrete Codes for Compact Embedding RepresentationsOral96 citations
  275. Mix & Match Agent Curricula for Reinforcement LearningOral96 citations
  276. PIPPS: Flexible Model-Based Policy Search Robust to the Curse of ChaosOral96 citations
  277. Autoregressive Quantile Networks for Generative ModelingOral94 citations
  278. ADMM and Accelerated ADMM as Continuous Dynamical SystemsOral93 citations
  279. Adaptive Sampled Softmax with Kernel Based SamplingOral93 citations
  280. On the Implicit Bias of DropoutOral93 citations
  281. Projection-Free Online Optimization with Stochastic Gradient: From Convexity to SubmodularityOral92 citations
  282. Accurate Inference for Adaptive Linear ModelsOral90 citations
  283. Learning One Convolutional Layer with Overlapping PatchesOral90 citations
  284. Composable Planning with AttributesOral89 citations
  285. Deep Reinforcement Learning in Continuous Action Spaces: a Case Study in the Game of Simulated CurlingOral87 citations
  286. Lyapunov Functions for First-Order Methods: Tight Automated Convergence GuaranteesOral86 citations
  287. Variational Bayesian dropout: pitfalls and fixesOral86 citations
  288. Improving Regression Performance with Distributional LossesOral84 citations
  289. Scalable Deletion-Robust Submodular Maximization: Data Summarization with Privacy and Fairness ConstraintsOral84 citations
  290. Neural Program Synthesis from Diverse Demonstration VideosOral82 citations
  291. Adversarial Distillation of Bayesian Neural Network Posteriors81 citations
  292. Fast Bellman Updates for Robust MDPsOral81 citations
  293. Best Arm Identification in Linear Bandits with Linear Dimension DependencyOral80 citations
  294. Budgeted Experiment Design for Causal Structure LearningOral80 citations
  295. DCFNet: Deep Neural Network with Decomposed Convolutional FiltersOral80 citations
  296. A Classification-Based Study of Covariate Shift in GAN DistributionsOral79 citations
  297. Black-Box Variational Inference for Stochastic Differential EquationsOral79 citations
  298. Greed is Still Good: Maximizing Monotone Submodular+Supermodular (BP) FunctionsOral79 citations
  299. Policy Optimization as Wasserstein Gradient FlowsOral79 citations
  300. QuantTree: Histograms for Change Detection in Multivariate Data StreamsOral79 citations
  301. Quasi-Monte Carlo Variational InferenceOral78 citations
  302. Learning and MemorizationOral77 citations
  303. Efficient Model-Based Deep Reinforcement Learning with Variational State TabulationOral76 citations
  304. Model-Level Dual LearningOral75 citations
  305. Structured Variationally Auto-encoded OptimizationOral75 citations
  306. Goodness-of-Fit Testing for Discrete Distributions via Stein DiscrepancyOral74 citations
  307. Fast Stochastic AUC Maximization with $O(1/n)$-Convergence RateOral73 citations
  308. Distributed Asynchronous Optimization with Unbounded Delays: How Slow Can You Go?Oral72 citations
  309. Fast Maximization of Non-Submodular, Monotonic Functions on the Integer LatticeOral72 citations
  310. Finding Influential Training Samples for Gradient Boosted Decision TreesOral72 citations
  311. Hierarchical Text Generation and Planning for Strategic DialogueOral72 citations
  312. Spatio-temporal Bayesian On-line Changepoint Detection with Model SelectionOral72 citations
  313. Towards Black-box Iterative Machine TeachingOral71 citations
  314. Stochastic Proximal Algorithms for AUC MaximizationOral70 citations
  315. CRAFTML, an Efficient Clustering-based Random Forest for Extreme Multi-label LearningOral69 citations
  316. Hierarchical Clustering with Structural ConstraintsOral69 citations
  317. On the Limitations of First-Order Approximation in GAN DynamicsOral69 citations
  318. On the Spectrum of Random Features Maps of High Dimensional DataOral69 citations
  319. Importance Weighted Transfer of Samples in Reinforcement LearningOral68 citations
  320. Massively Parallel Algorithms and Hardness for Single-Linkage Clustering under $\ell_p$ DistancesOral68 citations
  321. Towards More Efficient Stochastic Decentralized Learning: Faster Convergence and Sparse CommunicationOral68 citations
  322. Learning to Explore via Meta-Policy GradientOral67 citations
  323. Probably Approximately Metric-Fair LearningOral67 citations
  324. Entropy-SGD optimizes the prior of a PAC-Bayes bound: Generalization properties of Entropy-SGD and data-dependent priorsOral66 citations
  325. Fast Information-theoretic Bayesian OptimisationOral66 citations
  326. Local Private Hypothesis Testing: Chi-Square TestsOral66 citations
  327. Multi-Fidelity Black-Box Optimization with Hierarchical PartitionsOral66 citations
  328. Semi-Supervised Learning on Data Streams via Temporal Label PropagationOral66 citations
  329. Neural Networks Should Be Wide Enough to Learn Disconnected Decision RegionsOral65 citations
  330. Regret Minimization for Partially Observable Deep Reinforcement LearningOral65 citations
  331. Accelerated Spectral RankingOral64 citations
  332. Continuous-Time Flows for Efficient Inference and Density EstimationOral64 citations
  333. Gradient Primal-Dual Algorithm Converges to Second-Order Stationary Solution for Nonconvex Distributed Optimization Over NetworksOral64 citations
  334. Pseudo-task Augmentation: From Deep Multitask Learning to Intratask Sharing—and BackOral64 citations
  335. Understanding Generalization and Optimization Performance of Deep CNNsOral64 citations
  336. Locally Private Hypothesis TestingOral63 citations
  337. Clipped Action Policy GradientOral62 citations
  338. Deep Asymmetric Multi-task Feature LearningOral62 citations
  339. Max-Mahalanobis Linear Discriminant Analysis NetworksOral62 citations
  340. Coordinated Exploration in Concurrent Reinforcement LearningOral61 citations
  341. Towards Binary-Valued Gates for Robust LSTM TrainingOral61 citations
  342. A Two-Step Computation of the Exact GAN Wasserstein DistanceOral60 citations
  343. Riemannian Stochastic Recursive Gradient Algorithm60 citations
  344. Conditional Noise-Contrastive Estimation of Unnormalised ModelsOral59 citations
  345. Convergence guarantees for a class of non-convex and non-smooth optimization problemsOral59 citations
  346. Hierarchical Deep Generative Models for Multi-Rate Multivariate Time SeriesOral59 citations
  347. Minimax Concave Penalized Multi-Armed Bandit Model with High-Dimensional CovariatesOral59 citations
  348. Semiparametric Contextual BanditsOral59 citations
  349. Stein Variational Gradient Descent Without GradientOral59 citations
  350. Data Summarization at Scale: A Two-Stage Submodular ApproachOral58 citations
  351. RadialGAN: Leveraging multiple datasets to improve target-specific predictive models using Generative Adversarial NetworksOral58 citations
  352. SAFFRON: an Adaptive Algorithm for Online Control of the False Discovery RateOral58 citations
  353. Stein Variational Message Passing for Continuous Graphical ModelsOral58 citations
  354. The Multilinear Structure of ReLU NetworksOral58 citations
  355. Weightless: Lossy weight encoding for deep neural network compressionOral58 citations
  356. An Iterative, Sketching-based Framework for Ridge RegressionOral56 citations
  357. Competitive Multi-agent Inverse Reinforcement Learning with Sub-optimal DemonstrationsOral56 citations
  358. Online Learning with AbstentionOral56 citations
  359. The Dynamics of Learning: A Random Matrix ApproachOral56 citations
  360. Video Prediction with Appearance and Motion ConditionsOral56 citations
  361. Scalable Bilinear Pi Learning Using State and Action FeaturesOral55 citations
  362. Structured Control Nets for Deep Reinforcement LearningOral55 citations
  363. Exploring Hidden Dimensions in Accelerating Convolutional Neural NetworksOral54 citations
  364. Learning to Coordinate with Coordination Graphs in Repeated Single-Stage Multi-Agent Decision ProblemsOral54 citations
  365. Stochastic Variance-Reduced Cubic Regularized Newton MethodsOral54 citations
  366. A Conditional Gradient Framework for Composite Convex Minimization with Applications to Semidefinite ProgrammingOral53 citations
  367. Configurable Markov Decision ProcessesOral53 citations
  368. Weakly Submodular Maximization Beyond Cardinality Constraints: Does Randomization Help Greedy?Oral53 citations
  369. Fast Parametric Learning with Activation MemorizationOral52 citations
  370. Learning Long Term Dependencies via Fourier Recurrent UnitsOral52 citations
  371. On the Relationship between Data Efficiency and Error for Uncertainty SamplingOral52 citations
  372. Optimization, fast and slow: optimally switching between local and Bayesian optimizationOral52 citations
  373. SQL-Rank: A Listwise Approach to Collaborative RankingOral52 citations
  374. oi-VAE: Output Interpretable VAEs for Nonlinear Group Factor AnalysisOral52 citations
  375. A Delay-tolerant Proximal-Gradient Algorithm for Distributed LearningOral51 citations
  376. Bayesian Quadrature for Multiple Related IntegralsOral51 citations
  377. Differentially Private Database Release via Kernel Mean EmbeddingsOral51 citations
  378. Local Convergence Properties of SAGA/Prox-SVRG and AccelerationOral51 citations
  379. Orthogonal Machine Learning: Power and LimitationsOral51 citations
  380. Beyond the One-Step Greedy Approach in Reinforcement LearningOral49 citations
  381. Kronecker Recurrent UnitsOral49 citations
  382. One-Shot Segmentation in ClutterOral49 citations
  383. A Primal-Dual Analysis of Global Optimality in Nonconvex Low-Rank Matrix RecoveryOral48 citations
  384. Chi-square Generative Adversarial NetworkOral48 citations
  385. Convergent Tree Backup and Retrace with Function ApproximationOral48 citations
  386. Improved Training of Generative Adversarial Networks Using Representative FeaturesOral48 citations
  387. Learning Compact Neural Networks with RegularizationOral48 citations
  388. Mitigating Bias in Adaptive Data Gathering via Differential PrivacyOral48 citations
  389. Network Global Testing by Counting GraphletsOral48 citations
  390. Robust and Scalable Models of Microbiome DynamicsOral48 citations
  391. Differentially Private Identity and Equivalence Testing of Discrete DistributionsOral47 citations
  392. JointGAN: Multi-Domain Joint Distribution Learning with Generative Adversarial NetsOral47 citations
  393. MISSION: Ultra Large-Scale Feature Selection using Count-SketchesOral47 citations
  394. Randomized Block Cubic Newton MethodOral47 citations
  395. Improved large-scale graph learning through ridge spectral sparsificationOral46 citations
  396. LeapsAndBounds: A Method for Approximately Optimal Algorithm ConfigurationOral46 citations
  397. An Efficient, Generalized Bellman Update For Cooperative Inverse Reinforcement LearningOral45 citations
  398. Learning to Act in Decentralized Partially Observable MDPsOral45 citations
  399. Adversarial Learning with Local Coordinate CodingOral44 citations
  400. Alternating Randomized Block Coordinate DescentOral44 citations
  401. An Inference-Based Policy Gradient Method for Learning OptionsOral44 citations
  402. Differentially Private Matrix Completion RevisitedOral44 citations
  403. Adaptive Three Operator SplittingOral43 citations
  404. Can Deep Reinforcement Learning Solve Erdos-Selfridge-Spencer Games?Oral43 citations
  405. Decentralized Submodular Maximization: Bridging Discrete and Continuous SettingsOral43 citations
  406. Efficient Gradient-Free Variational Inference using Policy SearchOral43 citations
  407. Mixed batches and symmetric discriminators for GAN trainingOral43 citations
  408. Parallel and Streaming Algorithms for K-Core DecompositionOral43 citations
  409. Quickshift++: Provably Good Initializations for Sample-Based Mean ShiftOral43 citations
  410. Theoretical Analysis of Sparse Subspace Clustering with Missing EntriesOral43 citations
  411. Causal Bandits with Propagating InferenceOral41 citations
  412. Detecting non-causal artifacts in multivariate linear regression modelsOral41 citations
  413. Large-Scale Sparse Inverse Covariance Estimation via Thresholding and Max-Det Matrix CompletionOral41 citations
  414. Proportional Allocation: Simple, Distributed, and Diverse Matching with High EntropyOral41 citations
  415. Stochastic Variance-Reduced Hamilton Monte Carlo MethodsOral41 citations
  416. The Limits of Maxing, Ranking, and Preference LearningOral41 citations
  417. Comparison-Based Random ForestsOral40 citations
  418. Generalized Earley Parser: Bridging Symbolic Grammars and Sequence Data for Future PredictionOral40 citations
  419. Large-Scale Cox Process Inference using Variational Fourier FeaturesOral40 citations
  420. Subspace Embedding and Linear Regression with Orlicz NormOral40 citations
  421. Feedback-Based Tree Search for Reinforcement LearningOral39 citations
  422. Path Consistency Learning in Tsallis Entropy Regularized MDPsOral39 citations
  423. State Space Gaussian Processes with Non-Gaussian LikelihoodOral39 citations
  424. Approximate Leave-One-Out for Fast Parameter Tuning in High DimensionsOral38 citations
  425. Distributed Nonparametric Regression under Communication ConstraintsOral38 citations
  426. Invariance of Weight Distributions in Rectified MLPsOral38 citations
  427. Learning Dynamics of Linear Denoising AutoencodersOral38 citations
  428. Accelerating Greedy Coordinate Descent MethodsOral37 citations
  429. Adversarial Regression with Multiple LearnersOral37 citations
  430. Approximation Guarantees for Adaptive SamplingOral37 citations
  431. SADAGRAD: Strongly Adaptive Stochastic Gradient MethodsOral37 citations
  432. A Distributed Second-Order Algorithm You Can TrustOral36 citations
  433. Binary Classification with Karmic, Threshold-Quasi-Concave MetricsOral36 citations
  434. Dropout Training, Data-dependent Regularization, and Generalization BoundsOral36 citations
  435. Level-Set Methods for Finite-Sum Constrained Convex OptimizationOral36 citations
  436. Rectify Heterogeneous Models with Semantic MappingOral36 citations
  437. Spline Filters For End-to-End Deep LearningOral36 citations
  438. StrassenNets: Deep Learning with a Multiplication BudgetOral36 citations
  439. Variational Inference and Model Selection with Generalized Evidence BoundsOral36 citations
  440. An Efficient Semismooth Newton based Algorithm for Convex ClusteringOral35 citations
  441. Nearly Optimal Robust Subspace TrackingOral35 citations
  442. Adaptive Exploration-Exploitation Tradeoff for Opportunistic BanditsOral34 citations
  443. Learning a Mixture of Two Multinomial LogitsOral34 citations
  444. Discrete-Continuous Mixtures in Probabilistic Programming: Generalized Semantics and Inference AlgorithmsOral33 citations
  445. Functional Gradient Boosting based on Residual Network PerceptionOral33 citations
  446. Make the Minority Great Again: First-Order Regret Bound for Contextual BanditsOral33 citations
  447. Orthogonality-Promoting Distance Metric Learning: Convex Relaxation and Theoretical AnalysisOral33 citations
  448. Parameterized Algorithms for the Matrix Completion ProblemOral33 citations
  449. Recurrent Predictive State Policy NetworksOral33 citations
  450. Variable Selection via Penalized Neural Network: a Drop-Out-One Loss ApproachOral33 citations
  451. Analysis of Minimax Error Rate for Crowdsourcing and Its Application to Worker Clustering ModelOral32 citations
  452. Constraining the Dynamics of Deep Probabilistic ModelsOral32 citations
  453. Discovering and Removing Exogenous State Variables and Rewards for Reinforcement LearningOral32 citations
  454. End-to-End Learning for the Deep Multivariate Probit ModelOral32 citations
  455. Generative Temporal Models with Spatial Memory for Partially Observed EnvironmentsOral32 citations
  456. Kernelized Synaptic Weight MatricesOral32 citations
  457. Learning Diffusion using HyperparametersOral32 citations
  458. Non-convex Conditional Gradient SlidingOral32 citations
  459. Not to Cry Wolf: Distantly Supervised Multitask Learning in Critical CareOral32 citations
  460. Optimal Distributed Learning with Multi-pass Stochastic Gradient MethodsOral32 citations
  461. Scalable Gaussian Processes with Grid-Structured Eigenfunctions (GP-GRIEF)Oral32 citations
  462. Tempered Adversarial NetworksOral32 citations
  463. A Unified Framework for Structured Low-rank Matrix LearningOral31 citations
  464. Error Estimation for Randomized Least-Squares Algorithms via the BootstrapOral31 citations
  465. Frank-Wolfe with Subsampling OracleOral31 citations
  466. Gradient Descent for Sparse Rank-One Matrix Completion for Crowd-Sourced Aggregation of Sparsely Interacting WorkersOral31 citations
  467. Near Optimal Frequent Directions for Sketching Dense and Sparse MatricesOral31 citations
  468. Noisin: Unbiased Regularization for Recurrent Neural NetworksOral31 citations
  469. Optimal Tuning for Divide-and-conquer Kernel Ridge Regression with Massive DataOral31 citations
  470. Selecting Representative Examples for Program SynthesisOral31 citations
  471. Smoothed Action Value Functions for Learning Gaussian PoliciesOral31 citations
  472. Active Learning with Logged DataOral30 citations
  473. Binary Partitions with Approximate Minimum ImpurityOral30 citations
  474. Crowdsourcing with Arbitrary AdversariesOral30 citations
  475. Distributed Clustering via LSH Based Data PartitioningOral30 citations
  476. Fast and Sample Efficient Inductive Matrix Completion via Multi-Phase Procrustes FlowOral30 citations
  477. Learning Implicit Generative Models with the Method of Learned MomentsOral30 citations
  478. Unbiased Objective Estimation in Predictive OptimizationOral30 citations
  479. Augment and Reduce: Stochastic Inference for Large Categorical DistributionsOral29 citations
  480. On Matching Pursuit and Coordinate DescentOral29 citations
  481. Faster Derivative-Free Stochastic Algorithm for Shared Memory MachinesOral28 citations
  482. Focused Hierarchical RNNs for Conditional Sequence ProcessingOral28 citations
  483. Parallel Bayesian Network Structure LearningOral28 citations
  484. Partial Optimality and Fast Lower Bounds for Weighted Correlation ClusteringOral28 citations
  485. SMAC: Simultaneous Mapping and Clustering Using Spectral DecompositionsOral28 citations
  486. Tree Edit Distance Learning via Adaptive Symbol EmbeddingsOral28 citations
  487. Asynchronous Stochastic Quasi-Newton MCMC for Non-Convex OptimizationOral27 citations
  488. Feasible Arm IdentificationOral27 citations
  489. Learning Hidden Markov Models from Pairwise Co-occurrences with Application to Topic ModelingOral27 citations
  490. Let’s be Honest: An Optimal No-Regret Framework for Zero-Sum GamesOral27 citations
  491. Reinforcing Adversarial Robustness using Model Confidence Induced by Adversarial TrainingOral27 citations
  492. Tight Regret Bounds for Bayesian Optimization in One DimensionOral27 citations
  493. Dissipativity Theory for Accelerating Stochastic Variance Reduction: A Unified Analysis of SVRG and Katyusha Using Semidefinite ProgramsOral26 citations
  494. INSPECTRE: Privately Estimating the UnseenOral26 citations
  495. DICOD: Distributed Convolutional Coordinate Descent for Convolutional Sparse CodingOral25 citations
  496. Inter and Intra Topic Structure Learning with Word EmbeddingsOral25 citations
  497. Katyusha X: Simple Momentum Method for Stochastic Sum-of-Nonconvex OptimizationOral25 citations
  498. Loss Decomposition for Fast Learning in Large Output SpacesOral25 citations
  499. Problem Dependent Reinforcement Learning Bounds Which Can Identify Bandit Structure in MDPsOral25 citations
  500. A Probabilistic Theory of Supervised Similarity Learning for Pointwise ROC Curve OptimizationOral24 citations
  501. Accelerating Natural Gradient with Higher-Order InvarianceOral24 citations
  502. Black Box FDROral23 citations
  503. Continuous and Discrete-time Accelerated Stochastic Mirror Descent for Strongly Convex FunctionsOral23 citations
  504. Fast Approximate Spectral Clustering for Dynamic NetworksOral23 citations
  505. Local Density Estimation in High DimensionsOral23 citations
  506. MSplit LBI: Realizing Feature Selection and Dense Estimation Simultaneously in Few-shot and Zero-shot LearningOral23 citations
  507. Matrix Norms in Data Streams: Faster, Multi-Pass and Row-OrderOral23 citations
  508. Minimal I-MAP MCMC for Scalable Structure Discovery in Causal DAG ModelsOral23 citations
  509. Reinforcement Learning with Function-Valued Action Spaces for Partial Differential Equation ControlOral23 citations
  510. Streaming Principal Component Analysis in Noisy SettingOral23 citations
  511. Variance Regularized Counterfactual Risk Minimization via Variational Divergence MinimizationOral23 citations
  512. Weakly Consistent Optimal Pricing Algorithms in Repeated Posted-Price Auctions with Strategic BuyerOral23 citations
  513. Approximation Algorithms for Cascading Prediction ModelsOral22 citations
  514. Deep Density DestructorsOral22 citations
  515. Estimation of Markov Chain via Rank-Constrained LikelihoodOral22 citations
  516. Out-of-sample extension of graph adjacency spectral embeddingOral22 citations
  517. WHInter: A Working set algorithm for High-dimensional sparse second order Interaction modelsOral22 citations
  518. A Robust Approach to Sequential Information Theoretic PlanningOral21 citations
  519. Minibatch Gibbs Sampling on Large Graphical ModelsOral21 citations
  520. Probabilistic Boolean Tensor DecompositionOral21 citations
  521. Sound Abstraction and Decomposition of Probabilistic ProgramsOral21 citations
  522. Composite Functional Gradient Learning of Generative Adversarial ModelsOral20 citations
  523. Dependent Relational Gamma Process Models for Longitudinal NetworksOral20 citations
  524. Graphical Nonconvex Optimization via an Adaptive Convex RelaxationOral20 citations
  525. Kernel Recursive ABC: Point Estimation with Intractable LikelihoodOral20 citations
  526. Do Outliers Ruin Collaboration?Oral19 citations
  527. Efficient and Consistent Adversarial Bipartite MatchingOral19 citations
  528. Gradually Updated Neural Networks for Large-Scale Image RecognitionOral19 citations
  529. Composite Marginal Likelihood Methods for Random Utility ModelsOral18 citations
  530. Covariate Adjusted Precision Matrix Estimation via Nonconvex OptimizationOral18 citations
  531. Improving Optimization for Models With Continuous Symmetry BreakingOral18 citations
  532. Deep Bayesian Nonparametric TrackingOral17 citations
  533. Efficient end-to-end learning for quantizable representationsOral17 citations
  534. Firing Bandits: Optimizing CrowdfundingOral17 citations
  535. Learning to Optimize Combinatorial FunctionsOral17 citations
  536. Learning with AbandonmentOral17 citations
  537. Fast Gradient-Based Methods with Exponential Rate: A Hybrid Control FrameworkOral16 citations
  538. Fourier Policy GradientsOral16 citations
  539. Learning Binary Latent Variable Models: A Tensor Eigenpair ApproachOral16 citations
  540. Nonparametric variable importance using an augmented neural network with multi-task learningOral16 citations
  541. Signal and Noise Statistics Oblivious Orthogonal Matching PursuitOral16 citations
  542. Temporal Poisson Square Root Graphical ModelsOral16 citations
  543. K-Beam Minimax: Efficient Optimization for Deep Adversarial LearningOral15 citations
  544. Learning Registered Point Processes from Idiosyncratic ObservationsOral15 citations
  545. Linear Spectral Estimators and an Application to Phase RetrievalOral15 citations
  546. Non-linear motor control by local learning in spiking neural networksOral15 citations
  547. Provable Variable Selection for Streaming FeaturesOral15 citations
  548. A probabilistic framework for multi-view feature learning with many-to-many associations via neural networksOral14 citations
  549. Approximate message passing for amplitude based optimizationOral14 citations
  550. K-means clustering using random matrix sparsificationOral14 citations
  551. Active Testing: An Efficient and Robust Framework for Estimating AccuracyOral13 citations
  552. Learning the Reward Function for a Misspecified ModelOral13 citations
  553. Leveraging Well-Conditioned Bases: Streaming and Distributed Summaries in Minkowski $p$-NormsOral13 citations
  554. Neural Dynamic Programming for Musical Self SimilarityOral13 citations
  555. Prediction Rule ReshapingOral13 citations
  556. Scalable approximate Bayesian inference for particle tracking dataOral13 citations
  557. Bounds on the Approximation Power of Feedforward Neural NetworksOral12 citations
  558. Learning to Speed Up Structured Output PredictionOral12 citations
  559. Low-Rank Riemannian Optimization on Positive Semidefinite Stochastic Matrices with Applications to Graph ClusteringOral12 citations
  560. WSNet: Compact and Efficient Networks Through Weight SamplingOral12 citations
  561. Clustering Semi-Random Mixtures of GaussiansOral11 citations
  562. ContextNet: Deep learning for Star Galaxy ClassificationOral11 citations
  563. Convolutional Imputation of Matrix NetworksOral11 citations
  564. Cut-Pursuit Algorithm for Regularizing Nonsmooth Functionals with Graph Total VariationOral11 citations
  565. Learning Low-Dimensional Temporal RepresentationsOral11 citations
  566. Improved nearest neighbor search using auxiliary information and priority functionsOral10 citations
  567. Online Convolutional Sparse Coding with Sample-Dependent DictionaryOral10 citations
  568. Optimal Rates of Sketched-regularized Algorithms for Least-Squares Regression over Hilbert SpacesOral10 citations
  569. Predict and Constrain: Modeling Cardinality in Deep Structured PredictionOral10 citations
  570. The Edge Density Barrier: Computational-Statistical Tradeoffs in Combinatorial InferenceOral10 citations
  571. The Well-Tempered LassoOral10 citations
  572. Design of Experiments for Model Discrimination Hybridising Analytical and Data-Driven ApproachesOral9 citations
  573. Improving Sign Random Projections With Additional InformationOral9 citations
  574. Learning Maximum-A-Posteriori Perturbation Models for Structured Prediction in Polynomial TimeOral9 citations
  575. The Weighted Kendall and High-order Kernels for PermutationsOral9 citations
  576. Fast Variance Reduction Method with Stochastic Batch SizeOral8 citations
  577. Lightweight Stochastic Optimization for Minimizing Finite Sums with Infinite DataOral8 citations
  578. Nonoverlap-Promoting Variable SelectionOral8 citations
  579. Nonparametric Regression with Comparisons: Escaping the Curse of Dimensionality with Ordinal InformationOral8 citations
  580. Testing Sparsity over Known and Unknown BasesOral8 citations
  581. Theoretical Analysis of Image-to-Image Translation with Adversarial LearningOral8 citations
  582. First Order Generative Adversarial NetworksOral7 citations
  583. Inductive Two-Layer Modeling with Parametric Bregman TransferOral7 citations
  584. Topological mixture estimationOral7 citations
  585. A Fast and Scalable Joint Estimator for Integrating Additional Knowledge in Learning Multiple Related Sparse Gaussian Graphical ModelsOral6 citations
  586. An Estimation and Analysis Framework for the Rasch ModelOral6 citations
  587. Bayesian Model Selection for Change Point Detection and ClusteringOral6 citations
  588. CRVI: Convex Relaxation for Variational InferenceOral6 citations
  589. Closed-form Marginal Likelihood in Gamma-Poisson Matrix FactorizationOral6 citations
  590. CoVeR: Learning Covariate-Specific Vector Representations with Tensor DecompositionsOral6 citations
  591. Constrained Interacting Submodular GroupingsOral6 citations
  592. Equivalence of Multicategory SVM and Simplex Cone SVM: Fast Computations and Statistical TheoryOral6 citations
  593. Learn from Your Neighbor: Learning Multi-modal Mappings from Sparse AnnotationsOral6 citations
  594. Racing Thompson: an Efficient Algorithm for Thompson Sampling with Non-conjugate PriorsOral6 citations
  595. Ranking Distributions based on Noisy SortingOral6 citations
  596. Bucket Renormalization for Approximate InferenceOral5 citations
  597. Efficient First-Order Algorithms for Adaptive Signal DenoisingOral5 citations
  598. Information Theoretic Guarantees for Empirical Risk Minimization with Applications to Model Selection and Large-Scale OptimizationOral5 citations
  599. Structured Output Learning with Abstention: Application to Accurate Opinion PredictionOral5 citations
  600. An Algorithmic Framework of Variable Metric Over-Relaxed Hybrid Proximal Extra-Gradient MethodOral4 citations
  601. Candidates vs. Noises Estimation for Large Multi-Class Classification ProblemOral4 citations
  602. Extreme Learning to Rank via Low Rank AssumptionOral4 citations
  603. Markov Modulated Gaussian Cox Processes for Semi-Stationary Intensity Modeling of Events DataOral4 citations
  604. The Generalization Error of Dictionary Learning with Moreau EnvelopesOral4 citations
  605. The Hierarchical Adaptive Forgetting Variational FilterOral4 citations
  606. Compiling Combinatorial Prediction GamesOral3 citations
  607. Decoupling Gradient-Like Learning Rules from RepresentationsOral3 citations
  608. Learning in Integer Latent Variable Models with Nested Automatic DifferentiationOral3 citations
  609. Training Neural Machines with Trace-Based SupervisionOral3 citations
  610. A Boo(n) for Evaluating Architecture PerformanceOral2 citations
  611. On Learning Sparsely Used Dictionaries from Incomplete SamplesOral2 citations
  612. Safe Element Screening for Submodular Function MinimizationOral2 citations
  613. Learning Localized Spatio-Temporal Models From Streaming DataOral1 citations
  614. Revealing Common Statistical Behaviors in Heterogeneous PopulationsOral1 citations
  615. Self-Bounded Prediction Suffix Tree via Approximate String MatchingOral1 citations
  616. Using Inherent Structures to design Lean 2-layer RBMsOral1 citations
  617. Learning in Reproducing Kernel Kreı̆n SpacesOral
  618. Solving Partial Assignment Problems using Random Clique ComplexesOral
  619. Stochastic PCA with $\ell_2$ and $\ell_1$ RegularizationOral
  620. Variational Network Inference: Strong and Stable with Concrete SupportOral

Looking for submission deadlines instead? See the conference deadline calendar.