ICLR 2018 Accepted Papers
The full list of 429 papers accepted at ICLR 2018 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 314Workshop: 89Oral: 23Active: 3
- Towards Deep Learning Models Resistant to Adversarial AttacksPoster15,225 citations
- Graph Attention NetworksPoster14,887 citations
- mixup: Beyond Empirical Risk MinimizationPoster12,891 citations
- Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic ActorWorkshop11,310 citations
- Progressive Growing of GANs for Improved Quality, Stability, and VariationOral9,833 citations
- Spectral Normalization for Generative Adversarial NetworksOral5,867 citations
- Searching for Activation FunctionsWorkshop4,870 citations
- Diffusion Convolutional Recurrent Neural Network: Data-Driven Traffic ForecastingPoster4,697 citations
- Unsupervised Representation Learning by Predicting Image RotationsPoster4,239 citations
- Ensemble Adversarial Training: Attacks and DefensesPoster3,557 citations
- On the Convergence of Adam and BeyondOral3,446 citations
- Learning to TeachPoster2,782 citations
- Enhancing The Reliability of Out-of-distribution Image Detection in Neural NetworksPoster2,556 citations
- Visualizing the Loss Landscape of Neural NetsWorkshop2,486 citations
- Active Learning for Convolutional Neural Networks: A Core-Set ApproachPoster2,435 citations
- Deep Autoencoding Gaussian Mixture Model for Unsupervised Anomaly DetectionPoster2,410 citations
- Variational image compression with a scale hyperpriorPoster2,215 citations
- Mixed Precision TrainingPoster2,212 citations
- A Deep Reinforced Model for Abstractive SummarizationPoster2,047 citations
- FastGCN: Fast Learning with Graph Convolutional Networks via Importance SamplingPoster1,976 citations
- Demystifying MMD GANsPoster1,874 citations
- Countering Adversarial Images using Input TransformationsPoster1,821 citations
- Meta-Learning for Semi-Supervised Few-Shot ClassificationPoster1,791 citations
- Deep Gradient Compression: Reducing the Communication Bandwidth for Distributed TrainingPoster1,771 citations
- Learning Representations and Generative Models for 3D Point CloudsWorkshop1,765 citations
- Decision-Based Adversarial Attacks: Reliable Attacks Against Black-Box Machine Learning ModelsPoster1,732 citations
- A Simple Neural Attentive Meta-LearnerPoster1,683 citations
- Learning Differentially Private Recurrent Language ModelsPoster1,654 citations
- To Prune, or Not to Prune: Exploring the Efficacy of Pruning for Model CompressionWorkshop1,609 citations
- Defense-GAN: Protecting Classifiers Against Adversarial Attacks Using Generative ModelsPoster1,543 citations
- Data Augmentation Generative Adversarial NetworksWorkshop1,531 citations
- Lifelong Learning with Dynamically Expandable NetworksPoster1,448 citations
- Deep Neural Networks as Gaussian ProcessesPoster1,424 citations
- Wasserstein Auto-EncodersOral1,423 citations
- Learning Sparse Neural Networks through L_0 RegularizationPoster1,418 citations
- Regularizing and Optimizing LSTM Language ModelsPoster1,415 citations
- Mitigating Adversarial Effects Through RandomizationPoster1,391 citations
- Word translation without parallel dataPoster1,382 citations
- Don't Decay the Learning Rate, Increase the Batch SizePoster1,362 citations
- Matrix capsules with EM routingPoster1,356 citations
- Towards better understanding of gradient-based attribution methods for Deep Neural NetworksPoster1,347 citations
- Unsupervised Machine Translation Using Monolingual Corpora OnlyPoster1,332 citations
- QANet: Combining Local Convolution with Global Self-Attention for Reading ComprehensionPoster1,263 citations
- Noisy Networks For ExplorationPoster1,259 citations
- Certifying Some Distributional Robustness with Principled Adversarial TrainingOral1,237 citations
- Hierarchical Representations for Efficient Architecture SearchPoster1,205 citations
- Spherical CNNsOral1,203 citations
- Learning Robust Rewards with Adverserial Inverse Reinforcement LearningPoster1,194 citations
- Certified Defenses against Adversarial ExamplesPoster1,176 citations
- Deep Complex NetworksPoster1,142 citations
- Few-Shot Learning with Graph Neural NetworksPoster1,141 citations
- A Neural Representation of Sketch DrawingsPoster1,127 citations
- Training Confidence-calibrated Classifiers for Detecting Out-of-Distribution SamplesPoster1,102 citations
- The Implicit Bias of Gradient Descent on Separable DataPoster1,096 citations
- Generating Wikipedia by Summarizing Long SequencesPoster1,080 citations
- Unsupervised Neural Machine TranslationPoster1,070 citations
- Learning to Represent Programs with GraphsOral1,066 citations
- PixelDefend: Leveraging Generative Models to Understand and Defend against Adversarial ExamplesPoster1,019 citations
- PDE-Net: Learning PDEs from DataWorkshop980 citations
- Model compression via distillation and quantizationPoster960 citations
- Multi-Scale Dense Networks for Resource Efficient Image ClassificationOral941 citations
- Non-Autoregressive Neural Machine TranslationPoster933 citations
- SMASH: One-Shot Model Architecture Search through HyperNetworksPoster925 citations
- Variational Continual LearningPoster904 citations
- Characterizing Adversarial Subspaces Using Local Intrinsic DimensionalityOral903 citations
- Synthetic and Natural Noise Both Break Neural Machine TranslationOral893 citations
- Deep Gaussian Embedding of Graphs: Unsupervised Inductive Learning via RankingPoster885 citations
- Understanding Deep Neural Networks with Rectified Linear UnitsPoster864 citations
- Parameter Space Noise for ExplorationPoster811 citations
- Scalable Private Learning with PATEPoster809 citations
- Learning Deep Generative Models of GraphsWorkshop793 citations
- Thermometer Encoding: One Hot Way To Resist Adversarial ExamplesPoster771 citations
- A DIRT-T Approach to Unsupervised Domain AdaptationPoster758 citations
- Generating Natural Adversarial ExamplesPoster747 citations
- A PAC-Bayesian Approach to Spectrally-Normalized Margin Bounds for Neural NetworksPoster736 citations
- An efficient framework for learning sentence representationsPoster732 citations
- Stochastic Activation Pruning for Robust Adversarial DefensePoster729 citations
- Distributed Distributional Deterministic Policy GradientsPoster726 citations
- On the Information Bottleneck Theory of Deep LearningPoster723 citations
- Go for a Walk and Arrive at the Answer: Reasoning Over Paths in Knowledge Bases using Reinforcement LearningPoster701 citations
- cGANs with Projection DiscriminatorPoster694 citations
- Self-ensembling for visual domain adaptationPoster690 citations
- Recasting Gradient-Based Meta-Learning as Hierarchical BayesPoster686 citations
- Compositional Attention Networks for Machine ReasoningPoster684 citations
- On the State of the Art of Evaluation in Neural Language ModelsPoster678 citations
- Beyond Finite Layer Neural Networks: Bridging Deep Architectures and Numerical Differential EquationsWorkshop674 citations
- Stochastic Variational Video PredictionPoster671 citations
- MaskGAN: Better Text Generation via Filling in the _______Poster661 citations
- Spatially Transformed Adversarial ExamplesPoster648 citations
- Generalizing Across Domains via Cross-Gradient TrainingPoster645 citations
- Training GANs with OptimismPoster624 citations
- FearNet: Brain-Inspired Model for Incremental LearningPoster613 citations
- Variational Inference of Disentangled Latent Concepts from Unlabeled ObservationsPoster607 citations
- Deep Active Learning for Named Entity RecognitionPoster596 citations
- Learn to Pay AttentionPoster596 citations
- Model-Ensemble Trust-Region Policy OptimizationPoster592 citations
- Deep Voice 3: Scaling Text-to-Speech with Convolutional Sequence LearningPoster586 citations
- Evaluating the Robustness of Neural Networks: An Extreme Value Theory ApproachPoster585 citations
- Maximum a Posteriori Policy OptimisationPoster580 citations
- Sensitivity and Generalization in Neural Networks: an Empirical StudyPoster545 citations
- A Framework for the Quantitative Evaluation of Disentangled RepresentationsPoster537 citations
- GANITE: Estimation of Individualized Treatment Effects using Generative Adversarial NetsPoster536 citations
- Large scale distributed neural network training through online distillationPoster535 citations
- Rethinking the Smaller-Norm-Less-Informative Assumption in Channel Pruning of Convolution LayersPoster530 citations
- A Scalable Laplace Approximation for Neural NetworksPoster528 citations
- Training and Inference with Integers in Deep Neural NetworksOral527 citations
- Emergent Complexity via Multi-Agent CompetitionPoster524 citations
- Towards Reverse-Engineering Black-Box Neural NetworksPoster490 citations
- Gaussian Process Behaviour in Wide Deep Neural NetworksPoster483 citations
- Measuring the Intrinsic Dimension of Objective LandscapesPoster482 citations
- Intrinsic Motivation and Automatic Curricula via Asymmetric Self-PlayPoster464 citations
- META LEARNING SHARED HIERARCHIESPoster456 citations
- Breaking the Softmax Bottleneck: A High-Rank RNN Language ModelOral452 citations
- Continuous Adaptation via Meta-Learning in Nonstationary and Competitive EnvironmentsOral451 citations
- Semi-parametric topological memory for navigationPoster450 citations
- A Bayesian Perspective on Generalization and Stochastic Gradient DescentPoster448 citations
- Accelerating Neural Architecture Search using Performance PredictionWorkshop446 citations
- Syntax-Directed Variational Autoencoder for Structured DataPoster446 citations
- Adversarial SpheresWorkshop436 citations
- Deep Bayesian Bandits Showdown: An Empirical Comparison of Bayesian Deep Networks for Thompson SamplingPoster435 citations
- Empirical Analysis of the Hessian of Over-Parametrized Neural NetworksWorkshop435 citations
- Learning how to explain neural networks: PatternNet and PatternAttributionPoster433 citations
- i-RevNet: Deep Invertible NetworksPoster426 citations
- Flipout: Efficient Pseudo-Independent Weight Perturbations on Mini-BatchesPoster418 citations
- Depthwise Separable Convolutions for Neural Machine TranslationPoster416 citations
- Learning General Purpose Distributed Sentence Representations via Large Scale Multi-task LearningPoster414 citations
- Deep Learning for Physical Processes: Incorporating Prior Scientific KnowledgePoster412 citations
- Apprentice: Using Knowledge Distillation Techniques To Improve Low-Precision Network AccuracyPoster410 citations
- All-but-the-Top: Simple and Effective Postprocessing for Word RepresentationsPoster391 citations
- Adversarially Regularized AutoencodersWorkshop390 citations
- Improving GANs Using Optimal TransportPoster388 citations
- On the importance of single directions for generalizationPoster388 citations
- SpectralNet: Spectral Clustering using Deep Neural NetworksPoster387 citations
- WRPN: Wide Reduced-Precision NetworksPoster382 citations
- Stochastic gradient descent performs variational inference, converges to limit cycles for deep networksPoster375 citations
- Learning an Embedding Space for Transferable Robot SkillsPoster365 citations
- FigureQA: An Annotated Figure Dataset for Visual ReasoningWorkshop360 citations
- COLD FUSION: TRAINING SEQ2SEQ MODELS TOGETHER WITH LANGUAGE MODELSWorkshop358 citations
- Backpropagation through the Void: Optimizing control variates for black-box gradient estimationPoster353 citations
- Deep Rewiring: Training very sparse deep networksPoster352 citations
- Inference Suboptimality in Variational AutoencodersWorkshop349 citations
- Skip Connections Eliminate SingularitiesPoster349 citations
- Adversarial Dropout RegularizationPoster347 citations
- Natural Language Inference over Interaction SpacePoster347 citations
- Tree-to-tree Neural Networks for Program TranslationWorkshop342 citations
- Zero-Shot Visual ImitationOral339 citations
- Improving the Improved Training of Wasserstein GANs: A Consistency Term and Its Dual EffectPoster332 citations
- Learning from Between-class Examples for Deep Sound RecognitionPoster326 citations
- NerveNet: Learning Structured Policy with Graph Neural NetworksPoster326 citations
- Relational Neural Expectation Maximization: Unsupervised Discovery of Objects and their InteractionsPoster326 citations
- Temporal Difference Models: Model-Free Deep RL for Model-Based ControlPoster325 citations
- Meta-Learning and Universality: Deep Representations and Gradient Descent can Approximate any Learning AlgorithmPoster324 citations
- Simple and efficient architecture search for Convolutional Neural NetworksWorkshop323 citations
- Neural Map: Structured Memory for Deep Reinforcement LearningPoster320 citations
- Monotonic Chunkwise AttentionPoster319 citations
- Learning One-hidden-layer Neural Networks with Landscape DesignPoster318 citations
- CausalGAN: Learning Causal Implicit Generative Models with Adversarial TrainingPoster314 citations
- On the regularization of Wasserstein GANsPoster309 citations
- Latent Space Oddity: on the Curvature of Deep Generative ModelsPoster308 citations
- Learning Latent Permutations with Gumbel-Sinkhorn NetworksPoster307 citations
- SGD Learns Over-parameterized Networks that Provably Generalize on Linearly Separable DataPoster305 citations
- Routing Networks: Adaptive Selection of Non-Linear Functions for Multi-Task LearningPoster302 citations
- Online Learning Rate Adaptation with Hypergradient DescentPoster301 citations
- Skip RNN: Learning to Skip State Updates in Recurrent Neural NetworksPoster292 citations
- Large Scale Optimal Transport and Mapping EstimationPoster291 citations
- Communication Algorithms via Deep LearningPoster289 citations
- MGAN: Training Generative Adversarial Nets with Multiple GeneratorsPoster287 citations
- Wavelet Pooling for Convolutional Neural NetworksPoster285 citations
- Building Generalizable Agents with a Realistic and Rich 3D EnvironmentWorkshop279 citations
- Learning to cluster in order to transfer across domains and tasksPoster278 citations
- Emergence of Linguistic Communication from Referential Games with Symbolic and Pixel InputOral276 citations
- AmbientGAN: Generative models from lossy measurementsOral273 citations
- Beyond Word Importance: Contextual Decomposition to Extract Interactions from LSTMsOral272 citations
- Reinforcement Learning from Imperfect DemonstrationsWorkshop271 citations
- Many Paths to Equilibrium: GANs Do Not Need to Decrease a Divergence At Every StepPoster265 citations
- Auto-Conditioned Recurrent Networks for Extended Complex Human Motion SynthesisPoster264 citations
- Learning to Count Objects in Natural Images for Visual Question AnsweringPoster260 citations
- Emergence of grid-like representations by training recurrent neural networks to perform spatial localizationPoster257 citations
- Leveraging Grammar and Reinforcement Learning for Neural Program SynthesisPoster257 citations
- PixelNN: Example-based Image SynthesisPoster255 citations
- Detecting Statistical Interactions from Neural Network WeightsPoster243 citations
- The power of deeper networks for expressing natural functionsPoster242 citations
- Reinforcement Learning on Web Interfaces using Workflow-Guided ExplorationPoster234 citations
- N2N learning: Network to Network Compression via Policy Gradient Reinforcement LearningPoster232 citations
- Mixed Precision Training of Convolutional Neural Networks using Integer OperationsPoster226 citations
- Polar Transformer NetworksPoster225 citations
- Emergent Communication through NegotiationPoster211 citations
- A Hierarchical Model for Device PlacementPoster210 citations
- Investigating Human Priors for Playing Video GamesWorkshop210 citations
- FusionNet: Fusing via Fully-aware Attention with Application to Machine ComprehensionPoster209 citations
- Neural Language Modeling by Jointly Learning Syntax and LexiconPoster208 citations
- Evidence Aggregation for Answer Re-Ranking in Open-Domain Question AnsweringPoster207 citations
- Minimal-Entropy Correlation Alignment for Unsupervised Deep Domain AdaptationPoster204 citations
- Learning From Noisy Singly-labeled DataPoster202 citations
- Multi-level Residual Networks from Dynamical Systems ViewPoster202 citations
- Auto-Encoding Sequential Monte CarloPoster201 citations
- Towards Image Understanding from Deep Compression Without DecodingPoster200 citations
- VoiceLoop: Voice Fitting and Synthesis via a Phonological LoopPoster200 citations
- Eigenoption Discovery through the Deep Successor RepresentationPoster194 citations
- Hierarchical and Interpretable Skill Acquisition in Multi-task Reinforcement LearningPoster194 citations
- Do GANs learn the distribution? Some Theory and EmpiricsPoster191 citations
- Ask the Right Questions: Active Question Reformulation with Reinforcement LearningOral190 citations
- Neural-Guided Deductive Search for Real-Time Program Synthesis from ExamplesPoster190 citations
- Bi-Directional Block Self-Attention for Fast and Memory-Efficient Sequence ModelingPoster189 citations
- Can recurrent neural networks warp time?Poster189 citations
- Variance Reduction for Policy Gradient with Action-Dependent Factorized BaselinesOral187 citations
- Hyperparameter optimization: a spectral approachPoster184 citations
- Leave no Trace: Learning to Reset for Safe and Autonomous Reinforcement LearningPoster183 citations
- Residual Connections Encourage Iterative InferencePoster174 citations
- Efficient Sparse-Winograd Convolutional Neural NetworksPoster172 citations
- Latent Constraints: Learning to Generate Conditionally from Unconditional Generative ModelsPoster171 citations
- Loss-aware Weight Quantization of Deep NetworksPoster171 citations
- Decision Boundary Analysis of Adversarial ExamplesPoster170 citations
- Generative Models of Visually Grounded ImaginationPoster170 citations
- Dynamic Neural Program Embeddings for Program RepairPoster169 citations
- Compressing Word Embeddings via Deep Compositional Code LearningPoster166 citations
- Learning Discrete Weights Using the Local Reparameterization TrickPoster164 citations
- Neural Sketch Learning for Conditional Program GenerationOral164 citations
- DuoRC: Towards Complex Language Understanding with Paraphrased Reading ComprehensionWorkshop161 citations
- Learning Intrinsic Sparse Structures within Long Short-Term MemoryPoster161 citations
- TreeQN and ATreeC: Differentiable Tree-Structured Models for Deep Reinforcement LearningPoster161 citations
- Sobolev GANPoster160 citations
- Deep Learning with Logged Bandit FeedbackPoster158 citations
- Covariant Compositional Networks For Learning GraphsWorkshop157 citations
- Generalizing Hamiltonian Monte Carlo with Neural NetworksPoster157 citations
- Can Neural Networks Understand Logical Entailment?Poster154 citations
- On Unifying Deep Generative ModelsPoster152 citations
- Understanding Short-Horizon Bias in Stochastic Meta-OptimizationPoster152 citations
- SCAN: Learning Hierarchical Compositional Visual ConceptsPoster151 citations
- Some Considerations on Learning to Explore via Meta-Reinforcement LearningWorkshop151 citations
- On the insufficiency of existing momentum schemes for Stochastic OptimizationOral149 citations
- When is a Convolutional Filter Easy to Learn?Poster149 citations
- Variational Network QuantizationPoster148 citations
- Deep Learning and Quantum Entanglement: Fundamental Connections with Implications to Network DesignPoster147 citations
- Smooth Loss Functions for Deep Top-k ClassificationPoster147 citations
- Word Mover's Embedding: From Word2Vec to Document EmbeddingActive147 citations
- Simulating Action Dynamics with Neural Process NetworksPoster143 citations
- Beyond Shared Hierarchies: Deep Multitask Learning through Soft Layer OrderingPoster141 citations
- Semantically Decomposing the Latent Spaces of Generative Adversarial NetworksPoster140 citations
- Alternating Multi-bit Quantization for Recurrent Neural NetworksPoster138 citations
- Expressive power of recurrent neural networksPoster138 citations
- Trust-PCL: An Off-Policy Trust Region Method for Continuous ControlPoster137 citations
- Divide-and-Conquer Reinforcement LearningPoster136 citations
- Jointly Learning to Construct and Control Agents using Deep Reinforcement LearningWorkshop134 citations
- DCN+: Mixed Objective And Deep Residual Coattention for Question AnsweringPoster133 citations
- HexaConvPoster130 citations
- Overcoming Catastrophic Interference using Conceptor-Aided BackpropagationPoster127 citations
- Cascade Adversarial Machine Learning Regularized with a Unified EmbeddingPoster126 citations
- WHAI: Weibull Hybrid Autoencoding Inference for Deep Topic ModelingPoster126 citations
- Attacking Binarized Neural NetworksPoster125 citations
- Gradient Estimators for Implicit ModelsPoster123 citations
- Global Optimality Conditions for Deep Neural NetworksPoster122 citations
- Active Neural LocalizationPoster121 citations
- Memory-based Parameter AdaptationPoster121 citations
- Stabilizing Adversarial Nets with Prediction MethodsPoster121 citations
- Fix your classifier: the marginal value of training the last weight layerPoster118 citations
- Emergent Communication in a Multi-Modal, Multi-Step Referential GamePoster117 citations
- The Reactor: A fast and sample-efficient Actor-Critic agent for Reinforcement LearningPoster116 citations
- Parallelizing Linear Recurrent Neural Nets Over Sequence LengthPoster115 citations
- Kronecker-factored Curvature Approximations for Recurrent Neural NetworksPoster114 citations
- Activation Maximization Generative Adversarial NetsPoster112 citations
- TRUNCATED HORIZON POLICY SEARCH: COMBINING REINFORCEMENT LEARNING & IMITATION LEARNINGPoster112 citations
- Unbiased Online Recurrent OptimizationPoster112 citations
- Unsupervised Learning of Goal Spaces for Intrinsically Motivated Goal ExplorationPoster112 citations
- Exponentially vanishing sub-optimal local minima in multilayer neural networksWorkshop110 citations
- Critical Points of Linear Neural Networks: Analytical Forms and Landscape PropertiesPoster109 citations
- Towards Neural Phrase-based Machine TranslationPoster106 citations
- Intriguing Properties of Adversarial ExamplesWorkshop102 citations
- Exploring Deep Recurrent Models with Reinforcement Learning for Molecule DesignWorkshop101 citations
- The High-Dimensional Geometry of Binary Neural NetworksPoster101 citations
- Action-dependent Control Variates for Policy Optimization via Stein IdentityPoster100 citations
- Few-shot Autoregressive Density Estimation: Towards Learning to Learn DistributionsPoster99 citations
- Memory Augmented Control NetworksPoster98 citations
- DNA-GAN: Learning Disentangled Representations from Multi-Attribute ImagesWorkshop95 citations
- Variance-based Gradient Compression for Efficient Distributed Deep LearningWorkshop94 citations
- Compositional Obverter Communication Learning from Raw Visual InputPoster93 citations
- An Online Learning Approach to Generative Adversarial NetworksPoster92 citations
- Graph Partition Neural Networks for Semi-Supervised ClassificationWorkshop91 citations
- Multi-Task Learning for Document Ranking and Query SuggestionPoster91 citations
- Training wide residual networks for deployment using a single bit for each weightPoster89 citations
- Interactive Grounded Language Acquisition and Generalization in a 2D WorldPoster87 citations
- Unsupervised Cipher Cracking Using Discrete GANsPoster86 citations
- Time-Dependent Representation for Neural Event Sequence PredictionWorkshop85 citations
- Coulomb GANs: Provably Optimal Nash Equilibria via Potential FieldsPoster84 citations
- Fidelity-Weighted LearningPoster84 citations
- Quantitatively Evaluating GANs With Divergences Proposed for TrainingPoster84 citations
- Still not systematic after all these years: On the compositional skills of sequence-to-sequence recurrent networksWorkshop84 citations
- A New Method of Region Embedding for Text ClassificationPoster83 citations
- Convolutional Sequence Modeling RevisitedWorkshop80 citations
- DORA The Explorer: Directed Outreaching Reinforcement Action-SelectionPoster79 citations
- Interpretable Counting for Visual Question AnsweringPoster79 citations
- Progressive Reinforcement Learning with Distillation for Multi-Skilled Motion ControlPoster79 citations
- Adaptive Quantization of Neural NetworksPoster77 citations
- Emergent Translation in Multi-Agent CommunicationPoster77 citations
- Learning Wasserstein EmbeddingsPoster73 citations
- Minimax Curriculum Learning: Machine Teaching with Desirable Difficulties and Scheduled DiversityPoster73 citations
- Hierarchical Density Order EmbeddingsPoster70 citations
- Fraternal DropoutPoster69 citations
- On the limitations of first order approximation in GAN dynamicsWorkshop69 citations
- Learning Approximate Inference Networks for Structured PredictionPoster68 citations
- Kernel Implicit Variational InferencePoster67 citations
- Towards Synthesizing Complex Programs From Input-Output ExamplesPoster67 citations
- Multiple Source Domain Adaptation with Adversarial LearningWorkshop66 citations
- Robustness of Classifiers to Universal Perturbations: A Geometric PerspectivePoster66 citations
- Debiasing Evidence Approximations: On Importance-weighted Autoencoders and Jackknife Variational InferencePoster65 citations
- Regret Minimization for Partially Observable Deep Reinforcement LearningWorkshop65 citations
- Consequentialist conditional cooperation in social dilemmas with imperfect informationPoster64 citations
- Gradients explode - Deep Networks are shallow - ResNet explainedWorkshop64 citations
- Twin Networks: Matching the Future for Sequence GenerationPoster64 citations
- Challenges in Disentangling Independent Factors of VariationWorkshop63 citations
- Learning Deep Mean Field Games for Modeling Large Population BehaviorOral63 citations
- Memory Architectures in Recurrent Neural Network Language ModelsPoster63 citations
- DLVM: A modern compiler infrastructure for deep learning systemsWorkshop62 citations
- LEARNING TO SHARE: SIMULTANEOUS PARAMETER TYING AND SPARSIFICATION IN DEEP LEARNINGPoster58 citations
- Learning Awareness ModelsPoster58 citations
- Learning Parametric Closed-Loop Policies for Markov Potential GamesPoster58 citations
- Weightless: Lossy Weight Encoding For Deep Neural Network CompressionWorkshop58 citations
- Neural Speed Reading via Skim-RNNPoster57 citations
- Confidence Scoring Using Whitebox Meta-models with Linear Classifier ProbesActive54 citations
- The Kanerva Machine: A Generative Distributed MemoryPoster54 citations
- A Compressed Sensing View of Unsupervised Text Embeddings, Bag-of-n-Grams, and LSTMsPoster53 citations
- Combining Symbolic Expressions and Black-box Function Evaluations in Neural ProgramsPoster52 citations
- Semantic Code Repair using Neuro-Symbolic Transformation NetworksWorkshop52 citations
- Implicit Causal Models for Genome-wide Association StudiesPoster51 citations
- Memorization Precedes Generation: Learning Unsupervised GANs with Memory NetworksPoster51 citations
- Learning Deep Models: Critical Points and Local OpennessWorkshop50 citations
- Kronecker Recurrent UnitsWorkshop49 citations
- Variational Message Passing with Structured Inference NetworksPoster49 citations
- Boosting the Actor with Dual CriticPoster48 citations
- On the Expressive Power of Overlapping Architectures of Deep LearningPoster48 citations
- Deep Sensing: Active Sensing using Multi-directional Recurrent Neural NetworksPoster46 citations
- Proximal BackpropagationPoster46 citations
- Generative networks as inverse problems with Scattering transformsPoster45 citations
- Learning Latent Representations in Neural Networks for Clustering through Pseudo Supervision and Graph-based Activity RegularizationPoster43 citations
- Learning to Multi-Task by Active SamplingPoster43 citations
- Policy Optimization by Genetic DistillationPoster43 citations
- Reinforcement Learning Algorithm SelectionPoster43 citations
- An image representation based convolutional network for DNA classificationPoster42 citations
- Can Deep Reinforcement Learning solve Erdos-Selfridge-Spencer Games?Workshop42 citations
- Multi-Mention Learning for Reading Comprehension with Neural CascadesPoster41 citations
- Natural Language Inference with External KnowledgeWorkshop41 citations
- Adaptive Dropout with Rademacher Complexity RegularizationPoster40 citations
- Synthesizing realistic neural population activity patterns using Generative Adversarial NetworksPoster40 citations
- Sparse Persistent RNNs: Squeezing Large Recurrent Networks On-ChipPoster39 citations
- Value Propagation NetworksWorkshop38 citations
- Analyzing and Exploiting NARX Recurrent Neural Networks for Long-Term DependenciesWorkshop36 citations
- Learning Sparse Latent Representations with the Deep Copula Information BottleneckPoster35 citations
- Parametrized Hierarchical Procedures for Neural ProgrammingPoster35 citations
- The loss surface and expressivity of deep convolutional neural networksWorkshop35 citations
- Distributional Adversarial NetworksWorkshop32 citations
- Mastering the Dungeon: Grounded Language Learning by Mechanical Turker DescentPoster32 citations
- Guide Actor-Critic for Continuous ControlPoster30 citations
- Towards Provable Control for Unknown Linear Dynamical SystemsWorkshop29 citations
- Not-So-Random FeaturesPoster28 citations
- Semantic Interpolation in Implicit ModelsPoster28 citations
- Deep Learning as a Mixed Convex-Combinatorial Optimization ProblemPoster27 citations
- Learning a Generative Model for Validity in Complex Discrete StructuresPoster27 citations
- Temporally Efficient Deep Learning with SpikesPoster27 citations
- Deep learning mutation prediction enables early stage lung cancer detection in liquid biopsyWorkshop26 citations
- Fast and Accurate Text Classification: Skimming, Rereading and Early StoppingWorkshop26 citations
- Initialization matters: Orthogonal Predictive State Recurrent Neural NetworksPoster26 citations
- Benefits of Depth for Long-Term Memory of Recurrent NetworksWorkshop25 citations
- The Role of Minimal Complexity Functions in Unsupervised Learning of Semantic MappingsPoster25 citations
- Divide and Conquer NetworksPoster24 citations
- Neumann Optimizer: A Practical Optimization Algorithm for Deep Neural NetworksPoster24 citations
- Shifting Mean Activation Towards Zero with Bipolar Activation FunctionsWorkshop24 citations
- Viterbi-based Pruning for Sparse Matrix with Fixed and High Index Compression RatioPoster24 citations
- Boosting Dilated Convolutional Networks with Mixed Tensor DecompositionsOral23 citations
- Empirical Risk Landscape Analysis for Understanding Deep Neural NetworksPoster23 citations
- A Flexible Approach to Automated RNN Architecture GenerationWorkshop22 citations
- Distributed Fine-tuning of Language Models on Private DataPoster22 citations
- Fast Node Embeddings: Learning Ego-Centric RepresentationsWorkshop22 citations
- Multi-View Data Generation Without View SupervisionPoster22 citations
- TD or not TD: Analyzing the Role of Temporal Differencing in Deep Reinforcement LearningPoster22 citations
- Ensemble Robustness and Generalization of Stochastic Deep Learning AlgorithmsWorkshop21 citations
- Simulated+Unsupervised Learning With Adaptive Data Generation and Bidirectional MappingsPoster21 citations
- Feature Incay for Representation RegularizationWorkshop20 citations
- Predicting Floor-Level for 911 Calls with Neural Networks and Smartphone Sensor DataPoster18 citations
- TRAINING GENERATIVE ADVERSARIAL NETWORKS VIA PRIMAL-DUAL SUBGRADIENT METHODS: A LAGRANGIAN PERSPECTIVE ON GANPoster18 citations
- Faster Discovery of Neural Architectures by Searching for Paths in a Large ModelWorkshop17 citations
- Improving GAN Training via Binarized Representation Entropy (BRE) RegularizationPoster17 citations
- Espresso: Efficient Forward Propagation for Binary Deep Neural NetworksPoster16 citations
- Deep Mean Field Theory: Layerwise Variance and Width Variation as Methods to Control Gradient ExplosionWorkshop15 citations
- Imitation Learning from Visual Data with Multiple IntentionsPoster15 citations
- AUTOMATED DESIGN USING NEURAL NETWORKS AND GRADIENT DESCENTWorkshop14 citations
- Identifying Analogies Across DomainsPoster14 citations
- Improving the Universality and Learnability of Neural Programmer-Interpreters with Combinator AbstractionPoster14 citations
- Predict Responsibly: Increasing Fairness by Learning to DeferWorkshop14 citations
- LSH-SAMPLING BREAKS THE COMPUTATIONAL CHICKEN-AND-EGG LOOP IN ADAPTIVE STOCHASTIC GRADIENT ESTIMATIONWorkshop13 citations
- No Spurious Local Minima in a Two Hidden Unit ReLU NetworkWorkshop13 citations
- Hierarchical Subtask Discovery with Non-Negative Matrix FactorizationPoster12 citations
- Automatically Inferring Data Quality for Spatiotemporal ForecastingPoster9 citations
- Neural Program Search: Solving Data Processing Tasks from Description and ExamplesWorkshop9 citations
- Adversarial Policy Gradient for Alternating Markov GamesWorkshop8 citations
- Decoding Decoders: Finding Optimal Representation Spaces for Unsupervised Similarity TasksWorkshop8 citations
- Capturing Human Category Representations by Sampling in Deep Feature SpacesWorkshop7 citations
- Learning a neural response metric for retinal prosthesisPoster7 citations
- Learning to InferWorkshop7 citations
- THE EFFECTIVENESS OF A TWO-LAYER NEURAL NETWORK FOR RECOMMENDATIONSWorkshop7 citations
- Autoregressive Generative Adversarial NetworksWorkshop6 citations
- Extending the Framework of Equilibrium Propagation to General DynamicsWorkshop6 citations
- GeoSeq2Seq: Information Geometric Sequence-to-Sequence NetworksWorkshop6 citations
- Neuron as an AgentWorkshop6 citations
- Not-So-CLEVR: Visual Relations Strain Feedforward Neural NetworksWorkshop6 citations
- Residual Loss Prediction: Reinforcement Learning With No Incremental FeedbackPoster6 citations
- Rotational Unit of MemoryWorkshop6 citations
- Universal Agent for Disentangling Environments and TasksPoster6 citations
- Cross-View Training for Semi-Supervised LearningWorkshop5 citations
- Topic-Based Question GenerationWorkshop5 citations
- Understanding image motion with group representationsPoster5 citations
- Parametric Adversarial Divergences are Good Task Losses for Generative ModelingWorkshop4 citations
- Stable Distribution Alignment Using the Dual of the Adversarial DistanceWorkshop4 citations
- THINK VISUALLY: QUESTION ANSWERING THROUGH VIRTUAL IMAGERYActive4 citations
- Decoupling the Layers in Residual NetworksPoster2 citations
- DropMax: Adaptive Stochastic SoftmaxWorkshop2 citations
- Cross-Corpus Training with TreeLSTM for the Extraction of Biomedical Relationships from TextWorkshop1 citations
- Modular Continual Learning in a Unified Visual EnvironmentPoster1 citations
- Adaptive Memory NetworksWorkshop
- Boundary Seeking GANsPoster
- Critical Percolation as a Framework to Analyze the Training of Deep NetworksPoster
- Deep contextualized word representationsPoster
- Distributed Prioritized Experience ReplayPoster
- LEARNING TO ORGANIZE KNOWLEDGE WITH N-GRAM MACHINESWorkshop
- Learning to Write by Learning the ObjectiveWorkshop
- On the Discrimination-Generalization Tradeoff in GANsPoster
- Regularization Neural Networks via Constrained Virtual Movement FieldWorkshop
- SEARNN: Training RNNs with global-local lossesPoster
- Towards Effective GANs for Data Distributions with Diverse ModesWorkshop
- WSNet: Learning Compact and Efficient Networks with Weight SamplingWorkshop
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.