ICLR 2022 Accepted Papers
The full list of 1,094 papers accepted at ICLR 2022 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 865Spotlight: 174Oral: 55
- LoRA: Low-Rank Adaptation of Large Language ModelsPoster14,155 citations
- Finetuned Language Models are Zero-Shot LearnersOral3,956 citations
- BEiT: BERT Pre-Training of Image TransformersOral3,437 citations
- Efficiently Modeling Long Sequences with Structured State SpacesOral2,281 citations
- MobileViT: Light-weight, General-purpose, and Mobile-friendly Vision TransformerPoster1,975 citations
- Multitask Prompted Training Enables Zero-Shot Task GeneralizationSpotlight1,949 citations
- How Attentive are Graph Attention Networks?Poster1,723 citations
- SDEdit: Guided Image Synthesis and Editing with Stochastic Differential EquationsPoster1,666 citations
- Progressive Distillation for Fast Sampling of Diffusion ModelsSpotlight1,365 citations
- VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised LearningPoster1,327 citations
- Open-vocabulary Object Detection via Vision and Language Knowledge DistillationPoster1,091 citations
- Towards a Unified View of Parameter-Efficient Transfer LearningSpotlight1,066 citations
- DAB-DETR: Dynamic Anchor Boxes are Better Queries for DETRPoster1,046 citations
- Image BERT Pre-training with Online TokenizerPoster1,044 citations
- Offline Reinforcement Learning with Implicit Q-LearningPoster1,021 citations
- Pyraformer: Low-Complexity Pyramidal Attention for Long-Range Time Series Modeling and ForecastingOral984 citations
- SimVLM: Simple Visual Language Model Pretraining with Weak SupervisionPoster918 citations
- Rethinking Network Design and Local Geometry in Point Cloud: A Simple Residual MLP FrameworkPoster825 citations
- Fine-Tuning can Distort Pretrained Features and Underperform Out-of-DistributionOral807 citations
- An Explanation of In-context Learning as Implicit Bayesian InferencePoster795 citations
- Language-driven Semantic SegmentationPoster769 citations
- Anomaly Transformer: Time Series Anomaly Detection with Association DiscrepancySpotlight768 citations
- Train Short, Test Long: Attention with Linear Biases Enables Input Length ExtrapolationPoster757 citations
- Perceiver IO: A General Architecture for Structured Inputs & OutputsSpotlight698 citations
- How Do Vision Transformers Work?Spotlight687 citations
- FILIP: Fine-grained Interactive Language-Image Pre-TrainingPoster672 citations
- Tackling the Generative Learning Trilemma with Denoising Diffusion GANsSpotlight669 citations
- Reversible Instance Normalization for Accurate Time-Series Forecasting against Distribution ShiftPoster667 citations
- Pseudo Numerical Methods for Diffusion Models on ManifoldsPoster656 citations
- StyleNeRF: A Style-based 3D Aware Generator for High-resolution Image SynthesisPoster653 citations
- GeoDiff: A Geometric Diffusion Model for Molecular Conformation GenerationOral645 citations
- Label-Efficient Semantic Segmentation with Diffusion ModelsPoster644 citations
- Solving Inverse Problems in Medical Imaging with Score-Based Generative ModelsPoster615 citations
- Understanding over-squashing and bottlenecks on graphs via curvatureOral584 citations
- Vector-quantized Image Modeling with Improved VQGANPoster575 citations
- Open-Set Recognition: A Good Closed-Set Classifier is All You NeedOral556 citations
- Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training ParadigmPoster535 citations
- Fast Model Editing at ScalePoster510 citations
- How Much Can CLIP Benefit Vision-and-Language Tasks?Poster494 citations
- Omni-Dimensional Dynamic ConvolutionSpotlight472 citations
- Understanding Dimensional Collapse in Contrastive Self-supervised LearningPoster452 citations
- Graph Neural Networks with Learnable Structural and Positional RepresentationsPoster448 citations
- Pre-training Molecular Graph Representation with 3D GeometryPoster443 citations
- Large Language Models Can Be Strong Differentially Private LearnersOral415 citations
- Pix2seq: A Language Modeling Framework for Object DetectionPoster415 citations
- When Vision Transformers Outperform ResNets without Pre-training or Strong Data AugmentationsSpotlight410 citations
- Differentially Private Fine-tuning of Language ModelsPoster403 citations
- CrossFormer: A Versatile Vision Transformer Hinging on Cross-scale AttentionPoster394 citations
- Mastering Visual Continuous Control: Improved Data-Augmented Reinforcement LearningPoster393 citations
- VOS: Learning What You Don't Know by Virtual Outlier SynthesisPoster385 citations
- Analytic-DPM: an Analytic Estimate of the Optimal Reverse Variance in Diffusion Probabilistic ModelsOral383 citations
- Message Passing Neural PDE SolversSpotlight371 citations
- Learning Audio-Visual Speech Representation by Masked Multimodal Cluster PredictionPoster368 citations
- UniFormer: Unified Transformer for Efficient Spatial-Temporal Representation LearningPoster364 citations
- Is Homophily a Necessity for Graph Neural Networks?Poster358 citations
- CoST: Contrastive Learning of Disentangled Seasonal-Trend Representations for Time Series ForecastingPoster354 citations
- Gradient Matching for Domain GeneralizationPoster353 citations
- On Bridging Generic and Personalized Federated Learning for Image ClassificationSpotlight344 citations
- Temporal Efficient Training of Spiking Neural Network via Gradient Re-weightingPoster338 citations
- Discovering Invariant Rationales for Graph Neural NetworksPoster332 citations
- Trust Region Policy Optimisation in Multi-Agent Reinforcement LearningPoster329 citations
- Unsupervised Semantic Segmentation by Distilling Feature CorrespondencesPoster328 citations
- Large-Scale Representation Learning on Graphs via BootstrappingPoster324 citations
- Crystal Diffusion Variational Autoencoder for Periodic Material GenerationPoster315 citations
- Learning with Noisy Labels Revisited: A Study Using Real-World Human AnnotationsPoster313 citations
- CDTrans: Cross-domain Transformer for Unsupervised Domain AdaptationPoster310 citations
- FedBABU: Toward Enhanced Representation for Federated Image ClassificationPoster306 citations
- Memorizing TransformersSpotlight302 citations
- 8-bit Optimizers via Block-wise QuantizationSpotlight293 citations
- cosFormer: Rethinking Softmax In AttentionPoster290 citations
- Optimal ANN-SNN Conversion for High-accuracy and Ultra-low-latency Spiking Neural NetworksPoster280 citations
- A Fine-Grained Analysis on Distribution ShiftOral272 citations
- ViTGAN: Training GANs with Vision TransformersSpotlight269 citations
- Geometric and Physical Quantities improve E(3) Equivariant Message PassingSpotlight268 citations
- Score-Based Generative Modeling with Critically-Damped Langevin DiffusionSpotlight268 citations
- Equivariant Transformers for Neural Network based Molecular PotentialsSpotlight265 citations
- TAPEX: Table Pre-training via Learning a Neural SQL ExecutorPoster260 citations
- Graph-less Neural Networks: Teaching Old MLPs New Tricks Via DistillationPoster258 citations
- AS-MLP: An Axial Shifted MLP Architecture for VisionPoster256 citations
- RegionViT: Regional-to-Local Attention for Vision TransformersPoster256 citations
- Synchromesh: Reliable Code Generation from Pre-trained Language ModelsPoster255 citations
- Uncertainty Modeling for Out-of-Distribution GeneralizationPoster252 citations
- New Insights on Reducing Abrupt Representation Change in Online Continual LearningPoster251 citations
- Open-World Semi-Supervised LearningPoster251 citations
- Efficient Self-supervised Vision Transformers for Representation LearningPoster245 citations
- Handling Distribution Shifts on Graphs: An Invariance PerspectivePoster245 citations
- Conditional Object-Centric Learning from VideoPoster239 citations
- PolyLoss: A Polynomial Expansion Perspective of Classification Loss FunctionsPoster239 citations
- The Role of Permutation Invariance in Linear Mode Connectivity of Neural NetworksPoster237 citations
- Equivariant Subgraph Aggregation NetworksSpotlight234 citations
- Generating Videos with Dynamics-aware Implicit Generative Adversarial NetworksPoster234 citations
- Adversarial Unlearning of Backdoors via Implicit HypergradientPoster233 citations
- Backdoor Defense via Decoupling the Training ProcessPoster233 citations
- Maximum Entropy RL (Provably) Solves Some Robust RL ProblemsPoster228 citations
- Spherical Message Passing for 3D Molecular GraphsPoster228 citations
- RvS: What is Essential for Offline RL via Supervised Learning?Poster227 citations
- Sparse DETR: Efficient End-to-End Object Detection with Learnable SparsityPoster227 citations
- ExT5: Towards Extreme Multi-Task Scaling for Transfer LearningPoster222 citations
- Differentiable Prompt Makes Pre-trained Language Models Better Few-shot LearnersPoster220 citations
- Scarf: Self-Supervised Contrastive Learning using Random Feature CorruptionSpotlight215 citations
- Quadtree Attention for Vision TransformersPoster211 citations
- From Stars to Subgraphs: Uplifting Any GNN with Local Structure AwarenessPoster210 citations
- Graph Condensation for Graph Neural NetworksPoster206 citations
- Effect of scale on catastrophic forgetting in neural networksPoster204 citations
- Self-supervised Learning is More Robust to Dataset ImbalanceSpotlight204 citations
- AdaMatch: A Unified Approach to Semi-Supervised Learning and Domain AdaptationPoster203 citations
- Transformers Can Do Bayesian InferencePoster202 citations
- Poisoning and Backdooring Contrastive LearningOral201 citations
- Learning Fast Samplers for Diffusion Models by Differentiating Through Sample QualityPoster200 citations
- Learning Fast, Learning Slow: A General Continual Learning Method based on Complementary Learning SystemPoster196 citations
- The Effects of Reward Misspecification: Mapping and Mitigating Misaligned ModelsPoster196 citations
- Surrogate Gap Minimization Improves Sharpness-Aware TrainingPoster195 citations
- Latent Variable Sequential Set Transformers for Joint Multi-Agent Motion PredictionSpotlight192 citations
- QDrop: Randomly Dropping Quantization for Extremely Low-bit Post-Training QuantizationPoster192 citations
- Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement LearningSpotlight191 citations
- Filling the G_ap_s: Multivariate Time Series Imputation by Graph Neural NetworksPoster190 citations
- PiCO: Contrastive Label Disambiguation for Partial Label LearningOral190 citations
- Independent SE(3)-Equivariant Models for End-to-End Rigid Protein DockingSpotlight188 citations
- Transformer-based Transform CodingPoster187 citations
- THOMAS: Trajectory Heatmap Output with learned Multi-Agent SamplingPoster184 citations
- You are AllSet: A Multiset Function Framework for Hypergraph Neural NetworksPoster184 citations
- miniF2F: a cross-system benchmark for formal Olympiad-level mathematicsPoster184 citations
- Likelihood Training of Schrödinger Bridge using Forward-Backward SDEs TheoryPoster181 citations
- Online Coreset Selection for Rehearsal-based Continual LearningPoster180 citations
- Latent Image Animator: Learning to Animate Images via Latent Space NavigationPoster178 citations
- Bayesian Neural Network Priors RevisitedPoster177 citations
- Robust Learning Meets Generative Models: Can Proxy Distributions Improve Adversarial Robustness?Poster177 citations
- Byzantine-Robust Learning on Heterogeneous Datasets via BucketingSpotlight175 citations
- Representational Continuity for Unsupervised Continual LearningOral174 citations
- FILM: Following Instructions in Language with Modular MethodsPoster173 citations
- FastSHAP: Real-Time Shapley Value EstimationPoster172 citations
- Label Leakage and Protection in Two-party Split LearningPoster172 citations
- Representation Learning for Online and Offline RL in Low-rank MDPsSpotlight172 citations
- Neural Collapse Under MSE Loss: Proximity to and Dynamics on the Central PathOral171 citations
- Pessimistic Model-based Offline Reinforcement Learning under Partial CoveragePoster171 citations
- Robbing the Fed: Directly Obtaining Private Data in Federated Learning with Modified ModelsPoster171 citations
- Scale Efficiently: Insights from Pretraining and Finetuning TransformersPoster170 citations
- Entroformer: A Transformer-based Entropy Model for Learned Image CompressionPoster169 citations
- Sample and Computation Redistribution for Efficient Face DetectionPoster169 citations
- Anti-Oversmoothing in Deep Vision Transformers via the Fourier Domain Analysis: From Theory to PracticePoster168 citations
- Charformer: Fast Character Transformers via Gradient-based Subword TokenizationPoster168 citations
- Leveraging unlabeled data to predict out-of-distribution performancePoster168 citations
- Mapping Language Models to Grounded Conceptual SpacesPoster168 citations
- Omni-Scale CNNs: a simple and effective kernel size configuration for time series classificationPoster168 citations
- Autoregressive Diffusion ModelsPoster165 citations
- Efficient Sharpness-aware Minimization for Improved Training of Neural NetworksPoster165 citations
- Towards Continual Knowledge Learning of Language ModelsPoster165 citations
- Bootstrapping Semantic Segmentation with Regional ContrastPoster163 citations
- FedPara: Low-rank Hadamard Product for Communication-Efficient Federated LearningPoster162 citations
- Domino: Discovering Systematic Errors with Cross-Modal EmbeddingsOral160 citations
- Global Convergence of Multi-Agent Policy Gradient in Markov Potential GamesPoster160 citations
- Iterative Refinement Graph Neural Network for Antibody Sequence-Structure Co-designSpotlight160 citations
- Illiterate DALL-E Learns to ComposePoster159 citations
- Sample Selection with Uncertainty of Losses for Learning with Noisy LabelsPoster159 citations
- Generative Models as a Data Source for Multiview Representation LearningPoster158 citations
- Node Feature Extraction by Self-Supervised Multi-scale Neighborhood PredictionPoster157 citations
- Equivariant and Stable Positional Encoding for More Powerful Graph Neural NetworksPoster155 citations
- On the Connection between Local Attention and Dynamic Depth-wise ConvolutionSpotlight155 citations
- A Conditional Point Diffusion-Refinement Paradigm for 3D Point Cloud CompletionPoster153 citations
- CKConv: Continuous Kernel Convolution For Sequential DataPoster153 citations
- Graph-Guided Network for Irregularly Sampled Multivariate Time SeriesPoster153 citations
- Frame Averaging for Invariant and Equivariant Network DesignOral152 citations
- Benchmarking the Spectrum of Agent CapabilitiesPoster151 citations
- Self-Supervised Graph Neural Networks for Improved Electroencephalographic Seizure AnalysisPoster150 citations
- On the Importance of Difficulty Calibration in Membership Inference AttacksPoster148 citations
- Diverse Client Selection for Federated Learning via Submodular MaximizationPoster147 citations
- Simple GNN Regularisation for 3D Molecular Property Prediction and BeyondPoster147 citations
- Assessing Generalization of SGD via DisagreementSpotlight145 citations
- Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation OverlapPoster145 citations
- Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling SchemeOral145 citations
- Extending the WILDS Benchmark for Unsupervised AdaptationOral143 citations
- GiraffeDet: A Heavy-Neck Paradigm for Object DetectionPoster143 citations
- Cold Brew: Distilling Graph Node Representations with Incomplete or Missing NeighborhoodsPoster142 citations
- Memory Replay with Data Compression for Continual LearningPoster142 citations
- Taming Sparsely Activated Transformer with Stochastic ExpertsPoster142 citations
- Efficient Active Search for Combinatorial Optimization ProblemsPoster141 citations
- Topological Graph Neural NetworksPoster141 citations
- PriorGrad: Improving Conditional Denoising Diffusion Models with Data-Dependent Adaptive PriorPoster140 citations
- Complete Verification via Multi-Neuron Relaxation Guided Branch-and-BoundPoster138 citations
- Exploring the Limits of Large Scale Pre-trainingSpotlight138 citations
- Hyperparameter Tuning with Renyi Differential PrivacyOral138 citations
- Leveraging Automated Unit Tests for Unsupervised Code TranslationSpotlight137 citations
- BiBERT: Accurate Fully Binarized BERTPoster134 citations
- Einops: Clear and Reliable Tensor Manipulations with Einstein-like NotationOral134 citations
- Gradient Step Denoiser for convergent Plug-and-PlayPoster134 citations
- Natural Language Descriptions of Deep Visual FeaturesOral134 citations
- The Unreasonable Effectiveness of Random Pruning: Return of the Most Naive Baseline for Sparse TrainingPoster134 citations
- Unified Visual Transformer CompressionPoster133 citations
- On the Pitfalls of Heteroscedastic Uncertainty Estimation with Probabilistic Neural NetworksPoster131 citations
- Dropout Q-Functions for Doubly Efficient Reinforcement LearningPoster130 citations
- Proof Artifact Co-Training for Theorem Proving with Language ModelsPoster130 citations
- A Program to Build E(N)-Equivariant Steerable CNNsPoster129 citations
- The Efficiency MisnomerPoster128 citations
- Adversarial Retriever-Ranker for Dense Text RetrievalPoster127 citations
- A New Perspective on "How Graph Neural Networks Go Beyond Weisfeiler-Lehman?"Oral126 citations
- MT3: Multi-Task Multitrack Music TranscriptionSpotlight126 citations
- Understanding and Preventing Capacity Loss in Reinforcement LearningSpotlight126 citations
- BadPre: Task-agnostic Backdoor Attacks to Pre-trained NLP Foundation ModelsPoster125 citations
- Divergence-aware Federated Self-Supervised LearningPoster125 citations
- Unsupervised Discovery of Object Radiance FieldsPoster125 citations
- Generalized Decision Transformer for Offline Hindsight Information MatchingSpotlight124 citations
- GraphENS: Neighbor-Aware Ego Network Synthesis for Class-Imbalanced Node ClassificationPoster124 citations
- When Can We Learn General-Sum Markov Games with a Large Number of Players Sample-Efficiently?Poster124 citations
- Graph-Augmented Normalizing Flows for Anomaly Detection of Multiple Time SeriesSpotlight122 citations
- What Happens after SGD Reaches Zero Loss? --A Mathematical FrameworkSpotlight122 citations
- MonoDistill: Learning Spatial Features for Monocular 3D Object DetectionPoster120 citations
- Salient ImageNet: How to discover spurious features in Deep Learning?Poster120 citations
- Anomaly Detection for Tabular Data with Internal Contrastive LearningPoster119 citations
- ViDT: An Efficient and Effective Fully Transformer-based Object DetectorPoster119 citations
- NodePiece: Compositional and Parameter-Efficient Representations of Large Knowledge GraphsPoster118 citations
- OntoProtein: Protein Pretraining With Gene Ontology EmbeddingPoster118 citations
- Post hoc Explanations may be Ineffective for Detecting Unknown Spurious CorrelationPoster118 citations
- RotoGrad: Gradient Homogenization in Multitask LearningSpotlight118 citations
- Understanding Domain Randomization for Sim-to-real TransferSpotlight118 citations
- Accelerated Policy Learning with Parallel Differentiable SimulationPoster116 citations
- Invariant Causal Representation Learning for Out-of-Distribution GeneralizationPoster116 citations
- Predicting Physics in Mesh-reduced Space with Temporal AttentionPoster116 citations
- Path Integral Sampler: A Stochastic Control Approach For SamplingPoster115 citations
- Language model compression with weighted low-rank factorizationPoster113 citations
- Responsible Disclosure of Generative Models Using Scalable FingerprintingSpotlight113 citations
- SURF: Semi-supervised Reward Learning with Data Augmentation for Feedback-efficient Preference-based Reinforcement LearningPoster113 citations
- Step-unrolled Denoising Autoencoders for Text GenerationPoster113 citations
- Understanding and Improving Graph Injection Attack by Promoting UnnoticeabilityPoster113 citations
- On Improving Adversarial Transferability of Vision TransformersSpotlight112 citations
- ARTEMIS: Attention-based Retrieval with Text-Explicit Matching and Implicit SimilarityPoster111 citations
- Efficient Token Mixing for Transformers via Adaptive Fourier Neural OperatorsPoster110 citations
- Relating transformers to models and neural representations of the hippocampal formationPoster110 citations
- Learning Vision-Guided Quadrupedal Locomotion End-to-End with Cross-Modal TransformersSpotlight109 citations
- Coordination Among Neural Modules Through a Shared Global WorkspaceOral108 citations
- TRGP: Trust Region Gradient Projection for Continual LearningSpotlight108 citations
- LFPT5: A Unified Framework for Lifelong Few-shot Language Learning Based on Prompt Tuning of T5Poster107 citations
- Neural Networks as Kernel Learners: The Silent Alignment EffectPoster107 citations
- Learning to Extend Molecular Scaffolds with Structural MotifsPoster106 citations
- Adversarial Robustness Through the Lens of CausalityPoster105 citations
- DemoDICE: Offline Imitation Learning with Supplementary Imperfect DemonstrationsPoster105 citations
- Spread Spurious Attribute: Improving Worst-group Accuracy with Spurious Attribute EstimationPoster105 citations
- An Autoregressive Flow Model for 3D Molecular Geometry Generation from ScratchPoster104 citations
- FlexConv: Continuous Kernel Convolutions With Differentiable Kernel SizesPoster104 citations
- Learning Optimal Conformal ClassifiersSpotlight104 citations
- Scaling Laws for Neural Machine TranslationSpotlight104 citations
- VAT-Mart: Learning Visual Action Trajectory Proposals for Manipulating 3D ARTiculated ObjectsPoster104 citations
- Pretrained Language Model in Continual Learning: A Comparative StudyPoster101 citations
- MetaShift: A Dataset of Datasets for Evaluating Contextual Distribution Shifts and Training ConflictsPoster100 citations
- What Do We Mean by Generalization in Federated Learning?Poster100 citations
- An Unconstrained Layer-Peeled Perspective on Neural CollapsePoster99 citations
- Automated Self-Supervised Learning for GraphsPoster99 citations
- On the Role of Neural Collapse in Transfer LearningPoster99 citations
- Graph Neural Network Guided Local Search for the Traveling Salesperson ProblemPoster98 citations
- How Does SimSiam Avoid Collapse Without Negative Samples? A Unified Understanding with Self-supervised Contrastive LearningPoster98 citations
- NASViT: Neural Architecture Search for Efficient Vision Transformers with Gradient Conflict aware Supernet TrainingPoster98 citations
- NODE-GAM: Neural Generalized Additive Model for Interpretable Deep LearningSpotlight98 citations
- Reducing Excessive Margin to Achieve a Better Accuracy vs. Robustness Trade-offPoster98 citations
- MetaMorph: Learning Universal Controllers with TransformersPoster97 citations
- The MultiBERTs: BERT Reproductions for Robustness AnalysisSpotlight97 citations
- Expressiveness and Approximation Properties of Graph Neural NetworksOral96 citations
- GRAND++: Graph Neural Diffusion with A Source TermPoster96 citations
- Learning Temporally Causal Latent Processes from General Temporal DataPoster95 citations
- Pareto Set Learning for Neural Multi-Objective Combinatorial OptimizationPoster95 citations
- Decoupled Adaptation for Cross-Domain Object DetectionPoster94 citations
- Exploring Memorization in Adversarial TrainingPoster94 citations
- Learning to Map for Active Semantic Goal NavigationPoster94 citations
- Reliable Adversarial Distillation with Unreliable TeachersPoster93 citations
- Reward Uncertainty for Exploration in Preference-based Reinforcement LearningPoster93 citations
- Robust Unlearnable Examples: Protecting Data Privacy Against Adversarial LearningPoster93 citations
- ToM2C: Target-oriented Multi-agent Communication and Cooperation with Theory of MindPoster93 citations
- AEVA: Black-box Backdoor Detection Using Adversarial Extreme Value AnalysisPoster92 citations
- Differentiable Scaffolding Tree for Molecule OptimizationPoster92 citations
- Patch-Fool: Are Vision Transformers Always Robust Against Adversarial Perturbations?Poster92 citations
- Subspace Regularizers for Few-Shot Class Incremental LearningPoster92 citations
- Emergent Communication at ScaleSpotlight91 citations
- Equivariant Graph Mechanics Networks with ConstraintsPoster91 citations
- InfinityGAN: Towards Infinite-Pixel Image SynthesisPoster90 citations
- Stochastic Training is Not Necessary for GeneralizationPoster90 citations
- Chemical-Reaction-Aware Molecule Representation LearningPoster89 citations
- Neural Contextual Bandits with Deep Representation and Shallow ExplorationPoster89 citations
- Pixelated Butterfly: Simple and Efficient Sparse training for Neural Network ModelsSpotlight89 citations
- Policy improvement by planning with GumbelSpotlight89 citations
- Optimal Representations for Covariate ShiftPoster88 citations
- PipeGCN: Efficient Full-Graph Training of Graph Convolutional Networks with Pipelined Feature CommunicationPoster88 citations
- Surrogate NAS Benchmarks: Going Beyond the Limited Search Spaces of Tabular NAS BenchmarksPoster88 citations
- Zero-Shot Self-Supervised Learning for MRI ReconstructionPoster88 citations
- Mirror Descent Policy OptimizationPoster87 citations
- Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with PessimismPoster87 citations
- Efficient Neural Causal Discovery without Acyclicity ConstraintsPoster86 citations
- Rethinking Goal-Conditioned Supervised Learning and Its Connection to Offline RLPoster86 citations
- TAMP-S2GCNets: Coupling Time-Aware Multipersistence Knowledge Representation with Spatio-Supra Graph Convolutional Networks for Time-Series ForecastingSpotlight86 citations
- Attention-based Interpretability with Concept TransformersPoster85 citations
- Planning in Stochastic Environments with a Learned ModelSpotlight85 citations
- BDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech SynthesisPoster84 citations
- Generative Modeling with Optimal Transport MapsPoster84 citations
- HTLM: Hyper-Text Pre-Training and Prompting of Language ModelsPoster84 citations
- Bootstrapped Meta-LearningOral83 citations
- Generalized Demographic Parity for Group FairnessPoster83 citations
- Model Zoo: A Growing Brain That Learns ContinuallyPoster83 citations
- Natural Posterior Network: Deep Bayesian Predictive Uncertainty for Exponential Family DistributionsSpotlight83 citations
- Neural Link Prediction with Walk PoolingPoster83 citations
- Online Continual Learning on Class Incremental Blurry Task Configuration with Anytime InferencePoster83 citations
- Reinforcement Learning with Sparse Rewards using Guidance from Offline DemonstrationSpotlight83 citations
- Revisiting Over-smoothing in BERT from the Perspective of GraphSpotlight83 citations
- SQuant: On-the-Fly Data-Free Quantization via Diagonal Hessian ApproximationPoster83 citations
- An Agnostic Approach to Federated Learning with Class ImbalancePoster82 citations
- Chunked Autoregressive GAN for Conditional Waveform SynthesisPoster82 citations
- Incremental False Negative Detection for Contrastive LearningPoster82 citations
- Mind the Gap: Domain Gap Control for Single Shot Domain Adaptation for Generative Adversarial NetworksPoster82 citations
- Visual Representation Learning Does Not Generalize Strongly Within the Same DomainPoster81 citations
- $\pi$BO: Augmenting Acquisition Functions with User Beliefs for Bayesian OptimizationPoster80 citations
- AdaRL: What, Where, and How to Adapt in Transfer Reinforcement LearningSpotlight79 citations
- Who Is the Strongest Enemy? Towards Optimal and Efficient Evasion Attacks in Deep RLPoster79 citations
- Amortized Tree Generation for Bottom-up Synthesis Planning and Synthesizable Molecular DesignSpotlight78 citations
- DEPTS: Deep Expansion Learning for Periodic Time Series ForecastingSpotlight78 citations
- Vitruvion: A Generative Model of Parametric CAD SketchesPoster78 citations
- Discovering Latent Concepts Learned in BERTPoster77 citations
- ZeroFL: Efficient On-Device Training for Federated Learning with Local SparsityPoster77 citations
- DISCOVERING AND EXPLAINING THE REPRESENTATION BOTTLENECK OF DNNSOral76 citations
- Continual Normalization: Rethinking Batch Normalization for Online Continual LearningPoster74 citations
- Few-Shot Backdoor Attacks on Visual Object TrackingPoster74 citations
- Graph Auto-Encoder via Neighborhood Wasserstein ReconstructionPoster74 citations
- Resolving Training Biases via Influence-based Data RelabelingOral74 citations
- Improved deterministic l2 robustness on CIFAR-10 and CIFAR-100Spotlight73 citations
- Towards Model Agnostic Federated Learning Using Knowledge DistillationPoster73 citations
- A Theoretical Analysis on Feature Learning in Neural Networks: Emergence from Inputs and Advantage over Fixed FeaturesPoster72 citations
- Learning Strides in Convolutional Neural NetworksOral72 citations
- Lipschitz-constrained Unsupervised Skill DiscoveryPoster72 citations
- No One Representation to Rule Them All: Overlapping Features of Training MethodsPoster72 citations
- TAda! Temporally-Adaptive Convolutions for Video UnderstandingPoster72 citations
- Amortized Implicit Differentiation for Stochastic Bilevel OptimizationPoster71 citations
- Source-Free Adaptation to Measurement Shift via Bottom-Up Feature RestorationSpotlight71 citations
- Transferable Adversarial Attack based on Integrated GradientsPoster71 citations
- DR3: Value-Based Deep Reinforcement Learning Requires Explicit RegularizationSpotlight70 citations
- Revisiting Design Choices in Offline Model Based Reinforcement LearningSpotlight70 citations
- Constrained Policy Optimization via Bayesian World ModelsSpotlight69 citations
- GradMax: Growing Neural Networks using Gradient InformationPoster69 citations
- HyAR: Addressing Discrete-Continuous Action Reinforcement Learning via Hybrid Action RepresentationPoster69 citations
- Learning Efficient Image Super-Resolution Networks via Structure-Regularized PruningPoster69 citations
- Learning Efficient Online 3D Bin Packing on Packing Configuration TreesPoster69 citations
- Self-ensemble Adversarial Training for Improved RobustnessPoster69 citations
- Beyond ImageNet Attack: Towards Crafting Adversarial Examples for Black-box DomainsPoster68 citations
- Critical Points in Quantum Generative ModelsPoster68 citations
- Efficient Split-Mix Federated Learning for On-Demand and In-Situ CustomizationPoster68 citations
- EntQA: Entity Linking as Question AnsweringSpotlight68 citations
- Escaping limit cycles: Global convergence for constrained nonconvex-nonconcave minimax problemsSpotlight68 citations
- Meta-Learning with Fewer Tasks through Task InterpolationOral68 citations
- The Neural Data Router: Adaptive Control Flow in Transformers Improves Systematic GeneralizationPoster68 citations
- EXACT: Scalable Graph Neural Networks Training via Extreme Activation CompressionPoster67 citations
- MIDI-DDSP: Detailed Control of Musical Performance via Hierarchical ModelingOral67 citations
- COptiDICE: Offline Constrained Reinforcement Learning via Stationary Distribution Correction EstimationSpotlight66 citations
- How to Train Your MAML to Excel in Few-Shot ClassificationPoster66 citations
- Data Poisoning Won’t Save You From Facial RecognitionPoster65 citations
- Do We Need Anisotropic Graph Neural Networks?Poster65 citations
- Efficient Learning of Safe Driving Policy via Human-AI Copilot OptimizationPoster65 citations
- Policy Smoothing for Provably Robust Reinforcement LearningPoster65 citations
- Acceleration of Federated Learning with Alleviated Forgetting in Local TrainingPoster64 citations
- DISSECT: Disentangled Simultaneous Explanations via Concept TraversalsPoster64 citations
- DiffSkill: Skill Abstraction from Differentiable Physics for Deformable Object Manipulations with ToolsPoster64 citations
- Fairness Guarantees under Demographic ShiftPoster64 citations
- KL Guided Domain AdaptationPoster64 citations
- RelaxLoss: Defending Membership Inference Attacks without Losing UtilitySpotlight64 citations
- Skill-based Meta-Reinforcement LearningPoster64 citations
- PSA-GAN: Progressive Self Attention GANs for Synthetic Time SeriesPoster63 citations
- SphereFace2: Binary Classification is All You Need for Deep Face RecognitionSpotlight63 citations
- Finding an Unsupervised Image Segmenter in each of your Deep Generative ModelsPoster62 citations
- Post-Training Detection of Backdoor Attacks for Two-Class and Multi-Attack ScenariosPoster62 citations
- StyleAlign: Analysis and Applications of Aligned StyleGAN ModelsOral62 citations
- Cross-Domain Imitation Learning via Optimal TransportPoster60 citations
- Deep Ensembling with No Overhead for either Training or Testing: The All-Round Blessings of Dynamic SparsityPoster60 citations
- Dual Lottery Ticket HypothesisPoster60 citations
- Hybrid Local SGD for Federated Learning with Heterogeneous CommunicationsSpotlight60 citations
- On the Certified Robustness for Ensemble Models and BeyondPoster60 citations
- Transformer Embeddings of Irregularly Spaced Events and Their ParticipantsPoster60 citations
- Understanding the Role of Self Attention for Efficient Speech RecognitionSpotlight60 citations
- Unsupervised Learning of Full-Waveform Inversion: Connecting CNN and Partial Differential Equation in a LoopPoster60 citations
- Variational methods for simulation-based inferenceSpotlight60 citations
- Which Shortcut Cues Will DNNs Choose? A Study from the Parameter-Space PerspectivePoster60 citations
- Wisdom of Committees: An Overlooked Approach To Faster and More Accurate ModelsPoster60 citations
- CROP: Certifying Robust Policies for Reinforcement Learning through Functional SmoothingPoster59 citations
- ConFeSS: A Framework for Single Source Cross-Domain Few-Shot LearningPoster59 citations
- Consistent Counterfactuals for Deep ModelsPoster59 citations
- Exploiting Class Activation Value for Partial-Label LearningPoster59 citations
- GPT-Critic: Offline Reinforcement Learning for End-to-End Task-Oriented Dialogue SystemsPoster59 citations
- Learning Super-Features for Image RetrievalPoster59 citations
- NAS-Bench-Suite: NAS Evaluation is (Now) Surprisingly EasyPoster59 citations
- ComPhy: Compositional Physical Reasoning of Objects and Events from VideosPoster58 citations
- Exposing the Implicit Energy Networks behind Masked Language Models via Metropolis--HastingsPoster58 citations
- Towards General Function Approximation in Zero-Sum Markov GamesPoster58 citations
- Bayesian Framework for Gradient LeakagePoster57 citations
- Information-theoretic Online Memory Selection for Continual LearningPoster57 citations
- Learning more skills through optimistic explorationSpotlight57 citations
- Machine Learning For Elliptic PDEs: Fast Rate Generalization Bound, Neural Scaling Law and Minimax OptimalityPoster57 citations
- TRAIL: Near-Optimal Imitation Learning with Suboptimal DataPoster57 citations
- F8Net: Fixed-Point 8-bit Only Multiplication for Network QuantizationOral56 citations
- Hierarchical Few-Shot Imitation with Skill Transition ModelsPoster56 citations
- On the Pitfalls of Analyzing Individual Neurons in Language ModelsPoster56 citations
- Boosting Randomized Smoothing with Variance Reduced ClassifiersSpotlight55 citations
- Fixed Neural Network Steganography: Train the images, not the networkPoster55 citations
- Igeood: An Information Geometry Approach to Out-of-Distribution DetectionPoster55 citations
- Large Learning Rate Tames Homogeneity: Convergence and Balancing EffectPoster55 citations
- Learning to Complete Code with SketchesPoster55 citations
- NASI: Label- and Data-agnostic Neural Architecture Search at InitializationPoster55 citations
- Non-Transferable Learning: A New Approach for Model Ownership Verification and Applicability AuthorizationOral55 citations
- Prospect Pruning: Finding Trainable Weights at Initialization using Meta-GradientsPoster55 citations
- A Deep Variational Approach to Clustering Survival DataPoster54 citations
- A Tale of Two Flows: Cooperative Learning of Langevin Flow and Normalizing Flow Toward Energy-Based ModelPoster54 citations
- Defending Against Image Corruptions Through Adversarial AugmentationsPoster54 citations
- Discrete Representations Strengthen Vision Transformer RobustnessPoster54 citations
- Evaluation Metrics for Graph Generative Models: Problems, Pitfalls, and Practical SolutionsSpotlight54 citations
- Improving Non-Autoregressive Translation Models Without DistillationPoster54 citations
- Learning to Remember Patterns: Pattern Matching Memory Networks for Traffic ForecastingPoster54 citations
- Long Expressive Memory for Sequence ModelingSpotlight54 citations
- Programmatic Reinforcement Learning without OraclesSpotlight54 citations
- Top-label calibration and multiclass-to-binary reductionsPoster54 citations
- DKM: Differentiable k-Means Clustering Layer for Neural Network CompressionPoster53 citations
- DeSKO: Stability-Assured Robust Control with a Deep Stochastic Koopman OperatorPoster53 citations
- Federated Learning from Only Unlabeled Data with Class-conditional-sharing ClientsPoster53 citations
- Mention Memory: incorporating textual knowledge into Transformers through entity mention attentionPoster53 citations
- Modular Lifelong Reinforcement Learning via Neural CompositionPoster53 citations
- Sample Efficient Deep Reinforcement Learning via Uncertainty EstimationSpotlight53 citations
- Rethinking Supervised Pre-Training for Better Downstream TransferringPoster52 citations
- Semi-relaxed Gromov-Wasserstein divergence and applications on graphsPoster52 citations
- Trigger Hunting with a Topological Prior for Trojan DetectionPoster52 citations
- A Unified Wasserstein Distributional Robustness Framework for Adversarial TrainingPoster51 citations
- Data Efficient Language-Supervised Zero-Shot Recognition with Optimal Transport DistillationPoster51 citations
- Generalization of Neural Combinatorial Solvers Through the Lens of Adversarial RobustnessPoster51 citations
- Looking Back on Learned Experiences For Class/task Incremental LearningSpotlight51 citations
- On Evaluation Metrics for Graph Generative ModelsPoster51 citations
- Representing Mixtures of Word Embeddings with Mixtures of Topic EmbeddingsPoster51 citations
- CADDA: Class-wise Automatic Differentiable Data Augmentation for EEG SignalsPoster50 citations
- How to deal with missing data in supervised deep learning?Poster50 citations
- Learning Disentangled Representation by Exploiting Pretrained Generative Models: A Contrastive Learning ViewPoster50 citations
- Learning the Dynamics of Physical Systems from Sparse Observations with Finite Element NetworksSpotlight50 citations
- Offline Reinforcement Learning with Value-based Episodic MemoryPoster50 citations
- Out-of-distribution Generalization in the Presence of Nuisance-Induced Spurious CorrelationsPoster50 citations
- What’s Wrong with Deep Learning in Tree Search for Combinatorial OptimizationPoster50 citations
- Collapse by Conditioning: Training Class-conditional GANs with Limited DataPoster49 citations
- High Probability Bounds for a Class of Nonconvex Algorithms with AdaGrad StepsizePoster49 citations
- Hindsight: Posterior-guided training of retrievers for improved open-ended generationPoster49 citations
- Learning 3D Representations of Molecular Chirality with Invariance to Bond RotationsPoster49 citations
- A Statistical Framework for Efficient Out of Distribution Detection in Deep Neural NetworksPoster48 citations
- CURVATURE-GUIDED DYNAMIC SCALE NETWORKS FOR MULTI-VIEW STEREOPoster48 citations
- DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement LearningPoster48 citations
- Fortuitous Forgetting in Connectionist NetworksPoster48 citations
- Neural Deep Equilibrium SolversPoster48 citations
- Neural Methods for Logical Reasoning over Knowledge GraphsPoster48 citations
- Vision-Based Manipulators Need to Also See from Their HandsOral48 citations
- Zero-CL: Instance and Feature decorrelation for negative-free symmetric contrastive learningPoster48 citations
- Data-Driven Offline Optimization for Architecting Hardware AcceleratorsPoster47 citations
- Differentiable DAG SamplingPoster47 citations
- Learned Simulators for TurbulencePoster47 citations
- Learning to Downsample for Segmentation of Ultra-High Resolution ImagesPoster47 citations
- Noisy Feature MixupPoster47 citations
- Promoting Saliency From Depth: Deep Unsupervised RGB-D Saliency DetectionPoster47 citations
- Regularized Autoencoders for Isometric Representation LearningPoster47 citations
- Transform2Act: Learning a Transform-and-Control Policy for Efficient Agent DesignOral47 citations
- Trivial or Impossible --- dichotomous data difficulty masks model differences (on ImageNet and beyond)Poster47 citations
- Ab-Initio Potential Energy Surfaces by Pairing GNNs with Neural Wave FunctionsSpotlight46 citations
- CoBERL: Contrastive BERT for Reinforcement LearningSpotlight46 citations
- CrossMatch: Cross-Classifier Consistency Regularization for Open-Set Single Domain GeneralizationPoster46 citations
- Deconstructing the Inductive Biases of Hamiltonian Neural NetworksSpotlight46 citations
- Effective Model Sparsification by Scheduled Grow-and-Prune MethodsPoster46 citations
- Improving Federated Learning Face Recognition via Privacy-Agnostic ClustersSpotlight46 citations
- Minibatch vs Local SGD with Shuffling: Tight Convergence Bounds and BeyondOral46 citations
- PAC Prediction Sets Under Covariate ShiftPoster46 citations
- Revisiting flow generative models for Out-of-distribution detectionPoster46 citations
- Sparsity Winning Twice: Better Robust Generalization from More Efficient TrainingPoster46 citations
- An Information Fusion Approach to Learning with Instance-Dependent Label NoisePoster45 citations
- Continual Learning with Recursive Gradient OptimizationSpotlight45 citations
- EE-Net: Exploitation-Exploration Neural Networks in Contextual BanditsSpotlight45 citations
- Fair Normalizing FlowsPoster45 citations
- Learning Long-Term Reward Redistribution via Randomized Return DecompositionSpotlight45 citations
- Learning-Augmented $k$-means ClusteringSpotlight45 citations
- Low-Budget Active Learning via Wasserstein Distance: An Integer Programming ApproachPoster45 citations
- Neural graphical modelling in continuous-time: consistency guarantees and algorithmsPoster45 citations
- Objects in Semantic TopologyPoster45 citations
- Data-Efficient Graph Grammar Learning for Molecular GenerationOral44 citations
- Denoising Likelihood Score Matching for Conditional Score-based Data GenerationPoster44 citations
- Evading Adversarial Example Detection Defenses with Orthogonal Projected Gradient DescentPoster44 citations
- Learn Locally, Correct Globally: A Distributed Algorithm for Training Graph Neural NetworksPoster44 citations
- Permutation Compressors for Provably Faster Distributed Nonconvex OptimizationPoster44 citations
- Rethinking Adversarial Transferability from a Data Distribution PerspectivePoster44 citations
- Should I Run Offline Reinforcement Learning or Behavioral Cloning?Poster44 citations
- Adversarially Robust Conformal PredictionPoster43 citations
- CLEVA-Compass: A Continual Learning Evaluation Assessment Compass to Promote Research Transparency and ComparabilityPoster43 citations
- FP-DETR: Detection Transformer Advanced by Fully Pre-trainingPoster43 citations
- Learning Graphon Mean Field Games and Approximate Nash EquilibriaPoster43 citations
- Learning by Directional Gradient DescentPoster43 citations
- Meta Discovery: Learning to Discover Novel Classes given Very Limited DataSpotlight43 citations
- On the Existence of Universal Lottery TicketsPoster43 citations
- PAC-Bayes Information BottleneckSpotlight43 citations
- Strength of Minibatch Noise in SGDSpotlight43 citations
- Universalizing Weak SupervisionPoster43 citations
- Bridging the Gap: Providing Post-Hoc Symbolic Explanations for Sequential Decision-Making Problems with Inscrutable RepresentationsPoster42 citations
- Can an Image Classifier Suffice For Action Recognition?Poster42 citations
- Enhancing Cross-lingual Transfer by Manifold MixupPoster42 citations
- GLASS: GNN with Labeling Tricks for Subgraph Representation LearningPoster42 citations
- Geometry-Consistent Neural Shape Representation with Implicit Displacement FieldsPoster42 citations
- Iterated Reasoning with Mutual Information in Cooperative and Byzantine Decentralized TeamingPoster42 citations
- A Loss Curvature Perspective on Training Instabilities of Deep Learning ModelsPoster41 citations
- Explainable GNN-Based Models over Knowledge GraphsPoster41 citations
- GNN is a Counter? Revisiting GNN for Question AnsweringPoster41 citations
- Graph-Relational Domain AdaptationPoster41 citations
- How to Robustify Black-Box ML Models? A Zeroth-Order Optimization PerspectiveSpotlight41 citations
- Learning Pruning-Friendly Networks via Frank-Wolfe: One-Shot, Any-Sparsity, And No RetrainingSpotlight41 citations
- Properties from mechanisms: an equivariance perspective on identifiable representation learningSpotlight41 citations
- The Rich Get Richer: Disparate Impact of Semi-Supervised LearningPoster41 citations
- Value Function Spaces: Skill-Centric State Abstractions for Long-Horizon ReasoningPoster41 citations
- You Mostly Walk Alone: Analyzing Feature Attribution in Trajectory PredictionPoster41 citations
- Context-Aware Sparse Deep Coordination GraphsSpotlight40 citations
- Demystifying Batch Normalization in ReLU Networks: Equivalent Convex Optimization Models and Implicit RegularizationPoster40 citations
- Geometric Transformers for Protein Interface Contact PredictionPoster40 citations
- How to Inject Backdoors with Better Consistency: Logit Anchoring on Clean DataPoster40 citations
- Language modeling via stochastic processesOral40 citations
- Network Augmentation for Tiny Deep LearningPoster40 citations
- On the Limitations of Multimodal VAEsPoster40 citations
- SOSP: Efficiently Capturing Global Correlations by Second-Order Structured PruningSpotlight40 citations
- The Boltzmann Policy Distribution: Accounting for Systematic Suboptimality in Human ModelsPoster40 citations
- The Inductive Bias of In-Context Learning: Rethinking Pretraining Example DesignSpotlight40 citations
- The Information Geometry of Unsupervised Reinforcement LearningOral40 citations
- Top-N: Equivariant Set and Graph Generation without ExchangeabilityPoster40 citations
- Discovering Nonlinear PDEs from Scarce Data with Physics-encoded LearningPoster39 citations
- GATSBI: Generative Adversarial Training for Simulation-Based InferencePoster39 citations
- GNN-LM: Language Modeling based on Global Contexts via GNNSpotlight39 citations
- How Well Does Self-Supervised Pre-Training Perform with Streaming Data?Poster39 citations
- Procedural generalization by planning with self-supervised world modelsPoster39 citations
- The Hidden Convex Optimization Landscape of Regularized Two-Layer ReLU Networks: an Exact Characterization of Optimal SolutionsOral39 citations
- Understanding Latent Correlation-Based Multiview Learning and Self-Supervision: An Identifiability PerspectiveSpotlight39 citations
- When should agents explore?Spotlight39 citations
- COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning AttacksPoster38 citations
- Generalizing Few-Shot NAS with Gradient MatchingPoster38 citations
- It Takes Two to Tango: Mixup for Deep Metric LearningPoster38 citations
- Learning transferable motor skills with hierarchical latent mixture policiesSpotlight38 citations
- Multi-Mode Deep Matrix and Tensor FactorizationPoster38 citations
- On the role of population heterogeneity in emergent communicationPoster38 citations
- Continual Learning with Filter Atom SwappingSpotlight37 citations
- Deep Learning without Shortcuts: Shaping the Kernel with Tailored RectifiersPoster37 citations
- Do Not Escape From the Manifold: Discovering the Local Coordinates on the Latent Space of GANsPoster37 citations
- Generalized Kernel ThinningPoster37 citations
- GradSign: Model Performance Inference with Theoretical InsightsPoster37 citations
- Group equivariant neural posterior estimationPoster37 citations
- Learning to Generalize across Domains on Single Test SamplesPoster37 citations
- Modeling Label Space Interactions in Multi-label Classification using Box EmbeddingsPoster37 citations
- Revisit Kernel Pruning with Lottery Regulated Grouped ConvolutionsPoster37 citations
- Sound Adversarial Audio-Visual NavigationPoster37 citations
- Structure-Aware Transformer Policy for Inhomogeneous Multi-Task Reinforcement LearningPoster37 citations
- Universal Approximation Under Constraints is Possible with TransformersSpotlight37 citations
- An Experimental Design Perspective on Model-Based Reinforcement LearningPoster36 citations
- Attacking deep networks with surrogate-based adversarial black-box methods is easyPoster36 citations
- Auto-scaling Vision Transformers without TrainingPoster36 citations
- Autonomous Reinforcement Learning: Formalism and BenchmarkingPoster36 citations
- Compositional Training for End-to-End Deep AUC MaximizationSpotlight36 citations
- Continuously Discovering Novel Strategies via Reward-Switching Policy OptimizationPoster36 citations
- DEGREE: Decomposition Based Explanation for Graph Neural NetworksPoster36 citations
- Knowledge Removal in Sampling-based Bayesian InferencePoster36 citations
- MaGNET: Uniform Sampling from Deep Generative Network Manifolds Without RetrainingPoster36 citations
- Trans-Encoder: Unsupervised sentence-pair modelling through self- and mutual-distillationsPoster36 citations
- Who Is Your Right Mixup Partner in Positive and Unlabeled LearningPoster36 citations
- Audio Lottery: Speech Recognition Made Ultra-Lightweight, Noise-Robust, and TransferablePoster35 citations
- Boosting the Certified Robustness of L-infinity Distance NetsPoster35 citations
- CrossBeam: Learning to Search in Bottom-Up Program SynthesisPoster35 citations
- Diurnal or Nocturnal? Federated Learning of Multi-branch Networks from Periodically Shifting DistributionsPoster35 citations
- Increasing the Cost of Model Extraction with Calibrated Proof of WorkSpotlight35 citations
- SHINE: SHaring the INverse Estimate from the forward pass for bi-level optimization and implicit modelsSpotlight35 citations
- Selective Ensembles for Consistent PredictionsPoster35 citations
- Triangle and Four Cycle Counting with Predictions in Graph StreamsPoster35 citations
- Comparing Distributions by Measuring Differences that Affect Decision MakingOral34 citations
- Conditional Image Generation by Conditioning Variational Auto-EncodersPoster34 citations
- Joint Shapley values: a measure of joint feature importancePoster34 citations
- Should We Be Pre-training? An Argument for End-task Aware Training as an AlternativePoster34 citations
- Sqrt(d) Dimension Dependence of Langevin Monte CarloPoster34 citations
- Towards Better Understanding and Better Generalization of Low-shot Classification in Histology Images with Contrastive LearningPoster34 citations
- Variational Neural Cellular AutomataPoster34 citations
- Actor-Critic Policy Optimization in a Large-Scale Imperfect-Information GamePoster33 citations
- Conditional Contrastive Learning with KernelPoster33 citations
- Explanations of Black-Box Models based on Directional Feature InteractionsSpotlight33 citations
- Focus on the Common Good: Group Distributional Robustness FollowsPoster33 citations
- Imitation Learning by Reinforcement LearningPoster33 citations
- Information Prioritization through Empowerment in Visual Model-based RLPoster33 citations
- Missingness Bias in Model DebuggingPoster33 citations
- Neural Markov Controlled SDE: Stochastic Optimization for Continuous-Time DataPoster33 citations
- Online Facility Location with PredictionsPoster33 citations
- PEARL: Data Synthesis via Private Embeddings and Adversarial Reconstruction LearningPoster33 citations
- Query Embedding on Hyper-Relational Knowledge GraphsPoster33 citations
- Sound and Complete Neural Network Repair with Minimality and Locality GuaranteesPoster33 citations
- Steerable Partial Differential Operators for Equivariant Neural NetworksPoster33 citations
- Towards Deepening Graph Neural Networks: A GNTK-based Optimization PerspectivePoster33 citations
- Towards Training Billion Parameter Graph Neural Networks for Atomic SimulationsPoster33 citations
- Training invariances and the low-rank phenomenon: beyond linear networksPoster33 citations
- Value Gradient weighted Model-Based Reinforcement LearningSpotlight33 citations
- How unlabeled data improve generalization in self-training? A one-hidden-layer theoretical analysisPoster32 citations
- Monotonic Differentiable Sorting NetworksPoster32 citations
- Multi-Agent MDP Homomorphic NetworksPoster32 citations
- Multi-Critic Actor Learning: Teaching RL Policies to Act with StylePoster32 citations
- On the Optimal Memorization Power of ReLU Neural NetworksSpotlight32 citations
- Sequence Approximation using Feedforward Spiking Neural Network for Spatiotemporal Learning: Theory and Optimization MethodsPoster32 citations
- Ada-NETS: Face Clustering via Adaptive Neighbour Discovery in the Structure SpacePoster31 citations
- AdaAug: Learning Class- and Instance-adaptive Data Augmentation PoliciesPoster31 citations
- Bag of Instances Aggregation Boosts Self-supervised DistillationPoster31 citations
- Counterfactual Plans under Distributional AmbiguityPoster31 citations
- Cross-Trajectory Representation Learning for Zero-Shot Generalization in RLPoster31 citations
- MCMC Should Mix: Learning Energy-Based Model with Neural Transport Latent Space MCMCPoster31 citations
- Online Target Q-learning with Reverse Experience Replay: Efficiently finding the Optimal Policy for Linear MDPsPoster31 citations
- Provably Filtering Exogenous Distractors using Multistep Inverse DynamicsOral31 citations
- Towards Building A Group-based Unsupervised Representation Disentanglement FrameworkPoster31 citations
- Towards Empirical Sandwich Bounds on the Rate-Distortion FunctionPoster31 citations
- Understanding the Variance Collapse of SVGD in High DimensionsPoster31 citations
- Weighted Training for Cross-Task LearningOral31 citations
- iLQR-VAE : control-based learning of input-driven dynamics with applications to neural dataOral31 citations
- Learning Curves for SGD on Structured FeaturesPoster30 citations
- Lossless Compression with Probabilistic CircuitsSpotlight30 citations
- Multi-objective Optimization by Learning Space PartitionPoster30 citations
- On Lottery Tickets and Minimal Task Representations in Deep Reinforcement LearningSpotlight30 citations
- Optimizing Neural Networks with Gradient Lexicase SelectionPoster30 citations
- Practical Conditional Neural Process Via Tractable Dependent PredictionsPoster30 citations
- Proving the Lottery Ticket Hypothesis for Convolutional Neural NetworksPoster30 citations
- RISP: Rendering-Invariant State Predictor with Differentiable Simulation and Rendering for Cross-Domain Parameter EstimationOral30 citations
- Shuffle Private Stochastic Convex OptimizationPoster30 citations
- Spanning Tree-based Graph Generation for MoleculesSpotlight30 citations
- WeakM3D: Towards Weakly Supervised Monocular 3D Object DetectionPoster30 citations
- $\beta$-Intact-VAE: Identifying and Estimating Causal Effects under Limited OverlapPoster29 citations
- Active Hierarchical Exploration with Stable Subgoal Representation LearningPoster29 citations
- Bregman Gradient Policy OptimizationPoster29 citations
- Fooling Explanations in Text ClassifiersPoster29 citations
- Interpretable Unsupervised Diversity Denoising and Artefact RemovalSpotlight29 citations
- Knowledge Infused DecodingPoster29 citations
- Learning Multimodal VAEs through Mutual SupervisionSpotlight29 citations
- On Redundancy and Diversity in Cell-based Neural Architecture SearchPoster29 citations
- On the Generalization of Models Trained with SGD: Information-Theoretic Bounds and ImplicationsPoster29 citations
- Online Ad Hoc Teamwork under Partial ObservabilityPoster29 citations
- P-Adapters: Robustly Extracting Factual Information from Language Models with Diverse PromptsPoster29 citations
- Path Auxiliary Proposal for MCMC in Discrete SpaceSpotlight29 citations
- QUERY EFFICIENT DECISION BASED SPARSE ATTACKS AGAINST BLACK-BOX DEEP LEARNING MODELSPoster29 citations
- Stiffness-aware neural network for learning Hamiltonian systemsPoster29 citations
- Autonomous Learning of Object-Centric Abstractions for High-Level PlanningPoster28 citations
- Deep Point Cloud ReconstructionPoster28 citations
- Feature Kernel DistillationPoster28 citations
- Is Importance Weighting Incompatible with Interpolating Classifiers?Poster28 citations
- Mapping conditional distributions for domain adaptation under generalized target shiftPoster28 citations
- On the Convergence of the Monte Carlo Exploring Starts Algorithm for Reinforcement LearningPoster28 citations
- Overcoming The Spectral Bias of Neural Value ApproximationPoster28 citations
- POETREE: Interpretable Policy Learning with Adaptive Decision TreesSpotlight28 citations
- Scattering Networks on the Sphere for Scalable and Rotationally Equivariant Spherical CNNsPoster28 citations
- Self-Supervision Enhanced Feature Selection with Correlated GatesSpotlight28 citations
- Unifying Likelihood-free Inference with Black-box Optimization and BeyondSpotlight28 citations
- A Relational Intervention Approach for Unsupervised Dynamics Generalization in Model-Based Reinforcement LearningPoster27 citations
- A generalization of the randomized singular value decompositionPoster27 citations
- Compositional Attention: Disentangling Search and RetrievalSpotlight27 citations
- D-CODE: Discovering Closed-form ODEs from Observed TrajectoriesSpotlight27 citations
- Efficient and Differentiable Conformal Prediction with General Function ClassesPoster27 citations
- GeneDisco: A Benchmark for Experimental Design in Drug DiscoveryPoster27 citations
- How many degrees of freedom do we need to train deep networks: a loss landscape perspectivePoster27 citations
- Is High Variance Unavoidable in RL? A Case Study in Continuous ControlPoster27 citations
- Offline Neural Contextual Bandits: Pessimism, Optimization and GeneralizationPoster27 citations
- On Distributed Adaptive Optimization with Gradient CompressionPoster27 citations
- Plant 'n' Seek: Can You Find the Winning Ticket?Poster27 citations
- Recycling Model Updates in Federated Learning: Are Gradient Subspaces Low-Rank?Poster27 citations
- SPIRAL: Self-supervised Perturbation-Invariant Representation Learning for Speech Pre-TrainingPoster27 citations
- Towards Deployment-Efficient Reinforcement Learning: Lower Bound and OptimalitySpotlight27 citations
- Tracking the risk of a deployed model and detecting harmful distribution shiftsPoster27 citations
- When, Why, and Which Pretrained GANs Are Useful?Poster27 citations
- A Zest of LIME: Towards Architecture-Independent Model DistancesPoster26 citations
- Almost Tight L0-norm Certified Robustness of Top-k Predictions against Adversarial PerturbationsPoster26 citations
- Better Supervisory Signals by Observing Learning PathsPoster26 citations
- Certified Robustness for Deep Equilibrium Models via Interval Bound PropagationPoster26 citations
- ClimateGAN: Raising Climate Change Awareness by Generating Images of FloodsPoster26 citations
- Contact Points Discovery for Soft-Body Manipulations with Differentiable PhysicsSpotlight26 citations
- Continuous-Time Meta-Learning with Forward Mode DifferentiationSpotlight26 citations
- Dynamics-Aware Comparison of Learned Reward FunctionsSpotlight26 citations
- Explaining Point Processes by Learning Interpretable Temporal Logic RulesPoster26 citations
- Exploring extreme parameter compression for pre-trained language modelsPoster26 citations
- Generalisation in Lifelong Reinforcement Learning through Logical CompositionPoster26 citations
- Heteroscedastic Temporal Variational Autoencoder For Irregularly Sampled Time SeriesPoster26 citations
- L0-Sparse Canonical Correlation AnalysisPoster26 citations
- LIGS: Learnable Intrinsic-Reward Generation Selection for Multi-Agent LearningPoster26 citations
- Learning Prototype-oriented Set Representations for Meta-LearningPoster26 citations
- Model-augmented Prioritized Experience ReplayPoster26 citations
- Multi-Stage Episodic Control for Strategic Exploration in Text GamesSpotlight26 citations
- Optimal Transport for Long-Tailed Recognition with Learnable Cost MatrixPoster26 citations
- Prototype memory and attention mechanisms for few shot image generationPoster26 citations
- Rethinking Class-Prior Estimation for Positive-Unlabeled LearningPoster26 citations
- Reverse Engineering of Imperceptible Adversarial Image PerturbationsPoster26 citations
- Sampling with Mirrored Stein OperatorsSpotlight26 citations
- Towards Understanding the Data Dependency of Mixup-style TrainingSpotlight26 citations
- A General Analysis of Example-Selection for Stochastic Gradient DescentSpotlight25 citations
- Churn Reduction via DistillationSpotlight25 citations
- Controlling Directions Orthogonal to a ClassifierSpotlight25 citations
- Direct then Diffuse: Incremental Unsupervised Skill Discovery for State Covering and Goal ReachingPoster25 citations
- Distributionally Robust Models with Parametric Likelihood RatiosPoster25 citations
- Doubly Adaptive Scaled Algorithm for Machine Learning Using Second-Order InformationPoster25 citations
- Evaluating Distributional Distortion in Neural Language ModelingPoster25 citations
- Hidden Convexity of Wasserstein GANs: Interpretable Generative Models with Closed-Form SolutionsPoster25 citations
- Hierarchical Variational Memory for Few-shot Learning Across DomainsPoster25 citations
- Information Gain Propagation: a New Way to Graph Active Learning with Soft LabelsPoster25 citations
- MAML is a Noisy Contrastive Learner in ClassificationPoster25 citations
- RelViT: Concept-guided Vision Transformer for Visual Relational ReasoningPoster25 citations
- Adaptive Wavelet Transformer Network for 3D Shape Representation LearningPoster24 citations
- Augmented Sliced Wasserstein DistancesPoster24 citations
- Contextualized Scene Imagination for Generative Commonsense ReasoningPoster24 citations
- Energy-Inspired Molecular Conformation OptimizationPoster24 citations
- Evolutionary Diversity Optimization with Clustering-based Selection for Reinforcement LearningPoster24 citations
- FALCON: Fast Visual Concept Learning by Integrating Images, Linguistic descriptions, and Conceptual RelationsPoster24 citations
- FairCal: Fairness Calibration for Face VerificationPoster24 citations
- Hybrid Random FeaturesPoster24 citations
- IntSGD: Adaptive Floatless Compression of Stochastic GradientsSpotlight24 citations
- Learning meta-features for AutoMLSpotlight24 citations
- Linking Emergent and Natural Languages via Corpus TransferSpotlight24 citations
- Meta-Imitation Learning by Watching Video DemonstrationsPoster24 citations
- Model-Based Offline Meta-Reinforcement Learning with RegularizationPoster24 citations
- NeuPL: Neural Population LearningPoster24 citations
- On Robust Prefix-Tuning for Text ClassificationPoster24 citations
- The Three Stages of Learning Dynamics in High-dimensional Kernel MethodsPoster24 citations
- Unsupervised Vision-Language Grammar Induction with Shared Structure ModelingOral24 citations
- Approximation and Learning with Deep Convolutional Models: a Kernel PerspectivePoster23 citations
- Clean Images are Hard to Reblur: Exploiting the Ill-Posed Inverse Task for Dynamic Scene DeblurringPoster23 citations
- It Takes Four to Tango: Multiagent Self Play for Automatic Curriculum GenerationPoster23 citations
- Label Encoding for Regression NetworksSpotlight23 citations
- Learning curves for continual learning in neural networks: Self-knowledge transfer and forgettingPoster23 citations
- Nonlinear ICA Using Volume-Preserving TransformationsPoster23 citations
- Pareto Policy Pool for Model-based Offline Reinforcement LearningPoster23 citations
- ProtoRes: Proto-Residual Network for Pose Authoring via Learned Inverse KinematicsOral23 citations
- The Close Relationship Between Contrastive Learning and Meta-LearningPoster23 citations
- Transfer RL across Observation Feature Spaces via Model-Based RegularizationPoster23 citations
- A global convergence theory for deep ReLU implicit networks via over-parameterizationPoster22 citations
- Analyzing and Improving the Optimization Landscape of Noise-Contrastive EstimationSpotlight22 citations
- Autoregressive Quantile Flows for Predictive Uncertainty EstimationSpotlight22 citations
- C-Planning: An Automatic Curriculum for Learning Goal-Reaching TasksPoster22 citations
- CoMPS: Continual Meta Policy SearchPoster22 citations
- Constructing Orthogonal Convolutions in an Explicit MannerPoster22 citations
- Curriculum learning as a tool to uncover learning principles in the brainPoster22 citations
- Deep ReLU Networks Preserve Expected LengthPoster22 citations
- Distribution Compression in Near-Linear TimePoster22 citations
- Neural Parameter Allocation SearchPoster22 citations
- On the relation between statistical learning and perceptual distancesSpotlight22 citations
- Switch to Generalize: Domain-Switch Learning for Cross-Domain Few-Shot ClassificationPoster22 citations
- Towards Evaluating the Robustness of Neural Networks Learned by TransductionPoster22 citations
- Anytime Dense Prediction with Confidence AdaptivityPoster21 citations
- Discrepancy-Based Active Learning for Domain AdaptationPoster21 citations
- Distributional Reinforcement Learning with Monotonic SplinesPoster21 citations
- Do Users Benefit From Interpretable Vision? A User Study, Baseline, And DatasetPoster21 citations
- Finding Biological Plausibility for Adversarially Robust Features via Metameric TasksSpotlight21 citations
- HyperDQN: A Randomized Exploration Method for Deep Reinforcement LearningPoster21 citations
- Multiset-Equivariant Set Prediction with Approximate Implicit DifferentiationPoster21 citations
- Neural Structured Prediction for Inductive Node ClassificationOral21 citations
- On the Convergence of mSGD and AdaGrad for Stochastic OptimizationPoster21 citations
- Permutation-Based SGD: Is Random Optimal?Poster21 citations
- Sample Efficient Stochastic Policy Extragradient Algorithm for Zero-Sum Markov GamePoster21 citations
- Spike-inspired rank coding for fast and accurate recurrent neural networksSpotlight21 citations
- The Spectral Bias of Polynomial Neural NetworksPoster21 citations
- Topological Experience ReplayPoster21 citations
- Constructing a Good Behavior Basis for Transfer using Generalized Policy UpdatesPoster20 citations
- Convergent Graph SolversPoster20 citations
- Hindsight is 20/20: Leveraging Past Traversals to Aid 3D PerceptionPoster20 citations
- In a Nutshell, the Human Asked for This: Latent Goals for Following Temporal SpecificationsPoster20 citations
- Know Thyself: Transferable Visual Control Policies Through Robot-AwarenessPoster20 citations
- Learning to Schedule Learning rate with Graph Neural NetworksPoster20 citations
- Local Feature Swapping for Generalization in Reinforcement LearningPoster20 citations
- Neural Processes with Stochastic Attention: Paying more attention to the context datasetPoster20 citations
- Neural Stochastic Dual Dynamic ProgrammingPoster20 citations
- Non-Linear Operator Approximations for Initial Value ProblemsPoster20 citations
- On feature learning in neural networks with global convergence guaranteesPoster20 citations
- Pseudo-Labeled Auto-Curriculum Learning for Semi-Supervised Keypoint LocalizationPoster20 citations
- Symbolic Learning to Optimize: Towards Interpretability and ScalabilityPoster20 citations
- VAE Approximation Error: ELBO and Exponential FamiliesSpotlight20 citations
- Creating Training Sets via Weak Indirect SupervisionPoster19 citations
- Dealing with Non-Stationarity in MARL via Trust-Region DecompositionPoster19 citations
- Demystifying Limited Adversarial Transferability in Automatic Speech Recognition SystemsPoster19 citations
- Eliminating Sharp Minima from SGD with Truncated Heavy-tailed NoisePoster19 citations
- Fast Differentiable Matrix Square RootPoster19 citations
- How Did the Model Change? Efficiently Assessing Machine Learning API ShiftsPoster19 citations
- Information Bottleneck: Exact Analysis of (Quantized) Neural NetworksPoster19 citations
- Learning a subspace of policies for online adaptation in Reinforcement LearningPoster19 citations
- Near-Optimal Reward-Free Exploration for Linear Mixture MDPs with Plug-in SolverSpotlight19 citations
- Neural Spectral Marked Point ProcessesPoster19 citations
- On Covariate Shift of Latent Confounders in Imitation and Reinforcement LearningPoster19 citations
- Optimal Transport for Causal DiscoverySpotlight19 citations
- PI3NN: Out-of-distribution-aware Prediction Intervals from Three Neural NetworksPoster19 citations
- Pretraining Text Encoders with Adversarial Mixture of Training Signal GeneratorsPoster19 citations
- Space-Time Graph Neural NetworksPoster19 citations
- Wish you were here: Hindsight Goal Selection for long-horizon dexterous manipulationPoster19 citations
- Actor-critic is implicitly biased towards high entropy optimal policiesPoster18 citations
- Asymmetry Learning for Counterfactually-invariant Classification in OOD TasksOral18 citations
- Coherence-based Label Propagation over Time Series for Accelerated Active LearningPoster18 citations
- Distributionally Robust Fair Principal Components via Geodesic DescentsPoster18 citations
- Energy-Based Learning for Cooperative Games, with Applications to Valuation Problems in Machine LearningPoster18 citations
- Granger causal inference on DAGs identifies genomic loci regulating transcriptionPoster18 citations
- Learning Versatile Neural Architectures by Propagating Network CodesPoster18 citations
- Learning Weakly-supervised Contrastive RepresentationsPoster18 citations
- Pareto Policy AdaptationPoster18 citations
- SketchODE: Learning neural sketch representation in continuous timePoster18 citations
- Sparse Attention with Learning to HashPoster18 citations
- Target-Side Input Augmentation for Sequence to Sequence GenerationPoster18 citations
- Understanding and Leveraging Overparameterization in Recursive Value EstimationPoster18 citations
- Understanding approximate and unrolled dictionary learning for pattern recoveryPoster18 citations
- Anisotropic Random Feature Regression in High DimensionsPoster17 citations
- CodeTrek: Flexible Modeling of Code using an Extensible Relational RepresentationPoster17 citations
- Communication-Efficient Actor-Critic Methods for Homogeneous Markov GamesPoster17 citations
- Disentanglement Analysis with Partial Information DecompositionPoster17 citations
- Evaluating Model-Based Planning and Planner Amortization for Continuous ControlPoster17 citations
- Generative Principal Component AnalysisPoster17 citations
- Is Fairness Only Metric Deep? Evaluating and Addressing Subgroup Gaps in Deep Metric LearningPoster17 citations
- Know Your Action Set: Learning Action Relations for Reinforcement LearningPoster17 citations
- Learning Curves for Gaussian Process Regression with Power-Law Priors and TargetsPoster17 citations
- Learning Scenario Representation for Solving Two-stage Stochastic Integer ProgramsPoster17 citations
- On Non-Random Missing Labels in Semi-Supervised LearningPoster17 citations
- Visual Correspondence HallucinationPoster17 citations
- A First-Occupancy Representation for Reinforcement LearningPoster16 citations
- An Operator Theoretic View On Pruning Deep Neural NetworksPoster16 citations
- Capturing Structural Locality in Non-parametric Language ModelsPoster16 citations
- Closed-form Sample Probing for Learning Generative Models in Zero-shot LearningPoster16 citations
- Contrastive Fine-grained Class Clustering via Generative Adversarial NetworksSpotlight16 citations
- CoordX: Accelerating Implicit Neural Representation with a Split MLP ArchitecturePoster16 citations
- Does your graph need a confidence boost? Convergent boosted smoothing on graphs with tabular node featuresSpotlight16 citations
- Domain Adversarial Training: A Game PerspectivePoster16 citations
- Fast Regression for Structured InputsPoster16 citations
- Group-based Interleaved Pipeline Parallelism for Large-scale DNN TrainingPoster16 citations
- Implicit Bias of MSE Gradient Optimization in Underparameterized Neural NetworksPoster16 citations
- Improving Mutual Information Estimation with Annealed and Energy-Based BoundsPoster16 citations
- Maximizing Ensemble Diversity in Deep Reinforcement LearningPoster16 citations
- No Parameters Left Behind: Sensitivity Guided Adaptive Learning Rate for Training Large Transformer ModelsPoster16 citations
- On the Importance of Firth Bias Reduction in Few-Shot ClassificationSpotlight16 citations
- Relational Multi-Task Learning: Modeling Relations between Data and TasksSpotlight16 citations
- Sequential Reptile: Inter-Task Gradient Alignment for Multilingual LearningPoster16 citations
- T-WaveNet: A Tree-Structured Wavelet Neural Network for Time Series Signal AnalysisPoster16 citations
- Differentially Private Fractional Frequency Moments Estimation with Polylogarithmic SpacePoster15 citations
- Dive Deeper Into Integral Pose RegressionPoster15 citations
- Do deep networks transfer invariances across classes?Poster15 citations
- Expressivity of Emergent Languages is a Trade-off between Contextual Complexity and UnpredictabilityPoster15 citations
- FedChain: Chained Algorithms for Near-optimal Communication Cost in Federated LearningPoster15 citations
- Fine-grained Differentiable Physics: A Yarn-level Model for FabricsPoster15 citations
- LOSSY COMPRESSION WITH DISTRIBUTION SHIFT AS ENTROPY CONSTRAINED OPTIMAL TRANSPORTPoster15 citations
- Learning Hierarchical Structures with Differentiable Nondeterministic StacksSpotlight15 citations
- Learning Neural Contextual Bandits through Perturbed RewardsPoster15 citations
- Learning Towards The Largest MarginsPoster15 citations
- Particle Stochastic Dual Coordinate Ascent: Exponential convergent algorithm for mean field neural network optimizationPoster15 citations
- Retriever: Learning Content-Style Representation as a Token-Level Bipartite GraphPoster15 citations
- Task Affinity with Maximum Bipartite Matching in Few-Shot LearningPoster15 citations
- Temporal Alignment Prediction for Supervised Representation Learning and Few-Shot Sequence ClassificationPoster15 citations
- The Geometry of Memoryless Stochastic Policy Optimization in Infinite-Horizon POMDPsPoster15 citations
- What Makes Better Augmentation Strategies? Augment Difficult but Not too DifferentPoster15 citations
- Wiring Up Vision: Minimizing Supervised Synaptic Updates Needed to Produce a Primate Ventral StreamSpotlight15 citations
- Adversarial Support AlignmentSpotlight14 citations
- Constraining Linear-chain CRFs to Regular LanguagesPoster14 citations
- Controlling the Complexity and Lipschitz Constant improves Polynomial NetsPoster14 citations
- Delaunay Component Analysis for Evaluation of Data RepresentationsPoster14 citations
- Divisive Feature Normalization Improves Image Recognition Performance in AlexNetPoster14 citations
- Eigencurve: Optimal Learning Rate Schedule for SGD on Quadratic Objectives with Skewed Hessian SpectrumsPoster14 citations
- Fast AdvPropPoster14 citations
- Generalization Through the Lens of Leave-One-Out ErrorPoster14 citations
- Goal-Directed Planning via Hindsight Experience ReplayPoster14 citations
- Gradient Information Matters in Policy Optimization by Back-propagating through ModelPoster14 citations
- IGLU: Efficient GCN Training via Lazy UpdatesPoster14 citations
- Imitation Learning from Observations under Transition Model DisparityPoster14 citations
- Interacting Contour Stochastic Gradient Langevin DynamicsPoster14 citations
- Non-Parallel Text Style Transfer with Self-Parallel SupervisionPoster14 citations
- On Predicting Generalization using GANsSpotlight14 citations
- On the benefits of maximum likelihood estimation for Regression and ForecastingPoster14 citations
- One After Another: Learning Incremental Skills for a Changing WorldPoster14 citations
- Online Adversarial AttacksPoster14 citations
- PoNet: Pooling Network for Efficient Token Mixing in Long SequencesPoster14 citations
- Policy Gradients Incorporating the FuturePoster14 citations
- Real-Time Neural Voice CamouflageOral14 citations
- Shallow and Deep Networks are Near-Optimal Approximators of Korobov FunctionsPoster14 citations
- Spatial Graph Attention and Curiosity-driven Policy for Antiviral Drug DiscoveryPoster14 citations
- Task Relatedness-Based Generalization Bounds for Meta LearningSpotlight14 citations
- Task-Induced Representation LearningPoster14 citations
- The Convex Geometry of Backpropagation: Neural Network Gradient Flows Converge to Extreme Points of the Dual Convex ProgramPoster14 citations
- A Fine-Tuning Approach to Belief State ModelingPoster13 citations
- A NON-PARAMETRIC REGRESSION VIEWPOINT : GENERALIZATION OF OVERPARAMETRIZED DEEP RELU NETWORK UNDER NOISY OBSERVATIONSPoster13 citations
- A Unified Contrastive Energy-based Model for Understanding the Generative Ability of Adversarial TrainingPoster13 citations
- Anti-Concentrated Confidence Bonuses For Scalable ExplorationPoster13 citations
- Back2Future: Leveraging Backfill Dynamics for Improving Real-time Predictions in FuturePoster13 citations
- Conditioning Sequence-to-sequence Networks with Learned ActivationsPoster13 citations
- Connectome-constrained Latent Variable Model of Whole-Brain Neural ActivityPoster13 citations
- Filtered-CoPhy: Unsupervised Learning of Counterfactual Physics in Pixel SpaceOral13 citations
- GDA-AM: ON THE EFFECTIVENESS OF SOLVING MIN-IMAX OPTIMIZATION VIA ANDERSON MIXINGPoster13 citations
- Half-Inverse Gradients for Physical Deep LearningSpotlight13 citations
- Minimax Optimization with Smooth Algorithmic AdversariesPoster13 citations
- Model Agnostic Interpretability for Multiple Instance LearningPoster13 citations
- Normalization of Language Embeddings for Cross-Lingual AlignmentPoster13 citations
- Phenomenology of Double Descent in Finite-Width Neural NetworksPoster13 citations
- Provably Robust Adversarial ExamplesPoster13 citations
- R5: Rule Discovery with Reinforced and Recurrent Relational ReasoningSpotlight13 citations
- Reinforcement Learning in Presence of Discrete Markovian Context EvolutionPoster13 citations
- Safe Neurosymbolic Learning with Differentiable Symbolic ExecutionPoster13 citations
- Signing the Supermask: Keep, Hide, InvertPoster13 citations
- Superclass-Conditional Gaussian Mixture Model For Learning Fine-Grained EmbeddingsSpotlight13 citations
- The Role of Pretrained Representations for the OOD Generalization of RL AgentsPoster13 citations
- Toward Efficient Low-Precision Training: Data Format Optimization and Hysteresis QuantizationPoster13 citations
- Training Structured Neural Networks Through Manifold Identification and Variance ReductionPoster13 citations
- Using Graph Representation Learning with Schema Encoders to Measure the Severity of Depressive SymptomsPoster13 citations
- Variational autoencoders in the presence of low-dimensional data: landscape and implicit biasPoster13 citations
- switch-GLAT: Multilingual Parallel Machine Translation Via Code-Switch DecoderPoster13 citations
- A Biologically Interpretable Graph Convolutional Network to Link Genetic Risk Pathways and Imaging Phenotypes of DiseasePoster12 citations
- Concurrent Adversarial Learning for Large-Batch TrainingPoster12 citations
- Differentiable Expectation-Maximization for Set Representation LearningPoster12 citations
- Dynamic Token Normalization improves Vision TransformersPoster12 citations
- EigenGame Unloaded: When playing games is better than optimizingPoster12 citations
- Hot-Refresh Model Upgrades with Regression-Free Compatible Training in Image RetrievalPoster12 citations
- Learning Continuous Environment Fields via Implicit FunctionsPoster12 citations
- Learning State Representations via Retracing in Reinforcement LearningPoster12 citations
- Learning Value Functions from Undirected State-only ExperiencePoster12 citations
- On the Learning and Learnability of QuasimetricsPoster12 citations
- Optimization inspired Multi-Branch Equilibrium ModelsPoster12 citations
- PF-GNN: Differentiable particle filtering based approximation of universal graph representationsPoster12 citations
- Phase Collapse in Neural NetworksPoster12 citations
- Provably convergent quasistatic dynamics for mean-field two-player zero-sum gamesPoster12 citations
- Reinforcement Learning under a Multi-agent Predictive State Representation Model: Method and TheorySpotlight12 citations
- Toward Faithful Case-based Reasoning through Learning Prototypes in a Nearest Neighbor-friendly Space.Poster12 citations
- Variational Predictive Routing with Nested Subjective TimescalesPoster12 citations
- Why Propagate Alone? Parallel Use of Labels and Features on GraphsPoster12 citations
- A Johnson-Lindenstrauss Framework for Randomly Initialized CNNsPoster11 citations
- A fast and accurate splitting method for optimal transport: analysis and implementationPoster11 citations
- Case-based reasoning for better generalization in textual reinforcement learningPoster11 citations
- Constrained Physical-Statistics Models for Dynamical System Identification and PredictionPoster11 citations
- Gradient Importance Learning for Incomplete ObservationsPoster11 citations
- Hidden Parameter Recurrent State Space Models For Changing Dynamics ScenariosPoster11 citations
- Learnability of convolutional neural networks for infinite dimensional input via mixed and anisotropic smoothnessSpotlight11 citations
- Learning Altruistic Behaviours in Reinforcement Learning without External RewardsSpotlight11 citations
- Map Induction: Compositional spatial submap learning for efficient exploration in novel environmentsPoster11 citations
- Maximum n-times Coverage for Vaccine DesignPoster11 citations
- Measuring the Interpretability of Unsupervised Representations via Quantized Reversed ProbingPoster11 citations
- Multi-Task ProcessesPoster11 citations
- Multimeasurement Generative ModelsPoster11 citations
- Quantitative Performance Assessment of CNN Units via Topological Entropy CalculationPoster11 citations
- Random matrices in service of ML footprint: ternary random features with no performance lossPoster11 citations
- Scalable One-Pass Optimisation of High-Dimensional Weight-Update Hyperparameters by Implicit DifferentiationSpotlight11 citations
- Visual Representation Learning over Latent DomainsPoster11 citations
- Associated Learning: an Alternative to End-to-End Backpropagation that Works on CNN, RNN, and TransformerPoster10 citations
- Boosted Curriculum Reinforcement LearningPoster10 citations
- DictFormer: Tiny Transformer with Shared DictionaryPoster10 citations
- Efficient Computation of Deep Nonlinear Infinite-Width Neural Networks that Learn FeaturesPoster10 citations
- Generalized rectifier wavelet covariance models for texture synthesisPoster10 citations
- Generative Planning for Temporally Coordinated Exploration in Reinforcement LearningSpotlight10 citations
- High Probability Generalization Bounds with Fast Rates for Minimax ProblemsPoster10 citations
- Hindsight Foresight Relabeling for Meta-Reinforcement LearningPoster10 citations
- Language-biased image classification: evaluation based on semantic representationsPoster10 citations
- Neural Network Approximation based on Hausdorff distance of Tropical ZonotopesPoster10 citations
- On Incorporating Inductive Biases into VAEsPoster10 citations
- On the Convergence of Certified Robust Training with Interval Bound PropagationPoster10 citations
- On-Policy Model Errors in Reinforcement LearningPoster10 citations
- Topologically Regularized Data EmbeddingsPoster10 citations
- Towards Understanding the Robustness Against Evasion Attack on Categorical DataPoster10 citations
- Unraveling Model-Agnostic Meta-Learning via The Adaptation Learning RatePoster10 citations
- Variational oracle guiding for reinforcement learningPoster10 citations
- W-CTC: a Connectionist Temporal Classification Loss with Wild CardsPoster10 citations
- A Neural Tangent Kernel Perspective of Infinite Tree EnsemblesPoster9 citations
- Axiomatic Explanations for Visual Search, Retrieval, and Similarity LearningPoster9 citations
- DriPP: Driven Point Processes to Model Stimuli Induced Patterns in M/EEG SignalsPoster9 citations
- Evidential Turing ProcessesPoster9 citations
- Fairness in Representation for Multilingual NLP: Insights from Controlled Experiments on Conditional Language ModelingSpotlight9 citations
- Generalized Natural Gradient Flows in Hidden Convex-Concave Games and GANsPoster9 citations
- Huber Additive Models for Non-stationary Time Series AnalysisPoster9 citations
- Implicit Bias of Adversarial Training for Deep Neural NetworksPoster9 citations
- Improving the Accuracy of Learning Example Weights for Imbalance ClassificationPoster9 citations
- Learning Causal Models from Conditional Moment Restrictions by Importance WeightingSpotlight9 citations
- Learning Features with Parameter-Free LayersPoster9 citations
- Learning Object-Oriented Dynamics for Planning from TextPoster9 citations
- Online Hyperparameter Meta-Learning with Hypergradient DistillationSpotlight9 citations
- PER-ETD: A Polynomially Efficient Emphatic Temporal Difference Learning MethodPoster9 citations
- Peek-a-Boo: What (More) is Disguised in a Randomly Weighted Neural Network, and How to Find It EfficientlyPoster9 citations
- Prototypical Contrastive Predictive CodingPoster9 citations
- Relational Surrogate Loss LearningPoster9 citations
- Scale Mixtures of Neural Network Gaussian ProcessesPoster9 citations
- The Uncanny Similarity of Recurrence and DepthPoster9 citations
- A Class of Short-term Recurrence Anderson Mixing Methods and Their ApplicationsPoster8 citations
- Bi-linear Value Networks for Multi-goal Reinforcement LearningPoster8 citations
- Causal Contextual Bandits with Targeted InterventionsPoster8 citations
- Environment Predictive Coding for Visual NavigationPoster8 citations
- Few-shot Learning via Dirichlet Tessellation EnsemblePoster8 citations
- Graphon based Clustering and Testing of Networks: Algorithms and TheoryPoster8 citations
- Inverse Online Learning: Understanding Non-Stationary and Reactionary PoliciesPoster8 citations
- Minimax Optimality (Probably) Doesn't Imply Distribution Learning for GANsPoster8 citations
- MoReL: Multi-omics Relational LearningPoster8 citations
- On the Uncomputability of Partition Functions in Energy-Based Sequence ModelsSpotlight8 citations
- Orchestrated Value Mapping for Reinforcement LearningPoster8 citations
- Parallel Training of GRU Networks with a Multi-Grid Solver for Long SequencesPoster8 citations
- Representation-Agnostic Shape FieldsPoster8 citations
- Towards Understanding Generalization via Decomposing Excess Risk DynamicsPoster8 citations
- Unrolling PALM for Sparse Semi-Blind Source SeparationPoster8 citations
- Visual hyperacuity with moving sensor and recurrent neural computationsPoster8 citations
- A Reduction-Based Framework for Conservative Bandits and Reinforcement LearningPoster7 citations
- AlphaZero-based Proof Cost Network to Aid Game SolvingPoster7 citations
- Bundle Networks: Fiber Bundles, Local Trivializations, and a Generative Approach to Exploring Many-to-one MapsPoster7 citations
- Convergent and Efficient Deep Q Learning AlgorithmPoster7 citations
- DIVA: Dataset Derivative of a Learning TaskPoster7 citations
- Declarative nets that are equilibrium modelsPoster7 citations
- Fast topological clustering with Wasserstein distancePoster7 citations
- How Low Can We Go: Trading Memory for Error in Low-Precision TrainingPoster7 citations
- IFR-Explore: Learning Inter-object Functional Relationships in 3D Indoor ScenesPoster7 citations
- Inductive Relation Prediction Using Analogy Subgraph EmbeddingsPoster7 citations
- LEARNING GUARANTEES FOR GRAPH CONVOLUTIONAL NETWORKS ON THE STOCHASTIC BLOCK MODELPoster7 citations
- Learnability Lock: Authorized Learnability Control Through Adversarial Invertible TransformationsPoster7 citations
- Learning Discrete Structured Variational Auto-Encoder using Natural Evolution StrategiesPoster7 citations
- Learning Generalizable Representations for Reinforcement Learning via Adaptive Meta-learner of Behavioral SimilaritiesPoster7 citations
- Learning to Annotate Part Segmentation with Gradient MatchingPoster7 citations
- Neural Relational Inference with Node-Specific InformationPoster7 citations
- On the approximation properties of recurrent encoder-decoder architecturesSpotlight7 citations
- R4D: Utilizing Reference Objects for Long-Range Distance EstimationPoster7 citations
- Sparse Communication via Mixed DistributionsOral7 citations
- Training Transition Policies via Distribution Matching for Complex TasksPoster7 citations
- Auto-Transfer: Learning to Route Transferable RepresentationsPoster6 citations
- Contrastive Clustering to Mine Pseudo Parallel Data for Unsupervised TranslationPoster6 citations
- CrowdPlay: Crowdsourcing Human Demonstrations for Offline LearningPoster6 citations
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.