ICML 2022 Accepted Papers
The full list of 1,228 papers accepted at ICML 2022 (International Conference on Machine Learning). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Spotlight: 1,110Oral: 118
- BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and GenerationSpotlight5,196 citations
- GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion ModelsSpotlight3,944 citations
- FEDformer: Frequency Enhanced Decomposed Transformer for Long-term Series ForecastingSpotlight2,128 citations
- Improving Language Models by Retrieving from Trillions of TokensSpotlight1,323 citations
- Language Models as Zero-Shot Planners: Extracting Actionable Knowledge for Embodied AgentsSpotlight1,280 citations
- OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning FrameworkSpotlight1,222 citations
- Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference timeSpotlight1,132 citations
- data2vec: A General Framework for Self-supervised Learning in Speech, Vision and LanguageOral1,024 citations
- Equivariant Diffusion for Molecule Generation in 3DOral806 citations
- GLaM: Efficient Scaling of Language Models with Mixture-of-ExpertsSpotlight765 citations
- Planning with Diffusion for Flexible Behavior SynthesisOral764 citations
- Out-of-Distribution Detection with Deep Nearest NeighborsSpotlight635 citations
- Diffusion Models for Adversarial PurificationSpotlight583 citations
- Scaling Out-of-Distribution Detection for Real-World SettingsSpotlight571 citations
- YourTTS: Towards Zero-Shot Multi-Speaker TTS and Zero-Shot Voice Conversion for EveryoneSpotlight526 citations
- Learning inverse folding from millions of predicted structuresOral475 citations
- DSTAGNN: Dynamic Spatial-Temporal Aware Graph Neural Network for Traffic Flow ForecastingSpotlight441 citations
- Efficient Test-Time Model Adaptation without ForgettingSpotlight411 citations
- Structure-Aware Transformer for Graph Representation LearningSpotlight383 citations
- Memory-Based Model Editing at ScaleSpotlight368 citations
- Mitigating Neural Network Overconfidence with Logit NormalizationSpotlight362 citations
- EquiBind: Geometric Deep Learning for Drug Binding Structure PredictionSpotlight356 citations
- Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual ConceptsSpotlight346 citations
- Transformer Quality in Linear TimeSpotlight327 citations
- How Powerful are Spectral Graph Neural NetworksSpotlight316 citations
- DeepSpeed-MoE: Advancing Mixture-of-Experts Inference and Training to Power Next-Generation AI ScaleSpotlight315 citations
- Deduplicating Training Data Mitigates Privacy Risks in Language ModelsSpotlight311 citations
- FedScale: Benchmarking Model and System Performance of Federated Learning at ScaleSpotlight299 citations
- 3D Infomax improves GNNs for Molecular Property PredictionSpotlight294 citations
- Black-Box Tuning for Language-Model-as-a-ServiceSpotlight288 citations
- Rethinking Graph Neural Networks for Anomaly DetectionSpotlight287 citations
- Score-based Generative Modeling of Graphs via the System of Stochastic Differential EquationsSpotlight281 citations
- Temporal Difference Learning for Model Predictive ControlSpotlight278 citations
- Interpretable and Generalizable Graph Learning via Stochastic Attention MechanismSpotlight277 citations
- Online Decision TransformerOral276 citations
- How Faithful is your Synthetic Data? Sample-level Metrics for Evaluating and Auditing Generative ModelsSpotlight271 citations
- Fishr: Invariant Gradient Variances for Out-of-Distribution GeneralizationSpotlight267 citations
- Finding Global Homophily in Graph Neural Networks When Meeting HeterophilySpotlight263 citations
- It’s Raw! Audio Generation with State-Space ModelsOral256 citations
- G-Mixup: Graph Data Augmentation for Graph ClassificationOral255 citations
- Pocket2Mol: Efficient Molecular Sampling Based on 3D Protein PocketsSpotlight246 citations
- Improving Out-of-Distribution Robustness via Selective AugmentationSpotlight237 citations
- Tranception: Protein Fitness Prediction with Autoregressive Transformers and Inference-time RetrievalSpotlight237 citations
- Understanding The Robustness in Vision TransformersSpotlight235 citations
- From data to functa: Your data point is a function and you can treat it like oneSpotlight222 citations
- The Primacy Bias in Deep Reinforcement LearningSpotlight216 citations
- Self-supervised learning with random-projection quantizer for speech recognitionSpotlight215 citations
- What Language Model Architecture and Pretraining Objective Works Best for Zero-Shot Generalization?Spotlight214 citations
- The Unsurprising Effectiveness of Pre-Trained Vision Models for ControlOral212 citations
- Federated Learning with Partial Model PersonalizationSpotlight209 citations
- Dataset Condensation via Efficient Synthetic-Data ParameterizationSpotlight207 citations
- Biological Sequence Design with GFlowNetsSpotlight203 citations
- Correct-N-Contrast: a Contrastive Approach for Improving Robustness to Spurious CorrelationsOral201 citations
- Branchformer: Parallel MLP-Attention Architectures to Capture Local and Global Context for Speech Recognition and UnderstandingSpotlight200 citations
- ProxSkip: Yes! Local Gradient Steps Provably Lead to Communication Acceleration! Finally!Spotlight192 citations
- Neurotoxin: Durable Backdoors in Federated LearningSpotlight189 citations
- A Study of Face Obfuscation in ImageNetSpotlight184 citations
- Generalized Federated Learning via Sharpness Aware MinimizationSpotlight182 citations
- Towards Understanding Sharpness-Aware MinimizationSpotlight177 citations
- Adaptive Conformal Predictions for Time SeriesSpotlight175 citations
- Multi-Task Learning as a Bargaining GameSpotlight175 citations
- Prioritized Training on Points that are Learnable, Worth Learning, and not yet LearntSpotlight173 citations
- Prompting Decision Transformer for Few-Shot Policy GeneralizationSpotlight172 citations
- ProGCL: Rethinking Hard Negative Mining in Graph Contrastive LearningSpotlight168 citations
- Low-Complexity Deep Convolutional Neural Networks on Fully Homomorphic Encryption Using Multiplexed Parallel ConvolutionsSpotlight166 citations
- Robustness and Accuracy Could Be Reconcilable by (Proper) DefinitionSpotlight166 citations
- Data Determines Distributional Robustness in Contrastive Language Image Pre-training (CLIP)Spotlight165 citations
- DisPFL: Towards Communication-Efficient Personalized Federated Learning via Decentralized Sparse TrainingSpotlight165 citations
- Generating 3D Molecules for Target Protein BindingOral162 citations
- Online Continual Learning through Mutual Information MaximizationSpotlight162 citations
- Adversarially Trained Actor Critic for Offline Reinforcement LearningOral160 citations
- Graph-Coupled Oscillator NetworksSpotlight160 citations
- Inductive Biases and Variable Creation in Self-Attention MechanismsSpotlight159 citations
- A Closer Look at Smoothness in Domain Adversarial TrainingSpotlight157 citations
- Robust Training under Label Noise by Over-parameterizationSpotlight154 citations
- Privacy for Free: How does Dataset Condensation Help Privacy?Oral151 citations
- Unsupervised Time-Series Representation Learning with Iterative Bilinear Temporal-Spectral FusionSpotlight151 citations
- Evolving Curricula with Regret-Based Environment DesignSpotlight148 citations
- Forget-free Continual Learning with Winning SubnetworksSpotlight147 citations
- Active Learning on a Budget: Opposite Strategies Suit High and Low BudgetsSpotlight145 citations
- Understanding Contrastive Learning Requires Incorporating Inductive BiasesSpotlight141 citations
- Local Augmentation for Graph Neural NetworksSpotlight140 citations
- Dataset Condensation with Contrastive SignalsSpotlight139 citations
- Particle Transformer for Jet TaggingSpotlight139 citations
- ContentVec: An Improved Self-Supervised Speech Representation by Disentangling SpeakersSpotlight138 citations
- Let Invariant Rationale Discovery Inspire Graph Contrastive LearningSpotlight138 citations
- A Consistent and Efficient Evaluation Strategy for Attribution MethodsSpotlight137 citations
- Overcoming Oscillations in Quantization-Aware TrainingOral135 citations
- Reinforcement Learning with Action-Free Pre-Training from VideosSpotlight134 citations
- Understanding Clipping for Federated Learning: Convergence and Client-Level Differential PrivacySpotlight133 citations
- Understanding Gradient Descent on the Edge of Stability in Deep LearningSpotlight132 citations
- POEM: Out-of-Distribution Detection with Posterior SamplingOral131 citations
- Penalizing Gradient Norm for Efficiently Improving Generalization in Deep LearningSpotlight130 citations
- Recurrent Model-Free RL Can Be a Strong Baseline for Many POMDPsSpotlight130 citations
- Learning from Counterfactual Links for Link PredictionSpotlight129 citations
- Transformer Neural Processes: Uncertainty-Aware Meta Learning Via Sequence ModelingSpotlight128 citations
- XAI for Transformers: Better Explanations through Conservative PropagationSpotlight128 citations
- Do Differentiable Simulators Give Better Policy Gradients?Oral127 citations
- Flowformer: Linearizing Transformers with Conservation FlowsSpotlight127 citations
- Personalized Federated Learning through Local MemorizationSpotlight126 citations
- CITRIS: Causal Identifiability from Temporal Intervened SequencesSpotlight125 citations
- On the Optimization Landscape of Neural Collapse under MSE Loss: Global Optimality with Unconstrained FeaturesSpotlight125 citations
- Causal Transformer for Estimating Counterfactual OutcomesSpotlight124 citations
- Characterizing and Overcoming the Greedy Nature of Learning in Multi-modal Deep Neural NetworksSpotlight123 citations
- Matching Structure for Dual LearningSpotlight123 citations
- Modality Competition: What Makes Joint Training of Multi-modal Network Fail in Deep Learning? (Provably)Spotlight123 citations
- Connect, Not Collapse: Explaining Contrastive Learning for Unsupervised Domain AdaptationOral122 citations
- Personalized Federated Learning via Variational Bayesian InferenceSpotlight122 citations
- Class-Imbalanced Semi-Supervised Learning with Adaptive ThresholdingSpotlight120 citations
- Communication-Efficient Adaptive Federated LearningSpotlight120 citations
- Generative Flow Networks for Discrete Probabilistic ModelingSpotlight120 citations
- A data-driven approach for learning to control computersSpotlight119 citations
- Image-to-Image Regression with Distribution-Free Uncertainty Quantification and Applications in ImagingSpotlight119 citations
- The CLRS Algorithmic Reasoning BenchmarkSpotlight119 citations
- Pessimistic Q-Learning for Offline Reinforcement Learning: Towards Optimal Sample ComplexitySpotlight116 citations
- Adversarial Masking for Self-Supervised LearningSpotlight115 citations
- Confidence Score for Source-Free Unsupervised Domain AdaptationSpotlight115 citations
- Modeling Irregular Time Series with Continuous Recurrent UnitsSpotlight115 citations
- Training OOD Detectors in their Natural HabitatsSpotlight115 citations
- Accelerating Bayesian Optimization for Biological Sequence Design with Denoising AutoencodersSpotlight113 citations
- Guided-TTS: A Diffusion Model for Text-to-Speech via Classifier GuidanceSpotlight112 citations
- Design-Bench: Benchmarks for Data-Driven Offline Model-Based OptimizationSpotlight111 citations
- Extended Unconstrained Features Model for Exploring Deep Neural CollapseSpotlight111 citations
- Monarch: Expressive Structured Matrices for Efficient and Accurate TrainingOral111 citations
- Virtual Homogeneity Learning: Defending against Data Heterogeneity in Federated LearningSpotlight111 citations
- Domain Adaptation for Time Series Forecasting via Attention SharingSpotlight110 citations
- Learning Domain Adaptive Object Detection with Probabilistic TeacherSpotlight110 citations
- Meaningfully debugging model mistakes using conceptual counterfactual explanationsSpotlight108 citations
- Revisiting and Advancing Fast Adversarial Training Through The Lens of Bi-Level OptimizationSpotlight108 citations
- Balancing Discriminability and Transferability for Source-Free Domain AdaptationSpotlight107 citations
- Benchmarking and Analyzing Point Cloud Classification under CorruptionsSpotlight106 citations
- Fishing for User Data in Large-Batch Federated Learning via Gradient MagnificationSpotlight106 citations
- PLATON: Pruning Large Transformer Models with Upper Confidence Bound of Weight ImportanceSpotlight106 citations
- Neural-Symbolic Models for Logical Queries on Knowledge GraphsSpotlight105 citations
- Linear Adversarial Concept ErasureSpotlight104 citations
- Partial Counterfactual Identification from Observational and Experimental DataSpotlight103 citations
- Score Matching Enables Causal Discovery of Nonlinear Additive Noise ModelsOral103 citations
- Sharp-MAML: Sharpness-Aware Model-Agnostic Meta LearningSpotlight103 citations
- Structural Entropy Guided Graph Hierarchical PoolingSpotlight103 citations
- Constrained Variational Policy Optimization for Safe Reinforcement LearningSpotlight101 citations
- Proximal Denoiser for Convergent Plug-and-Play Optimization with Nonconvex RegularizationSpotlight100 citations
- To Smooth or Not? When Label Smoothing Meets Noisy LabelsOral99 citations
- Discriminator-Weighted Offline Imitation Learning from Suboptimal DemonstrationsSpotlight98 citations
- Independent Policy Gradient for Large-Scale Markov Potential Games: Sharper Rates, Function Approximation, and Game-Agnostic ConvergenceOral97 citations
- Plug & Play Attacks: Towards Robust and Flexible Model Inversion AttacksSpotlight97 citations
- Deep Safe Incomplete Multi-view Clustering: Theorem and AlgorithmSpotlight96 citations
- Deep Variational Graph Convolutional Recurrent Network for Multivariate Time Series Anomaly DetectionSpotlight96 citations
- FedNL: Making Newton-Type Methods Applicable to Federated LearningSpotlight96 citations
- ViT-NeT: Interpretable Vision Transformers with Neural Tree DecoderSpotlight96 citations
- Approximately Equivariant Networks for Imperfectly Symmetric DynamicsSpotlight95 citations
- Revisiting Consistency Regularization for Deep Partial Label LearningSpotlight95 citations
- HyperPrompt: Prompt-based Task-Conditioning of TransformersSpotlight94 citations
- Maximum Likelihood Training for Score-based Diffusion ODEs by High Order Denoising Score MatchingSpotlight94 citations
- Head2Toe: Utilizing Intermediate Representations for Better Transfer LearningOral93 citations
- HyperTransformer: Model Generation for Supervised and Semi-Supervised Few-Shot LearningSpotlight92 citations
- Learning to Cut by Looking Ahead: Cutting Plane Selection via Imitation LearningSpotlight92 citations
- Inducing Causal Structure for Interpretable Neural NetworksSpotlight91 citations
- SkexGen: Autoregressive Generation of CAD Construction Sequences with Disentangled CodebooksSpotlight91 citations
- Soft Truncation: A Universal Training Technique of Score-based Diffusion Model for High Precision Score EstimationSpotlight91 citations
- Latent Diffusion Energy-Based Model for Interpretable Text ModellingSpotlight90 citations
- Understanding Robust Overfitting of Adversarial Training and BeyondSpotlight90 citations
- Understanding the unstable convergence of gradient descentSpotlight90 citations
- AutoSNN: Towards Energy-Efficient Spiking Neural NetworksSpotlight89 citations
- Evaluating the Adversarial Robustness of Adaptive Test-time DefensesSpotlight89 citations
- Policy Gradient Method For Robust Reinforcement LearningSpotlight89 citations
- HyperImpute: Generalized Iterative Imputation with Automatic Model SelectionSpotlight88 citations
- Transformers are Meta-Reinforcement LearnersSpotlight88 citations
- Federated Reinforcement Learning: Linear Speedup Under Markovian SamplingOral87 citations
- Offline Meta-Reinforcement Learning with Online Self-SupervisionSpotlight87 citations
- Saute RL: Almost Surely Safe Reinforcement Learning Using State AugmentationSpotlight87 citations
- Estimating the Optimal Covariance with Imperfect Mean in Diffusion Probabilistic ModelsSpotlight86 citations
- Fisher SAM: Information Geometry and Sharpness Aware MinimisationSpotlight86 citations
- More Than a Toy: Random Matrix Models Predict How Real-World Neural Representations GeneralizeSpotlight86 citations
- A Rigorous Study of Integrated Gradients Method and Extensions to Internal Neuron AttributionsSpotlight85 citations
- How to Leverage Unlabeled Data in Offline Reinforcement LearningSpotlight85 citations
- Robin Hood and Matthew Effects: Differential Privacy Has Disparate Impact on Synthetic DataSpotlight85 citations
- DAdaQuant: Doubly-adaptive quantization for communication-efficient Federated LearningSpotlight84 citations
- Detecting Corrupted Labels Without Training a Model to PredictSpotlight84 citations
- Human-in-the-loop: Provably Efficient Preference-based Reinforcement Learning with General Function ApproximationSpotlight84 citations
- Anarchic Federated LearningOral83 citations
- Bayesian Model Selection, the Marginal Likelihood, and GeneralizationOral83 citations
- Sparse Invariant Risk MinimizationSpotlight83 citations
- SE(3) Equivariant Graph Neural Networks with Complete Local FramesSpotlight82 citations
- Wide Neural Networks Forget Less CatastrophicallySpotlight82 citations
- FedNest: Federated Bilevel, Minimax, and Compositional OptimizationOral81 citations
- Guarantees for Epsilon-Greedy Reinforcement Learning with Function ApproximationSpotlight81 citations
- Linear-Time Gromov Wasserstein Distances using Low Rank Couplings and CostsSpotlight81 citations
- Partial disentanglement for domain adaptationSpotlight81 citations
- SPECTRE: Spectral Conditioning Helps to Overcome the Expressivity Limits of One-shot Graph GeneratorsSpotlight81 citations
- On the Adversarial Robustness of Causal Algorithmic RecourseSpotlight80 citations
- SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic QuantizationSpotlight80 citations
- Universal Hopfield Networks: A General Framework for Single-Shot Associative Memory ModelsSpotlight80 citations
- Detecting Adversarial Examples Is (Nearly) As Hard As Classifying ThemOral79 citations
- Efficient Reinforcement Learning in Block MDPs: A Model-free Representation Learning approachSpotlight79 citations
- General-purpose, long-context autoregressive modeling with Perceiver ARSpotlight79 citations
- Generalization and Robustness Implications in Object-Centric LearningSpotlight79 citations
- Knowledge Base Question Answering by Case-based Reasoning over SubgraphsSpotlight79 citations
- Secure Quantized Training for Deep LearningSpotlight79 citations
- Unified Scaling Laws for Routed Language ModelsOral79 citations
- Achieving Fairness at No Utility Cost via Data Reweighing with InfluenceSpotlight78 citations
- De novo mass spectrometry peptide sequencing with a transformer modelSpotlight78 citations
- Frustratingly Easy Transferability EstimationSpotlight78 citations
- Flow-Guided Sparse Transformer for Video DeblurringSpotlight77 citations
- Latent Outlier Exposure for Anomaly Detection with Contaminated DataSpotlight77 citations
- On Improving Model-Free Algorithms for Decentralized Multi-Agent Reinforcement LearningSpotlight77 citations
- On the Practicality of Deterministic Epistemic UncertaintySpotlight77 citations
- Orchestra: Unsupervised Federated Learning via Globally Consistent ClusteringSpotlight77 citations
- The Fundamental Price of Secure Aggregation in Differentially Private Federated LearningSpotlight77 citations
- Translatotron 2: High-quality direct speech-to-speech translation with voice preservationSpotlight77 citations
- Byzantine Machine Learning Made Easy By Resilient Averaging of MomentumsSpotlight76 citations
- Fast Finite Width Neural Tangent KernelSpotlight76 citations
- On the Equivalence Between Temporal and Static Equivariant Graph RepresentationsSpotlight76 citations
- Reachability Constrained Reinforcement LearningSpotlight76 citations
- When and How Mixup Improves CalibrationSpotlight76 citations
- Deep Neural Network Fusion via Graph Matching with Applications to Model Ensemble and Federated LearningSpotlight75 citations
- Lie Point Symmetry Data Augmentation for Neural PDE SolversSpotlight75 citations
- Multi-Level Branched Regularization for Federated LearningSpotlight74 citations
- Variational Wasserstein gradient flowSpotlight74 citations
- Adaptive Second Order Coresets for Data-efficient Machine LearningSpotlight73 citations
- Neuro-Symbolic Language Modeling with Automaton-augmented RetrievalSpotlight73 citations
- Bounding Training Data Reconstruction in Private (Deep) LearningOral72 citations
- Geometric Multimodal Contrastive Representation LearningSpotlight72 citations
- Improved Certified Defenses against Data Poisoning with (Deterministic) Finite AggregationSpotlight72 citations
- Measuring the Effect of Training Data on Deep Learning Predictions via Randomized ExperimentsSpotlight72 citations
- Causal structure-based root cause analysis of outliersSpotlight71 citations
- Decision-Focused Learning: Through the Lens of Learning to RankSpotlight71 citations
- TAM: Topology-Aware Margin Loss for Class-Imbalanced Node ClassificationSpotlight71 citations
- Framework for Evaluating Faithfulness of Local ExplanationsSpotlight70 citations
- IGLUE: A Benchmark for Transfer Learning across Modalities, Tasks, and LanguagesSpotlight70 citations
- Representation Topology Divergence: A Method for Comparing Neural Network Representations.Spotlight70 citations
- Reward-Free RL is No Harder Than Reward-Aware RL in Linear Markov Decision ProcessesSpotlight70 citations
- Scalable Deep Reinforcement Learning Algorithms for Mean Field GamesSpotlight70 citations
- The Power of Exploiter: Provable Multi-Agent RL in Large State SpacesSpotlight70 citations
- Adaptive Inertia: Disentangling the Effects of Adaptive Learning Rate and MomentumOral69 citations
- Directed Acyclic Transformer for Non-Autoregressive Machine TranslationSpotlight69 citations
- Faster Fundamental Graph Algorithms via Learned PredictionsSpotlight69 citations
- NISPA: Neuro-Inspired Stability-Plasticity Adaptation for Continual Learning in Sparse NetworksSpotlight69 citations
- Plan Better Amid Conservatism: Offline Multi-Agent Reinforcement Learning with Actor RectificationSpotlight69 citations
- DAVINZ: Data Valuation using Deep Neural Networks at InitializationSpotlight68 citations
- Dialog Inpainting: Turning Documents into DialogsSpotlight68 citations
- Identification of Linear Non-Gaussian Latent Hierarchical StructureSpotlight68 citations
- Investigating Why Contrastive Learning Benefits Robustness against Label NoiseSpotlight68 citations
- Molecular Representation Learning via Heterogeneous Motif Graph Neural NetworksSpotlight68 citations
- Public Data-Assisted Mirror Descent for Private Model TrainingSpotlight68 citations
- Retroformer: Pushing the Limits of End-to-end Retrosynthesis TransformerSpotlight68 citations
- Modeling Strong and Human-Like Gameplay with KL-Regularized SearchSpotlight67 citations
- ProgFed: Effective, Communication, and Computation Efficient Federated Learning by Progressive TrainingSpotlight67 citations
- DreamerPro: Reconstruction-Free Model-Based Reinforcement Learning with Prototypical RepresentationsSpotlight66 citations
- HousE: Knowledge Graph Embedding with Householder ParameterizationSpotlight66 citations
- Model-Free Opponent ShapingSpotlight66 citations
- RieszNet and ForestRiesz: Automatic Debiased Machine Learning with Neural Nets and Random ForestsOral66 citations
- Causal Conceptions of Fairness and their ConsequencesOral65 citations
- Certified Neural Network Watermarks with Randomized SmoothingSpotlight65 citations
- Align-RUDDER: Learning From Few Demonstrations by Reward RedistributionOral64 citations
- Data Augmentation as Feature ManipulationSpotlight64 citations
- Distributionally Robust $Q$-LearningSpotlight64 citations
- Estimating Instance-dependent Bayes-label Transition Matrix using a Deep Neural NetworkSpotlight64 citations
- Model Agnostic Sample Reweighting for Out-of-Distribution LearningSpotlight64 citations
- Personalization Improves Privacy-Accuracy Tradeoffs in Federated LearningSpotlight64 citations
- Zero-Shot Reward Specification via Grounded Natural LanguageSpotlight64 citations
- Architecture Agnostic Federated Learning for Neural NetworksSpotlight63 citations
- RankSim: Ranking Similarity Regularization for Deep Imbalanced RegressionSpotlight63 citations
- Robust Counterfactual Explanations for Tree-Based EnsemblesSpotlight63 citations
- 3DLinker: An E(3) Equivariant Variational Autoencoder for Molecular Linker DesignOral62 citations
- A Theoretical Comparison of Graph Neural Network ExtensionsSpotlight62 citations
- COLA: Consistent Learning with Opponent-Learning AwarenessSpotlight62 citations
- Error-driven Input Modulation: Solving the Credit Assignment Problem without a Backward PassSpotlight62 citations
- Expression might be enough: representing pressure and demand for reinforcement learning based traffic signal controlSpotlight62 citations
- Federated Minimax Optimization: Improved Convergence Analyses and AlgorithmsSpotlight62 citations
- Improved Rates for Differentially Private Stochastic Convex Optimization with Heavy-Tailed DataOral62 citations
- Perfectly Balanced: Improving Transfer and Robustness of Supervised Contrastive LearningSpotlight62 citations
- StreamingQA: A Benchmark for Adaptation to New Knowledge over Time in Question Answering ModelsSpotlight62 citations
- A Differential Entropy Estimator for Training Neural NetworksSpotlight61 citations
- Active Sampling for Min-Max FairnessSpotlight61 citations
- Co-training Improves Prompt-based Learning for Large Language ModelsSpotlight61 citations
- Imitation Learning by Estimating Expertise of DemonstratorsSpotlight61 citations
- Antibody-Antigen Docking and Design via Hierarchical Structure RefinementSpotlight60 citations
- Continuous-Time Modeling of Counterfactual Outcomes Using Neural Controlled Differential EquationsSpotlight60 citations
- Exact Optimal Accelerated Complexity for Fixed-Point IterationsOral60 citations
- Robust Task Representations for Offline Meta-Reinforcement Learning via Contrastive LearningSpotlight60 citations
- The Poisson Binomial Mechanism for Unbiased Federated Learning with Secure AggregationOral60 citations
- Calibrated Learning to Defer with One-vs-All ClassifiersSpotlight59 citations
- Channel Importance Matters in Few-Shot Image ClassificationSpotlight59 citations
- Denoised MDPs: Learning World Models Better Than the World ItselfSpotlight59 citations
- EDEN: Communication-Efficient and Robust Distributed Mean Estimation for Federated LearningSpotlight59 citations
- Estimating and Penalizing Induced Preference Shifts in Recommender SystemsSpotlight59 citations
- NP-Match: When Neural Processes meet Semi-Supervised LearningSpotlight59 citations
- Optimizing Sequential Experimental Design with Deep Reinforcement LearningSpotlight59 citations
- Retrieval-Augmented Reinforcement LearningSpotlight59 citations
- Topology-Aware Network Pruning using Multi-stage Graph Embedding and Reinforcement LearningOral59 citations
- Towards understanding how momentum improves generalization in deep learningSpotlight59 citations
- Accelerated Federated Learning with Decoupled Adaptive OptimizationSpotlight58 citations
- Fairness with Adaptive WeightsSpotlight58 citations
- Implicit Bias of the Step Size in Linear Diagonal Neural NetworksSpotlight58 citations
- NLP From Scratch Without Large-Scale Pretraining: A Simple and Efficient FrameworkSpotlight58 citations
- The Combinatorial Brain Surgeon: Pruning Weights That Cancel One Another in Neural NetworksSpotlight58 citations
- A Multi-objective / Multi-task Learning Framework Induced by Pareto StationaritySpotlight57 citations
- Beyond Images: Label Noise Transition Matrix Estimation for Tasks with Lower-Quality FeaturesSpotlight57 citations
- Compressed-VFL: Communication-Efficient Learning with Vertically Partitioned DataSpotlight57 citations
- Constrained Optimization with Dynamic Bound-scaling for Effective NLP Backdoor DefenseSpotlight57 citations
- LIMO: Latent Inceptionism for Targeted Molecule GenerationSpotlight57 citations
- LyaNet: A Lyapunov Framework for Training Neural ODEsSpotlight57 citations
- Offline RL Policies Should Be Trained to be AdaptiveOral57 citations
- Partial and Asymmetric Contrastive Learning for Out-of-Distribution Detection in Long-Tailed RecognitionOral57 citations
- Rethinking Attention-Model Explainability through Faithfulness Violation TestSpotlight57 citations
- A Dynamical System Perspective for Lipschitz Neural NetworksOral56 citations
- Causal Dynamics Learning for Task-Independent State AbstractionOral56 citations
- Information Discrepancy in Strategic LearningSpotlight56 citations
- On Implicit Bias in Overparameterized Bilevel OptimizationSpotlight56 citations
- Anticorrelated Noise Injection for Improved GeneralizationSpotlight55 citations
- Continual Learning via Sequential Function-Space Variational InferenceSpotlight55 citations
- Making Linear MDPs Practical via Contrastive Representation LearningSpotlight55 citations
- POET: Training Neural Networks on Tiny Devices with Integrated Rematerialization and PagingSpotlight55 citations
- Query-Efficient and Scalable Black-Box Adversarial Attacks on Discrete Sequential Data via Bayesian OptimizationSpotlight55 citations
- Self-Supervised Models of Audio Effectively Explain Human Cortical Responses to SpeechSpotlight55 citations
- A Langevin-like Sampler for Discrete DistributionsSpotlight54 citations
- A$^3$T: Alignment-Aware Acoustic and Text Pretraining for Speech Synthesis and EditingSpotlight54 citations
- Improving Task-free Continual Learning by Distributionally Robust Memory EvolutionSpotlight54 citations
- Optimal Algorithms for Mean Estimation under Local Differential PrivacyOral54 citations
- Proximal Exploration for Model-guided Protein Sequence DesignSpotlight54 citations
- Removing Batch Normalization Boosts Adversarial TrainingSpotlight54 citations
- Smoothed Adaptive Weighting for Imbalanced Semi-Supervised Learning: Improve Reliability Against Unknown Distribution DataSpotlight54 citations
- Disentangled Federated Learning for Tackling Attributes Skew via Invariant Aggregation and Diversity TransferringSpotlight53 citations
- FriendlyCore: Practical Differentially Private AggregationSpotlight53 citations
- MASER: Multi-Agent Reinforcement Learning with Subgoals Generated from Experience Replay BufferSpotlight53 citations
- Predicting Out-of-Distribution Error with the Projection NormSpotlight53 citations
- Continual Repeated Annealed Flow Transport Monte CarloSpotlight52 citations
- Hierarchical Shrinkage: Improving the accuracy and interpretability of tree-based models.Oral52 citations
- No-Regret Learning in Time-Varying Zero-Sum GamesSpotlight52 citations
- Off-Policy Evaluation for Large Action Spaces via EmbeddingsSpotlight52 citations
- On Last-Iterate Convergence Beyond Zero-Sum GamesSpotlight52 citations
- Pessimistic Minimax Value Iteration: Provably Efficient Equilibrium Learning from Offline DatasetsSpotlight52 citations
- Provable Reinforcement Learning with a Short-Term MemorySpotlight52 citations
- Proximal and Federated Random ReshufflingSpotlight52 citations
- Selective Network Linearization for Efficient Private InferenceSpotlight52 citations
- SpeqNets: Sparsity-aware permutation-equivariant graph networksSpotlight52 citations
- TACTiS: Transformer-Attentional Copulas for Time SeriesSpotlight52 citations
- Test-Time Training Can Close the Natural Distribution Shift Performance Gap in Deep Learning Based Compressed SensingSpotlight52 citations
- Conditional GANs with Auxiliary Discriminative ClassifierSpotlight51 citations
- Datamodels: Understanding Predictions with Data and Data with PredictionsSpotlight51 citations
- Online Learning with Knapsacks: the Best of Both WorldsSpotlight51 citations
- Equivariant Quantum Graph CircuitsSpotlight50 citations
- History Compression via Language Models in Reinforcement LearningSpotlight50 citations
- Improving Mini-batch Optimal Transport via Partial TransportationSpotlight50 citations
- VLMixer: Unpaired Vision-Language Pre-training via Cross-Modal CutMixSpotlight50 citations
- A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision ProcessesOral49 citations
- DRIBO: Robust Deep Reinforcement Learning via Multi-View Information BottleneckSpotlight49 citations
- Data Scaling Laws in NMT: The Effect of Noise and ArchitectureSpotlight49 citations
- Do More Negative Samples Necessarily Hurt In Contrastive Learning?Oral49 citations
- GraphFM: Improving Large-Scale GNN Training via Feature MomentumSpotlight49 citations
- Learning Symmetric Embeddings for Equivariant World ModelsSpotlight49 citations
- Revisiting Some Common Practices in Cooperative Multi-Agent Reinforcement LearningSpotlight49 citations
- Rich Feature Construction for the Optimization-Generalization DilemmaSpotlight49 citations
- The power of first-order smooth optimization for black-box non-smooth problemsSpotlight49 citations
- A Tree-based Model Averaging Approach for Personalized Treatment Effect Estimation from Heterogeneous Data SourcesSpotlight48 citations
- A new similarity measure for covariate shift with applications to nonparametric regressionOral48 citations
- Action-Sufficient State Representation Learning for Control with Structural ConstraintsSpotlight48 citations
- DynaMixer: A Vision MLP Architecture with Dynamic MixingSpotlight48 citations
- FedNew: A Communication-Efficient and Privacy-Preserving Newton-Type Method for Federated LearningSpotlight48 citations
- Generative Coarse-Graining of Molecular ConformationsSpotlight48 citations
- Going Deeper into Permutation-Sensitive Graph Neural NetworksSpotlight48 citations
- Revisiting Label Smoothing and Knowledge Distillation Compatibility: What was Missing?Spotlight48 citations
- SPDY: Accurate Pruning with Speedup GuaranteesSpotlight48 citations
- Sample Efficient Learning of Predictors that Complement HumansSpotlight48 citations
- Stabilizing Off-Policy Deep Reinforcement Learning from PixelsSpotlight48 citations
- UNIREX: A Unified Learning Framework for Language Model Rationale ExtractionSpotlight48 citations
- Understanding Gradual Domain Adaptation: Improved Analysis, Optimal Path and BeyondSpotlight48 citations
- Generalizing to New Physical Systems via Context-Informed Dynamics ModelSpotlight47 citations
- MAE-DET: Revisiting Maximum Entropy Principle in Zero-Shot NAS for Efficient Object DetectionSpotlight47 citations
- Regret Minimization with Performative FeedbackSpotlight47 citations
- State Transition of Dendritic Spines Improves Learning of Sparse Spiking Neural NetworksSpotlight47 citations
- Topology-aware Generalization of Decentralized SGDSpotlight47 citations
- Variational nearest neighbor Gaussian processSpotlight47 citations
- Convergence of Uncertainty Sampling for Active LearningSpotlight46 citations
- Curriculum Reinforcement Learning via Constrained Optimal TransportSpotlight46 citations
- DNA: Domain Generalization with Diversified Neural AveragingSpotlight46 citations
- Direct Behavior Specification via Constrained Reinforcement LearningSpotlight46 citations
- Estimation in Rotationally Invariant Generalized Linear Models via Approximate Message PassingSpotlight46 citations
- Linear Complexity Randomized Self-attention MechanismSpotlight46 citations
- MAML and ANIL Provably Learn RepresentationsSpotlight46 citations
- Matching Normalizing Flows and Probability Paths on ManifoldsSpotlight46 citations
- Online Algorithms with Multiple PredictionsSpotlight46 citations
- Optimistic Linear Support and Successor Features as a Basis for Optimal Policy TransferSpotlight46 citations
- SDQ: Stochastic Differentiable Quantization with Mixed PrecisionSpotlight46 citations
- Tell me why! Explanations support learning relational and causal structureSpotlight46 citations
- Validating Causal Inference MethodsSpotlight46 citations
- Versatile Offline Imitation from Observations and Examples via Regularized State-Occupancy MatchingSpotlight46 citations
- Algorithms for the Communication of SamplesSpotlight45 citations
- Doubly Robust Distributionally Robust Off-Policy Evaluation and LearningSpotlight45 citations
- GNNRank: Learning Global Rankings from Pairwise Comparisons via Directed Graph Neural NetworksSpotlight45 citations
- Gaussian Mixture Variational Autoencoder with Contrastive Learning for Multi-Label ClassificationSpotlight45 citations
- Learning to Solve PDE-constrained Inverse Problems with Graph NetworksSpotlight45 citations
- Open-Sampling: Exploring Out-of-Distribution data for Re-balancing Long-tailed datasetsSpotlight45 citations
- Optimal Clipping and Magnitude-aware Differentiation for Improved Quantization-aware TrainingSpotlight45 citations
- Region-Based Semantic Factorization in GANsSpotlight45 citations
- Robust Multi-Objective Bayesian Optimization Under Input NoiseSpotlight45 citations
- Coarsening the Granularity: Towards Structurally Sparse Lottery TicketsSpotlight44 citations
- Optimization-Induced Graph Implicit Nonlinear DiffusionSpotlight44 citations
- Staged Training for Transformer Language ModelsSpotlight44 citations
- A Modern Self-Referential Weight Matrix That Learns to Modify ItselfSpotlight43 citations
- A New Perspective on the Effects of Spectrum in Graph Neural NetworksSpotlight43 citations
- Bisimulation Makes Analogies in Goal-Conditioned Reinforcement LearningSpotlight43 citations
- Differentiable Top-k Classification LearningSpotlight43 citations
- First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation ApproachOral43 citations
- H-Consistency Bounds for Surrogate Loss MinimizersOral43 citations
- Individual Reward Assisted Multi-Agent Reinforcement LearningSpotlight43 citations
- Langevin Monte Carlo for Contextual BanditsSpotlight43 citations
- Neuro-Symbolic Hierarchical Rule InductionSpotlight43 citations
- Not All Poisons are Created Equal: Robust Training against Data PoisoningOral43 citations
- Off-Policy Reinforcement Learning with Delayed RewardsSpotlight43 citations
- Self-Supervised Representation Learning via Latent Graph PredictionSpotlight43 citations
- The Dual Form of Neural Networks Revisited: Connecting Test Time Predictions to Training Patterns via Spotlights of AttentionSpotlight43 citations
- Certified Robustness Against Natural Language Attacks by Causal InterventionSpotlight42 citations
- Exploiting Redundancy: Separable Group Convolutional Networks on Lie GroupsSpotlight42 citations
- Locally Sparse Neural Networks for Tabular Biomedical DataSpotlight42 citations
- Probabilistically Robust Learning: Balancing Average and Worst-case PerformanceSpotlight42 citations
- Revisiting End-to-End Speech-to-Text Translation From ScratchSpotlight42 citations
- A Simple Reward-free Approach to Constrained Reinforcement LearningSpotlight41 citations
- Loss Function Learning for Domain Generalization by Implicit GradientSpotlight41 citations
- MetAug: Contrastive Learning via Meta Feature AugmentationSpotlight41 citations
- On the Finite-Time Complexity and Practical Computation of Approximate Stationarity Concepts of Lipschitz FunctionsSpotlight41 citations
- Resilient and Communication Efficient Learning for Heterogeneous Federated SystemsSpotlight41 citations
- The Importance of Non-Markovianity in Maximum State Entropy ExplorationOral41 citations
- Training Your Sparse Neural Network Better with Any MaskSpotlight41 citations
- Why Should I Trust You, Bellman? The Bellman Error is a Poor Replacement for Value ErrorSpotlight41 citations
- A Branch and Bound Framework for Stronger Adversarial Attacks of ReLU NetworksSpotlight40 citations
- A Context-Integrated Transformer-Based Neural Network for Auction DesignSpotlight40 citations
- Active fairness auditingOral40 citations
- Contextual Bandits with Large Action Spaces: Made PracticalSpotlight40 citations
- Contrastive Learning with Boosted MemorizationSpotlight40 citations
- Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement LearningSpotlight40 citations
- Kernelized Multiplicative Weights for 0/1-Polyhedral Games: Bridging the Gap Between Learning in Extensive-Form and Normal-Form GamesSpotlight40 citations
- Probabilistic Bilevel Coreset SelectionSpotlight40 citations
- $p$-Laplacian Based Graph Neural NetworksSpotlight39 citations
- Adapting the Linearised Laplace Model Evidence for Modern Deep LearningSpotlight39 citations
- Comprehensive Analysis of Negative Sampling in Knowledge Graph Representation LearningSpotlight39 citations
- Learning Augmented Binary Search TreesSpotlight39 citations
- Learning Dynamics and Generalization in Deep Reinforcement LearningSpotlight39 citations
- Near-Exact Recovery for Tomographic Inverse Problems via Deep LearningOral39 citations
- NeuroFluid: Fluid Dynamics Grounding with Particle-Driven Neural Radiance FieldsSpotlight39 citations
- Addressing Optimism Bias in Sequence Modeling for Reinforcement LearningSpotlight38 citations
- Constraint-based graph network simulatorSpotlight38 citations
- Continuous Control with Action Quantization from DemonstrationsSpotlight38 citations
- Controlling Conditional Language Models without Catastrophic ForgettingSpotlight38 citations
- Learning Infinite-horizon Average-reward Markov Decision Process with ConstraintsSpotlight38 citations
- Nearly Minimax Optimal Reinforcement Learning with Linear Function ApproximationSpotlight38 citations
- Neural Language Models are not Born Equal to Fit Brain Data, but Training HelpsSpotlight38 citations
- Neural Tangent Kernel Beyond the Infinite-Width Limit: Effects of Depth and InitializationSpotlight38 citations
- On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy EvaluationSpotlight38 citations
- Private Adaptive Optimization with Side informationSpotlight38 citations
- Provable Domain Generalization via Invariant-Feature Subspace RecoverySpotlight38 citations
- The Neural Race Reduction: Dynamics of Abstraction in Gated NetworksSpotlight38 citations
- The State of Sparse Training in Deep Reinforcement LearningSpotlight38 citations
- Tractable Dendritic RNNs for Reconstructing Nonlinear Dynamical SystemsSpotlight38 citations
- Unaligned Supervision for Automatic Music Transcription in The WildSpotlight38 citations
- Unraveling Attention via Convex Duality: Analysis and Interpretations of Vision TransformersSpotlight38 citations
- Adapting to Mixing Time in Stochastic Optimization with Markovian DataOral37 citations
- Calibrated and Sharp Uncertainties in Deep Learning via Density EstimationSpotlight37 citations
- Conformal Prediction Sets with Limited False PositivesSpotlight37 citations
- Fast Relative Entropy Coding with A* codingSpotlight37 citations
- From block-Toeplitz matrices to differential equations on graphs: towards a general theory for scalable masked TransformersSpotlight37 citations
- GACT: Activation Compressed Training for Generic Network ArchitecturesSpotlight37 citations
- How to Stay Curious while avoiding Noisy TVs using Aleatoric Uncertainty EstimationSpotlight37 citations
- Knowledge-Grounded Self-Rationalization via Extractive and Natural Language ExplanationsSpotlight37 citations
- Learning to Predict Graphs with Fused Gromov-Wasserstein BarycentersSpotlight37 citations
- Neural Laplace: Learning diverse classes of differential equations in the Laplace domainOral37 citations
- On Numerical Integration in Neural Ordinary Differential EquationsSpotlight37 citations
- Robust Fine-Tuning of Deep Neural Networks with Hessian-based Generalization GuaranteesSpotlight37 citations
- Sample-Efficient Reinforcement Learning with loglog(T) Switching CostSpotlight37 citations
- Sparse Double Descent: Where Network Pruning Aggravates OverfittingSpotlight37 citations
- Towards Scaling Difference Target Propagation by Learning Backprop TargetsSpotlight37 citations
- Understanding Instance-Level Impact of Fairness ConstraintsSpotlight37 citations
- When AUC meets DRO: Optimizing Partial AUC for Deep Learning with Non-Convex Convergence GuaranteeSpotlight37 citations
- 3PC: Three Point Compressors for Communication-Efficient Distributed Training and a Better Theory for Lazy AggregationSpotlight36 citations
- A Theoretical Analysis on Independence-driven Importance Weighting for Covariate-shift GeneralizationSpotlight36 citations
- Causal Imitation Learning under Temporally Correlated NoiseOral36 citations
- Fluctuations, Bias, Variance & Ensemble of Learners: Exact Asymptotics for Convex Losses in High-DimensionSpotlight36 citations
- How to Steer Your Adversary: Targeted and Efficient Model Stealing Defenses with Gradient RedirectionSpotlight36 citations
- Implicit Regularization in Hierarchical Tensor Factorization and Deep Convolutional Neural NetworksSpotlight36 citations
- Improving Transformers with Probabilistic Attention KeysSpotlight36 citations
- Koopman Q-learning: Offline Reinforcement Learning via Symmetries of DynamicsSpotlight36 citations
- Learning Stochastic Shortest Path with Linear Function ApproximationSpotlight36 citations
- Near-Optimal Learning of Extensive-Form Games with Imperfect InformationSpotlight36 citations
- On Measuring Causal Contributions via do-interventionsSpotlight36 citations
- PMIC: Improving Multi-Agent Reinforcement Learning with Progressive Mutual Information CollaborationSpotlight36 citations
- Sample and Communication-Efficient Decentralized Actor-Critic Algorithms with Finite-Time AnalysisSpotlight36 citations
- Symmetric Machine Theory of MindSpotlight36 citations
- A Psychological Theory of ExplainabilitySpotlight35 citations
- Breaking Down Out-of-Distribution Detection: Many Methods Based on OOD Training Data Estimate a Combination of the Same Core QuantitiesSpotlight35 citations
- Constrained Discrete Black-Box Optimization using Mixed-Integer ProgrammingSpotlight35 citations
- Fast Convex Optimization for Two-Layer ReLU Networks: Equivalent Model Classes and Cone DecompositionsSpotlight35 citations
- Graph Neural Architecture Search Under Distribution ShiftsSpotlight35 citations
- Preconditioning for Scalable Gaussian Process Hyperparameter OptimizationOral35 citations
- Restarted Nonconvex Accelerated Gradient Descent: No More Polylogarithmic Factor in the $O(ε^-7/4)$ ComplexitySpotlight35 citations
- Selling Data To a Machine Learner: Pricing via Costly SignalingSpotlight35 citations
- You Only Cut Once: Boosting Data Augmentation with a Single CutSpotlight35 citations
- Additive Gaussian Processes RevisitedSpotlight34 citations
- Equivariance versus Augmentation for Spherical ImagesSpotlight34 citations
- Finite-Sum Coupled Compositional Stochastic Optimization: Theory and ApplicationsSpotlight34 citations
- Interventional Contrastive Learning with Meta Semantic RegularizerSpotlight34 citations
- Nonlinear Feature Diffusion on HypergraphsSpotlight34 citations
- Policy Diagnosis via Measuring Role Diversity in Cooperative Multi-agent RLSpotlight34 citations
- Re-evaluating Word Mover’s DistanceOral34 citations
- Robust Training of Neural Networks Using Scale Invariant ArchitecturesOral34 citations
- Stochastic Contextual Dueling Bandits under Linear Stochastic Transitivity ModelsSpotlight34 citations
- Strategic Instrumental Variable Regression: Recovering Causal Relationships From Strategic ResponsesSpotlight34 citations
- Utilizing Expert Features for Contrastive Learning of Time-Series RepresentationsSpotlight34 citations
- AnyMorph: Learning Transferable Polices By Inferring Agent MorphologySpotlight33 citations
- EqR: Equivariant Representations for Data-Efficient Reinforcement LearningSpotlight33 citations
- Exploring the Gap between Collapsed & Whitened Features in Self-Supervised LearningSpotlight33 citations
- From Noisy Prediction to True Label: Noisy Prediction Calibration via Generative ModelSpotlight33 citations
- In defense of dual-encoders for neural rankingSpotlight33 citations
- Learning-based Optimisation of Particle Accelerators Under Partial Observability Without Real-World TrainingSpotlight33 citations
- Lyapunov Density Models: Constraining Distribution Shift in Learning-Based ControlSpotlight33 citations
- Robust Deep Reinforcement Learning through Bootstrapped Opportunistic CurriculumSpotlight33 citations
- Selective Regression under Fairness CriteriaSpotlight33 citations
- Winning the Lottery Ahead of Time: Efficient Early Network PruningSpotlight33 citations
- Content Addressable Memory Without Catastrophic Forgetting by Heteroassociation with a Fixed ScaffoldSpotlight32 citations
- Deep Networks on Toroids: Removing Symmetries Reveals the Structure of Flat Regions in the Landscape GeometrySpotlight32 citations
- Divergence-Regularized Multi-Agent Actor-CriticSpotlight32 citations
- GALAXY: Graph-based Active Learning at the ExtremeSpotlight32 citations
- Generalized Strategic Classification and the Case of Aligned IncentivesOral32 citations
- Large-Scale Graph Neural Architecture SearchSpotlight32 citations
- Last Iterate Risk Bounds of SGD with Decaying Stepsize for Overparameterized Linear RegressionOral32 citations
- NAFS: A Simple yet Tough-to-beat Baseline for Graph Representation LearningSpotlight32 citations
- QSFL: A Two-Level Uplink Communication Optimization Framework for Federated LearningSpotlight32 citations
- What Can Linear Interpolation of Neural Network Loss Landscapes Tell Us?Spotlight32 citations
- A Natural Actor-Critic Framework for Zero-Sum Markov GamesSpotlight31 citations
- A Simple Unified Framework for High Dimensional Bandit ProblemsSpotlight31 citations
- Blocks Assemble! Learning to Assemble with Large-Scale Structured Reinforcement LearningSpotlight31 citations
- Cycle Representation Learning for Inductive Relation PredictionSpotlight31 citations
- GSmooth: Certified Robustness against Semantic Transformations via Generalized Randomized SmoothingSpotlight31 citations
- Gaussian Process Uniform Error Bounds with Unknown Hyperparameters for Safety-Critical ApplicationsSpotlight31 citations
- Generalization Guarantee of Training Graph Convolutional Networks with Graph Topology SamplingSpotlight31 citations
- Intriguing Properties of Input-Dependent Randomized SmoothingSpotlight31 citations
- Mirror Learning: A Unifying Framework of Policy OptimisationSpotlight31 citations
- Mitigating Modality Collapse in Multimodal VAEs via Impartial OptimizationSpotlight31 citations
- Non-Vacuous Generalisation Bounds for Shallow Neural NetworksSpotlight31 citations
- Nyström Kernel Mean EmbeddingsSpotlight31 citations
- On Distribution Shift in Learning-based Bug DetectorsSpotlight31 citations
- Parsimonious Learning-Augmented CachingSpotlight31 citations
- Provable Stochastic Optimization for Global Contrastive Learning: Small Batch Does Not Harm PerformanceSpotlight31 citations
- Quantum-Inspired Algorithms from Randomized Numerical Linear AlgebraSpotlight31 citations
- Robustness Implies Generalization via Data-Dependent Generalization BoundsOral31 citations
- Role-based Multiplex Network EmbeddingSpotlight31 citations
- Subspace Learning for Effective Meta-LearningSpotlight31 citations
- Value Function based Difference-of-Convex Algorithm for Bilevel Hyperparameter Selection ProblemsSpotlight31 citations
- A Statistical Manifold Framework for Point Cloud DataSpotlight30 citations
- Adversarially trained neural representations are already as robust as biological neural representationsOral30 citations
- Boosting Graph Structure Learning with Dummy NodesSpotlight30 citations
- Differentially Private Approximate QuantilesSpotlight30 citations
- Fair Representation Learning through Implicit Path AlignmentSpotlight30 citations
- Flashlight: Enabling Innovation in Tools for Machine LearningSpotlight30 citations
- Instrumental Variable Regression with Confounder BalancingSpotlight30 citations
- ME-GAN: Learning Panoptic Electrocardio Representations for Multi-view ECG Synthesis Conditioned on Heart DiseasesSpotlight30 citations
- Multi-scale Feature Learning Dynamics: Insights for Double DescentSpotlight30 citations
- On the Difficulty of Defending Self-Supervised Learning against Model ExtractionSpotlight30 citations
- Robust Models Are More Interpretable Because Attributions Look NormalSpotlight30 citations
- Stochastic Rising BanditsSpotlight30 citations
- Tight and Robust Private Mean Estimation with Few UsersOral30 citations
- UAST: Uncertainty-Aware Siamese TrackingSpotlight30 citations
- An Equivalence Between Data Poisoning and Byzantine Gradient AttacksSpotlight29 citations
- Bitwidth Heterogeneous Federated Learning with Progressive Weight DequantizationSpotlight29 citations
- Causal Inference Through the Structural Causal Marginal ProblemSpotlight29 citations
- Composing Partial Differential Equations with Physics-Aware Neural NetworksSpotlight29 citations
- Context-Aware Drift DetectionSpotlight29 citations
- Deep symbolic regression for recurrence predictionSpotlight29 citations
- Distribution Regression with Sliced Wasserstein KernelsSpotlight29 citations
- Double Sampling Randomized SmoothingSpotlight29 citations
- Federated Learning with Positive and Unlabeled DataSpotlight29 citations
- Gradient Descent on Neurons and its Link to Approximate Second-order OptimizationSpotlight29 citations
- Hermite Polynomial Features for Private Data GenerationSpotlight29 citations
- High Probability Guarantees for Nonconvex Stochastic Gradient Descent with Heavy TailsSpotlight29 citations
- Model-based Meta Reinforcement Learning using Graph Structured Surrogate Models and Amortized Policy SearchSpotlight29 citations
- On the Surrogate Gap between Contrastive and Supervised LossesSpotlight29 citations
- Pure Noise to the Rescue of Insufficient Data: Improving Imbalanced Classification by Training on Random Noise ImagesSpotlight29 citations
- Quant-BnB: A Scalable Branch-and-Bound Method for Optimal Decision Trees with Continuous FeaturesSpotlight29 citations
- Refined Convergence Rates for Maximum Likelihood Estimation under Finite Mixture ModelsOral29 citations
- Shuffle Private Linear Contextual BanditsSpotlight29 citations
- Stable Conformal Prediction SetsOral29 citations
- Streaming Algorithms for High-Dimensional Robust StatisticsSpotlight29 citations
- Weisfeiler-Lehman Meets Gromov-WassersteinSpotlight29 citations
- Continuous-Time Analysis of Accelerated Gradient Methods via Conservation Laws in Dilated Coordinate SystemsOral28 citations
- Diversified Adversarial Attacks based on Conjugate Gradient MethodSpotlight28 citations
- Improved Convergence Rates for Sparse Approximation Methods in Kernel-Based LearningSpotlight28 citations
- Injecting Logical Constraints into Neural Networks via Straight-Through EstimatorsSpotlight28 citations
- LIDL: Local Intrinsic Dimension Estimation Using Approximate LikelihoodOral28 citations
- Leveraging Approximate Symbolic Models for Reinforcement Learning via Skill DiversitySpotlight28 citations
- On the Generalization Analysis of Adversarial LearningSpotlight28 citations
- Robust alignment of cross-session recordings of neural population activity by behaviour via unsupervised domain adaptationSpotlight28 citations
- Thresholded Lasso BanditSpotlight28 citations
- Toward Compositional Generalization in Object-Oriented World ModelingOral28 citations
- Versatile Dueling Bandits: Best-of-both World Analyses for Learning from Relative PreferencesSpotlight28 citations
- pathGCN: Learning General Graph Spatial Operators from PathsSpotlight28 citations
- A Convergence Theory for SVGD in the Population Limit under Talagrand’s Inequality T1Spotlight27 citations
- A Simple yet Universal Strategy for Online Convex OptimizationOral27 citations
- Blurs Behave Like Ensembles: Spatial Smoothings to Improve Accuracy, Uncertainty, and RobustnessSpotlight27 citations
- Improving Policy Optimization with Generalist-Specialist LearningSpotlight27 citations
- Label-Free Explainability for Unsupervised ModelsSpotlight27 citations
- NOMU: Neural Optimization-based Model UncertaintySpotlight27 citations
- Neural Inverse KinematicSpotlight27 citations
- Skin Deep Unlearning: Artefact and Instrument Debiasing in the Context of Melanoma ClassificationSpotlight27 citations
- A Neural Tangent Kernel Perspective of GANsSpotlight26 citations
- Accelerated Gradient Methods for Geodesically Convex Optimization: Tractable Algorithms and Convergence AnalysisSpotlight26 citations
- Augment with Care: Contrastive Learning for Combinatorial ProblemsSpotlight26 citations
- Bounding the Width of Neural Networks via Coupled Initialization A Worst Case AnalysisSpotlight26 citations
- Deep Hierarchy in BanditsSpotlight26 citations
- Dynamic Topic Models for Temporal Document NetworksSpotlight26 citations
- Fairness Interventions as (Dis)Incentives for Strategic ManipulationSpotlight26 citations
- Fast rates for noisy interpolation require rethinking the effect of inductive biasSpotlight26 citations
- Learning Mixtures of Linear Dynamical SystemsOral26 citations
- On Collective Robustness of Bagging Against Data PoisoningSpotlight26 citations
- PINs: Progressive Implicit Networks for Multi-Scale Neural RepresentationsSpotlight26 citations
- Power-Law Escape Rate of SGDSpotlight26 citations
- Reconstructing Nonlinear Dynamical Systems from Multi-Modal Time SeriesSpotlight26 citations
- Reducing Variance in Temporal-Difference Value Estimation via Ensemble of Deep NetworksSpotlight26 citations
- Score-Guided Intermediate Level Optimization: Fast Langevin Mixing for Inverse ProblemsSpotlight26 citations
- Showing Your Offline Reinforcement Learning Work: Online Evaluation Budget MattersSpotlight26 citations
- Streaming Algorithm for Monotone k-Submodular Maximization with Cardinality ConstraintsOral26 citations
- Style Equalization: Unsupervised Learning of Controllable Generative Sequence ModelsSpotlight26 citations
- Welfare Maximization in Competitive Equilibrium: Reinforcement Learning for Markov Exchange EconomySpotlight26 citations
- A Self-Play Posterior Sampling Algorithm for Zero-Sum Markov GamesSpotlight25 citations
- AdaGrad Avoids Saddle PointsSpotlight25 citations
- Adaptive Random Walk Gradient Descent for Decentralized OptimizationSpotlight25 citations
- Correlation Clustering via Strong Triadic Closure Labeling: Fast Approximation Algorithms and Practical Lower BoundsSpotlight25 citations
- Demystifying the Adversarial Robustness of Random Transformation DefensesSpotlight25 citations
- Differentially Private Community Detection for Stochastic Block ModelsSpotlight25 citations
- Does the Data Induce Capacity Control in Deep Learning?Spotlight25 citations
- Flow-based Recurrent Belief State Learning for POMDPsSpotlight25 citations
- Generalizing to Evolving Domains with Latent Structure-Aware Sequential AutoencoderSpotlight25 citations
- LCANets: Lateral Competition Improves Robustness Against Corruption and AttackSpotlight25 citations
- Learning Markov Games with Adversarial Opponents: Efficient Algorithms and Fundamental LimitsOral25 citations
- Learning from Demonstration: Provably Efficient Adversarial Policy Imitation with Linear Function ApproximationSpotlight25 citations
- NeuralEF: Deconstructing Kernels by Deep Neural NetworksSpotlight25 citations
- Object Permanence Emerges in a Random Walk along MemorySpotlight25 citations
- On the Role of Discount Factor in Offline Reinforcement LearningSpotlight25 citations
- Private frequency estimation via projective geometrySpotlight25 citations
- Robust Imitation Learning against Variations in Environment DynamicsSpotlight25 citations
- End-to-End Balancing for Causal Continuous Treatment-Effect EstimationSpotlight24 citations
- From Dirichlet to Rubin: Optimistic Exploration in RL without BonusesOral24 citations
- G$^2$CN: Graph Gaussian Convolution Networks with Concentrated Graph FiltersSpotlight24 citations
- Generalization Bounds using Lower Tail Exponents in Stochastic OptimizersSpotlight24 citations
- Large Batch Experience ReplayOral24 citations
- Large-scale Stochastic Optimization of NDCG Surrogates for Deep Learning with Provable ConvergenceSpotlight24 citations
- On the Learning of Non-Autoregressive TransformersSpotlight24 citations
- On the Robustness of CountSketch to Adaptive InputsSpotlight24 citations
- PDE-Based Optimal Strategy for Unconstrained Online LearningSpotlight24 citations
- Provable Acceleration of Heavy Ball beyond Quadratics for a Class of Polyak-Lojasiewicz Functions when the Non-Convexity is Averaged-OutSpotlight24 citations
- Provably Efficient Offline Reinforcement Learning for Partially Observable Markov Decision ProcessesSpotlight24 citations
- Smoothed Adversarial Linear Contextual Bandits with KnapsacksSpotlight24 citations
- The dynamics of representation learning in shallow, non-linear autoencodersSpotlight24 citations
- Accelerated, Optimal and Parallel: Some results on model-based stochastic optimizationSpotlight23 citations
- Convergence Rates of Non-Convex Stochastic Gradient Descent Under a Generic Lojasiewicz Condition and Local SmoothnessSpotlight23 citations
- Debiaser Beware: Pitfalls of Centering Regularized Transport MapsSpotlight23 citations
- Deconfounded Value Decomposition for Multi-Agent Reinforcement LearningSpotlight23 citations
- Fair and Fast k-Center Clustering for Data SummarizationSpotlight23 citations
- Generative Cooperative Networks for Natural Language GenerationSpotlight23 citations
- Improve Single-Point Zeroth-Order Optimization Using High-Pass and Low-Pass FiltersSpotlight23 citations
- Improving Screening Processes via Calibrated Subset SelectionSpotlight23 citations
- Inferring Cause and Effect in the Presence of Heteroscedastic NoiseSpotlight23 citations
- Learning Efficient and Robust Ordinary Differential Equations via Invertible Neural NetworksSpotlight23 citations
- Learning fair representation with a parametric integral probability metricSpotlight23 citations
- Learning of Cluster-based Feature Importance for Electronic Health Record Time-seriesSpotlight23 citations
- Neural Tangent Kernel Empowered Federated LearningSpotlight23 citations
- Off-Policy Fitted Q-Evaluation with Differentiable Function Approximators: Z-Estimation and Inference TheorySpotlight23 citations
- PACE: A Parallelizable Computation Encoder for Directed Acyclic GraphsSpotlight23 citations
- Position Prediction as an Effective Pretraining StrategySpotlight23 citations
- Proving Theorems using Incremental Learning and Hindsight Experience ReplaySpotlight23 citations
- REvolveR: Continuous Evolutionary Models for Robot-to-robot Policy TransferOral23 citations
- Reinforcement Learning from Partial Observation: Linear Function Approximation with Provable Sample EfficiencySpotlight23 citations
- Robust Kernel Density Estimation with Median-of-Means principleSpotlight23 citations
- Robustness Verification for Contrastive LearningOral23 citations
- A General Recipe for Likelihood-free Bayesian OptimizationOral22 citations
- A State-Distribution Matching Approach to Non-Episodic Reinforcement LearningSpotlight22 citations
- AGNAS: Attention-Guided Micro and Macro-Architecture SearchSpotlight22 citations
- Adversarial Robustness against Multiple and Single $l_p$-Threat Models via Quick Fine-Tuning of Robust ClassifiersSpotlight22 citations
- AutoIP: A United Framework to Integrate Physics into Gaussian ProcessesSpotlight22 citations
- Certifying Out-of-Domain Generalization for Blackbox FunctionsSpotlight22 citations
- Constrained Offline Policy OptimizationSpotlight22 citations
- Data-SUITE: Data-centric identification of in-distribution incongruous examplesSpotlight22 citations
- DepthShrinker: A New Compression Paradigm Towards Boosting Real-Hardware Efficiency of Compact Neural NetworksSpotlight22 citations
- Entropic Gromov-Wasserstein between Gaussian DistributionsSpotlight22 citations
- Gating Dropout: Communication-efficient Regularization for Sparsely Activated TransformersSpotlight22 citations
- Learning Iterative Reasoning through Energy MinimizationSpotlight22 citations
- Mitigating Gender Bias in Face Recognition using the von Mises-Fisher Mixture ModelSpotlight22 citations
- On the Convergence of Local Stochastic Compositional Gradient Descent with MomentumSpotlight22 citations
- Pairwise Conditional Gradients without Swap Steps and Sparser Kernel HerdingSpotlight22 citations
- Phasic Self-Imitative Reduction for Sparse-Reward Goal-Conditioned Reinforcement LearningSpotlight22 citations
- Quantifying and Learning Linear Symmetry-Based DisentanglementSpotlight22 citations
- Scalable Spike-and-SlabSpotlight22 citations
- Simple and near-optimal algorithms for hidden stratification and multi-group learningSpotlight22 citations
- Stochastic Continuous Submodular Maximization: Boosting via Non-oblivious FunctionSpotlight22 citations
- The Role of Deconfounding in Meta-learningSpotlight22 citations
- Accelerating Shapley Explanation via Contributive Cooperator SelectionSpotlight21 citations
- Building Robust Ensembles via Margin BoostingSpotlight21 citations
- Contextual Information-Directed SamplingSpotlight21 citations
- Differentially Private Coordinate Descent for Composite Empirical Risk MinimizationSpotlight21 citations
- Dynamic Regret of Online Markov Decision ProcessesSpotlight21 citations
- Examining Scaling and Transfer of Language Model Architectures for Machine TranslationSpotlight21 citations
- Exploiting Independent Instruments: Identification and Distribution GeneralizationSpotlight21 citations
- Fighting Fire with Fire: Avoiding DNN Shortcuts through PrimingSpotlight21 citations
- Improving Adversarial Robustness via Mutual Information EstimationSpotlight21 citations
- Measure Estimation in the Barycentric Coding ModelSpotlight21 citations
- Modeling Adversarial Noise for Adversarial TrainingSpotlight21 citations
- On Transportation of Mini-batches: A Hierarchical ApproachSpotlight21 citations
- Optimal Algorithms for Stochastic Multi-Level Compositional OptimizationSpotlight21 citations
- Permutation Search of Tensor Network Structures via Local SamplingSpotlight21 citations
- Structure-preserving GANsSpotlight21 citations
- Unified Fourier-based Kernel and Nonlinearity Design for Equivariant Networks on Homogeneous SpacesSpotlight21 citations
- Unsupervised Flow-Aligned Sequence-to-Sequence Learning for Video RestorationSpotlight21 citations
- A Tighter Analysis of Spectral Clustering, and BeyondSpotlight20 citations
- Adaptive Best-of-Both-Worlds Algorithm for Heavy-Tailed Multi-Armed BanditsSpotlight20 citations
- An Exact Symbolic Reduction of Linear Smart Predict+Optimize to Mixed Integer Linear ProgrammingSpotlight20 citations
- Deletion Robust Submodular Maximization over MatroidsOral20 citations
- Difference Advantage Estimation for Multi-Agent Policy GradientsSpotlight20 citations
- Efficient Online ML API Selection for Multi-Label Classification TasksSpotlight20 citations
- Fair Generalized Linear Models with a Convex PenaltySpotlight20 citations
- Fast and Reliable Evaluation of Adversarial Robustness with Minimum-Margin AttackSpotlight20 citations
- Fast-Rate PAC-Bayesian Generalization Bounds for Meta-LearningSpotlight20 citations
- Fictitious Play and Best-Response Dynamics in Identical Interest and Zero-Sum Stochastic GamesSpotlight20 citations
- GenLabel: Mixup Relabeling using Generative ModelsSpotlight20 citations
- Improving Robustness against Real-World and Worst-Case Distribution Shifts through Decision Region QuantificationSpotlight20 citations
- Input-agnostic Certified Group Fairness via Gaussian Parameter SmoothingSpotlight20 citations
- Learning Pseudometric-based Action Representations for Offline Reinforcement LearningSpotlight20 citations
- On the Hidden Biases of Policy Mirror Ascent in Continuous Action SpacesSpotlight20 citations
- PAGE-PG: A Simple and Loopless Variance-Reduced Policy Gradient Method with Probabilistic Gradient EstimationSpotlight20 citations
- Probabilistic ODE Solutions in Millions of DimensionsSpotlight20 citations
- RetrievalGuard: Provably Robust 1-Nearest Neighbor Image RetrievalSpotlight20 citations
- Robust SDE-Based Variational Formulations for Solving Linear PDEs via Deep LearningSpotlight20 citations
- Safe Learning in Tree-Form Sequential Decision Making: Handling Hard and Soft ConstraintsSpotlight20 citations
- Sequential Covariate Shift Detection Using Classifier Two-Sample TestsSpotlight20 citations
- Understanding and Improving Knowledge Graph Embedding for Entity AlignmentSpotlight20 citations
- An iterative clustering algorithm for the Contextual Stochastic Block Model with optimality guaranteesSpotlight19 citations
- Auxiliary Learning with Joint Task and Data SchedulingSpotlight19 citations
- Convolutional and Residual Networks Provably Contain Lottery TicketsSpotlight19 citations
- Diffusion bridges vector quantized variational autoencodersSpotlight19 citations
- Discrete Probabilistic Inverse Optimal TransportSpotlight19 citations
- Efficient Distributionally Robust Bayesian Optimization with Worst-case SensitivitySpotlight19 citations
- Efficient Model-based Multi-agent Reinforcement Learning via Optimistic Equilibrium ComputationSpotlight19 citations
- Entropic Causal Inference: Graph IdentifiabilitySpotlight19 citations
- Fast Composite Optimization and Statistical Recovery in Federated LearningSpotlight19 citations
- Feature Learning and Signal Propagation in Deep Neural NetworksSpotlight19 citations
- Fully-Connected Network on Noncompact Symmetric Space and Ridgelet Transform based on Helgason-Fourier AnalysisSpotlight19 citations
- IDYNO: Learning Nonparametric DAGs from Interventional Dynamic DataSpotlight19 citations
- Inverse Contextual Bandits: Learning How Behavior Evolves over TimeSpotlight19 citations
- Linearity Grafting: Relaxed Neuron Pruning Helps Certifiable RobustnessSpotlight19 citations
- Online Learning for Min Sum Set Cover and Pandora’s BoxOral19 citations
- Provably Adversarially Robust Nearest Prototype ClassifiersSpotlight19 citations
- Scaling Gaussian Process Optimization by Evaluating a Few Unique Candidates Multiple TimesSpotlight19 citations
- Secure Distributed Training at ScaleSpotlight19 citations
- Self-supervised Models are Good Teaching Assistants for Vision TransformersSpotlight19 citations
- Sequential and Parallel Constrained Max-value Entropy Search via Information Lower BoundSpotlight19 citations
- Set Norm and Equivariant Skip Connections: Putting the Deep in Deep SetsSpotlight19 citations
- ShiftAddNAS: Hardware-Inspired Search for More Accurate and Efficient Neural NetworksSpotlight19 citations
- Tackling Data Heterogeneity: A New Unified Framework for Decentralized SGD with Sample-induced TopologySpotlight19 citations
- Universal Joint Approximation of Manifolds and Densities by Simple Injective FlowsSpotlight19 citations
- A Unified Weight Initialization Paradigm for Tensorial Convolutional Neural NetworksSpotlight18 citations
- Accurate Quantization of Measures via Interacting Particle-based OptimizationSpotlight18 citations
- An Intriguing Property of Geophysics InversionSpotlight18 citations
- Bayesian Optimization under Stochastic Delayed FeedbackSpotlight18 citations
- Benefits of Overparameterized Convolutional Residual Networks: Function Approximation under Smoothness ConstraintSpotlight18 citations
- Deep Probability EstimationSpotlight18 citations
- Delayed Reinforcement Learning by ImitationSpotlight18 citations
- Faster Privacy Accounting via Evolving DiscretizationSpotlight18 citations
- Implicit Bias of Linear Equivariant NetworksSpotlight18 citations
- Learning Bellman Complete Representations for Offline Policy EvaluationOral18 citations
- Learning Multiscale Transformer Models for Sequence GenerationSpotlight18 citations
- Linear Bandit Algorithms with Sublinear Time ComplexitySpotlight18 citations
- Modular Conformal CalibrationSpotlight18 citations
- More Efficient Sampling for Tensor Decomposition With Worst-Case GuaranteesSpotlight18 citations
- Nesterov Accelerated Shuffling Gradient Method for Convex OptimizationSpotlight18 citations
- Optimizing Tensor Network Contraction Using Reinforcement LearningSpotlight18 citations
- Path-Gradient Estimators for Continuous Normalizing FlowsOral18 citations
- Regret Bounds for Stochastic Shortest Path Problems with Linear Function ApproximationSpotlight18 citations
- Robust Policy Learning over Multiple Uncertainty SetsSpotlight18 citations
- Self-Organized Polynomial-Time Coordination GraphsSpotlight18 citations
- Simplex Neural Population Learning: Any-Mixture Bayes-Optimality in Symmetric Zero-sum GamesSpotlight18 citations
- TPC: Transformation-Specific Smoothing for Point Cloud ModelsSpotlight18 citations
- A Framework for Learning to Request Rich and Contextually Useful Information from HumansSpotlight17 citations
- Combining Diverse Feature PriorsSpotlight17 citations
- Contextual Bandits with Smooth Regret: Efficient Learning in Continuous Action SpacesOral17 citations
- DNNR: Differential Nearest Neighbors RegressionSpotlight17 citations
- Deep and Flexible Graph Neural Architecture SearchSpotlight17 citations
- Detached Error Feedback for Distributed SGD with Random SparsificationSpotlight17 citations
- Generalized Results for the Existence and Consistency of the MLE in the Bradley-Terry-Luce ModelOral17 citations
- Generalizing Gaussian Smoothing for Random SearchSpotlight17 citations
- Improved No-Regret Algorithms for Stochastic Shortest Path with Linear MDPOral17 citations
- Interpretable Neural Networks with Frank-Wolfe: Sparse Relevance Maps and Relevance OrderingsSpotlight17 citations
- LeNSE: Learning To Navigate Subgraph Embeddings for Large-Scale Combinatorial OptimisationSpotlight17 citations
- Learning to Incorporate Texture Saliency Adaptive Attention to Image CartoonizationSpotlight17 citations
- Low-Precision Stochastic Gradient Langevin DynamicsSpotlight17 citations
- Maslow’s Hammer in Catastrophic Forgetting: Node Re-Use vs. Node ActivationSpotlight17 citations
- Nearly Optimal Catoni’s M-estimator for Infinite VarianceSpotlight17 citations
- Partial Label Learning via Label Influence FunctionSpotlight17 citations
- Revisiting Contrastive Learning through the Lens of Neighborhood Component Analysis: an Integrated FrameworkSpotlight17 citations
- Safe Exploration for Efficient Policy Evaluation and ComparisonSpotlight17 citations
- Sanity Simulations for Saliency MethodsSpotlight17 citations
- Self-conditioning Pre-Trained Language ModelsSpotlight17 citations
- Towards Evaluating Adaptivity of Model-Based Reinforcement Learning MethodsSpotlight17 citations
- Utility Theory for Sequential Decision MakingSpotlight17 citations
- A Reduction from Linear Contextual Bandits Lower Bounds to Estimations Lower BoundsSpotlight16 citations
- A Study on the Ramanujan Graph Property of Winning Lottery TicketsSpotlight16 citations
- Asking for Knowledge (AFK): Training RL Agents to Query External Knowledge Using LanguageSpotlight16 citations
- DRAGONN: Distributed Randomized Approximate Gradients of Neural NetworksSpotlight16 citations
- Delay-Adaptive Step-sizes for Asynchronous LearningSpotlight16 citations
- Equivalence Analysis between Counterfactual Regret Minimization and Online Mirror DescentSpotlight16 citations
- Fast Aquatic Swimmer Optimization with Differentiable Projective Dynamics and Neural Network Hydrodynamic ModelsSpotlight16 citations
- Fast Provably Robust Decision Trees and BoostingSpotlight16 citations
- Feature Space Particle Inference for Neural Network EnsemblesSpotlight16 citations
- Finding the Task-Optimal Low-Bit Sub-Distribution in Deep Neural NetworksSpotlight16 citations
- Generative Modeling for Multi-task Visual LearningSpotlight16 citations
- Greedy when Sure and Conservative when Uncertain about the OpponentsSpotlight16 citations
- Learning General Halfspaces with Adversarial Label Noise via Online Gradient DescentSpotlight16 citations
- Model Selection in Batch Policy OptimizationSpotlight16 citations
- NysADMM: faster composite convex optimization via low-rank approximationSpotlight16 citations
- Optimally Controllable Perceptual Lossy CompressionSpotlight16 citations
- Principal Component FlowsSpotlight16 citations
- Private Streaming SCO in $\ell_p$ geometry with Applications in High Dimensional Online Decision MakingSpotlight16 citations
- ROCK: Causal Inference Principles for Reasoning about Commonsense CausalitySpotlight16 citations
- Time Is MattEr: Temporal Self-supervision for Video TransformersSpotlight16 citations
- Towards Noise-adaptive, Problem-adaptive (Accelerated) Stochastic Gradient DescentOral16 citations
- Transfer and Marginalize: Explaining Away Label Noise with Privileged InformationSpotlight16 citations
- VLUE: A Multi-Task Multi-Dimension Benchmark for Evaluating Vision-Language Pre-trainingSpotlight16 citations
- Zero-shot AutoML with Pretrained ModelsSpotlight16 citations
- A Joint Exponential Mechanism For Differentially Private Top-$k$Spotlight15 citations
- A Single-Loop Gradient Descent and Perturbed Ascent Algorithm for Nonconvex Functional Constrained OptimizationSpotlight15 citations
- Active Multi-Task Representation LearningSpotlight15 citations
- Adaptive Gaussian Process Change Point DetectionSpotlight15 citations
- An Initial Alignment between Neural Network and Target is Needed for Gradient Descent to LearnSpotlight15 citations
- Cascaded Gaps: Towards Logarithmic Regret for Risk-Sensitive Reinforcement LearningSpotlight15 citations
- Correlated Quantization for Distributed Mean Estimation and OptimizationSpotlight15 citations
- CtrlFormer: Learning Transferable State Representation for Visual Control via TransformerSpotlight15 citations
- Fat–Tailed Variational Inference with Anisotropic Tail Adaptive FlowsSpotlight15 citations
- Fenrir: Physics-Enhanced Regression for Initial Value ProblemsSpotlight15 citations
- Generalized Data Distribution IterationSpotlight15 citations
- Greedy based Value Representation for Optimal Coordination in Multi-agent Reinforcement LearningSpotlight15 citations
- Identity-Disentangled Adversarial Augmentation for Self-supervised LearningSpotlight15 citations
- Iterative Hard Thresholding with Adaptive Regularization: Sparser Solutions Without Sacrificing RuntimeSpotlight15 citations
- Matching Learned Causal Effects of Neural Networks with Domain PriorsSpotlight15 citations
- Minimizing Control for Credit Assignment with Strong FeedbackSpotlight15 citations
- Nearly Optimal Policy Optimization with Stable at Any Time GuaranteeSpotlight15 citations
- Omni-Granular Ego-Semantic Propagation for Self-Supervised Graph Representation LearningSpotlight15 citations
- On Learning Mixture of Linear Regressions in the Non-Realizable SettingSpotlight15 citations
- Online and Consistent Correlation ClusteringSpotlight15 citations
- PAC-Net: A Model Pruning Approach to Inductive Transfer LearningSpotlight15 citations
- Reverse Engineering the Neural Tangent KernelSpotlight15 citations
- SCHA-VAE: Hierarchical Context Aggregation for Few-Shot GenerationSpotlight15 citations
- Scaling-up Diverse Orthogonal Convolutional Networks by a Paraunitary FrameworkSpotlight15 citations
- Sharpened Quasi-Newton Methods: Faster Superlinear Rate and Larger Local Convergence NeighborhoodSpotlight15 citations
- Short-Term Plasticity Neurons Learning to Learn and ForgetSpotlight15 citations
- Solving Stackelberg Prediction Game with Least Squares Loss via Spherically Constrained Least Squares ReformulationOral15 citations
- Structured Stochastic Gradient MCMCSpotlight15 citations
- Surrogate Likelihoods for Variational Annealed Importance SamplingSpotlight15 citations
- When Are Linear Stochastic Bandits Attackable?Spotlight15 citations
- A Unified View on PAC-Bayes Bounds for Meta-LearningSpotlight14 citations
- Achieving Minimax Rates in Pool-Based Batch Active LearningSpotlight14 citations
- Adaptive Model Design for Markov Decision ProcessSpotlight14 citations
- Batched Dueling BanditsOral14 citations
- Bayesian Optimization for Distributionally Robust Chance-constrained ProblemSpotlight14 citations
- Convergence of Invariant Graph NetworksSpotlight14 citations
- Convergence of Policy Gradient for Entropy Regularized MDPs with Neural Network Approximation in the Mean-Field RegimeSpotlight14 citations
- Distributional Hamilton-Jacobi-Bellman Equations for Continuous-Time Reinforcement LearningSpotlight14 citations
- Failure and success of the spectral bias prediction for Laplace Kernel Ridge Regression: the case of low-dimensional dataSpotlight14 citations
- Fast Population-Based Reinforcement Learning on a Single MachineSpotlight14 citations
- Generic Coreset for Scalable Learning of Monotonic Kernels: Logistic Regression, Sigmoid and moreSpotlight14 citations
- Learning to Estimate and Refine Fluid Motion with Physical DynamicsSpotlight14 citations
- Learning to Separate Voices by Spatial RegionsSpotlight14 citations
- Neural Implicit Dictionary Learning via Mixture-of-Expert TrainingSpotlight14 citations
- Neural Tangent Kernel Analysis of Deep Narrow Neural NetworksSpotlight14 citations
- On the Convergence of the Shapley Value in Parametric Bayesian Learning GamesSpotlight14 citations
- Regularizing a Model-based Policy Stationary Distribution to Stabilize Offline Reinforcement LearningSpotlight14 citations
- Robust Meta-learning with Sampling Noise and Label Noise via Eigen-ReptileSpotlight14 citations
- Sparsity in Partially Controllable Linear SystemsSpotlight14 citations
- Stochastic Deep Networks with Linear Competing Units for Model-Agnostic Meta-LearningOral14 citations
- Strategies for Safe Multi-Armed Bandits with Logarithmic Regret and RiskSpotlight14 citations
- Towards Coherent and Consistent Use of Entities in Narrative GenerationSpotlight14 citations
- Variational Mixtures of ODEs for Inferring Cellular Gene Expression DynamicsSpotlight14 citations
- Adversarially Robust Models may not Transfer Better: Sufficient Conditions for Domain Transferability from the View of RegularizationSpotlight13 citations
- BabelTower: Learning to Auto-parallelized Program TranslationSpotlight13 citations
- Born-Infeld (BI) for AI: Energy-Conserving Descent (ECD) for OptimizationOral13 citations
- C-MinHash: Improving Minwise Hashing with Circulant PermutationSpotlight13 citations
- Collaboration of Experts: Achieving 80% Top-1 Accuracy on ImageNet with 100M FLOPsSpotlight13 citations
- Consistent Polyhedral Surrogates for Top-k Classification and VariantsSpotlight13 citations
- Dual Perspective of Label-Specific Feature Learning for Multi-Label ClassificationSpotlight13 citations
- Fast and Provable Nonconvex Tensor RPCASpotlight13 citations
- For Learning in Symmetric Teams, Local Optima are Global Nash EquilibriaSpotlight13 citations
- Individual Preference Stability for ClusteringOral13 citations
- Learning to Hash Robustly, GuaranteedSpotlight13 citations
- Leverage Score Sampling for Tensor Product Matrices in Input Sparsity TimeSpotlight13 citations
- Marginal Tail-Adaptive Normalizing FlowsSpotlight13 citations
- Multicoated Supermasks Enhance Hidden NetworksSpotlight13 citations
- One-Pass Diversified Sampling with Application to Terabyte-Scale Genomic Sequence StreamsSpotlight13 citations
- RECAPP: Crafting a More Efficient Catalyst for Convex OptimizationSpotlight13 citations
- Searching for BurgerFormer with Micro-Meso-Macro Space DesignSpotlight13 citations
- Simultaneously Learning Stochastic and Adversarial Bandits with General Graph FeedbackSpotlight13 citations
- Stability Based Generalization Bounds for Exponential Family Langevin DynamicsSpotlight13 citations
- Stochastic smoothing of the top-K calibrated hinge loss for deep imbalanced classificationSpotlight13 citations
- Tractable Uncertainty for Structure LearningOral13 citations
- VariGrow: Variational Architecture Growing for Task-Agnostic Continual Learning based on Bayesian NoveltySpotlight13 citations
- Wide Bayesian neural networks have a simple weight posterior: theory and accelerated samplingSpotlight13 citations
- A Simple Guard for Learned OptimizersSpotlight12 citations
- Bayesian Imitation Learning for End-to-End Mobile ManipulationSpotlight12 citations
- ButterflyFlow: Building Invertible Layers with Butterfly MatricesSpotlight12 citations
- Cliff Diving: Exploring Reward Surfaces in Reinforcement Learning EnvironmentsSpotlight12 citations
- Convergence and Recovery Guarantees of the K-Subspaces Method for Subspace ClusteringSpotlight12 citations
- Disentangling Sources of Risk for Distributional Multi-Agent Reinforcement LearningSpotlight12 citations
- Distinguishing rule and exemplar-based generalization in learning systemsSpotlight12 citations
- Efficient Computation of Higher-Order Subgraph Attribution via Message PassingSpotlight12 citations
- Efficient Variance Reduction for Meta-learningSpotlight12 citations
- FITNESS: (Fine Tune on New and Similar Samples) to detect anomalies in streams with drift and outliersSpotlight12 citations
- FOCUS: Familiar Objects in Common and Uncommon SettingsSpotlight12 citations
- Function-space Inference with Sparse Implicit ProcessesOral12 citations
- Functional Generalized Empirical Likelihood Estimation for Conditional Moment RestrictionsSpotlight12 citations
- How Tempering Fixes Data Augmentation in Bayesian Neural NetworksOral12 citations
- Interpretable Off-Policy Learning via Hyperbox SearchSpotlight12 citations
- Label-Descriptive Patterns and Their Application to Characterizing Classification ErrorsSpotlight12 citations
- Multi Resolution Analysis (MRA) for Approximate Self-AttentionSpotlight12 citations
- Near-optimal rate of consistency for linear models with missing valuesSpotlight12 citations
- Neural Network Pruning Denoises the Features and Makes Local Connectivity Emerge in Visual TasksSpotlight12 citations
- Neural Network Weights Do Not Converge to Stationary Points: An Invariant Measure PerspectiveSpotlight12 citations
- On the Statistical Benefits of Curriculum LearningSpotlight12 citations
- Path-Aware and Structure-Preserving Generation of Synthetically Accessible MoleculesSpotlight12 citations
- SpaceMAP: Visualizing High-Dimensional Data by Space ExpansionSpotlight12 citations
- Stochastic Reweighted Gradient DescentSpotlight12 citations
- Synergy and Symmetry in Deep Learning: Interactions between the Data, Model, and Inference AlgorithmSpotlight12 citations
- Training Characteristic Functions with Reinforcement Learning: XAI-methods play Connect FourOral12 citations
- Why the Rich Get Richer? On the Balancedness of Random Partition ModelsSpotlight12 citations
- A Hierarchical Bayesian Approach to Inverse Reinforcement Learning with Symbolic Reward MachinesSpotlight11 citations
- Adaptive Data Analysis with Correlated ObservationsSpotlight11 citations
- An Asymptotic Test for Conditional Independence using Analytic Kernel EmbeddingsSpotlight11 citations
- Approximate Bayesian Computation with Domain Expert in the LoopSpotlight11 citations
- Being Properly ImproperSpotlight11 citations
- Continual Learning with Guarantees via Weight Interval ConstraintsSpotlight11 citations
- DNS: Determinantal Point Process Based Neural Network Sampler for Ensemble Reinforcement LearningSpotlight11 citations
- Decentralized Online Convex Optimization in Networked SystemsSpotlight11 citations
- Feature and Parameter Selection in Stochastic Linear BanditsSpotlight11 citations
- Generative Trees: Adversarial and CopycatOral11 citations
- Interactively Learning Preference Constraints in Linear BanditsSpotlight11 citations
- Model-Value Inconsistency as a Signal for Epistemic UncertaintySpotlight11 citations
- Neuron Dependency Graphs: A Causal Abstraction of Neural NetworksSpotlight11 citations
- On Finite-Sample Identifiability of Contrastive Learning-Based Nonlinear Independent Component AnalysisSpotlight11 citations
- Only tails matter: Average-Case Universality and Robustness in the Convex RegimeSpotlight11 citations
- PDO-s3DCNNs: Partial Differential Operator Based Steerable 3D CNNsSpotlight11 citations
- Rethinking Image-Scaling Attacks: The Interplay Between Vulnerabilities in Machine Learning SystemsOral11 citations
- Robust Group Synchronization via Quadratic ProgrammingSpotlight11 citations
- Scalable First-Order Bayesian Optimization via Structured Automatic DifferentiationSpotlight11 citations
- Supervised Learning with General Risk FunctionalsSpotlight11 citations
- Understanding Doubly Stochastic ClusteringSpotlight11 citations
- Unsupervised Ground Metric Learning Using Wasserstein Singular VectorsSpotlight11 citations
- Unsupervised Image Representation Learning with Deep Latent ParticlesSpotlight11 citations
- VarScene: A Deep Generative Model for Realistic Scene Graph SynthesisSpotlight11 citations
- Variational Sparse Coding with Learned ThresholdingSpotlight11 citations
- A deep convolutional neural network that is invariant to time rescalingSpotlight10 citations
- Adapting k-means Algorithms for OutliersSpotlight10 citations
- Anytime Information Cascade Popularity Prediction via Self-Exciting ProcessesSpotlight10 citations
- Be Like Water: Adaptive Floating Point for Machine LearningSpotlight10 citations
- Bregman Neural NetworksSpotlight10 citations
- Choosing Answers in Epsilon-Best-Answer Identification for Linear BanditsSpotlight10 citations
- Functional Output Regression with Infimal Convolution: Exploring the Huber and $ε$-insensitive LossesSpotlight10 citations
- Hardness and Algorithms for Robust and Sparse OptimizationSpotlight10 citations
- How to Train Your Wide Neural Network Without Backprop: An Input-Weight Alignment PerspectiveSpotlight10 citations
- Improved Regret for Differentially Private Exploration in Linear MDPSpotlight10 citations
- Inductive Matrix Completion: No Bad Local Minima and a Fast AlgorithmSpotlight10 citations
- LSB: Local Self-Balancing MCMC in Discrete SpacesSpotlight10 citations
- Learning Stable Classifiers by Transferring Unstable FeaturesSpotlight10 citations
- Learning to Infer Structures of Network GamesSpotlight10 citations
- Meta-Learning Hypothesis Spaces for Sequential Decision-makingSpotlight10 citations
- Minimax Classification under Concept Drift with Multidimensional Adaptation and Performance GuaranteesSpotlight10 citations
- ModLaNets: Learning Generalisable Dynamics via Modularity and Physical Inductive BiasOral10 citations
- Multiple-Play Stochastic Bandits with Shareable Finite-Capacity ArmsSpotlight10 citations
- No-Regret Learning in Partially-Informed AuctionsSpotlight10 citations
- Online Active RegressionOral10 citations
- Plug-In Inversion: Model-Agnostic Inversion for Vision with Data AugmentationsSpotlight10 citations
- Random Forest Density EstimationSpotlight10 citations
- Risk-Averse No-Regret Learning in Online Convex GamesSpotlight10 citations
- Rotting Infinitely Many-Armed BanditsSpotlight10 citations
- Sparse Mixed Linear Regression with Guarantees: Taming an Intractable Problem with Invex RelaxationSpotlight10 citations
- Structure Preserving Neural Networks: A Case Study in the Entropy Closure of the Boltzmann EquationSpotlight10 citations
- Understanding Policy Gradient Algorithms: A Sensitivity-Based ApproachSpotlight10 citations
- Visual Attention Emerges from Recurrent Sparse ReconstructionSpotlight10 citations
- A Deep Learning Approach for the Segmentation of Electroencephalography Data in Eye Tracking ApplicationsSpotlight9 citations
- Adversarial Attacks on Gaussian Process BanditsSpotlight9 citations
- Balancing Sample Efficiency and Suboptimality in Inverse Reinforcement LearningSpotlight9 citations
- Bayesian Nonparametric Learning for Point Processes with Spatial Homogeneity: A Spatial Analysis of NBA Shot LocationsSpotlight9 citations
- Biased Gradient Estimate with Drastic Variance Reduction for Meta Reinforcement LearningSpotlight9 citations
- Bregman Proximal Langevin Monte Carlo via Bregman-Moreau EnvelopesSpotlight9 citations
- C*-algebra Net: A New Approach Generalizing Neural Network Parameters to C*-algebraSpotlight9 citations
- COAT: Measuring Object Compositionality in Emergent RepresentationsSpotlight9 citations
- Communicating via Markov Decision ProcessesSpotlight9 citations
- Communication-efficient Distributed Learning for Large Batch OptimizationSpotlight9 citations
- Coordinated Attacks against Contextual Bandits: Fundamental Limits and Defense MechanismsSpotlight9 citations
- Counterfactual Prediction for Outcome-Oriented TreatmentsSpotlight9 citations
- Deep Causal Metric LearningSpotlight9 citations
- Deep equilibrium networks are sensitive to initialization statisticsSpotlight9 citations
- Efficient Learning for AlphaZero via Path ConsistencySpotlight9 citations
- Efficient PAC Learning from the Crowd with Pairwise ComparisonsSpotlight9 citations
- Faster Algorithms for Learning Convex FunctionsSpotlight9 citations
- Generalised Policy Improvement with Geometric Policy CompositionOral9 citations
- Improving Ensemble Distillation With Weight Averaging and Diversifying PerturbationSpotlight9 citations
- Kernel Methods for Radial Transformed Compositional Data with Many ZerosSpotlight9 citations
ICML accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.