ICLR 2023 Accepted Papers
The full list of 1,575 papers accepted at ICLR 2023 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,204Top-25%: 280Top-5%: 91
- ReAct: Synergizing Reasoning and Acting in Language ModelsTop-5%2,772 citations
- DreamFusion: Text-to-3D using 2D DiffusionTop-5%2,361 citations
- DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object DetectionPoster1,881 citations
- An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual InversionTop-25%1,810 citations
- A Time Series is Worth 64 Words: Long-term Forecasting with TransformersPoster1,749 citations
- Prompt-to-Prompt Image Editing with Cross-Attention ControlTop-25%1,736 citations
- Self-Consistency Improves Chain of Thought Reasoning in Language ModelsPoster1,586 citations
- Least-to-Most Prompting Enables Complex Reasoning in Large Language ModelsPoster1,438 citations
- Make-A-Video: Text-to-Video Generation without Text-Video DataPoster1,412 citations
- TimesNet: Temporal 2D-Variation Modeling for General Time Series AnalysisPoster1,337 citations
- Flow Matching for Generative ModelingTop-25%1,222 citations
- CodeGen: An Open Large Language Model for Code with Multi-Turn Program SynthesisTop-25%1,177 citations
- DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding SharingPoster1,147 citations
- Large Language Models are Human-Level Prompt EngineersPoster1,085 citations
- Automatic Chain of Thought Prompting in Large Language ModelsPoster1,016 citations
- Crossformer: Transformer Utilizing Cross-Dimension Dependency for Multivariate Time Series ForecastingTop-5%923 citations
- Human Motion Diffusion ModelTop-25%921 citations
- Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified FlowTop-25%878 citations
- Conditional Positional Encodings for Vision TransformersPoster802 citations
- Diffusion Posterior Sampling for General Noisy Inverse ProblemsTop-25%784 citations
- Quantifying Memorization Across Neural Language ModelsTop-25%776 citations
- PaLI: A Jointly-Scaled Multilingual Language-Image ModelTop-5%736 citations
- GLM-130B: An Open Bilingual Pre-trained ModelPoster715 citations
- Vision Transformer Adapter for Dense PredictionsTop-25%699 citations
- InCoder: A Generative Model for Code Infilling and SynthesisTop-25%688 citations
- DiffDock: Diffusion Steps, Twists, and Turns for Molecular DockingPoster595 citations
- CogVideo: Large-scale Pretraining for Text-to-Video Generation via TransformersPoster589 citations
- Editing models with task arithmeticPoster588 citations
- Simplified State Space Layers for Sequence ModelingTop-5%588 citations
- Adaptive Budget Allocation for Parameter-Efficient Fine-TuningPoster581 citations
- Socratic Models: Composing Zero-Shot Multimodal Reasoning with LanguageTop-25%559 citations
- Mass-Editing Memory in a TransformerTop-25%533 citations
- Hungry Hungry Hippos: Towards Language Modeling with State Space ModelsTop-25%521 citations
- What learning algorithm is in-context learning? Investigations with linear modelsTop-5%517 citations
- DiffEdit: Diffusion-based semantic image editing with mask guidanceTop-25%508 citations
- Token Merging: Your ViT But FasterTop-5%505 citations
- Towards Understanding Ensemble, Knowledge Distillation and Self-Distillation in Deep LearningTop-5%496 citations
- UL2: Unifying Language Learning ParadigmsPoster488 citations
- Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 SmallPoster472 citations
- Zero-Shot Image Restoration Using Denoising Diffusion Null-Space ModelTop-25%457 citations
- Decomposed Prompting: A Modular Approach for Solving Complex TasksPoster452 citations
- UNIFIED-IO: A Unified Model for Vision, Language, and Multi-modal TasksTop-25%446 citations
- DiGress: Discrete Denoising diffusion for graph generationPoster445 citations
- Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language GenerationTop-25%445 citations
- Phenaki: Variable Length Video Generation from Open Domain Textual DescriptionsPoster440 citations
- When and Why Vision-Language Models Behave like Bags-Of-Words, and What to Do About It?Top-5%430 citations
- Fast Sampling of Diffusion Models with Exponential IntegratorPoster425 citations
- Complexity-Based Prompting for Multi-step ReasoningPoster416 citations
- FreeMatch: Self-adaptive Thresholding for Semi-supervised LearningPoster413 citations
- Is Conditional Generative Modeling all you need for Decision Making?Top-5%413 citations
- Visual Classification via Description from Large Language ModelsTop-5%406 citations
- AudioGen: Textually Guided Audio GenerationPoster400 citations
- Progress measures for grokking via mechanistic interpretabilityTop-25%397 citations
- Selection-Inference: Exploiting Large Language Models for Interpretable Logical ReasoningTop-5%384 citations
- Diffusion Policies as an Expressive Policy Class for Offline Reinforcement LearningPoster377 citations
- Uni-Mol: A Universal 3D Molecular Representation Learning FrameworkPoster377 citations
- Building Normalizing Flows with Stochastic InterpolantsPoster369 citations
- Last Layer Re-Training is Sufficient for Robustness to Spurious CorrelationsTop-25%363 citations
- DiffuSeq: Sequence to Sequence Text Generation with Diffusion ModelsPoster355 citations
- CodeT: Code Generation with Generated TestsPoster352 citations
- Git Re-Basin: Merging Models modulo Permutation SymmetriesTop-5%351 citations
- TabPFN: A Transformer That Solves Small Tabular Classification Problems in a SecondTop-25%344 citations
- Sampling is as easy as learning the score: theory for diffusion models with minimal data assumptionsTop-5%335 citations
- LightGCL: Simple Yet Effective Graph Contrastive Learning for RecommendationTop-25%333 citations
- MICN: Multi-scale Local and Global Context Modeling for Long-term Series ForecastingTop-5%333 citations
- IS SYNTHETIC DATA FROM GENERATIVE MODELS READY FOR IMAGE RECOGNITION?Top-25%331 citations
- Language models are multilingual chain-of-thought reasonersPoster331 citations
- Training-Free Structured Diffusion Guidance for Compositional Text-to-Image SynthesisPoster326 citations
- Discovering Latent Knowledge in Language Models Without SupervisionPoster321 citations
- Spikformer: When Spiking Neural Network Meets TransformerPoster317 citations
- Generate rather than Retrieve: Large Language Models are Strong Context GeneratorsPoster316 citations
- Analog Bits: Generating Discrete Data using Diffusion Models with Self-ConditioningPoster305 citations
- Emergent World Representations: Exploring a Sequence Model Trained on a Synthetic TaskTop-5%304 citations
- Towards Stable Test-time Adaptation in Dynamic Wild WorldTop-5%303 citations
- VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-TrainingTop-25%295 citations
- Diffusion-GAN: Training GANs with DiffusionPoster290 citations
- Prompting GPT-3 To Be ReliablePoster287 citations
- Pseudoinverse-Guided Diffusion Models for Inverse ProblemsPoster285 citations
- Language Models Are Greedy Reasoners: A Systematic Formal Analysis of Chain-of-ThoughtPoster279 citations
- BigVGAN: A Universal Neural Vocoder with Large-Scale TrainingPoster278 citations
- Novel View Synthesis with Diffusion ModelsPoster277 citations
- Reward Design with Language ModelsPoster277 citations
- Diffusion Probabilistic Modeling of Protein Backbones in 3D for the motif-scaffolding problemPoster275 citations
- Dynamic Prompt Learning via Policy Gradient for Semi-structured Mathematical ReasoningPoster273 citations
- MapTR: Structured Modeling and Learning for Online Vectorized HD Map ConstructionTop-25%270 citations
- Long Range Language Modeling via Gated State SpacesPoster267 citations
- Equiformer: Equivariant Graph Attention Transformer for 3D Atomistic GraphsTop-25%262 citations
- Post-hoc Concept Bottleneck ModelsTop-25%255 citations
- Diffusion Models Already Have A Semantic Latent SpaceTop-25%254 citations
- Language Models are Realistic Tabular Data GeneratorsPoster253 citations
- Protein Representation Learning by Geometric Structure PretrainingPoster249 citations
- Ask Me Anything: A simple strategy for prompting language modelsTop-25%248 citations
- More ConvNets in the 2020s: Scaling up Kernels Beyond 51x51 using SparsityPoster246 citations
- A critical look at the evaluation of GNNs under heterophily: Are we really making progress?Poster244 citations
- SoftMatch: Addressing the Quantity-Quality Tradeoff in Semi-supervised LearningPoster241 citations
- The KFIoU Loss for Rotated Object DetectionPoster239 citations
- Promptagator: Few-shot Dense Retrieval From 8 ExamplesPoster230 citations
- AIM: Adapting Image Models for Efficient Video Action RecognitionPoster229 citations
- Surgical Fine-Tuning Improves Adaptation to Distribution ShiftsPoster229 citations
- Open-Vocabulary Object Detection upon Frozen Vision and Language ModelsPoster228 citations
- Dual Diffusion Implicit Bridges for Image-to-Image TranslationPoster227 citations
- A Model or 603 Exemplars: Towards Memory-Efficient Class-Incremental LearningTop-25%221 citations
- The Role of ImageNet Classes in Fréchet Inception DistanceTop-25%216 citations
- Imitating Human Behaviour with Diffusion ModelsPoster214 citations
- Selective Annotation Makes Language Models Better Few-Shot LearnersPoster214 citations
- Transformers Learn Shortcuts to AutomataTop-5%213 citations
- 3D UX-Net: A Large Kernel Volumetric ConvNet Modernizing Hierarchical Transformer for Medical Image SegmentationPoster210 citations
- Label-free Concept Bottleneck ModelsPoster202 citations
- Dataless Knowledge Fusion by Merging Weights of Language ModelsPoster201 citations
- Re-Imagen: Retrieval-Augmented Text-to-Image GeneratorPoster198 citations
- 3D Equivariant Diffusion for Target-Aware Molecule Generation and Affinity PredictionPoster197 citations
- Transformers are Sample-Efficient World ModelsTop-5%197 citations
- Binding Language Models in Symbolic LanguagesTop-25%195 citations
- How to Exploit Hyperspherical Embeddings for Out-of-Distribution Detection?Poster193 citations
- Sign and Basis Invariant Networks for Spectral Graph Representation LearningTop-25%193 citations
- Time Will Tell: New Outlooks and A Baseline for Temporal Multi-View 3D Object DetectionTop-5%192 citations
- Extremely Simple Activation Shaping for Out-of-Distribution DetectionPoster190 citations
- Leveraging Large Language Models for Multiple Choice Question AnsweringPoster189 citations
- SeaFormer: Squeeze-enhanced Axial Transformer for Mobile Semantic SegmentationPoster189 citations
- Visual Recognition with Deep Nearest CentroidsTop-25%183 citations
- Factorized Fourier Neural OperatorsPoster177 citations
- Formal Mathematics Statement Curriculum LearningTop-25%177 citations
- PLOT: Prompt Learning with Optimal Transport for Vision-Language ModelsTop-25%177 citations
- Planning with Large Language Models for Code GenerationPoster177 citations
- MeshDiffusion: Score-based Generative 3D Mesh ModelingTop-25%175 citations
- NAGphormer: A Tokenized Graph Transformer for Node Classification in Large GraphsPoster175 citations
- Diffusion-based Image Translation using disentangled style and content representationPoster173 citations
- Draft, Sketch, and Prove: Guiding Formal Theorem Provers with Informal ProofsTop-5%172 citations
- Selective Frequency Network for Image RestorationPoster169 citations
- Mole-BERT: Rethinking Pre-training Graph Neural Networks for MoleculesPoster167 citations
- Neural Collapse Inspired Feature-Classifier Alignment for Few-Shot Class-Incremental LearningTop-25%166 citations
- Transformer-Patcher: One Mistake Worth One NeuronPoster164 citations
- Personalized Federated Learning with Feature Alignment and Classifier CollaborationTop-5%163 citations
- Progressive Prompts: Continual Learning for Language ModelsPoster161 citations
- Learning on Large-scale Text-attributed Graphs via Variational InferenceTop-5%158 citations
- Contrastive Audio-Visual Masked AutoencoderTop-25%156 citations
- Do We Really Need Complicated Model Architectures For Temporal Networks?Top-5%156 citations
- DocPrompting: Generating Code by Retrieving the DocsTop-25%155 citations
- Neural Networks and the Chomsky HierarchyTop-25%155 citations
- Compositional Semantic Parsing with Large Language ModelsPoster150 citations
- Continual Pre-training of Language ModelsPoster149 citations
- Embedding Fourier for Ultra-High-Definition Low-Light Image EnhancementTop-5%147 citations
- GeneFace: Generalized and High-Fidelity Audio-Driven 3D Talking Face SynthesisPoster147 citations
- In-context Reinforcement Learning with Algorithm DistillationTop-5%145 citations
- Pre-training via Denoising for Molecular Property PredictionTop-25%145 citations
- Bridging the Gap to Real-World Object-Centric LearningPoster144 citations
- SQA3D: Situated Question Answering in 3D ScenesPoster142 citations
- Calibrating Sequence likelihood Improves Conditional Language GenerationPoster140 citations
- kNN-Diffusion: Image Generation via Large-Scale RetrievalPoster139 citations
- Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked ModelingTop-25%138 citations
- Rethinking the Expressive Power of GNNs via Graph BiconnectivityTop-5%138 citations
- Multi-lingual Evaluation of Code Generation ModelsTop-25%137 citations
- Towards the Generalization of Contrastive Self-Supervised LearningPoster137 citations
- Dataset Pruning: Reducing Training Data by Examining Generalization InfluencePoster135 citations
- MaskViT: Masked Visual Pre-Training for Video PredictionPoster135 citations
- Accurate Image Restoration with Attention Retractable TransformerTop-25%134 citations
- TEMPERA: Test-Time Prompt Editing via Reinforcement LearningTop-25%134 citations
- Graph Neural Networks for Link Prediction with Subgraph SketchingTop-5%133 citations
- Liquid Structural State-Space ModelsPoster132 citations
- Recitation-Augmented Language ModelsPoster131 citations
- Where to Begin? On the Impact of Pre-Training and Initialization in Federated LearningTop-25%131 citations
- PiFold: Toward effective and efficient protein inverse foldingTop-25%130 citations
- PEER: A Collaborative Language ModelTop-25%129 citations
- gDDIM: Generalized denoising diffusion implicit modelsTop-25%129 citations
- Multitask Prompt Tuning Enables Parameter-Efficient Transfer LearningPoster128 citations
- Scaleformer: Iterative Multi-scale Refining Transformers for Time Series ForecastingPoster125 citations
- Revisiting the Assumption of Latent Separability for Backdoor DefensesPoster124 citations
- DIFFormer: Scalable (Graph) Transformers Induced by Energy Constrained DiffusionTop-25%123 citations
- EVA3D: Compositional 3D Human Generation from 2D Image CollectionsTop-25%123 citations
- Generating Sequences by Learning to Self-CorrectPoster122 citations
- ROSCOE: A Suite of Metrics for Scoring Step-by-Step ReasoningTop-25%122 citations
- Non-parametric Outlier SynthesisPoster121 citations
- Sparse Upcycling: Training Mixture-of-Experts from Dense CheckpointsPoster119 citations
- One Transformer Can Understand Both 2D & 3D Molecular DataPoster117 citations
- How to Train your HIPPO: State Space Models with Generalized Orthogonal Basis ProjectionsPoster116 citations
- On the duality between contrastive and non-contrastive self-supervised learningTop-5%116 citations
- Sample-Efficient Reinforcement Learning by Breaking the Replay Ratio BarrierTop-5%116 citations
- What Makes Convolutional Models Great on Long Sequence Modeling?Poster116 citations
- DeCap: Decoding CLIP Latents for Zero-Shot Captioning via Text-Only TrainingPoster115 citations
- Linearly Mapping from Image to Text SpacePoster115 citations
- Measuring Forgetting of Memorized Training ExamplesPoster112 citations
- TTN: A Domain-Shift Aware Batch Normalization in Test-Time AdaptationPoster111 citations
- ManiSkill2: A Unified Benchmark for Generalizable Manipulation SkillsPoster110 citations
- Learning Object-Language Alignments for Open-Vocabulary Object DetectionPoster109 citations
- Offline RL for Natural Language Generation with Implicit Language Q LearningPoster109 citations
- Specformer: Spectral Graph Neural Networks Meet TransformersPoster109 citations
- Is Reinforcement Learning (Not) for Natural Language Processing: Benchmarks, Baselines, and Building Blocks for Natural Language Policy OptimizationTop-25%108 citations
- Omnigrok: Grokking Beyond Algorithmic DataTop-25%108 citations
- Offline Reinforcement Learning via High-Fidelity Generative Behavior ModelingPoster107 citations
- S-NeRF: Neural Radiance Fields for Street ViewsPoster107 citations
- SCALE-UP: An Efficient Black-box Input-level Backdoor Detection via Analyzing Scaled Prediction ConsistencyPoster107 citations
- Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?Poster106 citations
- Clifford Neural Layers for PDE ModelingPoster106 citations
- Generative Modelling with Inverse Heat DissipationPoster106 citations
- Multimodal Federated Learning via Contrastive Representation EnsemblePoster106 citations
- Out-of-Distribution Detection and Selective Generation for Conditional Language ModelsTop-25%106 citations
- Moderate Coreset: A Universal Method of Data Selection for Real-world Data-efficient Deep LearningPoster102 citations
- UniKGQA: Unified Retrieval and Reasoning for Solving Multi-hop Question Answering Over Knowledge GraphPoster102 citations
- CLIP-Dissect: Automatic Description of Neuron Representations in Deep Vision NetworksTop-25%101 citations
- Relative representations enable zero-shot latent space communicationTop-5%101 citations
- Reversible Column NetworksPoster101 citations
- Voxurf: Voxel-based Efficient and Accurate Neural Surface ReconstructionTop-25%101 citations
- DecAF: Joint Decoding of Answers and Logical Forms for Question Answering over Knowledge BasesPoster100 citations
- SlotFormer: Unsupervised Visual Dynamics Simulation with Object-Centric ModelsPoster100 citations
- What Do Self-Supervised Vision Transformers Learn?Poster98 citations
- Switch-NeRF: Learning Scene Decomposition with Mixture of Experts for Large-scale Neural Radiance FieldsPoster97 citations
- Self-Stabilization: The Implicit Bias of Gradient Descent at the Edge of StabilityPoster96 citations
- Mega: Moving Average Equipped Gated AttentionPoster95 citations
- Hybrid RL: Using both offline and online data can make RL efficientPoster94 citations
- Corrupted Image Modeling for Self-Supervised Visual Pre-TrainingTop-25%93 citations
- Learning to Compose Soft Prompts for Compositional Zero-Shot LearningPoster93 citations
- Offline RL with No OOD Actions: In-Sample Learning via Implicit Value RegularizationTop-5%93 citations
- GFlowNets and variational inferencePoster92 citations
- Molecular Geometry Pretraining with SE(3)-Invariant Denoising Distance MatchingPoster92 citations
- The Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in TransformersPoster92 citations
- On the Importance and Applicability of Pre-Training for Federated LearningPoster91 citations
- Ordered GNN: Ordering Message Passing to Deal with Heterophily and Over-smoothingPoster91 citations
- Preference Transformer: Modeling Human Preferences using Transformers for RLPoster91 citations
- Discrete Contrastive Diffusion for Cross-Modal Music and Image GenerationPoster90 citations
- Energy-based Out-of-Distribution Detection for Graph Neural NetworksPoster90 citations
- FoSR: First-order spectral rewiring for addressing oversquashing in GNNsPoster89 citations
- MPCFORMER: FAST, PERFORMANT AND PRIVATE TRANSFORMER INFERENCE WITH MPCTop-25%89 citations
- The Role of Coverage in Online Reinforcement LearningTop-5%89 citations
- Human alignment of neural network representationsPoster88 citations
- MEDICAL IMAGE UNDERSTANDING WITH PRETRAINED VISION LANGUAGE MODELS: A COMPREHENSIVE STUDYPoster88 citations
- Masked Frequency Modeling for Self-Supervised Visual Pre-TrainingPoster88 citations
- REPAIR: REnormalizing Permuted Activations for Interpolation RepairPoster87 citations
- Towards Understanding and Mitigating Dimensional Collapse in Heterogeneous Federated LearningPoster87 citations
- Transformer-based World Models Are Happy With 100k InteractionsPoster87 citations
- Code Translation with Compiler RepresentationsTop-25%86 citations
- Conditional Antibody Design as 3D Equivariant Graph TranslationTop-5%86 citations
- Distilling Model Failures as Directions in Latent SpaceTop-25%86 citations
- Diffusion Adversarial Representation Learning for Self-supervised Vessel SegmentationPoster85 citations
- BEVDistill: Cross-Modal BEV Distillation for Multi-View 3D Object DetectionPoster84 citations
- Denoising Diffusion SamplersPoster84 citations
- LPT: Long-tailed Prompt Tuning for Image ClassificationPoster84 citations
- Mind's Eye: Grounded Language Model Reasoning through SimulationPoster84 citations
- NORM: Knowledge Distillation via N-to-One Representation MatchingPoster84 citations
- Sparse Mixture-of-Experts are Domain Generalizable LearnersTop-5%84 citations
- A Theoretical Understanding of Shallow Vision Transformers: Learning, Generalization, and Sample ComplexityPoster83 citations
- Broken Neural Scaling LawsPoster83 citations
- From Play to Policy: Conditional Behavior Generation from Uncurated Robot DataTop-5%83 citations
- MEDFAIR: Benchmarking Fairness for Medical ImagingTop-25%83 citations
- Understanding Zero-shot Adversarial Robustness for Large-Scale ModelsPoster83 citations
- Continuous PDE Dynamics Forecasting with Implicit Neural RepresentationsTop-25%82 citations
- Explicit Box Detection Unifies End-to-End Multi-Person Pose EstimationPoster82 citations
- Flow Annealed Importance Sampling BootstrapTop-25%82 citations
- PAC-NeRF: Physics Augmented Continuum Neural Radiance Fields for Geometry-Agnostic System IdentificationTop-25%82 citations
- Agree to Disagree: Diversity through Disagreement for Better TransferabilityTop-5%81 citations
- Blurring Diffusion ModelsPoster81 citations
- Image as Set of PointsTop-5%81 citations
- Extreme Q-Learning: MaxEnt RL without EntropyTop-5%80 citations
- Score-based Continuous-time Discrete Diffusion ModelsPoster80 citations
- ZiCo: Zero-shot NAS via inverse Coefficient of Variation on GradientsTop-25%80 citations
- Empowering Graph Representation Learning with Test-Time Graph TransformationPoster79 citations
- Language Models Can Teach Themselves to Program BetterPoster79 citations
- Learning MLPs on Graphs: A Unified View of Effectiveness, Robustness, and EfficiencyTop-25%79 citations
- Pushing the Limits of Fewshot Anomaly Detection in Industry Vision: GraphcorePoster79 citations
- STaSy: Score-based Tabular data SynthesisTop-25%79 citations
- H2RBox: Horizontal Box Annotation is All You Need for Oriented Object DetectionPoster78 citations
- Leveraging Future Relationship Reasoning for Vehicle Trajectory PredictionPoster78 citations
- MOAT: Alternating Mobile Convolution and Attention Brings Strong Vision ModelsPoster78 citations
- Graph Neural Networks are Inherently Good Generalizers: Insights by Bridging GNNs and MLPsPoster77 citations
- Contrastive Learning for Unsupervised Domain Adaptation of Time SeriesPoster76 citations
- EVC: Towards Real-Time Neural Image Compression with Mask DecayPoster76 citations
- GOGGLE: Generative Modelling for Tabular Data by Learning Relational StructurePoster76 citations
- Learning Hierarchical Protein Representations via Complete 3D Graph NetworksPoster76 citations
- Masked Vision and Language Modeling for Multi-modal Representation LearningPoster76 citations
- BEEF: Bi-Compatible Class-Incremental Learning via Energy-Based Expansion and FusionPoster75 citations
- DELTA: DEGRADATION-FREE FULLY TEST-TIME ADAPTATIONPoster75 citations
- DM-NeRF: 3D Scene Geometry Decomposition and Manipulation from 2D ImagesPoster75 citations
- Policy Expansion for Bridging Offline-to-Online Reinforcement LearningPoster75 citations
- Anti-Symmetric DGN: a stable architecture for Deep Graph NetworksPoster74 citations
- HiViT: A Simpler and More Efficient Design of Hierarchical Vision TransformerTop-25%74 citations
- Symbolic Physics Learner: Discovering governing equations via Monte Carlo tree searchTop-5%74 citations
- Can CNNs Be More Robust Than Transformers?Poster73 citations
- Decepticons: Corrupted Transformers Breach Privacy in Federated Learning for Language ModelsPoster72 citations
- FedExP: Speeding Up Federated Averaging via ExtrapolationTop-25%72 citations
- Noise Is Not the Main Factor Behind the Gap Between Sgd and Adam on Transformers, But Sign Descent Might BePoster72 citations
- DDM$^2$: Self-Supervised Diffusion MRI Denoising with Generative Diffusion ModelsPoster71 citations
- Equivariant Energy-Guided SDE for Inverse Molecular DesignPoster71 citations
- Neural Networks Efficiently Learn Low-Dimensional Representations with SGDTop-25%71 citations
- Parameter-Efficient Fine-Tuning Design SpacesPoster71 citations
- A Unified Approach to Reinforcement Learning, Quantal Response Equilibria, and Two-Player Zero-Sum GamesPoster70 citations
- Pareto Invariant Risk Minimization: Towards Mitigating the Optimization Dilemma in Out-of-Distribution GeneralizationPoster70 citations
- Global Explainability of GNNs via Logic Combination of Learned ConceptsPoster69 citations
- LAVA: Data Valuation without Pre-Specified Learning AlgorithmsTop-25%69 citations
- Advancing Radiograph Representation Learning with Masked Record ModelingPoster68 citations
- Coverage-centric Coreset Selection for High Pruning RatesPoster68 citations
- Gradient Gating for Deep Multi-Rate Learning on GraphsPoster68 citations
- Optimizing Bi-Encoder for Named Entity Recognition via Contrastive LearningPoster68 citations
- PINTO: Faithful Language Reasoning Using Prompt-Generated RationalesPoster68 citations
- Sparse Random Networks for Communication-Efficient Federated LearningPoster68 citations
- FedSpeed: Larger Local Interval, Less Communication Round, and Higher Generalization AccuracyPoster67 citations
- Learning to Grow Pretrained Models for Efficient Transformer TrainingTop-25%67 citations
- Out-of-Distribution Detection based on In-Distribution Data Patterns Memorization with Modern Hopfield EnergyPoster67 citations
- StableDR: Stabilized Doubly Robust Learning for Recommendation on Data Missing Not at RandomPoster67 citations
- Test-Time Adaptation via Self-Training with Nearest Neighbor InformationPoster67 citations
- Bidirectional Language Models Are Also Few-shot LearnersPoster66 citations
- Equivariant Hypergraph Diffusion Neural OperatorsPoster66 citations
- NeRF-SOS: Any-View Self-supervised Object Segmentation on Complex ScenesPoster66 citations
- Better Generative Replay for Continual Federated LearningPoster65 citations
- Certified Training: Small Boxes are All You NeedTop-25%65 citations
- Out-of-distribution Representation Learning for Time Series ClassificationPoster65 citations
- Re-parameterizing Your Optimizers rather than ArchitecturesPoster65 citations
- Statistical Efficiency of Score Matching: The View from IsoperimetryTop-5%65 citations
- VA-DepthNet: A Variational Approach to Single Image Depth PredictionTop-25%65 citations
- How Sharpness-Aware Minimization Minimizes Sharpness?Poster64 citations
- On the Soft-Subnetwork for Few-Shot Class Incremental LearningPoster64 citations
- Spotlight: Mobile UI Understanding using Vision-Language Models with a FocusPoster64 citations
- Batch Multivalid Conformal PredictionPoster63 citations
- Understanding the Generalization of Adam in Learning Neural Networks with Proper RegularizationPoster63 citations
- Warping the Space: Weight Space Rotation for Class-Incremental Few-Shot LearningTop-25%63 citations
- An efficient encoder-decoder architecture with top-down attention for speech separationPoster62 citations
- Learning Cut Selection for Mixed-Integer Linear Programming via Hierarchical Sequence ModelPoster62 citations
- NANSY++: Unified Voice Synthesis with Neural Analysis and SynthesisPoster62 citations
- SLTUNET: A Simple Unified Model for Sign Language TranslationPoster62 citations
- Spectral Augmentation for Self-Supervised Learning on GraphsTop-25%62 citations
- Data augmentation alone can improve adversarial trainingPoster61 citations
- Free Lunch for Domain Adversarial Training: Environment Label SmoothingPoster61 citations
- Hebbian Deep Learning Without FeedbackTop-25%61 citations
- Implicit Bias in Leaky ReLU Networks Trained on High-Dimensional DataTop-25%61 citations
- Neural Optimal TransportTop-25%61 citations
- Offline Q-learning on Diverse Multi-Task Data Both Scales And GeneralizesTop-5%61 citations
- 3D generation on ImageNetTop-5%60 citations
- A Unified Algebraic Perspective on Lipschitz Neural NetworksTop-25%60 citations
- Better Teacher Better Student: Dynamic Prior Knowledge for Knowledge DistillationPoster60 citations
- CROM: Continuous Reduced-Order Modeling of PDEs Using Implicit Neural RepresentationsTop-25%60 citations
- GNNInterpreter: A Probabilistic Generative Model-Level Explanation for Graph Neural NetworksPoster60 citations
- General Neural Gauge FieldsPoster60 citations
- Graph Domain Adaptation via Theory-Grounded Spectral RegularizationPoster60 citations
- Multi-skill Mobile Manipulation for Object RearrangementTop-25%60 citations
- Neural Compositional Rule Learning for Knowledge Graph ReasoningPoster60 citations
- Scaling Forward Gradient With Local LossesPoster60 citations
- TaskPrompter: Spatial-Channel Multi-Task Prompting for Dense Scene UnderstandingPoster60 citations
- The hidden uniform cluster prior in self-supervised learningPoster60 citations
- Understanding DDPM Latent Codes Through Optimal TransportPoster60 citations
- Causal Confusion and Reward Misidentification in Preference-Based Reward LearningPoster59 citations
- Learning Fair Graph Representations via Automated Data AugmentationsTop-25%59 citations
- Learning to Induce Causal StructurePoster59 citations
- Robust Scheduling with GFlowNetsPoster59 citations
- Towards Interpretable Deep Reinforcement Learning with Human-Friendly PrototypesTop-25%59 citations
- Boosting the Cycle Counting Power of Graph Neural Networks with I$^2$-GNNsPoster58 citations
- Generalize Learned Heuristics to Solve Large-scale Vehicle Routing Problems in Real-timePoster58 citations
- Harnessing Out-Of-Distribution Examples via Augmenting Content and StylePoster58 citations
- Learning Fast and Slow for Online Time Series ForecastingPoster58 citations
- On Representing Linear Programs by Graph Neural NetworksTop-25%58 citations
- Continual evaluation for lifelong learning: Identifying the stability gapTop-25%57 citations
- Effectively Modeling Time Series with Simple Discrete State SpacesPoster57 citations
- FLIP: A Provable Defense Framework for Backdoor Mitigation in Federated LearningPoster57 citations
- Jointly Learning Visual and Auditory Speech Representations from Raw DataPoster57 citations
- Test-Time Robust Personalization for Federated LearningPoster57 citations
- When Source-Free Domain Adaptation Meets Learning with Noisy LabelsTop-25%57 citations
- Deep Learning on Implicit Neural Representations of ShapesPoster56 citations
- Is Attention All That NeRF Needs?Poster56 citations
- Molecule Generation For Target Protein Binding with Structural MotifsPoster56 citations
- UniMax: Fairer and More Effective Language Sampling for Large-Scale Multilingual PretrainingPoster56 citations
- Diagnosing and Rectifying Vision Models using LanguagePoster55 citations
- Discovering Evolution Strategies via Meta-Black-Box OptimizationPoster55 citations
- Improving Deep Regression with Ordinal EntropyPoster55 citations
- MLPInit: Embarrassingly Simple GNN Training Acceleration with MLP InitializationPoster55 citations
- Masked Image Modeling with Denoising ContrastPoster55 citations
- Mastering the Game of No-Press Diplomacy via Human-Regularized Reinforcement Learning and PlanningTop-5%55 citations
- Mitigating Gradient Bias in Multi-objective Learning: A Provably Convergent ApproachTop-5%55 citations
- StrucTexTv2: Masked Visual-Textual Prediction for Document Image Pre-trainingPoster55 citations
- TILP: Differentiable Learning of Temporal Logical Rules on Knowledge GraphsPoster55 citations
- A Self-Attention Ansatz for Ab-initio Quantum ChemistryPoster54 citations
- CUDA: Curriculum of Data Augmentation for Long-tailed RecognitionTop-25%54 citations
- Diffusion Models for Causal Discovery via Topological OrderingPoster54 citations
- Edge Guided GANs with Contrastive Learning for Semantic Image SynthesisPoster54 citations
- Efficient Model Updates for Approximate Unlearning of Graph-Structured DataPoster54 citations
- Language Modelling with PixelsTop-5%54 citations
- Linear Connectivity Reveals Generalization StrategiesPoster54 citations
- Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov GamePoster54 citations
- Out-of-distribution Detection with Implicit Outlier TransformationPoster54 citations
- SMART: Self-supervised Multi-task pretrAining with contRol TransformersTop-25%54 citations
- Temporal Domain Generalization with Drift-Aware Dynamic Neural NetworksTop-5%54 citations
- Unsupervised Semantic Segmentation with Self-supervised Object-centric RepresentationsTop-25%54 citations
- ViewCo: Discovering Text-Supervised Segmentation Masks via Multi-View Semantic ConsistencyPoster54 citations
- A Call to Reflect on Evaluation Practices for Failure Detection in Image ClassificationTop-5%53 citations
- A Non-Asymptotic Analysis of Oversmoothing in Graph Neural NetworksPoster53 citations
- CUTS: Neural Causal Discovery from Irregular Time-Series DataPoster53 citations
- Concept-level Debugging of Part-Prototype NetworksTop-25%53 citations
- LMC: Fast Training of GNNs via Subgraph Sampling with Provable ConvergenceTop-25%53 citations
- Sparse MoE as the New Dropout: Scaling Dense and Self-Slimmable TransformersTop-25%53 citations
- $k$NN Prompting: Beyond-Context Learning with Calibration-Free Nearest Neighbor InferencePoster52 citations
- Bridging the Gap between ANNs and SNNs by Calibrating Offset SpikesPoster52 citations
- DepthFL : Depthwise Federated Learning for Heterogeneous ClientsPoster52 citations
- Exploring the Limits of Differentially Private Deep Learning with Group-wise ClippingPoster52 citations
- SimPer: Simple Self-Supervised Learning of Periodic TargetsTop-5%52 citations
- The Modality Focusing Hypothesis: Towards Understanding Crossmodal Knowledge DistillationTop-5%52 citations
- Unsupervised Model Selection for Time Series Anomaly DetectionTop-25%52 citations
- DENSE RGB SLAM WITH NEURAL IMPLICIT MAPSPoster51 citations
- HiCLIP: Contrastive Language-Image Pretraining with Hierarchy-aware AttentionPoster51 citations
- Linear Convergence of Natural Policy Gradient Methods with Log-Linear PoliciesPoster51 citations
- PAC Reinforcement Learning for Predictive State RepresentationsPoster51 citations
- Pink Noise Is All You Need: Colored Noise Exploration in Deep Reinforcement LearningTop-25%51 citations
- Reliability of CKA as a Similarity Measure in Deep LearningPoster51 citations
- Retrieval-based Controllable Molecule GenerationTop-25%51 citations
- The Best of Both Worlds: Accurate Global and Personalized Models through Federated Learning with Data-Free Hyper-Knowledge DistillationPoster51 citations
- ACMP: Allen-Cahn Message Passing with Attractive and Repulsive Forces for Graph Neural NetworksTop-25%50 citations
- Continuous-Discrete Convolution for Geometry-Sequence Modeling in ProteinsPoster50 citations
- ContraNorm: A Contrastive Learning Perspective on Oversmoothing and BeyondPoster50 citations
- Data-Free One-Shot Federated Learning Under Very High Statistical HeterogeneityPoster50 citations
- Dichotomy of Control: Separating What You Can Control from What You CannotTop-5%50 citations
- Does Zero-Shot Reinforcement Learning Exist?Top-25%50 citations
- FluidLab: A Differentiable Environment for Benchmarking Complex Fluid ManipulationTop-25%50 citations
- ImageNet-X: Understanding Model Mistakes with Factor of Variation AnnotationsTop-25%50 citations
- Probabilistically Robust Recourse: Navigating the Trade-offs between Costs and Robustness in Algorithmic RecoursePoster50 citations
- Trainability Preserving Neural PruningPoster50 citations
- Unmasking the Lottery Ticket Hypothesis: What's Encoded in a Winning Ticket's Mask?Top-25%50 citations
- Variance Reduction is an Antidote to Byzantines: Better Rates, Weaker Assumptions and Communication Compression as a Cherry on the TopPoster50 citations
- simpleKT: A Simple But Tough-to-Beat Baseline for Knowledge TracingPoster50 citations
- Equivariant Descriptor Fields: SE(3)-Equivariant Energy-Based Models for End-to-End Visual Robotic Manipulation LearningPoster49 citations
- FedFA: Federated Feature AugmentationPoster49 citations
- MoDem: Accelerating Visual Model-Based Reinforcement Learning with DemonstrationsPoster49 citations
- POPGym: Benchmarking Partially Observable Reinforcement LearningPoster49 citations
- TDR-CL: Targeted Doubly Robust Collaborative Learning for Debiased RecommendationsPoster49 citations
- TranSpeech: Speech-to-Speech Translation With Bilateral PerturbationPoster49 citations
- Behavior Proximal Policy OptimizationPoster48 citations
- GNNDelete: A General Strategy for Unlearning in Graph Neural NetworksPoster48 citations
- Identifiability Results for Multimodal Contrastive LearningPoster48 citations
- Improving Object-centric Learning with Query OptimizationPoster48 citations
- Neural Systematic BinderPoster48 citations
- PD-MORL: Preference-Driven Multi-Objective Reinforcement Learning AlgorithmPoster48 citations
- Transfer Learning with Deep Tabular ModelsPoster48 citations
- Classically Approximating Variational Quantum Machine Learning with Random Fourier FeaturesPoster47 citations
- Clean-image Backdoor: Attacking Multi-label Models with Poisoned Labels OnlyTop-5%47 citations
- Human-level Atari 200x fasterPoster47 citations
- Optimal Conservative Offline RL with General Function Approximation via Augmented LagrangianTop-25%47 citations
- Protein Sequence and Structure Co-Design with Equivariant TranslationPoster47 citations
- Prototypical Calibration for Few-shot Learning of Language ModelsPoster47 citations
- Spherical Sliced-WassersteinPoster47 citations
- Transferable Unlearnable ExamplesPoster47 citations
- UNICORN: A Unified Backdoor Trigger Inversion FrameworkTop-25%47 citations
- Efficient Planning in a Compact Latent Action SpacePoster46 citations
- Exploring and Exploiting Decision Boundary Dynamics for Adversarial RobustnessPoster46 citations
- Federated Learning from Small DatasetsPoster46 citations
- Generative Augmented Flow NetworksTop-25%46 citations
- Relational Attention: Generalizing Transformers for Graph-Structured TasksTop-25%46 citations
- Spiking Convolutional Neural Networks for Text ClassificationPoster46 citations
- Temperature Schedules for self-supervised contrastive methods on long-tail dataPoster46 citations
- Verifying the Union of Manifolds Hypothesis for Image DataPoster46 citations
- Characterizing intrinsic compositionality in transformers with Tree ProjectionsPoster45 citations
- Context-enriched molecule representations improve few-shot drug discoveryPoster45 citations
- Faster Last-iterate Convergence of Policy Optimization in Zero-Sum Markov GamesPoster45 citations
- Multi-level Protein Structure Pre-training via Prompt LearningPoster45 citations
- OTOv2: Automatic, Generic, User-FriendlyPoster45 citations
- RandProx: Primal-Dual Optimization Algorithms with Randomized Proximal UpdatesPoster45 citations
- SIMPLE: Specialized Model-Sample Matching for Domain GeneralizationPoster45 citations
- The In-Sample Softmax for Offline Reinforcement LearningTop-25%45 citations
- Understanding Edge-of-Stability Training Dynamics with a Minimalist ExamplePoster45 citations
- E3Bind: An End-to-End Equivariant Network for Protein-Ligand DockingPoster44 citations
- Hyper-Decision Transformer for Efficient Online Policy AdaptationPoster44 citations
- Hyperbolic Self-paced Learning for Self-supervised Skeleton-based Action RepresentationsPoster44 citations
- Learning to Linearize Deep Neural Networks for Secure and Efficient Private InferencePoster44 citations
- Modeling content creator incentives on algorithm-curated platformsTop-5%44 citations
- On the Robustness of Safe Reinforcement Learning under Observational PerturbationsPoster44 citations
- The Lie Derivative for Measuring Learned EquivarianceTop-5%44 citations
- Causal Imitation Learning via Inverse Reinforcement LearningPoster43 citations
- CktGNN: Circuit Graph Neural Network for Electronic Design AutomationPoster43 citations
- De Novo Molecular Generation via Connection-aware Motif MiningPoster43 citations
- Deep Generative Symbolic RegressionPoster43 citations
- DensePure: Understanding Diffusion Models for Adversarial RobustnessPoster43 citations
- Dirichlet-based Uncertainty Calibration for Active Domain AdaptationTop-25%43 citations
- Exploring Low-Rank Property in Multiple Instance Learning for Whole Slide Image ClassificationPoster43 citations
- Knowledge Distillation based Degradation Estimation for Blind Super-ResolutionPoster43 citations
- LexMAE: Lexicon-Bottlenecked Pretraining for Large-Scale RetrievalPoster43 citations
- MultiViz: Towards Visualizing and Understanding Multimodal ModelsPoster43 citations
- Recon: Reducing Conflicting Gradients From the Root For Multi-Task LearningPoster43 citations
- Unicom: Universal and Compact Representation Learning for Image RetrievalPoster43 citations
- Accelerated Single-Call Methods for Constrained Min-Max OptimizationPoster42 citations
- Dilated convolution with learnable spacingsPoster42 citations
- Discovering Policies with DOMiNO: Diversity Optimization Maintaining Near OptimalityPoster42 citations
- Graph Contrastive Learning for Skeleton-based Action RecognitionPoster42 citations
- How Much Data Are Augmentations Worth? An Investigation into Scaling Laws, Invariance, and Implicit RegularizationPoster42 citations
- Masked Distillation with Receptive TokensPoster42 citations
- Masked Unsupervised Self-training for Label-free Image ClassificationPoster42 citations
- Pruning Deep Neural Networks from a Sparsity PerspectivePoster42 citations
- Using Language to Extend to Unseen DomainsTop-25%42 citations
- A framework for benchmarking Class-out-of-distribution detection and its application to ImageNetTop-25%41 citations
- Effects of Graph Convolutions in Multi-layer NetworksTop-25%41 citations
- MAESTRO: Open-Ended Environment Design for Multi-Agent Reinforcement LearningPoster41 citations
- MECTA: Memory-Economic Continual Test-Time Model AdaptationPoster41 citations
- Meta Knowledge Condensation for Federated LearningPoster41 citations
- Unbiased Supervised Contrastive LearningPoster41 citations
- A Graph Neural Network Approach to Automated Model Building in Cryo-EM MapsPoster40 citations
- Causal Representation Learning for Instantaneous and Temporal Effects in Interactive SystemsPoster40 citations
- Competitive Physics Informed NetworksPoster40 citations
- Divide to Adapt: Mitigating Confirmation Bias for Domain Adaptation of Black-Box PredictorsTop-25%40 citations
- Edgeformers: Graph-Empowered Transformers for Representation Learning on Textual-Edge NetworksPoster40 citations
- ExpressivE: A Spatio-Functional Embedding For Knowledge Graph CompletionTop-25%40 citations
- Meta-learning Adaptive Deep Kernel Gaussian Processes for Molecular Property PredictionPoster40 citations
- Policy Pre-training for Autonomous Driving via Self-supervised Geometric ModelingPoster40 citations
- Programmatically Grounded, Compositionally Generalizable Robotic ManipulationTop-25%40 citations
- WiNeRT: Towards Neural Ray Tracing for Wireless Channel Modelling and Differentiable SimulationsPoster40 citations
- Active Learning for Object Detection with Evidential Deep Learning and Hierarchical Uncertainty AggregationPoster39 citations
- BrainBERT: Self-supervised representation learning for intracranial recordingsPoster39 citations
- Building a Subspace of Policies for Scalable Continual LearningTop-25%39 citations
- Causal Balancing for Domain GeneralizationPoster39 citations
- Implicit Bias of Large Depth Networks: a Notion of Rank for Nonlinear FunctionsTop-25%39 citations
- Learning Zero-Shot Cooperation with Humans, Assuming Humans Are BiasedPoster39 citations
- Making Substitute Models More Bayesian Can Enhance Transferability of Adversarial ExamplesPoster39 citations
- Multi-task Self-supervised Graph Neural Networks Enable Stronger Task GeneralizationPoster39 citations
- REVISITING PRUNING AT INITIALIZATION THROUGH THE LENS OF RAMANUJAN GRAPHTop-5%39 citations
- Revisiting Graph Adversarial Attack and Defense From a Data Distribution PerspectivePoster39 citations
- Rhino: Deep Causal Temporal Relationship Learning with History-dependent NoiseTop-25%39 citations
- A GNN-Guided Predict-and-Search Framework for Mixed-Integer Linear ProgrammingPoster38 citations
- Automated Data Augmentations for Graph ClassificationPoster38 citations
- Benchmarking Offline Reinforcement Learning on Real-Robot HardwareTop-25%38 citations
- CLARE: Conservative Model-Based Reward Learning for Offline Inverse Reinforcement LearningPoster38 citations
- Copy is All You NeedPoster38 citations
- Disentanglement of Correlated Factors via Hausdorff Factorized SupportPoster38 citations
- Efficient Deep Reinforcement Learning Requires Regulating OverfittingPoster38 citations
- Interpretable Geometric Deep Learning via Learnable Randomness InjectionPoster38 citations
- Learning Diffusion Bridges on Constrained DomainsTop-25%38 citations
- Multimodal Analogical Reasoning over Knowledge GraphsPoster38 citations
- Neural Causal Models for Counterfactual Identification and EstimationPoster38 citations
- Packed Ensembles for efficient uncertainty estimationTop-25%38 citations
- STUNT: Few-shot Tabular Learning with Self-generated Tasks from Unlabeled TablesTop-25%38 citations
- Searching Lottery Tickets in Graph Neural Networks: A Dual PerspectivePoster38 citations
- Soft Neighbors are Positive Supporters in Contrastive Visual Representation LearningPoster38 citations
- Unified Detoxifying and Debiasing in Language Generation via Inference-time Adaptive OptimizationPoster38 citations
- A General Framework for Sample-Efficient Function Approximation in Reinforcement LearningTop-25%37 citations
- Beyond calibration: estimating the grouping loss of modern neural networksPoster37 citations
- Deep Transformers without Shortcuts: Modifying Self-attention for Faithful Signal PropagationPoster37 citations
- Distilling Cognitive Backdoor Patterns within an ImagePoster37 citations
- Logical Message Passing Networks with One-hop Inference on Atomic FormulasPoster37 citations
- Multivariate Time-series Imputation with Disentangled Temporal RepresentationsPoster37 citations
- Neural Lagrangian Schr\"{o}dinger Bridge: Diffusion Modeling for Population DynamicsTop-25%37 citations
- Nonlinear Reconstruction for Operator Learning of PDEs with DiscontinuitiesTop-25%37 citations
- Towards Robust Object Detection Invariant to Real-World Domain ShiftsPoster37 citations
- DAG Matters! GFlowNets Enhanced Explainer for Graph Neural NetworksPoster36 citations
- Diversify and Disambiguate: Out-of-Distribution Robustness via DisagreementPoster36 citations
- EAGLE: Large-scale Learning of Turbulent Fluid Dynamics with Mesh TransformersPoster36 citations
- Exploring Active 3D Object Detection from a Generalization PerspectiveTop-25%36 citations
- GReTo: Remedying dynamic graph topology-task discordance via target homophilyPoster36 citations
- HomoDistil: Homotopic Task-Agnostic Distillation of Pre-trained TransformersPoster36 citations
- ISS: Image as Stepping Stone for Text-Guided 3D Shape GenerationTop-25%36 citations
- Long-Tailed Partial Label Learning via Dynamic RebalancingPoster36 citations
- MIMT: Masked Image Modeling Transformer for Video CompressionTop-25%36 citations
- Machine Unlearning of Federated ClustersPoster36 citations
- Rarity Score : A New Metric to Evaluate the Uncommonness of Synthesized ImagesTop-25%36 citations
- Universal Few-shot Learning of Dense Prediction Tasks with Visual Token MatchingTop-5%36 citations
- Which Layer is Learning Faster? A Systematic Exploration of Layer-wise Convergence Rate for Deep Neural NetworksPoster36 citations
- (Certified!!) Adversarial Robustness for Free!Poster35 citations
- A theoretical study of inductive biases in contrastive learningPoster35 citations
- An Adaptive Policy to Employ Sharpness-Aware MinimizationPoster35 citations
- Are More Layers Beneficial to Graph Transformers?Poster35 citations
- Canary in a Coalmine: Better Membership Inference with Ensembled Adversarial QueriesTop-25%35 citations
- DEP-RL: Embodied Exploration for Reinforcement Learning in Overactuated and Musculoskeletal SystemsTop-25%35 citations
- Disentanglement with Biological Constraints: A Theory of Functional Cell TypesTop-25%35 citations
- Equivariant Shape-Conditioned Generation of 3D Molecules for Ligand-Based Drug DesignPoster35 citations
- Fairness-aware Contrastive Learning with Partially Annotated Sensitive AttributesPoster35 citations
- Learning Math Reasoning from Self-Sampled Correct and Partially-Correct SolutionsPoster35 citations
- Learning differentiable solvers for systems with hard constraintsPoster35 citations
- Loss Landscapes are All You Need: Neural Network Generalization Can Be Explained Without the Implicit Bias of Gradient DescentTop-25%35 citations
- Meta Learning to Bridge Vision and Language Models for Multimodal Few-Shot LearningPoster35 citations
- Mitigating Memorization of Noisy Labels via Regularization between RepresentationsPoster35 citations
- No Reason for No Supervision: Improved Generalization in Supervised ModelsTop-25%35 citations
- Sparsity May Cry: Let Us Fail (Current) Sparse Neural Networks Together!Top-25%35 citations
- Sparsity-Constrained Optimal TransportTop-25%35 citations
- The Devil is in the Wrongly-classified Samples: Towards Unified Open-set RecognitionPoster35 citations
- Aligning Model and Macaque Inferior Temporal Cortex Representations Improves Model-to-Human Behavioral Alignment and Adversarial RobustnessTop-5%34 citations
- Backpropagation through Combinatorial Algorithms: Identity with Projection WorksPoster34 citations
- Compositional Prompt Tuning with Motion Cues for Open-vocabulary Video Relation DetectionPoster34 citations
- Compressing multidimensional weather and climate data into neural networksTop-5%34 citations
- Defending against Adversarial Audio via Diffusion ModelPoster34 citations
- Error Sensitivity Modulation based Experience Replay: Mitigating Abrupt Representation Drift in Continual LearningPoster34 citations
- FairGBM: Gradient Boosting with Fairness ConstraintsPoster34 citations
- Fake It Until You Make It : Towards Accurate Near-Distribution Novelty DetectionPoster34 citations
- Generating Diverse Cooperative Agents by Learning Incompatible PoliciesTop-25%34 citations
- Indiscriminate Poisoning Attacks on Unsupervised Contrastive LearningTop-25%34 citations
- Learning rigid dynamics with face interaction graph networksTop-25%34 citations
- Model-based Causal Bayesian OptimizationTop-25%34 citations
- NTK-SAP: Improving neural network pruning by aligning training dynamicsPoster34 citations
- Online Bias Correction for Task-Free Continual LearningPoster34 citations
- Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision ProcessesPoster34 citations
- Planning Goals for ExplorationTop-25%34 citations
- TANGOS: Regularizing Tabular Neural Networks through Gradient Orthogonalization and SpecializationPoster34 citations
- The Surprising Effectiveness of Equivariant Models in Domains with Latent SymmetryTop-25%34 citations
- $\mathrm{SE}(3)$-Equivariant Attention Networks for Shape Reconstruction in Function SpacePoster33 citations
- Adversarial Training of Self-supervised Monocular Depth Estimation against Physical-World AttacksTop-25%33 citations
- Benchmarking Constraint Inference in Inverse Reinforcement LearningPoster33 citations
- Betty: An Automatic Differentiation Library for Multilevel OptimizationTop-5%33 citations
- Composing Ensembles of Pre-trained Models via Iterative ConsensusPoster33 citations
- Data Valuation Without Training of a ModelPoster33 citations
- Investigating Multi-task Pretraining and Generalization in Reinforcement LearningPoster33 citations
- Learning to Estimate Shapley Values with Vision TransformersTop-25%33 citations
- LipsFormer: Introducing Lipschitz Continuity to Vision TransformersPoster33 citations
- Lossless Adaptation of Pretrained Vision Models For Robotic ManipulationPoster33 citations
- Neuro-Symbolic Procedural Planning with Commonsense PromptingTop-25%33 citations
- One-Pixel Shortcut: On the Learning Preference of Deep Neural NetworksTop-25%33 citations
- Perfectly Secure Steganography Using Minimum Entropy CouplingPoster33 citations
- Solving stochastic weak Minty variational inequalities without increasing batch sizePoster33 citations
- Spectral Decomposition Representation for Reinforcement LearningPoster33 citations
- Sub-Task Decomposition Enables Learning in Sequence to Sequence TasksPoster33 citations
- TabCaps: A Capsule Neural Network for Tabular Data Classification with BoW RoutingPoster33 citations
- Targeted Hyperparameter Optimization with Lexicographic Preferences Over Multiple ObjectivesTop-5%33 citations
- The Trade-off between Universality and Label Efficiency of Representations from Contrastive LearningTop-25%33 citations
- Toeplitz Neural Network for Sequence ModelingTop-25%33 citations
- Universal Vision-Language Dense Retrieval: Learning A Unified Representation Space for Multi-Modal RetrievalPoster33 citations
- FIGARO: Controllable Music Generation using Learned and Expert FeaturesPoster32 citations
- Optimal Transport for Offline Imitation LearningTop-25%32 citations
- Private Federated Learning Without a Trusted Server: Optimal Algorithms for Convex LossesPoster32 citations
- The Onset of Variance-Limited Behavior for Networks in the Lazy and Rich RegimesPoster32 citations
- When Data Geometry Meets Deep Function: Generalizing Offline Reinforcement LearningPoster32 citations
- AE-FLOW: Autoencoders with Normalizing Flows for Medical Images Anomaly DetectionPoster31 citations
- CO3: Cooperative Unsupervised 3D Representation Learning for Autonomous DrivingPoster31 citations
- Denoising Diffusion Error Correction CodesTop-25%31 citations
- Discovering Generalizable Multi-agent Coordination Skills from Multi-task Offline DataPoster31 citations
- ERL-Re$^2$: Efficient Evolutionary Reinforcement Learning with Shared State Representation and Individual Policy RepresentationPoster31 citations
- Emergence of Maps in the Memories of Blind Navigation AgentsTop-5%31 citations
- Partially Observable RL with B-Stability: Unified Structural Condition and Sharp Sample-Efficient AlgorithmsTop-25%31 citations
- Rethinking the Effect of Data Augmentation in Adversarial Contrastive LearningPoster31 citations
- Revisiting Robustness in Graph Machine LearningPoster31 citations
- SAM as an Optimal Relaxation of BayesTop-5%31 citations
- SketchKnitter: Vectorized Sketch Generation with Diffusion ModelsTop-25%31 citations
- Towards Open Temporal Graph Neural NetworksTop-5%31 citations
- Autoregressive Conditional Neural ProcessesPoster30 citations
- Become a Proficient Player with Limited Data through Watching Pure VideosPoster30 citations
- Boosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant NetworksPoster30 citations
- DBQ-SSD: Dynamic Ball Query for Efficient 3D Object DetectionPoster30 citations
- Decision S4: Efficient Sequence-Based RL via State Spaces LayersPoster30 citations
- Estimating individual treatment effects under unobserved confounding using binary instrumentsPoster30 citations
- Explicitly Minimizing the Blur Error of Variational AutoencodersPoster30 citations
- Fairness and Accuracy under Domain GeneralizationPoster30 citations
- Federated Neural BanditsPoster30 citations
- Hierarchical Relational Learning for Few-Shot Knowledge Graph CompletionPoster30 citations
- HyperDeepONet: learning operator with complex target function space using the limited resources via hypernetworkPoster30 citations
- MMVAE+: Enhancing the Generative Quality of Multimodal VAEs without CompromisesPoster30 citations
- Multi-Objective Reinforcement Learning: Convexity, Stationarity and Pareto OptimalityPoster30 citations
- ResAct: Reinforcing Long-term Engagement in Sequential Recommendation with Residual ActorPoster30 citations
- Robust Fair Clustering: A Novel Fairness Attack and Defense FrameworkPoster30 citations
- Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One ObjectivePoster30 citations
- Symmetric Pruning in Quantum Neural NetworksTop-25%30 citations
- Task Ambiguity in Humans and Language ModelsPoster30 citations
- The Influence of Learning Rule on Representation Dynamics in Wide Neural NetworksTop-25%30 citations
- TypeT5: Seq2seq Type Inference using Static AnalysisPoster30 citations
- Understanding Influence Functions and Datamodels via Harmonic AnalysisPoster30 citations
- Understanding Why Generalized Reweighting Does Not Improve Over ERMPoster30 citations
- A Unified Framework for Soft Threshold PruningPoster29 citations
- Avoiding spurious correlations via logit correctionPoster29 citations
- Backpropagation at the Infinitesimal Inference Limit of Energy-Based Models: Unifying Predictive Coding, Equilibrium Propagation, and Contrastive Hebbian LearningPoster29 citations
- Basic Binary Convolution Unit for Binarized Image Restoration NetworkPoster29 citations
- Disparate Impact in Differential Privacy from Gradient MisalignmentTop-25%29 citations
- FiT: Parameter Efficient Few-shot Transfer Learning for Personalized and Federated Image ClassificationPoster29 citations
- Hierarchical Sliced Wasserstein DistancePoster29 citations
- Incremental Learning of Structured Memory via Closed-Loop TranscriptionPoster29 citations
- Learning to Decompose Visual Features with Latent Textual PromptsPoster29 citations
- Learning to reason over visual objectsPoster29 citations
- Metadata Archaeology: Unearthing Data Subsets by Leveraging Training DynamicsTop-25%29 citations
- MocoSFL: enabling cross-client collaborative self-supervised learningTop-5%29 citations
- On the Sensitivity of Reward Inference to Misspecified Human ModelsTop-5%29 citations
- Order Matters: Agent-by-agent Policy OptimizationPoster29 citations
- PerFedMask: Personalized Federated Learning with Optimized Masking VectorsPoster29 citations
- Provably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst PathPoster29 citations
- SoftZoo: A Soft Robot Co-design Benchmark For Locomotion In Diverse EnvironmentsPoster29 citations
- The Asymmetric Maximum Margin Bias of Quasi-Homogeneous Neural NetworksTop-25%29 citations
- TrojText: Test-time Invisible Textual Trojan InsertionPoster29 citations
- Visually-Augmented Language ModelingPoster29 citations
- Why (and When) does Local SGD Generalize Better than SGD?Poster29 citations
- Your Contrastive Learning Is Secretly Doing Stochastic Neighbor EmbeddingPoster29 citations
- Contrastive Learning Can Find An Optimal Basis For Approximately View-Invariant FunctionsPoster28 citations
- DiffusER: Diffusion via Edit-based ReconstructionPoster28 citations
- Diffusion Probabilistic FieldsPoster28 citations
- From $t$-SNE to UMAP with contrastive learningPoster28 citations
- Harnessing Mixed Offline Reinforcement Learning Datasets via Trajectory WeightingPoster28 citations
- Hyperbolic Deep Reinforcement LearningTop-25%28 citations
- Learning Soft Constraints From Constrained Expert DemonstrationsTop-25%28 citations
- Modeling the Data-Generating Process is Necessary for Out-of-Distribution GeneralizationTop-25%28 citations
- On amortizing convex conjugates for optimal transportPoster28 citations
- Provable Memorization Capacity of TransformersPoster28 citations
- Representational Dissimilarity Metric Spaces for Stochastic Neural NetworksPoster28 citations
- Scaling Laws for a Multi-Agent Reinforcement Learning ModelPoster28 citations
- Scaling Up Probabilistic Circuits by Latent Variable DistillationTop-5%28 citations
- Stochastic Multi-Person 3D Motion ForecastingTop-25%28 citations
- Transformer-based model for symbolic regression via joint supervised learningPoster28 citations
- What Can we Learn From The Selective Prediction And Uncertainty Estimation Performance Of 523 Imagenet Classifiers?Poster28 citations
- f-DM: A Multi-stage Diffusion Model via Progressive Signal TransformationPoster28 citations
- Achieve the Minimum Width of Neural Networks for Universal ApproximationPoster27 citations
- AutoGT: Automated Graph Transformer Architecture SearchTop-5%27 citations
- CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled VideosPoster27 citations
- Can We Faithfully Represent Absence States to Compute Shapley Values on a DNN?Poster27 citations
- Deja Vu: Continual Model Generalization for Unseen DomainsPoster27 citations
- Denoising Masked Autoencoders Help Robust ClassificationPoster27 citations
- HotProtein: A Novel Framework for Protein Thermostability Prediction and EditingPoster27 citations
- Is Adversarial Training Really a Silver Bullet for Mitigating Data Poisoning?Top-25%27 citations
- LS-IQ: Implicit Reward Regularization for Inverse Reinforcement LearningPoster27 citations
- Learning where and when to reason in neuro-symbolic inferenceTop-5%27 citations
- Rethinking Graph Lottery Tickets: Graph Sparsity MattersPoster27 citations
- STREET: A MULTI-TASK STRUCTURED REASONING AND EXPLANATION BENCHMARKTop-25%27 citations
- Solving Continuous Control via Q-learningPoster27 citations
- Unified Discrete Diffusion for Simultaneous Vision-Language GenerationPoster27 citations
- Bias Propagation in Federated LearningPoster26 citations
- Delving into Semantic Scale ImbalancePoster26 citations
- Guiding continuous operator learning through Physics-based boundary constraintsPoster26 citations
- Learning topology-preserving data representationsPoster26 citations
- Mind the Gap: Offline Policy Optimization for Imperfect RewardsPoster26 citations
- Multifactor Sequential Disentanglement via Structured Koopman AutoencodersTop-25%26 citations
- Replicable BanditsPoster26 citations
- Simplicial Hopfield networksPoster26 citations
- Stable Target Field for Reduced Variance Score Estimation in Diffusion ModelsPoster26 citations
- Temporal Dependencies in Feature Importance for Time Series PredictionPoster26 citations
- The Power of Regularization in Solving Extensive-Form GamesPoster26 citations
- Transformer Meets Boundary Value Inverse ProblemsPoster26 citations
- CANIFE: Crafting Canaries for Empirical Privacy Measurement in Federated LearningPoster25 citations
- Does Learning from Decentralized Non-IID Unlabeled Data Benefit from Self Supervision?Poster25 citations
- ESCHER: Eschewing Importance Sampling in Games by Computing a History Value Function to Estimate RegretPoster25 citations
- Efficient recurrent architectures through activity sparsity and sparse back-propagation through timeTop-25%25 citations
- Fair Attribute Completion on Graph with Missing AttributesPoster25 citations
- Latent Graph Inference using Product ManifoldsPoster25 citations
- Link Prediction with Non-Contrastive LearningPoster25 citations
- Measuring axiomatic soundness of counterfactual image modelsPoster25 citations
- NTFields: Neural Time Fields for Physics-Informed Robot Motion PlanningTop-25%25 citations
- NeRN: Learning Neural Representations for Neural NetworksTop-25%25 citations
- Neuroevolution is a Competitive Alternative to Reinforcement Learning for Skill DiscoveryTop-25%25 citations
- On the Saturation Effect of Kernel Ridge RegressionPoster25 citations
- Predictive Inference with Feature Conformal PredictionPoster25 citations
- SIMPLE: A Gradient Estimator for k-Subset SamplingPoster25 citations
- Towards Better Selective ClassificationPoster25 citations
- Unsupervised Meta-learning via Few-shot Pseudo-supervised Contrastive LearningTop-25%25 citations
- Voint Cloud: Multi-View Point Cloud Representation for 3D UnderstandingPoster25 citations
- What shapes the loss landscape of self supervised learning?Poster25 citations
- A Closer Look at Model Adaptation using Feature Distortion and Simplicity BiasTop-25%24 citations
- Choreographer: Learning and Adapting Skills in ImaginationTop-25%24 citations
- Continuous-time identification of dynamic state-space models by deep subspace encodingPoster24 citations
- DaxBench: Benchmarking Deformable Object Manipulation with Differentiable PhysicsTop-5%24 citations
- Deconstructing Distributions: A Pointwise Framework of LearningPoster24 citations
- Deep Learning From Crowdsourced Labels: Coupled Cross-Entropy Minimization, Identifiability, and RegularizationPoster24 citations
- Dual Algorithmic ReasoningTop-25%24 citations
- Evaluating Long-Term Memory in 3D MazesPoster24 citations
- Function-Consistent Feature DistillationPoster24 citations
- IDEAL: Query-Efficient Data-Free Learning from Black-Box ModelsPoster24 citations
- Image to Sphere: Learning Equivariant Features for Efficient Pose PredictionTop-5%24 citations
- Kernel Neural Optimal TransportPoster24 citations
- Learnable Graph Convolutional Attention NetworksPoster24 citations
- Learning What and Where: Disentangling Location and Identity Tracking Without SupervisionPoster24 citations
- ManyDG: Many-domain Generalization for Healthcare ApplicationsPoster24 citations
- Memory Gym: Partially Observable Challenges to Memory-Based AgentsPoster24 citations
- Modelling Long Range Dependencies in $N$D: From Task-Specific to a General Purpose CNNPoster24 citations
- Multi-domain image generation and translation with identifiability guaranteesTop-25%24 citations
- Online Boundary-Free Continual Learning by Scheduled Data PriorPoster24 citations
- Protein Representation Learning via Knowledge Enhanced Primary Structure ReasoningPoster24 citations
- Re-weighting Based Group Fairness Regularization via Classwise Robust OptimizationPoster24 citations
- Sampling-based inference for large linear models, with application to linearised LaplacePoster24 citations
- Self-Supervised Geometric Correspondence for Category-Level 6D Object Pose Estimation in the WildPoster24 citations
- Suppressing the Heterogeneity: A Strong Feature Extractor for Few-shot SegmentationPoster24 citations
- Tailoring Language Generation Models under Total Variation DistanceTop-5%24 citations
- Agent-based Graph Neural NetworksPoster23 citations
- Alternating Differentiation for Optimization LayersPoster23 citations
- Asynchronous Distributed Bilevel OptimizationPoster23 citations
- BSTT: A Bayesian Spatial-Temporal Transformer for Sleep StagingPoster23 citations
- Causality Compensated Attention for Contextual Biased Visual RecognitionPoster23 citations
- Characterizing the Influence of Graph ElementsPoster23 citations
- Confidence-Conditioned Value Functions for Offline Reinforcement LearningTop-5%23 citations
- Dual Student Networks for Data-Free Model StealingPoster23 citations
- Efficiently Computing Nash Equilibria in Adversarial Team Markov GamesTop-5%23 citations
- First Steps Toward Understanding the Extrapolation of Nonlinear Models to Unseen DomainsPoster23 citations
- Implicit regularization in Heavy-ball momentum accelerated stochastic gradient descentTop-25%23 citations
- Layer Grafted Pre-training: Bridging Contrastive Learning And Masked Image Modeling For Label-Efficient RepresentationsPoster23 citations
- Learning Multimodal Data Augmentation in Feature SpacePoster23 citations
- Learning to CROSS exchange to solve min-max vehicle routing problemsPoster23 citations
- Lower Bounds on the Depth of Integral ReLU Neural Networks via Lattice PolytopesPoster23 citations
- Maximizing Communication Efficiency for Large-scale Training via 0/1 AdamPoster23 citations
- Mitigating Dataset Bias by Using Per-Sample GradientPoster23 citations
- On the Effectiveness of Out-of-Distribution Data in Self-Supervised Long-Tail Learning.Poster23 citations
- Progressive Voronoi Diagram Subdivision Enables Accurate Data-free Class-Incremental LearningPoster23 citations
- Self-Ensemble Protection: Training Checkpoints Are Good Data ProtectorsPoster23 citations
- Symmetries, Flat Minima, and the Conserved Quantities of Gradient FlowPoster23 citations
- Temporal Disentanglement of Representations for Improved Generalisation in Reinforcement LearningPoster23 citations
- Towards Addressing Label Skews in One-Shot Federated LearningPoster23 citations
- Towards Understanding Why Mask Reconstruction Pretraining Helps in Downstream TasksPoster23 citations
- Unsupervised Learning for Combinatorial Optimization Needs Meta LearningPoster23 citations
- Weighted Ensemble Self-Supervised LearningPoster23 citations
- $O(T^{-1})$ Convergence of Optimistic-Follow-the-Regularized-Leader in Two-Player Zero-Sum Markov GamesPoster22 citations
- $\Lambda$-DARTS: Mitigating Performance Collapse by Harmonizing Operation Selection among CellsPoster22 citations
- A CMDP-within-online framework for Meta-Safe Reinforcement LearningTop-25%22 citations
- Actionable Neural Representations: Grid Cells from Minimal ConstraintsPoster22 citations
- ChordMixer: A Scalable Neural Attention Model for Sequences with Different LengthPoster22 citations
- CoRTX: Contrastive Framework for Real-time ExplanationPoster22 citations
- Confidential-PROFITT: Confidential PROof of FaIr Training of TreesTop-5%22 citations
- Contextual Image Masking Modeling via Synergized Contrasting without View Augmentation for Faster and Better Visual PretrainingPoster22 citations
- Decompositional Generation Process for Instance-Dependent Partial Label LearningTop-25%22 citations
- DexDeform: Dexterous Deformable Object Manipulation with Human Demonstrations and Differentiable PhysicsPoster22 citations
- Distributionally Robust Post-hoc Classifiers under Prior ShiftsPoster22 citations
- Dr.Spider: A Diagnostic Evaluation Benchmark towards Text-to-SQL RobustnessTop-5%22 citations
- Efficient Edge Inference by Selective QueryPoster22 citations
- Fantastic Rewards and How to Tame Them: A Case Study on Reward Learning for Task-oriented Dialogue SystemsPoster22 citations
- Faster federated optimization under second-order similarityPoster22 citations
- Guiding Energy-based Models via Contrastive Latent VariablesTop-25%22 citations
- Learnable Topological Features For Phylogenetic Inference via Graph Neural NetworksPoster22 citations
- Learning Controllable Adaptive Simulation for Multi-resolution PhysicsTop-25%22 citations
- Learning to Extrapolate: A Transductive ApproachPoster22 citations
- Meta-Learning in GamesPoster22 citations
- More Centralized Training, Still Decentralized Execution: Multi-Agent Conditional Policy FactorizationPoster22 citations
- Over-Training with Mixup May Hurt GeneralizationPoster22 citations
- PASHA: Efficient HPO and NAS with Progressive Resource AllocationPoster22 citations
- PandA: Unsupervised Learning of Parts and Appearances in the Feature Maps of GANsPoster22 citations
- Particle-based Variational Inference with Preconditioned Functional Gradient FlowPoster22 citations
- PatchDCT: Patch Refinement for High Quality Instance SegmentationPoster22 citations
- Quality-Similar Diversity via Population Based Reinforcement LearningPoster22 citations
- Robust Explanation Constraints for Neural NetworksPoster22 citations
- SWIFT: Rapid Decentralized Federated Learning via Wait-Free Model CommunicationPoster22 citations
- Scaling Pareto-Efficient Decision Making via Offline Multi-Objective RLPoster22 citations
- Self-Guided Noise-Free Data Generation for Efficient Zero-Shot LearningTop-25%22 citations
- Softened Symbol Grounding for Neuro-symbolic SystemsPoster22 citations
- Task-Aware Information Routing from Common Representation Space in Lifelong LearningPoster22 citations
- TextGrad: Advancing Robustness Evaluation in NLP by Gradient-Driven OptimizationPoster22 citations
- Towards a Unified Theoretical Understanding of Non-contrastive Learning via Rank Differential MechanismPoster22 citations
- VoGE: A Differentiable Volume Renderer using Gaussian Ellipsoids for Analysis-by-SynthesisPoster22 citations
- CLIP-ViP: Adapting Pre-trained Image-Text Model to Video-Language AlignmentPoster21 citations
- Certifiably Robust Policy Learning against Adversarial Multi-Agent CommunicationPoster21 citations
- Chasing All-Round Graph Representation Robustness: Model, Training, and OptimizationPoster21 citations
- Compositional Task Representations for Large Language ModelsPoster21 citations
- Confidence-Based Feature Imputation for Graphs with Partially Known FeaturesPoster21 citations
- Effective passive membership inference attacks in federated learning against overparameterized modelsPoster21 citations
- Energy-Based Test Sample Adaptation for Domain GeneralizationPoster21 citations
- Federated Learning as Variational Inference: A Scalable Expectation Propagation ApproachPoster21 citations
- Few-shot Backdoor Attacks via Neural Tangent KernelsPoster21 citations
- GAMR: A Guided Attention Model for (visual) ReasoningPoster21 citations
- GPViT: A High Resolution Non-Hierarchical Vision Transformer with Group PropagationTop-25%21 citations
- Guess the Instruction! Flipped Learning Makes Language Models Stronger Zero-Shot LearnersPoster21 citations
- How robust is unsupervised representation learning to distribution shift?Poster21 citations
- Imbalanced Semi-supervised Learning with Bias Adaptive ClassifierPoster21 citations
- LDMIC: Learning-based Distributed Multi-view Image CodingPoster21 citations
- Learning Vortex Dynamics for Fluid Inference and PredictionPoster21 citations
- Learning with Logical Constraints but without Shortcut SatisfactionTop-25%21 citations
- Multi-Rate VAE: Train Once, Get the Full Rate-Distortion CurveTop-5%21 citations
- SMART: Sentences as Basic Units for Text EvaluationPoster21 citations
- Sample Complexity of Nonparametric Off-Policy Evaluation on Low-Dimensional Manifolds using Deep NetworksPoster21 citations
- Simple and Scalable Nearest Neighbor Machine TranslationPoster21 citations
- Simplicial Embeddings in Self-Supervised Learning and Downstream ClassificationTop-25%21 citations
- SmartFRZ: An Efficient Training Framework using Attention-Based Layer FreezingTop-25%21 citations
- Task-customized Masked Autoencoder via Mixture of Cluster-conditional ExpertsTop-25%21 citations
- Training language models to summarize narratives improves brain alignmentTop-25%21 citations
- Transfer NAS with Meta-learned Bayesian SurrogatesTop-5%21 citations
- Uniform-in-time propagation of chaos for the mean-field gradient Langevin dynamicsPoster21 citations
- Unsupervised visualization of image datasets using contrastive learningPoster21 citations
- Where to Diffuse, How to Diffuse, and How to Get Back: Automated Learning for Multivariate DiffusionsPoster21 citations
- Words are all you need? Language as an approximation for human similarity judgmentsPoster21 citations
- A Message Passing Perspective on Learning Dynamics of Contrastive LearningPoster20 citations
- Bayes-MIL: A New Probabilistic Perspective on Attention-based Multiple Instance Learning for Whole Slide ImagesPoster20 citations
- Bispectral Neural NetworksPoster20 citations
- CFlowNets: Continuous Control with Generative Flow NetworksPoster20 citations
- Conservative Bayesian Model-Based Value Expansion for Offline Policy OptimizationPoster20 citations
- Domain-Indexing Variational Bayes: Interpretable Domain Index for Domain AdaptationTop-25%20 citations
- Efficient Conditionally Invariant Representation LearningTop-5%20 citations
- Explaining Temporal Graph Models through an Explorer-Navigator FrameworkPoster20 citations
- GOOD: Exploring geometric cues for detecting objects in an open worldPoster20 citations
- How Much Space Has Been Explored? Measuring the Chemical Space Covered by Databases and Machine-Generated MoleculesPoster20 citations
- Improved Convergence of Differential Private SGD with Gradient ClippingPoster20 citations
- Instance-wise Batch Label Restoration via Gradients in Federated LearningPoster20 citations
- Joint Edge-Model Sparse Learning is Provably Efficient for Graph Neural NetworksPoster20 citations
- Knowledge-in-Context: Towards Knowledgeable Semi-Parametric Language ModelsTop-25%20 citations
- KwikBucks: Correlation Clustering with Cheap-Weak and Expensive-Strong SignalsPoster20 citations
- LMSeg: Language-guided Multi-dataset SegmentationPoster20 citations
- Latent Bottlenecked Attentive Neural ProcessesPoster20 citations
- Learning Hyper Label Model for Programmatic Weak SupervisionPoster20 citations
- Learning the Positions in CountSketchTop-25%20 citations
- MixPro: Data Augmentation with MaskMix and Progressive Attention Labeling for Vision TransformerPoster20 citations
- Near-optimal Coresets for Robust ClusteringTop-5%20 citations
- On the Trade-Off between Actionable Explanations and the Right to be ForgottenPoster20 citations
- Preserving Pre-trained Features Helps Calibrate Fine-tuned Language ModelsPoster20 citations
- RLx2: Training a Sparse Deep Reinforcement Learning Model from ScratchTop-25%20 citations
- Sampling-free Inference for Ab-Initio Potential Energy Surface NetworksPoster20 citations
- Self-Supervised Category-Level Articulated Object Pose Estimation with Part-Level SE(3) EquivariancePoster20 citations
- Share Your Representation Only: Guaranteed Improvement of the Privacy-Utility Tradeoff in Federated LearningPoster20 citations
- Sparse Distributed Memory is a Continual LearnerPoster20 citations
- Spatial Attention Kinetic Networks with E(n)-EquivariancePoster20 citations
- Using Both Demonstrations and Language Instructions to Efficiently Learn Robotic TasksPoster20 citations
- View Synthesis with Sculpted Neural PointsTop-5%20 citations
- WikiWhy: Answering and Explaining Cause-and-Effect QuestionsTop-5%20 citations
- $\mathscr{N}$-WL: A New Hierarchy of Expressivity for Graph Neural NetworksPoster19 citations
- A Theoretical Framework for Inference and Learning in Predictive Coding NetworksPoster19 citations
- Adversarial Diversity in HanabiTop-25%19 citations
- Beyond Lipschitz: Sharp Generalization and Excess Risk Bounds for Full-Batch GDPoster19 citations
- Bi-level Physics-Informed Neural Networks for PDE Constrained Optimization using Broyden's HypergradientsPoster19 citations
- Certified Defences Against Adversarial Patch Attacks on Semantic SegmentationPoster19 citations
- Concept Gradient: Concept-based Interpretation Without Linear AssumptionPoster19 citations
- DCI-ES: An Extended Disentanglement Framework with Connections to IdentifiabilityPoster19 citations
- Easy Differentially Private Linear RegressionPoster19 citations
- Efficiently Controlling Multiple Risks with Pareto TestingPoster19 citations
- Encoding Recurrence into TransformersTop-5%19 citations
- FIFA: Making Fairness More Generalizable in Classifiers Trained on Imbalanced DataPoster19 citations
- Hidden Markov Transformer for Simultaneous Machine TranslationTop-25%19 citations
- Improved Training of Physics-Informed Neural Networks Using Energy-Based Priors: a Study on Electrical Impedance TomographyPoster19 citations
- Learning Probabilistic Topological Representations Using Discrete Morse TheoryTop-25%19 citations
- Learning a Data-Driven Policy Network for Pre-Training Automated Feature EngineeringTop-25%19 citations
- Learning multi-scale local conditional probability models of imagesTop-25%19 citations
- Meta Temporal Point ProcessesPoster19 citations
- Neural Architecture Design and Robustness: A DatasetPoster19 citations
- Neural Image-based Avatars: Generalizable Radiance Fields for Human Avatar ModelingPoster19 citations
- Offline Reinforcement Learning with Differentiable Function Approximation is Provably EfficientPoster19 citations
- Ollivier-Ricci Curvature for Hypergraphs: A Unified FrameworkPoster19 citations
- Patch-Level Contrasting without Patch Correspondence for Accurate and Dense Contrastive Representation LearningPoster19 citations
- ROCO: A General Framework for Evaluating Robustness of Combinatorial Optimization Solvers on GraphsPoster19 citations
- Scaling Laws For Deep Learning Based Image ReconstructionPoster19 citations
- Summarization Programs: Interpretable Abstractive Summarization with Neural Modular TreesPoster19 citations
- Understanding Embodied Reference with Touch-Line TransformerPoster19 citations
- Win: Weight-Decay-Integrated Nesterov Acceleration for Adaptive Gradient AlgorithmsTop-5%19 citations
- Write and Paint: Generative Vision-Language Models are Unified Modal LearnersPoster19 citations
- A General Framework For Proving The Equivariant Strong Lottery Ticket HypothesisPoster18 citations
- A Primal-Dual Framework for Transformers and Neural NetworksTop-25%18 citations
- Accelerating Guided Diffusion Sampling with Splitting Numerical MethodsPoster18 citations
- Computational Language Acquisition with Theory of MindPoster18 citations
- Computing all Optimal Partial TransportsPoster18 citations
- Consolidator: Mergable Adapter with Group Connections for Visual AdaptationPoster18 citations
- Deep Learning meets Nonparametric Regression: Are Weight-Decayed DNNs Locally Adaptive?Poster18 citations
- Discrete Predictor-Corrector Diffusion Models for Image SynthesisPoster18 citations
- Evolve Smoothly, Fit Consistently: Learning Smooth Latent Dynamics For Advection-Dominated SystemsTop-25%18 citations
- Generalization Bounds for Federated Learning: Fast Rates, Unparticipating Clients and Unbounded LossesPoster18 citations
- Individual Privacy Accounting with Gaussian Differential PrivacyPoster18 citations
- Is Forgetting Less a Good Inductive Bias for Forward Transfer?Poster18 citations
- Learning to Segment from Noisy Annotations: A Spatial Correction ApproachPoster18 citations
- Noise-Robust De-Duplication at ScalePoster18 citations
- On Pre-training Language Model for AntibodyPoster18 citations
- PV3D: A 3D Generative Model for Portrait Video GenerationPoster18 citations
- Parallel Deep Neural Networks Have Zero Duality GapPoster18 citations
- PowerQuant: Automorphism Search for Non-Uniform QuantizationPoster18 citations
- Provable Defense Against Geometric TransformationsTop-25%18 citations
- Recursive Time Series Data AugmentationPoster18 citations
- Revisiting adapters with adversarial trainingTop-25%18 citations
- Robust Multivariate Time-Series Forecasting: Adversarial Attacks and Defense MechanismsPoster18 citations
- Rotamer Density Estimator is an Unsupervised Learner of the Effect of Mutations on Protein-Protein InteractionPoster18 citations
- Sampling with Mollified Interaction Energy DescentPoster18 citations
- Towards One-shot Neural Combinatorial Solvers: Theoretical and Empirical Notes on the Cardinality-Constrained CasePoster18 citations
- Active Image IndexingPoster17 citations
- Decoupled Training for Long-Tailed Classification With Stochastic RepresentationsPoster17 citations
- Deep Reinforcement Learning for Cost-Effective Medical DiagnosisPoster17 citations
- DiffMimic: Efficient Motion Mimicking with Differentiable PhysicsPoster17 citations
- Distributed Differential Privacy in Multi-Armed BanditsPoster17 citations
- Eva: Practical Second-order Optimization with Kronecker-vectorized ApproximationPoster17 citations
- Evidential Uncertainty and Diversity Guided Active Learning for Scene Graph GenerationPoster17 citations
- Forward Super-Resolution: How Can GANs Learn Hierarchical Generative Models for Real-World DistributionsPoster17 citations
- Generalizing and Decoupling Neural Collapse via Hyperspherical Uniformity GapPoster17 citations
- How to prepare your task head for finetuningPoster17 citations
- Information-Theoretic Analysis of Unsupervised Domain AdaptationPoster17 citations
- Information-Theoretic DiffusionPoster17 citations
- Interactive Portrait HarmonizationPoster17 citations
- Koopman Neural Operator Forecaster for Time-series with Temporal Distributional ShiftsPoster17 citations
- Latent Neural ODEs with Sparse Bayesian Multiple ShootingPoster17 citations
- Learnable Behavior Control: Breaking Atari Human World Records via Sample-Efficient Behavior SelectionTop-5%17 citations
- Learning About Progress From ExpertsTop-25%17 citations
- Learning Harmonic Molecular Representations on Riemannian ManifoldPoster17 citations
- New Insights for the Stability-Plasticity Dilemma in Online Continual LearningPoster17 citations
- PGrad: Learning Principal Gradients For Domain GeneralizationPoster17 citations
- Proactive Multi-Camera Collaboration for 3D Human Pose EstimationPoster17 citations
- Regression with Label Differential PrivacyPoster17 citations
- Risk-Aware Reinforcement Learning with Coherent Risk Measures and Non-linear Function ApproximationPoster17 citations
- Safe Reinforcement Learning From Pixels Using a Stochastic Latent RepresentationPoster17 citations
- Stochastic Differentially Private and Fair LearningPoster17 citations
- Temporal Coherent Test Time Optimization for Robust Video ClassificationPoster17 citations
- The Provable Benefit of Unsupervised Data Sharing for Offline Reinforcement LearningPoster17 citations
- Why adversarial training can hurt robust accuracyPoster17 citations
- A Mixture-of-Expert Approach to RL-based Dialogue ManagementPoster16 citations
- Bridge the Inference Gaps of Neural Processes via Expectation MaximizationPoster16 citations
- ChiroDiff: Modelling chirographic data with Diffusion ModelsPoster16 citations
- Decision Transformer under Random Frame DroppingPoster16 citations
- DualAfford: Learning Collaborative Visual Affordance for Dual-gripper ManipulationPoster16 citations
- Efficient Attention via Control VariatesTop-5%16 citations
- EquiMod: An Equivariance Module to Improve Visual Instance DiscriminationPoster16 citations
- ImaginaryNet: Learning Object Detectors without Real Images and AnnotationsPoster16 citations
- Impossibly Good Experts and How to Follow ThemPoster16 citations
- Is Model Ensemble Necessary? Model-based RL via a Single Model with Lipschitz Regularized Value FunctionPoster16 citations
- Learning ReLU networks to high uniform accuracy is intractablePoster16 citations
- Model ensemble instead of prompt fusion: a sample-specific knowledge transfer method for few-shot prompt tuningPoster16 citations
- Revisiting Intrinsic Reward for Exploration in Procedurally Generated EnvironmentsPoster16 citations
- Single-shot General Hyper-parameter Optimization for Federated LearningTop-25%16 citations
- Systematic Rectification of Language Models via Dead-end AnalysisPoster16 citations
- Time to augment self-supervised visual representation learningPoster16 citations
- Towards Smooth Video CompositionPoster16 citations
- Valid P-Value for Deep Learning-driven Salient RegionPoster16 citations
- A Stable and Scalable Method for Solving Initial Value PDEs with Neural NetworksPoster15 citations
- AANG : Automating Auxiliary LearningTop-25%15 citations
- Accurate Neural Training with 4-bit Matrix Multiplications at Standard FormatsPoster15 citations
- Addressing Parameter Choice Issues in Unsupervised Domain Adaptation by AggregationTop-5%15 citations
- Cross-Layer Retrospective Retrieving via Layer AttentionPoster15 citations
- DAVA: Disentangling Adversarial Variational AutoencoderPoster15 citations
- Don’t fear the unlabelled: safe semi-supervised learning via debiasingPoster15 citations
- Exploring The Role of Mean Teachers in Self-supervised Masked Auto-EncodersPoster15 citations
- Feature selection and low test error in shallow low-rotation ReLU networksPoster15 citations
- Few-shot Cross-domain Image Generation via Inference-time Latent-code LearningTop-25%15 citations
- Fundamental Limits in Formal Verification of Message-Passing Neural NetworksPoster15 citations
- Gromov-Wasserstein AutoencodersPoster15 citations
- Is a Caption Worth a Thousand Images? A Study on Representation LearningPoster15 citations
- Is the Performance of My Deep Network Too Good to Be True? A Direct Approach to Estimating the Bayes Error in Binary ClassificationTop-5%15 citations
- Mutual Partial Label Learning with Competitive Label NoisePoster15 citations
- On The Specialization of Neural ModulesPoster15 citations
- Planckian Jitter: countering the color-crippling effects of color jitter on self-supervised trainingPoster15 citations
- Random Laplacian Features for Learning with Hyperbolic SpacePoster15 citations
- Self-supervision through Random Segments with Autoregressive Coding (RandSAC)Poster15 citations
- Static Prediction of Runtime Errors by Learning to Execute Programs with External Resource DescriptionsPoster15 citations
- Strategic Classification with Graph Neural NetworksPoster15 citations
- The Tilted Variational Autoencoder: Improving Out-of-Distribution DetectionPoster15 citations
- Towards Robustness Certification Against Universal PerturbationsPoster15 citations
- User-Interactive Offline Reinforcement LearningPoster15 citations
- Weakly-supervised HOI Detection via Prior-guided Bi-level Representation LearningPoster15 citations
- Zeroth-Order Optimization with Trajectory-Informed Derivative EstimationPoster15 citations
- $\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural NetworksPoster14 citations
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.