ICLR 2024 Accepted Papers
The full list of 2,260 papers accepted at ICLR 2024 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,807Spotlight: 367Oral: 86
- MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language ModelsPoster2,918 citations
- SDXL: Improving Latent Diffusion Models for High-Resolution Image SynthesisSpotlight2,203 citations
- FlashAttention-2: Faster Attention with Better Parallelism and Work PartitioningPoster1,041 citations
- iTransformer: Inverted Transformers Are Effective for Time Series ForecastingSpotlight912 citations
- Let's Verify Step by StepPoster888 citations
- MetaGPT: Meta Programming for A Multi-Agent Collaborative FrameworkOral872 citations
- AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific TuningSpotlight832 citations
- Large Language Models as OptimizersPoster811 citations
- WizardCoder: Empowering Code Large Language Models with Evol-InstructPoster661 citations
- ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIsSpotlight639 citations
- DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content CreationOral636 citations
- Teaching Large Language Models to Self-DebugPoster636 citations
- MVDream: Multi-view Diffusion for 3D GenerationPoster630 citations
- MetaMath: Bootstrap Your Own Mathematical Questions for Large Language ModelsSpotlight613 citations
- Efficient Streaming Language Models with Attention SinksPoster598 citations
- A Simple and Effective Pruning Approach for Large Language ModelsPoster582 citations
- Time-LLM: Time Series Forecasting by Reprogramming Large Language ModelsPoster577 citations
- Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!Oral564 citations
- PixArt-$\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image SynthesisSpotlight546 citations
- MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual ContextsOral541 citations
- Self-RAG: Learning to Retrieve, Generate, and Critique through Self-ReflectionOral517 citations
- AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language ModelsPoster508 citations
- SWE-bench: Can Language Models Resolve Real-world Github Issues?Oral500 citations
- ChatEval: Towards Better LLM-based Evaluators through Multi-Agent DebatePoster461 citations
- Large Language Models Cannot Self-Correct Reasoning YetPoster431 citations
- LRM: Large Reconstruction Model for Single Image to 3DOral411 citations
- Eureka: Human-Level Reward Design via Coding Large Language ModelsPoster380 citations
- MiniLLM: Knowledge Distillation of Large Language ModelsPoster375 citations
- WebArena: A Realistic Web Environment for Building Autonomous AgentsPoster363 citations
- LongLoRA: Efficient Fine-tuning of Long-Context Large Language ModelsOral360 citations
- Vision Transformers Need RegistersOral360 citations
- Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion PriorsPoster356 citations
- Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMsPoster355 citations
- YaRN: Efficient Context Window Extension of Large Language ModelsPoster352 citations
- CRITIC: Large Language Models Can Self-Correct with Tool-Interactive CritiquingPoster347 citations
- AgentVerse: Facilitating Multi-Agent Collaboration and Exploring Emergent BehaviorsPoster335 citations
- MAmmoTH: Building Math Generalist Models through Hybrid Instruction TuningSpotlight332 citations
- Llemma: An Open Language Model for MathematicsPoster320 citations
- Safe RLHF: Safe Reinforcement Learning from Human FeedbackSpotlight320 citations
- Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formattingPoster318 citations
- DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language ModelsPoster314 citations
- Training Diffusion Models with Reinforcement LearningPoster303 citations
- Ferret: Refer and Ground Anything Anywhere at Any GranularitySpotlight300 citations
- Language Model Beats Diffusion - Tokenizer is key to visual generationPoster296 citations
- InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and GenerationSpotlight295 citations
- Catastrophic Jailbreak of Open-source LLMs via Exploiting GenerationSpotlight292 citations
- Detecting Pretraining Data from Large Language ModelsPoster287 citations
- SALMONN: Towards Generic Hearing Abilities for Large Language ModelsPoster286 citations
- Effective Data Augmentation With Diffusion ModelsPoster284 citations
- Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge GraphPoster275 citations
- ControlVideo: Training-free Controllable Text-to-video GenerationPoster271 citations
- Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction TuningPoster270 citations
- Sheared LLaMA: Accelerating Language Model Pre-training via Structured PruningPoster270 citations
- Emu: Generative Pretraining in MultimodalityPoster269 citations
- DNABERT-2: Efficient Foundation Model and Benchmark For Multi-Species GenomesPoster262 citations
- NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing SynthesizersSpotlight260 citations
- Sparse Autoencoders Find Highly Interpretable Features in Language ModelsPoster257 citations
- Universal Guidance for Diffusion ModelsPoster257 citations
- Instant3D: Fast Text-to-3D with Sparse-view Generation and Large Reconstruction ModelPoster250 citations
- Real-time Photorealistic Dynamic Scene Representation and Rendering with 4D Gaussian SplattingPoster248 citations
- Language Models Represent Space and TimePoster247 citations
- SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight CompressionPoster247 citations
- OmniQuant: Omnidirectionally Calibrated Quantization for Large Language ModelsSpotlight246 citations
- Analyzing and Mitigating Object Hallucination in Large Vision-Language ModelsPoster244 citations
- TokenFlow: Consistent Diffusion Features for Consistent Video EditingPoster244 citations
- Building Cooperative Embodied Agents Modularly with Large Language ModelsPoster238 citations
- Multilingual Jailbreak Challenges in Large Language ModelsPoster238 citations
- GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via CipherPoster236 citations
- AlpaGasus: Training a Better Alpaca with Fewer DataPoster235 citations
- OctoPack: Instruction Tuning Code Large Language ModelsSpotlight235 citations
- A Real-World WebAgent with Planning, Long Context Understanding, and Program SynthesisOral233 citations
- Personalize Segment Anything Model with One ShotPoster233 citations
- OpenChat: Advancing Open-source Language Models with Mixed-Quality DataPoster232 citations
- Reasoning on Graphs: Faithful and Interpretable Large Language Model ReasoningPoster231 citations
- Self-Alignment with Instruction BacktranslationOral230 citations
- Human Motion Diffusion as a Generative PriorPoster229 citations
- PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning OptimizationPoster227 citations
- The Alignment Problem from a Deep Learning PerspectivePoster225 citations
- Towards Understanding Sycophancy in Language ModelsPoster225 citations
- SyncDreamer: Generating Multiview-consistent Images from a Single-view ImageSpotlight223 citations
- LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic AlignmentPoster222 citations
- InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image GenerationPoster217 citations
- Large Language Models Are Not Robust Multiple Choice SelectorsSpotlight215 citations
- Can LLM-Generated Misinformation Be Detected?Poster214 citations
- TimeMixer: Decomposable Multiscale Mixing for Time Series ForecastingPoster210 citations
- Model Tells You What to Discard: Adaptive KV Cache Compression for LLMsOral202 citations
- RingAttention with Blockwise Transformers for Near-Infinite ContextPoster202 citations
- TEMPO: Prompt-based Generative Pre-trained Transformer for Time Series ForecastingPoster202 citations
- Statistical Rejection Sampling Improves Preference OptimizationPoster199 citations
- DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language ModelsPoster197 citations
- Prometheus: Inducing Fine-Grained Evaluation Capability in Language ModelsPoster193 citations
- ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem SolvingPoster193 citations
- DreamLLM: Synergistic Multimodal Comprehension and CreationSpotlight187 citations
- VeRA: Vector-based Random Matrix AdaptationPoster184 citations
- Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and MitigationPoster181 citations
- Self-Consuming Generative Models Go MADPoster179 citations
- LoftQ: LoRA-Fine-Tuning-aware Quantization for Large Language ModelsOral178 citations
- WildChat: 1M ChatGPT Interaction Logs in the WildSpotlight178 citations
- Listen, Think, and UnderstandPoster177 citations
- AgentBench: Evaluating LLMs as AgentsPoster175 citations
- WizardLM: Empowering Large Pre-Trained Language Models to Follow Complex InstructionsPoster175 citations
- Large Language Models as Tool MakersPoster174 citations
- The Reversal Curse: LLMs trained on “A is B” fail to learn “B is A”Poster174 citations
- Language Modeling Is CompressionPoster173 citations
- Talk like a Graph: Encoding Graphs for Large Language ModelsPoster173 citations
- Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow InstructionsPoster172 citations
- Making Retrieval-Augmented Language Models Robust to Irrelevant ContextPoster171 citations
- Retrieval meets Long Context Large Language ModelsPoster171 citations
- Consistency Trajectory Models: Learning Probability Flow ODE Trajectory of DiffusionPoster169 citations
- The Unlocking Spell on Base LLMs: Rethinking Alignment via In-Context LearningPoster169 citations
- What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction TuningPoster169 citations
- QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language ModelsPoster168 citations
- Demystifying CLIP DataSpotlight166 citations
- Finite Scalar Quantization: VQ-VAE Made SimplePoster166 citations
- Provable Robust Watermarking for AI-Generated TextPoster166 citations
- Beyond Memorization: Violating Privacy via Inference with Large Language ModelsSpotlight164 citations
- EquiformerV2: Improved Equivariant Transformer for Scaling to Higher-Degree RepresentationsPoster164 citations
- SliceGPT: Compress Large Language Models by Deleting Rows and ColumnsPoster164 citations
- Evaluating Large Language Models at Evaluating Instruction FollowingPoster163 citations
- Fine-Tuning Language Models for FactualityPoster162 citations
- LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation DatasetSpotlight160 citations
- Take a Step Back: Evoking Reasoning via Abstraction in Large Language ModelsPoster157 citations
- A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language ModelsPoster156 citations
- Chain of Hindsight aligns Language Models with FeedbackPoster155 citations
- Conformal Risk ControlSpotlight155 citations
- Nearly $d$-Linear Convergence Bounds for Diffusion Models via Stochastic LocalizationSpotlight154 citations
- Data Filtering NetworksPoster153 citations
- Solving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-VerificationPoster153 citations
- Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level VisionSpotlight151 citations
- Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-trainingPoster151 citations
- DMV3D: Denoising Multi-view Diffusion Using 3D Large Reconstruction ModelSpotlight150 citations
- DragonDiffusion: Enabling Drag-style Manipulation on Diffusion ModelsSpotlight149 citations
- AnomalyCLIP: Object-agnostic Prompt Learning for Zero-shot Anomaly DetectionPoster148 citations
- Improved Techniques for Training Consistency ModelsOral148 citations
- SOTOPIA: Interactive Evaluation for Social Intelligence in Language AgentsSpotlight148 citations
- Function Vectors in Large Language ModelsPoster147 citations
- Jailbreak in pieces: Compositional Adversarial Attacks on Multi-Modal Language ModelsSpotlight147 citations
- Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability CurvaturePoster146 citations
- LUT-GEMM: Quantized Matrix Multiplication based on LUTs for Efficient Inference in Large-Scale Generative Language ModelsPoster144 citations
- In-context Autoencoder for Context Compression in a Large Language ModelPoster143 citations
- Time Travel in LLMs: Tracing Data Contamination in Large Language ModelsSpotlight143 citations
- RA-DIT: Retrieval-Augmented Dual Instruction TuningPoster142 citations
- From Sparse to Soft Mixtures of ExpertsSpotlight138 citations
- Proving Test Set Contamination in Black-Box Language ModelsOral137 citations
- Let 2D Diffusion Model Know 3D-Consistency for Robust Text-to-3D GenerationPoster136 citations
- SpeechTokenizer: Unified Speech Tokenizer for Speech Language ModelsPoster136 citations
- Directly Fine-Tuning Diffusion Models on Differentiable RewardsPoster135 citations
- MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language FeedbackPoster135 citations
- When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning MethodPoster135 citations
- Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge ConflictsSpotlight134 citations
- RepoBench: Benchmarking Repository-Level Code Auto-Completion SystemsPoster134 citations
- UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity RecognitionPoster133 citations
- Vision-Language Foundation Models as Effective Robot ImitatorsSpotlight133 citations
- Learning Interactive Real-World SimulatorsOral132 citations
- What Algorithms can Transformers Learn? A Study in Length GeneralizationPoster132 citations
- SalUn: Empowering Machine Unlearning via Gradient-based Weight Saliency in Both Image Classification and GenerationSpotlight130 citations
- Harnessing Explanations: LLM-to-LM Interpreter for Enhanced Text-Attributed Graph Representation LearningPoster129 citations
- KoLA: Carefully Benchmarking World Knowledge of Large Language ModelsPoster129 citations
- RAPTOR: Recursive Abstractive Processing for Tree-Organized RetrievalPoster129 citations
- SEINE: Short-to-Long Video Diffusion Model for Generative Transition and PredictionPoster129 citations
- Unbiased Watermark for Large Language ModelsSpotlight129 citations
- ModernTCN: A Modern Pure Convolution Structure for General Time Series AnalysisSpotlight128 citations
- TEST: Text Prototype Aligned Embedding to Activate LLM's Ability for Time SeriesPoster126 citations
- Can Large Language Models Infer Causation from Correlation?Poster125 citations
- GAIA: a benchmark for General AI AssistantsPoster125 citations
- Mol-Instructions: A Large-Scale Biomolecular Instruction Dataset for Large Language ModelsPoster124 citations
- FITS: Modeling Time Series with $10k$ ParametersSpotlight123 citations
- Zero-Shot Robotic Manipulation with Pre-Trained Image-Editing Diffusion ModelsPoster123 citations
- RAIN: Your Language Models Can Align Themselves without FinetuningPoster122 citations
- AdaMerging: Adaptive Model Merging for Multi-Task LearningPoster121 citations
- Understanding the Effects of RLHF on LLM Generalisation and DiversityPoster121 citations
- MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised TrainingPoster120 citations
- SaProt: Protein Language Modeling with Structure-aware VocabularySpotlight117 citations
- TD-MPC2: Scalable, Robust World Models for Continuous ControlSpotlight117 citations
- A Variational Perspective on Solving Inverse Problems with Diffusion ModelsPoster116 citations
- Making LLaMA SEE and Draw with SEED TokenizerPoster116 citations
- BooookScore: A systematic exploration of book-length summarization in the era of LLMsOral115 citations
- Guiding Instruction-based Image Editing via Multimodal Large Language ModelsSpotlight115 citations
- Identifying the Risks of LM Agents with an LM-Emulated SandboxSpotlight115 citations
- PromptAgent: Strategic Planning with Language Models Enables Expert-level Prompt OptimizationPoster115 citations
- SweetDreamer: Aligning Geometric Priors in 2D diffusion for Consistent Text-to-3DPoster115 citations
- Generative Judge for Evaluating AlignmentPoster114 citations
- Mixture of LoRA ExpertsPoster114 citations
- SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step ReasoningPoster114 citations
- Nougat: Neural Optical Understanding for Academic DocumentsPoster113 citations
- OmniControl: Control Any Joint at Any Time for Human Motion GenerationPoster113 citations
- One Step of Gradient Descent is Provably the Optimal In-Context Learner with One Layer of Linear Self-AttentionPoster112 citations
- Reward Model Ensembles Help Mitigate OveroptimizationPoster112 citations
- Habitat 3.0: A Co-Habitat for Humans, Avatars, and RobotsPoster111 citations
- Multimodal Web Navigation with Instruction-Finetuned Foundation ModelsPoster111 citations
- PnP Inversion: Boosting Diffusion-based Editing with 3 Lines of CodePoster111 citations
- ReLoRA: High-Rank Training Through Low-Rank UpdatesPoster111 citations
- DreamCraft3D: Hierarchical 3D Generation with Bootstrapped Diffusion PriorPoster110 citations
- Chain of Thought Empowers Transformers to Solve Inherently Serial ProblemsPoster109 citations
- On-Policy Distillation of Language Models: Learning from Self-Generated MistakesPoster109 citations
- Teaching Arithmetic to Small TransformersPoster108 citations
- Chain-of-Table: Evolving Tables in the Reasoning Chain for Table UnderstandingPoster107 citations
- Is Self-Repair a Silver Bullet for Code Generation?Poster106 citations
- Pushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction TuningPoster106 citations
- The Expressive Power of Transformers with Chain of ThoughtPoster105 citations
- Hypothesis Search: Inductive Reasoning with Language ModelsPoster104 citations
- Turning large language models into cognitive modelsPoster104 citations
- MagicDrive: Street View Generation with Diverse 3D Geometry ControlPoster103 citations
- Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion ModelsPoster102 citations
- LLMCarbon: Modeling the End-to-End Carbon Footprint of Large Language ModelsOral102 citations
- LLaMA-Adapter: Efficient Fine-tuning of Large Language Models with Zero-initialized AttentionPoster102 citations
- Bias Runs Deep: Implicit Reasoning Biases in Persona-Assigned LLMsPoster101 citations
- PF-LRM: Pose-Free Large Reconstruction Model for Joint Pose and Shape PredictionSpotlight101 citations
- Pathformer: Multi-scale Transformers with Adaptive Pathways for Time Series ForecastingPoster101 citations
- #InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language ModelsPoster100 citations
- Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous SourcesPoster100 citations
- DNA-GPT: Divergent N-Gram Analysis for Training-Free Detection of GPT-Generated TextPoster100 citations
- ZipIt! Merging Models from Different Tasks without TrainingPoster100 citations
- Does Writing with Language Models Reduce Content Diversity?Poster99 citations
- Knowledge Fusion of Large Language ModelsPoster99 citations
- Uni3D: Exploring Unified 3D Representation at ScaleSpotlight99 citations
- GoLLIE: Annotation Guidelines improve Zero-Shot Information-ExtractionPoster98 citations
- MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical ReasoningPoster98 citations
- Würstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion ModelsOral97 citations
- Zipformer: A faster and better encoder for automatic speech recognitionOral97 citations
- Can Sensitive Information Be Deleted From LLMs? Objectives for Defending Against Extraction AttacksSpotlight96 citations
- Generalization in diffusion models arises from geometry-adaptive harmonic representationsOral96 citations
- Matcher: Segment Anything with One Shot Using All-Purpose Feature MatchingPoster96 citations
- GeoLLM: Extracting Geospatial Knowledge from Large Language ModelsPoster95 citations
- The All-Seeing Project: Towards Panoptic Visual Recognition and Understanding of the Open WorldPoster94 citations
- What's In My Big Data?Spotlight94 citations
- FLASK: Fine-grained Language Model Evaluation based on Alignment Skill SetsSpotlight93 citations
- Interpreting CLIP's Image Representation via Text-Based DecompositionOral91 citations
- INSIDE: LLMs' Internal States Retain the Power of Hallucination DetectionPoster90 citations
- Ring-A-Bell! How Reliable are Concept Removal Methods For Diffusion Models?Poster90 citations
- GenSim: Generating Robotic Simulation Tasks via Large Language ModelsSpotlight89 citations
- Unleashing Large-Scale Video Generative Pre-training for Visual Robot ManipulationPoster89 citations
- Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image GenerationPoster88 citations
- Fine-tuning Multimodal LLMs to Follow Zero-shot Demonstrative InstructionsSpotlight88 citations
- Kosmos-G: Generating Images in Context with Multimodal Large Language ModelsPoster87 citations
- Mixed-Type Tabular Data Synthesis with Score-based Diffusion in Latent SpaceOral87 citations
- Solving Inverse Problems with Latent Diffusion Models via Hard Data ConsistencySpotlight87 citations
- Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory MatchingPoster87 citations
- AnyText: Multilingual Visual Text Generation and EditingSpotlight86 citations
- Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity TheorySpotlight86 citations
- DistillSpec: Improving Speculative Decoding via Knowledge DistillationPoster86 citations
- Tensor Trust: Interpretable Prompt Injection Attacks from an Online GameSpotlight86 citations
- Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual TokenizationPoster86 citations
- ReLU Strikes Back: Exploiting Activation Sparsity in Large Language ModelsOral85 citations
- Text-to-3D with Classifier Score DistillationPoster85 citations
- Towards Foundation Models for Knowledge Graph ReasoningPoster85 citations
- Tag2Text: Guiding Vision-Language Model via Image TaggingPoster84 citations
- Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesisPoster84 citations
- FreeNoise: Tuning-Free Longer Video Diffusion via Noise ReschedulingPoster82 citations
- Zoology: Measuring and Improving Recall in Efficient Language ModelsPoster82 citations
- FasterViT: Fast Vision Transformers with Hierarchical AttentionPoster81 citations
- OpenWebMath: An Open Dataset of High-Quality Mathematical Web TextPoster81 citations
- Hybrid LLM: Cost-Efficient and Quality-Aware Query RoutingPoster80 citations
- MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to UsePoster80 citations
- Universal Jailbreak Backdoors from Poisoned Human FeedbackPoster80 citations
- Beyond Reverse KL: Generalizing Direct Preference Optimization with Diverse Divergence ConstraintsSpotlight79 citations
- Small-scale proxies for large-scale Transformer training instabilitiesOral79 citations
- HyperAttention: Long-context Attention in Near-Linear TimePoster78 citations
- Mixture-of-Experts Meets Instruction Tuning: A Winning Combination for Large Language ModelsPoster78 citations
- Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis RefinementOral78 citations
- Towards Best Practices of Activation Patching in Language Models: Metrics and MethodsPoster78 citations
- Fine-Tuned Language Models Generate Stable Inorganic Materials as TextPoster77 citations
- Label-free Node Classification on Graphs with Large Language Models (LLMs)Poster77 citations
- Large Brain Model for Learning Generic Representations with Tremendous EEG Data in BCISpotlight77 citations
- Spike-driven Transformer V2: Meta Spiking Neural Network Architecture Inspiring the Design of Next-generation Neuromorphic ChipsPoster77 citations
- Deep Temporal Graph ClusteringPoster76 citations
- Improving LoRA in Privacy-preserving Federated LearningPoster76 citations
- Linearity of Relation Decoding in Transformer Language ModelsSpotlight76 citations
- Retroformer: Retrospective Large Language Agents with Policy Gradient OptimizationSpotlight76 citations
- SE(3)-Stochastic Flow Matching for Protein Backbone GenerationSpotlight76 citations
- Think before you speak: Training Language Models With Pause TokensPoster76 citations
- Vision-Language Models are Zero-Shot Reward Models for Reinforcement LearningPoster76 citations
- BadChain: Backdoor Chain-of-Thought Prompting for Large Language ModelsPoster75 citations
- Bayesian Low-rank Adaptation for Large Language ModelsPoster75 citations
- Conformal Language ModelingPoster75 citations
- Large Language Models as Generalizable Policies for Embodied TasksPoster75 citations
- PoSE: Efficient Context Window Extension of LLMs via Positional Skip-wise TrainingPoster75 citations
- FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editingPoster74 citations
- Massive Editing for Large Language Models via Meta LearningPoster74 citations
- LLM-grounded Video Diffusion ModelsPoster73 citations
- Learning Performance-Improving Code EditsSpotlight73 citations
- Noise-free Score DistillationPoster72 citations
- SILO Language Models: Isolating Legal Risk In a Nonparametric DatastoreSpotlight72 citations
- Unpaired Image-to-Image Translation via Neural Schrödinger BridgePoster72 citations
- Curiosity-driven Red-teaming for Large Language ModelsPoster71 citations
- Diffusion-TS: Interpretable Diffusion for General Time Series GenerationPoster71 citations
- Navigating Text-To-Image Customization: From LyCORIS Fine-Tuning to Model EvaluationPoster71 citations
- Single Motion DiffusionSpotlight71 citations
- DiffusionSat: A Generative Foundation Model for Satellite ImageryPoster70 citations
- How Many Pretraining Tasks Are Needed for In-Context Learning of Linear Regression?Spotlight70 citations
- On the Reliability of Watermarks for Large Language ModelsPoster70 citations
- RECOMP: Improving Retrieval-Augmented LMs with Context Compression and Selective AugmentationPoster70 citations
- Strategic Preys Make Acute Predators: Enhancing Camouflaged Object Detectors by Generating Camouflaged ObjectsPoster70 citations
- PB-LLM: Partially Binarized Large Language ModelsPoster68 citations
- QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language ModelsPoster68 citations
- The Expressive Power of Low-Rank AdaptationPoster68 citations
- CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense PredictionSpotlight67 citations
- Understanding Catastrophic Forgetting in Language Models via Implicit InferencePoster67 citations
- Amortizing intractable inference in large language modelsOral66 citations
- Privacy-Preserving In-Context Learning with Differentially Private Few-Shot GenerationPoster66 citations
- Unified Human-Scene Interaction via Prompted Chain-of-ContactsSpotlight66 citations
- DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image GenerationPoster65 citations
- MogaNet: Multi-order Gated Aggregation NetworkPoster65 citations
- Neural Common Neighbor with Completion for Link PredictionPoster65 citations
- SmartPlay : A Benchmark for LLMs as Intelligent AgentsPoster65 citations
- Synapse: Trajectory-as-Exemplar Prompting with Memory for Computer ControlPoster65 citations
- Consistent4D: Consistent 360° Dynamic Object Generation from Monocular VideoPoster64 citations
- Large Multilingual Models Pivot Zero-Shot Multimodal Learning across LanguagesSpotlight64 citations
- Motif: Intrinsic Motivation from Artificial Intelligence FeedbackPoster64 citations
- ScaleCrafter: Tuning-free Higher-Resolution Visual Generation with Diffusion ModelsSpotlight64 citations
- The Truth is in There: Improving Reasoning in Language Models with Layer-Selective Rank ReductionPoster64 citations
- The mechanistic basis of data dependence and abrupt learning in an in-context classification taskOral64 citations
- Vision-by-Language for Training-Free Compositional Image RetrievalPoster64 citations
- Circuit Component Reuse Across Tasks in Transformer Language ModelsSpotlight63 citations
- Consistency-guided Prompt Learning for Vision-Language ModelsPoster63 citations
- Large Language Model Cascades with Mixture of Thought Representations for Cost-Efficient ReasoningPoster63 citations
- CRAFT: Customizing LLMs by Creating and Retrieving from Specialized ToolsetsPoster62 citations
- Large Language Models to Enhance Bayesian OptimizationPoster62 citations
- Mechanistically analyzing the effects of fine-tuning on procedurally defined tasksPoster62 citations
- Sudden Drops in the Loss: Syntax Acquisition, Phase Transitions, and Simplicity Bias in MLMsSpotlight62 citations
- How Do Transformers Learn In-Context Beyond Simple Functions? A Case Study on Learning with RepresentationsPoster61 citations
- LEGO-Prover: Neural Theorem Proving with Growing LibrariesOral61 citations
- VDT: General-purpose Video Diffusion Transformers via Mask ModelingPoster61 citations
- BadEdit: Backdooring Large Language Models by Model EditingPoster60 citations
- CARD: Channel Aligned Robust Blend Transformer for Time Series ForecastingPoster60 citations
- Cameras as Rays: Pose Estimation via Ray DiffusionOral60 citations
- DataInf: Efficiently Estimating Data Influence in LoRA-tuned LLMs and Diffusion ModelsPoster60 citations
- Improved sampling via learned diffusionsPoster60 citations
- Large Language Models as Analogical ReasonersPoster60 citations
- Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised PretrainingPoster60 citations
- Denoising Diffusion Bridge ModelsPoster59 citations
- HIFA: High-fidelity Text-to-3D Generation with Advanced Diffusion GuidancePoster59 citations
- How to Catch an AI Liar: Lie Detection in Black-Box LLMs by Asking Unrelated QuestionsPoster59 citations
- Learning Delays in Spiking Neural Networks using Dilated Convolutions with Learnable SpacingsPoster59 citations
- DFormer: Rethinking RGBD Representation Learning for Semantic SegmentationPoster58 citations
- Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHFPoster58 citations
- JoMA: Demystifying Multilayer Transformers via Joint Dynamics of MLP and AttentionPoster58 citations
- Rethinking Model Ensemble in Transfer-based Adversarial AttacksPoster58 citations
- Universal Humanoid Motion Representations for Physics-Based ControlSpotlight58 citations
- ARGS: Alignment as Reward-Guided SearchPoster57 citations
- AntGPT: Can Large Language Models Help Long-term Action Anticipation from Videos?Poster57 citations
- Parameter-Efficient Orthogonal Finetuning via Butterfly FactorizationPoster57 citations
- Copilot4D: Learning Unsupervised World Models for Autonomous Driving via Discrete DiffusionPoster56 citations
- LLM-CXR: Instruction-Finetuned LLM for CXR Image Understanding and GenerationPoster56 citations
- LQ-LoRA: Low-rank plus Quantized Matrix Decomposition for Efficient Language Model FinetuningPoster56 citations
- Language Model InversionPoster56 citations
- Learning to Act from Actionless Videos through Dense CorrespondencesSpotlight56 citations
- MMICL: Empowering Vision-language Model with Multi-Modal In-Context LearningPoster56 citations
- On the Humanity of Conversational AI: Evaluating the Psychological Portrayal of LLMsOral56 citations
- Scaling Laws of RoPE-based ExtrapolationPoster56 citations
- Detecting, Explaining, and Mitigating Memorization in Diffusion ModelsOral55 citations
- Dynamic Sparse No Training: Training-Free Fine-tuning for Sparse LLMsPoster55 citations
- EmerNeRF: Emergent Spatial-Temporal Scene Decomposition via Self-SupervisionPoster55 citations
- Flow Matching on General GeometriesOral55 citations
- Recursive Generalization Transformer for Image Super-ResolutionPoster55 citations
- Scalable Diffusion for Materials GenerationPoster55 citations
- Tree-Planner: Efficient Close-loop Task Planning with Large Language ModelsPoster55 citations
- Brain decoding: toward real-time reconstruction of visual perceptionPoster54 citations
- Diffusion Posterior Sampling for Linear Inverse Problem Solving: A Filtering PerspectivePoster54 citations
- Grounding Multimodal Large Language Models to the WorldPoster54 citations
- Linear attention is (maybe) all you need (to understand Transformer optimization)Poster54 citations
- MuSR: Testing the Limits of Chain-of-thought with Multistep Soft ReasoningSpotlight54 citations
- Training Socially Aligned Language Models on Simulated Social InteractionsPoster54 citations
- Composed Image Retrieval with Text Feedback via Multi-grained Uncertainty RegularizationPoster53 citations
- Decomposed Diffusion Sampler for Accelerating Large-Scale Inverse ProblemsPoster53 citations
- Matryoshka Diffusion ModelsPoster53 citations
- NEFTune: Noisy Embeddings Improve Instruction FinetuningPoster53 citations
- RT-Trajectory: Robotic Task Generalization via Hindsight Trajectory SketchesSpotlight53 citations
- Model Merging by Uncertainty-Based Gradient MatchingPoster52 citations
- ToolChain*: Efficient Action Space Navigation in Large Language Models with A* SearchPoster52 citations
- Unveiling the Pitfalls of Knowledge Editing for Large Language ModelsPoster52 citations
- Batch Calibration: Rethinking Calibration for In-Context Learning and Prompt EngineeringPoster51 citations
- HyperHuman: Hyper-Realistic Human Generation with Latent Structural DiffusionPoster51 citations
- Text2Reward: Reward Shaping with Language Models for Reinforcement LearningSpotlight51 citations
- Towards 3D Molecule-Text Interpretation in Language ModelsPoster51 citations
- Chain-of-Experts: When LLMs Meet Complex Operations Research ProblemsPoster50 citations
- FeatUp: A Model-Agnostic Framework for Features at Any ResolutionPoster50 citations
- Manifold Preserving Guided DiffusionPoster50 citations
- Masked Audio Generation using a Single Non-Autoregressive TransformerPoster50 citations
- PINNsFormer: A Transformer-Based Framework For Physics-Informed Neural NetworksPoster50 citations
- Quality-Diversity through AI FeedbackPoster50 citations
- Remote Sensing Vision-Language Foundation Models without Annotations via Ground Remote AlignmentPoster50 citations
- Robust agents learn causal world modelsOral50 citations
- Convolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything ModelPoster49 citations
- Deep Confident Steps to New Pockets: Strategies for Docking GeneralizationPoster49 citations
- DeepZero: Scaling Up Zeroth-Order Optimization for Deep Model TrainingPoster49 citations
- Evaluating the Zero-shot Robustness of Instruction-tuned Language ModelsSpotlight49 citations
- Exploring Target Representations for Masked AutoencodersPoster49 citations
- Fair and Efficient Contribution Valuation for Vertical Federated LearningPoster49 citations
- Large-scale Training of Foundation Models for Wearable BiosignalsPoster49 citations
- THOUGHT PROPAGATION: AN ANALOGICAL APPROACH TO COMPLEX REASONING WITH LARGE LANGUAGE MODELSPoster49 citations
- Towards image compression with perfect realism at ultra-low bitratesPoster49 citations
- How to Capture Higher-order Correlations? Generalizing Matrix Softmax Attention to Kronecker ComputationSpotlight48 citations
- Lemur: Harmonizing Natural Language and Code for Language AgentsSpotlight48 citations
- Plan-Seq-Learn: Language Model Guided RL for Solving Long Horizon Robotics TasksPoster48 citations
- The Hedgehog & the Porcupine: Expressive Linear Attentions with Softmax MimicryPoster48 citations
- BEND: Benchmarking DNA Language Models on Biologically Meaningful TasksPoster47 citations
- Functional Interpolation for Relative Positions improves Long Context TransformersPoster47 citations
- One For All: Towards Training One Graph Model For All Classification TasksSpotlight47 citations
- Plug-and-Play: An Efficient Post-training Pruning Method for Large Language ModelsPoster47 citations
- Real3D-Portrait: One-shot Realistic 3D Talking Portrait SynthesisSpotlight47 citations
- Robustness of AI-Image Detectors: Fundamental Limits and Practical AttacksPoster47 citations
- STanHop: Sparse Tandem Hopfield Model for Memory-Enhanced Time Series PredictionPoster47 citations
- Seer: Language Instructed Video Prediction with Latent Diffusion ModelsPoster47 citations
- True Knowledge Comes from Practice: Aligning Large Language Models with Embodied Environments via Reinforcement LearningPoster47 citations
- An Emulator for Fine-tuning Large Language Models using Small Language ModelsPoster46 citations
- An Extensible Framework for Open Heterogeneous Collaborative PerceptionPoster46 citations
- An Unforgeable Publicly Verifiable Watermark for Large Language ModelsPoster46 citations
- CLEX: Continuous Length Extrapolation for Large Language ModelsPoster46 citations
- ClimODE: Climate and Weather Forecasting with Physics-informed Neural ODEsOral46 citations
- From Molecules to Materials: Pre-training Large Generalizable Models for Atomic Property PredictionPoster46 citations
- Inducing High Energy-Latency of Large Vision-Language Models with Verbose ImagesPoster46 citations
- InfoBatch: Lossless Training Speed Up by Unbiased Dynamic Data PruningOral46 citations
- Multi-Source Diffusion Models for Simultaneous Music Generation and SeparationOral46 citations
- TorchRL: A data-driven decision-making library for PyTorchSpotlight46 citations
- At Which Training Stage Does Code Data Help LLMs Reasoning?Spotlight45 citations
- Confronting Reward Model Overoptimization with Constrained RLHFSpotlight45 citations
- Finetuning Text-to-Image Diffusion Models for FairnessOral45 citations
- Fusing Models with Complementary ExpertisePoster45 citations
- On the Stability of Iterative Retraining of Generative Models on their own DataSpotlight45 citations
- Overthinking the Truth: Understanding how Language Models Process False DemonstrationsSpotlight45 citations
- Tensor Programs VI: Feature Learning in Infinite Depth Neural NetworksPoster45 citations
- Controlling Vision-Language Models for Multi-Task Image RestorationPoster44 citations
- DP-OPT: Make Large Language Model Your Privacy-Preserving Prompt EngineerSpotlight44 citations
- DePT: Decomposed Prompt Tuning for Parameter-Efficient Fine-tuningPoster44 citations
- Divide and not forget: Ensemble of selectively trained experts in Continual LearningPoster44 citations
- EasyTPP: Towards Open Benchmarking Temporal Point ProcessesPoster44 citations
- EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion ModelsSpotlight44 citations
- LEAP: Liberate Sparse-View 3D Modeling from Camera PosesPoster44 citations
- LLM Augmented LLMs: Expanding Capabilities through CompositionPoster44 citations
- Magnushammer: A Transformer-Based Approach to Premise SelectionPoster44 citations
- OWL: A Large Language Model for IT OperationsPoster44 citations
- On the Learnability of Watermarks for Language ModelsPoster44 citations
- PromptTTS 2: Describing and Generating Voices with Text PromptPoster44 citations
- Simplifying Transformer BlocksPoster44 citations
- SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMsPoster44 citations
- Transport meets Variational Inference: Controlled Monte Carlo DiffusionsPoster44 citations
- Understanding In-Context Learning in Transformers and LLMs by Learning to Learn Discrete FunctionsOral44 citations
- Fine-Tuning Enhances Existing Mechanisms: A Case Study on Entity TrackingPoster43 citations
- Human Feedback is not Gold StandardPoster43 citations
- Towards Seamless Adaptation of Pre-trained Models for Visual Place RecognitionPoster43 citations
- ViDA: Homeostatic Visual Domain Adapter for Continual Test Time AdaptationPoster43 citations
- Differentially Private Synthetic Data via Foundation Model APIs 1: ImagesPoster42 citations
- Geographic Location Encoding with Spherical Harmonics and Sinusoidal Representation NetworksSpotlight42 citations
- Intriguing Properties of Generative ClassifiersSpotlight42 citations
- METRA: Scalable Unsupervised RL with Metric-Aware AbstractionOral42 citations
- Multiscale Positive-Unlabeled Detection of AI-Generated TextsSpotlight42 citations
- Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic PromptsPoster42 citations
- Protein Discovery with Discrete Walk-Jump SamplingOral42 citations
- Skeleton-of-Thought: Prompting LLMs for Efficient Parallel GenerationPoster42 citations
- Circumventing Concept Erasure Methods For Text-To-Image Generative ModelsPoster41 citations
- Faithful Explanations of Black-box NLP Models Using LLM-generated CounterfactualsPoster41 citations
- Group Preference Optimization: Few-Shot Alignment of Large Language ModelsPoster41 citations
- Language Model Self-improvement by Reinforcement Learning ContemplationPoster41 citations
- Mega-TTS 2: Boosting Prompting Mechanisms for Zero-Shot Speech SynthesisPoster41 citations
- Negative Label Guided OOD Detection with Pretrained Vision-Language ModelsSpotlight41 citations
- Neural Optimal Transport with General Cost FunctionalsPoster41 citations
- Provable Offline Preference-Based Reinforcement LearningSpotlight41 citations
- Space Group Constrained Crystal GenerationPoster41 citations
- Tuning LayerNorm in Attention: Towards Efficient Multi-Modal LLM FinetuningSpotlight41 citations
- A Benchmark for Learning to Translate a New Language from One Grammar BookSpotlight40 citations
- Compressing LLMs: The Truth is Rarely Pure and Never SimplePoster40 citations
- DyVal: Dynamic Evaluation of Large Language Models for Reasoning TasksSpotlight40 citations
- FROSTER: Frozen CLIP is A Strong Teacher for Open-Vocabulary Action RecognitionPoster40 citations
- Frozen Transformers in Language Models Are Effective Visual Encoder LayersSpotlight40 citations
- LaneSegNet: Map Learning with Lane Segment Perception for Autonomous DrivingPoster40 citations
- Learning to Embed Time Series Patches IndependentlyPoster40 citations
- One-shot Empirical Privacy Estimation for Federated LearningOral40 citations
- Privacy-Preserving In-Context Learning for Large Language ModelsPoster40 citations
- Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLMPoster40 citations
- Successor Heads: Recurring, Interpretable Attention Heads In The WildPoster40 citations
- Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language ModelsPoster39 citations
- Graph Neural Networks for Learning Equivariant Representations of Neural NetworksOral39 citations
- GraphCare: Enhancing Healthcare Predictions with Personalized Knowledge GraphsPoster39 citations
- Ground-A-Video: Zero-shot Grounded Video Editing using Text-to-image Diffusion ModelsPoster39 citations
- ImagenHub: Standardizing the evaluation of conditional image generation modelsPoster39 citations
- Making Pre-trained Language Models Great on Tabular PredictionSpotlight39 citations
- OMNI: Open-endedness via Models of human Notions of InterestingnessPoster39 citations
- TabR: Tabular Deep Learning Meets Nearest NeighborsPoster39 citations
- CADS: Unleashing the Diversity of Diffusion Models through Condition-Annealed SamplingSpotlight38 citations
- CLaM-TTS: Improving Neural Codec Language Model for Zero-Shot Text-to-SpeechPoster38 citations
- Entropy is not Enough for Test-Time Adaptation: From the Perspective of Disentangled FactorsSpotlight38 citations
- Octavius: Mitigating Task Interference in MLLMs via LoRA-MoEPoster38 citations
- Prototypical Information Bottlenecking and Disentangling for Multimodal Cancer Survival PredictionSpotlight38 citations
- Relay Diffusion: Unifying diffusion process across resolutions for image synthesisSpotlight38 citations
- Towards Foundational Models for Molecular Learning on Large-Scale Multi-Task DatasetsPoster38 citations
- UniAdapter: Unified Parameter-Efficient Transfer Learning for Cross-modal ModelingPoster38 citations
- When Do Prompting and Prefix-Tuning Work? A Theory of Capabilities and LimitationsPoster38 citations
- CodeChain: Towards Modular Code Generation Through Chain of Self-revisions with Representative Sub-modulesPoster37 citations
- Diffusion Generative Flow Samplers: Improving learning signals through partial trajectory optimizationPoster37 citations
- Elucidating the Exposure Bias in Diffusion ModelsPoster37 citations
- GROOT: Learning to Follow Instructions by Watching Gameplay VideosSpotlight37 citations
- Graph Metanetworks for Processing Diverse Neural ArchitecturesSpotlight37 citations
- In-Context Learning Learns Label Relationships but Is Not Conventional LearningPoster37 citations
- Polynormer: Polynomial-Expressive Graph Transformer in Linear TimePoster37 citations
- Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion ModelPoster37 citations
- Tell Your Model Where to Attend: Post-hoc Attention Steering for LLMsPoster37 citations
- AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion ModelPoster36 citations
- Alleviating Exposure Bias in Diffusion Models through Sampling with Shifted Time StepsPoster36 citations
- Beyond Weisfeiler-Lehman: A Quantitative Framework for GNN ExpressivenessOral36 citations
- Consistency Models as a Rich and Efficient Policy Class for Reinforcement LearningPoster36 citations
- CrossQ: Batch Normalization in Deep Reinforcement Learning for Greater Sample Efficiency and SimplicitySpotlight36 citations
- Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake AnalysisPoster36 citations
- Improved Probabilistic Image-Text RepresentationsPoster36 citations
- Language Model Cascades: Token-Level Uncertainty And BeyondPoster36 citations
- Merge, Then Compress: Demystify Efficient SMoE with Hints from Its Routing PolicySpotlight36 citations
- On the Stability of Expressive Positional Encodings for GraphsPoster36 citations
- Sign2GPT: Leveraging Large Language Models for Gloss-Free Sign Language TranslationPoster36 citations
- The Blessing of Randomness: SDE Beats ODE in General Diffusion-based Image EditingPoster36 citations
- Variational Bayesian Last LayersSpotlight36 citations
- Xformer: Hybrid X-Shaped Transformer for Image DenoisingPoster36 citations
- An Efficient Membership Inference Attack for the Diffusion Model by Proximal InitializationPoster35 citations
- An Image Is Worth 1000 Lies: Transferability of Adversarial Images across Prompts on Vision-Language ModelsSpotlight35 citations
- BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity AllocationPoster35 citations
- Facing the Elephant in the Room: Visual Prompt Tuning or Full finetuning?Poster35 citations
- Faithful Vision-Language Interpretation via Concept Bottleneck ModelsPoster35 citations
- Federated Recommendation with Additive PersonalizationPoster35 citations
- InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph PriorSpotlight35 citations
- Multi-View Causal Representation Learning with Partial ObservabilitySpotlight35 citations
- Periodicity Decoupling Framework for Long-term Series ForecastingPoster35 citations
- Plug-and-Play Policy Planner for Large Language Model Powered Dialogue AgentsPoster35 citations
- Real-Fake: Effective Training Data Synthesis Through Distribution MatchingPoster35 citations
- TiC-CLIP: Continual Training of CLIP ModelsPoster35 citations
- Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking OraclesPoster35 citations
- BrainLM: A foundation model for brain activity recordingsPoster34 citations
- ED-NeRF: Efficient Text-Guided Editing of 3D Scene With Latent Space NeRFPoster34 citations
- Generative Pre-training for Speech with Flow MatchingPoster34 citations
- How do Language Models Bind Entities in Context?Poster34 citations
- Local Search GFlowNetsSpotlight34 citations
- Motion Guidance: Diffusion-Based Image Editing with Differentiable Motion EstimatorsPoster34 citations
- SKILL-MIX: a Flexible and Expandable Family of Evaluations for AI ModelsPoster34 citations
- Skip-Attention: Improving Vision Transformers by Paying Less AttentionPoster34 citations
- T-MARS: Improving Visual Representations by Circumventing Text Feature LearningPoster34 citations
- Benign Overfitting and Grokking in ReLU Networks for XOR Cluster DataPoster33 citations
- Jointly Training Large Autoregressive Multimodal ModelsPoster33 citations
- LLM-Assisted Code Cleaning For Training Accurate Code GeneratorsPoster33 citations
- Never Train from Scratch: Fair Comparison of Long-Sequence Models Requires Data-Driven PriorsOral33 citations
- On Diffusion Modeling for Anomaly DetectionSpotlight33 citations
- OpenNeRF: Open Set 3D Neural Scene Segmentation with Pixel-Wise Features and Rendered Novel ViewsPoster33 citations
- Query-Dependent Prompt Evaluation and Optimization with Offline Inverse RLPoster33 citations
- Rethinking Channel Dependence for Multivariate Time Series Forecasting: Learning from Leading IndicatorsPoster33 citations
- SEPT: Towards Efficient Scene Representation Learning for Motion PredictionPoster33 citations
- SLiMe: Segment Like MePoster33 citations
- The LLM SurgeonPoster33 citations
- An LLM can Fool Itself: A Prompt-Based Adversarial AttackPoster32 citations
- AutomaTikZ: Text-Guided Synthesis of Scientific Vector Graphics with TikZPoster32 citations
- DSPy: Compiling Declarative Language Model Calls into State-of-the-Art PipelinesSpotlight32 citations
- Do Generated Data Always Help Contrastive Learning?Poster32 citations
- Knowledge Card: Filling LLMs' Knowledge Gaps with Plug-in Specialized Language ModelsOral32 citations
- LLM Blueprint: Enabling Text-to-Image Generation with Complex and Detailed PromptsPoster32 citations
- Learning Multi-Agent Communication from Graph Modeling PerspectivePoster32 citations
- MAPE-PPI: Towards Effective and Efficient Protein-Protein Interaction Prediction via Microenvironment-Aware Protein EmbeddingSpotlight32 citations
- Making RL with Preference-based Feedback Efficient via RandomizationPoster32 citations
- Poisoned Forgery Face: Towards Backdoor Attacks on Face Forgery DetectionSpotlight32 citations
- Towards Few-Shot Adaptation of Foundation Models via Multitask FinetuningPoster32 citations
- AMAGO: Scalable In-Context Reinforcement Learning for Adaptive AgentsSpotlight31 citations
- DIAGNOSIS: Detecting Unauthorized Data Usages in Text-to-image Diffusion ModelsPoster31 citations
- Decoding Natural Images from EEG for Object RecognitionPoster31 citations
- Dichotomy of Early and Late Phase Implicit Biases Can Provably Induce GrokkingPoster31 citations
- Don't Trust: Verify -- Grounding LLM Quantitative Reasoning with AutoformalizationPoster31 citations
- FedCDA: Federated Learning with Cross-rounds Divergence-aware AggregationPoster31 citations
- Frequency-Aware Transformer for Learned Image CompressionPoster31 citations
- In-Context Learning through the Bayesian PrismPoster31 citations
- Large-Vocabulary 3D Diffusion Model with TransformerPoster31 citations
- Prompt Gradient Projection for Continual LearningSpotlight31 citations
- Scaling for Training Time and Post-hoc Out-of-distribution Detection EnhancementPoster31 citations
- Spurious Feature Diversification Improves Out-of-distribution GeneralizationPoster31 citations
- Teaching Language Models to Hallucinate Less with Synthetic TasksPoster31 citations
- Towards Non-Asymptotic Convergence for Diffusion-Based Generative ModelsPoster31 citations
- Towards Reliable and Efficient Backdoor Trigger Inversion via Decoupling Benign FeaturesSpotlight31 citations
- V-DETR: DETR with Vertex Relative Position Encoding for 3D Object DetectionPoster31 citations
- VCR-Graphormer: A Mini-batch Graph Transformer via Virtual ConnectionsPoster31 citations
- C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature DispersionPoster30 citations
- DrM: Mastering Visual Reinforcement Learning through Dormant Ratio MinimizationSpotlight30 citations
- Learning with Mixture of Prototypes for Out-of-Distribution DetectionPoster30 citations
- Lemur: Integrating Large Language Models in Automated Program VerificationPoster30 citations
- Low Rank Matrix Completion via Robust Alternating Minimization in Nearly Linear TimePoster30 citations
- PROGRAM: PROtotype GRAph Model based Pseudo-Label Learning for Test-Time AdaptationPoster30 citations
- Partitioning Message Passing for Graph Fraud DetectionPoster30 citations
- Raidar: geneRative AI Detection viA RewritingPoster30 citations
- The Generative AI Paradox: “What It Can Create, It May Not Understand”Poster30 citations
- TopoMLP: A Simple yet Strong Pipeline for Driving Topology ReasoningPoster30 citations
- A Hard-to-Beat Baseline for Training-free CLIP-based AdaptationPoster29 citations
- A Study of Bayesian Neural Network Surrogates for Bayesian OptimizationPoster29 citations
- An operator preconditioning perspective on training in physics-informed machine learningPoster29 citations
- Benchmarking and Improving Generator-Validator Consistency of Language ModelsPoster29 citations
- COLLIE: Systematic Construction of Constrained Text Generation TasksPoster29 citations
- Controlled Text Generation via Language Model ArithmeticSpotlight29 citations
- Large Language Models are Efficient Learners of Noise-Robust Speech RecognitionSpotlight29 citations
- Locality-Aware Graph Rewiring in GNNsPoster29 citations
- Machine Unlearning for Image-to-Image Generative ModelsPoster29 citations
- PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human FeedbackPoster29 citations
- PINNACLE: PINN Adaptive ColLocation and Experimental points selectionSpotlight29 citations
- Toward effective protection against diffusion-based mimicry through score distillationPoster29 citations
- Understanding Addition in TransformersPoster29 citations
- Understanding and Mitigating the Label Noise in Pre-training on Downstream TasksSpotlight29 citations
- AffineQuant: Affine Transformation Quantization for Large Language ModelsPoster28 citations
- Are Transformers with One Layer Self-Attention Using Low-Rank Weight Matrices Universal Approximators?Poster28 citations
- Channel Vision Transformers: An Image Is Worth 1 x 16 x 16 WordsPoster28 citations
- Depthwise Hyperparameter Transfer in Residual Networks: Dynamics and Scaling LimitPoster28 citations
- Dual RL: Unification and New Methods for Reinforcement and Imitation LearningSpotlight28 citations
- Fusion Is Not Enough: Single Modal Attacks on Fusion Models for 3D Object DetectionPoster28 citations
- IDEAL: Influence-Driven Selective Annotations Empower In-Context Learners in Large Language ModelsPoster28 citations
- Less is More: Fewer Interpretable Region via Submodular Subset SelectionOral28 citations
- Leveraging Optimization for Adaptive Attacks on Image WatermarksPoster28 citations
- MVSFormer++: Revealing the Devil in Transformer's Details for Multi-View StereoPoster28 citations
- RetroBridge: Modeling Retrosynthesis with Markov BridgesSpotlight28 citations
- Reverse Diffusion Monte CarloPoster28 citations
- Stochastic Controlled Averaging for Federated Learning with Communication CompressionSpotlight28 citations
- VQGraph: Rethinking Graph Representation Space for Bridging GNNs and MLPsPoster28 citations
- Contrastive Preference Learning: Learning from Human Feedback without Reinforcement LearningPoster27 citations
- Empirical Analysis of Model Selection for Heterogeneous Causal Effect EstimationSpotlight27 citations
- It's Never Too Late: Fusing Acoustic Information into Large Language Models for Automatic Speech RecognitionPoster27 citations
- Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAXPoster27 citations
- KW-Design: Pushing the Limit of Protein Design via Knowledge RefinementPoster27 citations
- Learning to Act without ActionsSpotlight27 citations
- Memorization Capacity of Multi-Head Attention in TransformersSpotlight27 citations
- On Penalty Methods for Nonconvex Bilevel Optimization and First-Order Stochastic ApproximationSpotlight27 citations
- On the Foundations of Shortcut LearningSpotlight27 citations
- Particle Guidance: non-I.I.D. Diverse Sampling with Diffusion ModelsPoster27 citations
- Posterior Sampling Based on Gradient Flows of the MMD with Negative Distance KernelPoster27 citations
- Reasoning with Latent Diffusion in Offline Reinforcement LearningPoster27 citations
- SNIP: Bridging Mathematical Symbolic and Numeric Realms with Unified Pre-trainingSpotlight27 citations
- Simple Hierarchical Planning with DiffusionPoster27 citations
- Soft Contrastive Learning for Time SeriesSpotlight27 citations
- Teach LLMs to Phish: Stealing Private Information from Language ModelsPoster27 citations
- To the Cutoff... and Beyond? A Longitudinal Perspective on LLM Data ContaminationPoster27 citations
- Unleashing the Power of Pre-trained Language Models for Offline Reinforcement LearningPoster27 citations
- A Sublinear Adversarial Training AlgorithmPoster26 citations
- Addressing Loss of Plasticity and Catastrophic Forgetting in Continual LearningPoster26 citations
- Analysis of Learning a Flow-based Generative Model from Limited Sample ComplexityPoster26 citations
- Bridging State and History Representations: Understanding Self-Predictive RLPoster26 citations
- CausalLM is not optimal for in-context learningPoster26 citations
- Effective pruning of web-scale datasets based on complexity of concept clustersPoster26 citations
- FFB: A Fair Fairness Benchmark for In-Processing Group Fairness MethodsPoster26 citations
- From Zero to Turbulence: Generative Modeling for 3D Flow SimulationPoster26 citations
- GPAvatar: Generalizable and Precise Head Avatar from Image(s)Poster26 citations
- Generalized Schrödinger Bridge MatchingPoster26 citations
- Initializing Models with Larger OnesSpotlight26 citations
- Knowledge Distillation Based on Transformed Teacher MatchingPoster26 citations
- LLMs Meet VLMs: Boost Open Vocabulary Object Detection with Fine-grained DescriptorsPoster26 citations
- MUSTARD: Mastering Uniform Synthesis of Theorem and Proof DataSpotlight26 citations
- Momentum Benefits Non-iid Federated Learning Simply and ProvablyPoster26 citations
- MuSc: Zero-Shot Industrial Anomaly Classification and Segmentation with Mutual Scoring of the Unlabeled ImagesPoster26 citations
- Multi-resolution HuBERT: Multi-resolution Speech Self-Supervised Learning with Masked Unit PredictionSpotlight26 citations
- PTaRL: Prototype-based Tabular Representation Learning via Space CalibrationSpotlight26 citations
- Patched Denoising Diffusion Models For High-Resolution Image SynthesisPoster26 citations
- PolyVoice: Language Models for Speech to Speech TranslationPoster26 citations
- Steve-Eye: Equipping LLM-based Embodied Agents with Visual Perception in Open WorldsPoster26 citations
- Transformer Fusion with Optimal TransportPoster26 citations
- Unified Generative Modeling of 3D Molecules with Bayesian Flow NetworksOral26 citations
- A Unified and General Framework for Continual LearningPoster25 citations
- DREAM: Dual Structured Exploration with Mixup for Open-set Graph Domain AdaptionPoster25 citations
- GIM: Learning Generalizable Image Matcher From Internet VideosSpotlight25 citations
- How Does Unlabeled Data Provably Help Out-of-Distribution Detection?Poster25 citations
- Image Translation as Diffusion Visual ProgrammersPoster25 citations
- Intriguing Properties of Data Attribution on Diffusion ModelsPoster25 citations
- Long-Short-Range Message-Passing: A Physics-Informed Framework to Capture Non-Local Interaction for Scalable Molecular Dynamics SimulationPoster25 citations
- Mastering Memory Tasks with World ModelsOral25 citations
- ODEFormer: Symbolic Regression of Dynamical Systems with TransformersSpotlight25 citations
- PhyloGFN: Phylogenetic inference with generative flow networksPoster25 citations
- Retrieval-Enhanced Contrastive Vision-Text ModelsPoster25 citations
- Revisiting Link Prediction: a data perspectivePoster25 citations
- SpikePoint: An Efficient Point-based Spiking Neural Network for Event Cameras Action RecognitionSpotlight25 citations
- CellPLM: Pre-training of Cell Language Model Beyond Single CellsPoster24 citations
- Consistency Training with Learnable Data Augmentation for Graph Anomaly Detection with Limited SupervisionSpotlight24 citations
- DQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context LearningPoster24 citations
- Efficient Video Diffusion Models via Content-Frame Motion-Latent DecompositionPoster24 citations
- Fast, Expressive $\mathrm{SE}(n)$ Equivariant Networks through Weight-Sharing in Position-Orientation SpacePoster24 citations
- FlashFFTConv: Efficient Convolutions for Long Sequences with Tensor CoresPoster24 citations
- Fourier Transporter: Bi-Equivariant Robotic Manipulation in 3DPoster24 citations
- Generative Sliced MMD Flows with Riesz KernelsPoster24 citations
- GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data GenerationPoster24 citations
- Guiding Masked Representation Learning to Capture Spatio-Temporal Relationship of ElectrocardiogramPoster24 citations
- Improving Non-Transferable Representation Learning by Harnessing Content and StyleSpotlight24 citations
- Learning to Reject with a Fixed Predictor: Application to DecontextualizationPoster24 citations
- Multisize Dataset CondensationOral24 citations
- Navigating the Design Space of Equivariant Diffusion-Based Generative Models for De Novo 3D Molecule GenerationPoster24 citations
- Parameter-Efficient Multi-Task Model Fusion with Partial LinearizationPoster24 citations
- Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language ModelsPoster24 citations
- Quadratic models for understanding catapult dynamics of neural networksPoster24 citations
- R&B: Region and Boundary Aware Zero-shot Grounded Text-to-image GenerationPoster24 citations
- SALMON: Self-Alignment with Instructable Reward ModelsPoster24 citations
- Scaling Laws for Sparsely-Connected Foundation ModelsSpotlight24 citations
- TAIL: Task-specific Adapters for Imitation Learning with Large Pretrained ModelsPoster24 citations
- Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language ModelsPoster24 citations
- The Trickle-down Impact of Reward Inconsistency on RLHFPoster24 citations
- Towards Diverse Behaviors: A Benchmark for Imitation Learning with Human DemonstrationsPoster24 citations
- Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy OptimizationPoster24 citations
- AGILE3D: Attention Guided Interactive Multi-object 3D SegmentationPoster23 citations
- Beyond Imitation: Leveraging Fine-grained Quality Signals for AlignmentPoster23 citations
- Curriculum reinforcement learning for quantum architecture search under hardware errorsPoster23 citations
- Debiased Collaborative Filtering with Kernel-Based Causal BalancingSpotlight23 citations
- Does CLIP’s generalization performance mainly stem from high train-test similarity?Poster23 citations
- Elastic Feature Consolidation For Cold Start Exemplar-Free Incremental LearningPoster23 citations
- Enabling Efficient Equivariant Operations in the Fourier Basis via Gaunt Tensor ProductsSpotlight23 citations
- Evaluating Language Model Agency Through NegotiationsPoster23 citations
- GeneOH Diffusion: Towards Generalizable Hand-Object Interaction Denoising via Denoising DiffusionPoster23 citations
- How to Fine-Tune Vision Models with SGDPoster23 citations
- Improving protein optimization with smoothed fitness landscapesPoster23 citations
- Neural Network-Based Score Estimation in Diffusion Models: Optimization and GeneralizationPoster23 citations
- PolyGCL: GRAPH CONTRASTIVE LEARNING via Learnable Spectral Polynomial FiltersSpotlight23 citations
- Provable Compositional Generalization for Object-Centric LearningOral23 citations
- RLCD: Reinforcement Learning from Contrastive Distillation for LM AlignmentPoster23 citations
- SPTNet: An Efficient Alternative Framework for Generalized Category Discovery with Spatial Prompt TuningPoster23 citations
- Str2Str: A Score-based Framework for Zero-shot Protein Conformation SamplingPoster23 citations
- Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human FeedbackPoster23 citations
- What does the Knowledge Neuron Thesis Have to do with Knowledge?Spotlight23 citations
- Be Careful What You Smooth For: Label Smoothing Can Be a Privacy Shield but Also a Catalyst for Model Inversion AttacksPoster22 citations
- Beyond Accuracy: Evaluating Self-Consistency of Code Large Language Models with IdentityChainPoster22 citations
- BioBridge: Bridging Biomedical Foundation Models via Knowledge GraphsPoster22 citations
- Boosting of Thoughts: Trial-and-Error Problem Solving with Large Language ModelsPoster22 citations
- CoBIT: A Contrastive Bi-directional Image-Text Generation ModelPoster22 citations
- Concept Bottleneck Generative ModelsPoster22 citations
- Conversational Drug Editing Using Retrieval and Domain FeedbackPoster22 citations
- DreamTime: An Improved Optimization Strategy for Diffusion-Guided 3D GenerationPoster22 citations
- Efficient Modulation for Vision NetworksPoster22 citations
- Embarrassingly Simple Dataset DistillationPoster22 citations
- FreeDyG: Frequency Enhanced Continuous-Time Dynamic Graph Model for Link PredictionPoster22 citations
- Generative Learning for Financial Time Series with Irregular and Scale-Invariant PatternsSpotlight22 citations
- HoloNets: Spectral Convolutions do extend to Directed GraphsPoster22 citations
- Idempotent Generative NetworkPoster22 citations
- Is ImageNet worth 1 video? Learning strong image encoders from 1 long unlabelled videoOral22 citations
- LayoutNUWA: Revealing the Hidden Layout Expertise of Large Language ModelsPoster22 citations
- Let Models Speak Ciphers: Multiagent Debate through EmbeddingsPoster22 citations
- MG-TSD: Multi-Granularity Time Series Diffusion Models with Guided Learning ProcessPoster22 citations
- Meta Continual Learning Revisited: Implicitly Enhancing Online Hessian Approximation via Variance ReductionOral22 citations
- Meta Inverse Constrained Reinforcement Learning: Convergence Guarantee and Generalization AnalysisPoster22 citations
- MgNO: Efficient Parameterization of Linear Operators via MultigridPoster22 citations
- OpenTab: Advancing Large Language Models as Open-domain Table ReasonersPoster22 citations
- Out-of-Distribution Detection with Negative PromptsPoster22 citations
- Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte CarloPoster22 citations
- SEGNO: Generalizing Equivariant Graph Neural Networks with Physical Inductive BiasesSpotlight22 citations
- SemiReward: A General Reward Model for Semi-supervised LearningPoster22 citations
- Spatio-Temporal Few-Shot Learning via Diffusive Neural Network GenerationPoster22 citations
- TESTAM: A Time-Enhanced Spatio-Temporal Attention Model with Mixture of ExpertsPoster22 citations
- Tool-Augmented Reward ModelingSpotlight22 citations
- CAMIL: Context-Aware Multiple Instance Learning for Cancer Detection and Subtyping in Whole Slide ImagesSpotlight21 citations
- CivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making AgentsSpotlight21 citations
- DIFFTACTILE: A Physics-based Differentiable Tactile Simulator for Contact-rich Robotic ManipulationPoster21 citations
- Deep Reinforcement Learning Guided Improvement Heuristic for Job Shop SchedulingPoster21 citations
- Efficient and Scalable Graph Generation through Iterative Local ExpansionPoster21 citations
- Escape Sky-high Cost: Early-stopping Self-Consistency for Multi-step ReasoningPoster21 citations
- FedImpro: Measuring and Improving Client Update in Federated LearningPoster21 citations
- Forward Learning with Top-Down Feedback: Empirical and Analytical CharacterizationPoster21 citations
- Fully Hyperbolic Convolutional Neural Networks for Computer VisionPoster21 citations
- GAIA: Zero-shot Talking Avatar GenerationPoster21 citations
- Hybrid Internal Model: Learning Agile Legged Locomotion with Simulated Robot ResponsePoster21 citations
- InstructCV: Instruction-Tuned Text-to-Image Diffusion Models as Vision GeneralistsPoster21 citations
- Interpretable Diffusion via Information DecompositionPoster21 citations
- Localizing and Editing Knowledge In Text-to-Image Generative ModelsPoster21 citations
- MUFFIN: Curating Multi-Faceted Instructions for Improving Instruction FollowingPoster21 citations
- Multi-Resolution Diffusion Models for Time Series ForecastingPoster21 citations
- Neuron Activation Coverage: Rethinking Out-of-distribution Detection and GeneralizationSpotlight21 citations
- ReMasker: Imputing Tabular Data with Masked AutoencodingPoster21 citations
- SF(DA)$^2$: Source-free Domain Adaptation Through the Lens of Data AugmentationPoster21 citations
- SGD Finds then Tunes Features in Two-Layer Neural Networks with near-Optimal Sample Complexity: A Case Study in the XOR problemSpotlight21 citations
- SafeDreamer: Safe Reinforcement Learning with World ModelsPoster21 citations
- Scaling Laws for Associative MemoriesSpotlight21 citations
- Smooth ECE: Principled Reliability Diagrams via Kernel SmoothingPoster21 citations
- Test-Time Training on Nearest Neighbors for Large Language ModelsPoster21 citations
- The Consensus Game: Language Model Generation via Equilibrium SearchSpotlight21 citations
- Towards Codable Watermarking for Injecting Multi-Bits Information to LLMsPoster21 citations
- Transformer-Modulated Diffusion Models for Probabilistic Multivariate Time Series ForecastingPoster21 citations
- Understanding In-Context Learning from RepetitionsPoster21 citations
- Zero-Shot Robustification of Zero-Shot ModelsPoster21 citations
- $\infty$-Diff: Infinite Resolution Diffusion with Subsampled Mollified StatesPoster20 citations
- Bespoke Solvers for Generative Flow ModelsSpotlight20 citations
- Closing the Gap between TD Learning and Supervised Learning - A Generalisation Point of View.Poster20 citations
- Consistent Video-to-Video Transfer Using Synthetic DatasetPoster20 citations
- Contrastive Learning is Spectral Clustering on Similarity GraphPoster20 citations
- Copula Conformal prediction for multi-step time series predictionPoster20 citations
- Data Distillation Can Be Like Vodka: Distilling More Times For Better QualityPoster20 citations
- Dynamic Sparse Training with Structured SparsityPoster20 citations
- Early Neuron Alignment in Two-layer ReLU Networks with Small InitializationPoster20 citations
- Early Stopping Against Label Noise Without Validation DataPoster20 citations
- Energy-based Automated Model EvaluationPoster20 citations
- FairTune: Optimizing Parameter Efficient Fine Tuning for Fairness in Medical Image AnalysisPoster20 citations
- Finite-Time Analysis of On-Policy Heterogeneous Federated Reinforcement LearningPoster20 citations
- Flow to Better: Offline Preference-based Reinforcement Learning via Preferred Trajectory GenerationPoster20 citations
- From Latent Graph to Latent Topology Inference: Differentiable Cell Complex ModulePoster20 citations
- Graph Transformers on EHRs: Better Representation Improves Downstream PerformancePoster20 citations
- Implicit bias of SGD in $L_2$-regularized linear DNNs: One-way jumps from high to low rankSpotlight20 citations
- Implicit regularization of deep residual networks towards neural ODEsSpotlight20 citations
- Inherently Interpretable Time Series Classification via Multiple Instance LearningSpotlight20 citations
- Is This the Subspace You Are Looking for? An Interpretability Illusion for Subspace Activation PatchingPoster20 citations
- Layer-wise linear mode connectivityPoster20 citations
- MOFDiff: Coarse-grained Diffusion for Metal-Organic Framework DesignPoster20 citations
- Multi-Task Reinforcement Learning with Mixture of Orthogonal ExpertsPoster20 citations
- Multi-granularity Correspondence Learning from Long-term Noisy VideosOral20 citations
- NECO: NEural Collapse Based Out-of-distribution detectionPoster20 citations
- NeuroBack: Improving CDCL SAT Solving using Graph Neural NetworksPoster20 citations
- Protein Multimer Structure Prediction via Prompt LearningPoster20 citations
- Protein-Ligand Interaction Prior for Binding-aware 3D Molecule Diffusion ModelsPoster20 citations
- RLIF: Interactive Imitation Learning as Reinforcement LearningPoster20 citations
- Rephrase, Augment, Reason: Visual Grounding of Questions for Vision-Language ModelsPoster20 citations
- Score Regularized Policy Optimization through Diffusion BehaviorPoster20 citations
- The Hidden Language of Diffusion ModelsPoster20 citations
- Towards Energy Efficient Spiking Neural Networks: An Unstructured Pruning FrameworkSpotlight20 citations
- Towards Green AI in Fine-tuning Large Language Models via Adaptive BackpropagationPoster20 citations
- Towards Unified Multi-Modal Personalization: Large Vision-Language Models for Generative Recommendation and BeyondPoster20 citations
- Trajeglish: Traffic Modeling as Next-Token PredictionPoster20 citations
- Transformer-VQ: Linear-Time Transformers via Vector QuantizationPoster20 citations
- Unmasking and Improving Data Credibility: A Study with Datasets for Training Harmless Language ModelsPoster20 citations
- A Simple Interpretable Transformer for Fine-Grained Image Classification and AnalysisPoster19 citations
- AutoVP: An Automated Visual Prompting Framework and BenchmarkPoster19 citations
- Batched Low-Rank Adaptation of Foundation ModelsOral19 citations
- Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision MakingSpotlight19 citations
- Deep Orthogonal Hypersphere Compression for Anomaly DetectionSpotlight19 citations
- Demystifying Local & Global Fairness Trade-offs in Federated Learning Using Partial Information DecompositionPoster19 citations
- Denoising Diffusion Step-aware ModelsPoster19 citations
- Discovering Temporally-Aware Reinforcement Learning AlgorithmsPoster19 citations
- Dissecting learning and forgetting in language model finetuningPoster19 citations
- Duolando: Follower GPT with Off-Policy Reinforcement Learning for Dance AccompanimentPoster19 citations
- EmerDiff: Emerging Pixel-level Semantic Knowledge in Diffusion ModelsPoster19 citations
- ExeDec: Execution Decomposition for Compositional Generalization in Neural Program SynthesisOral19 citations
- Few-Shot Detection of Machine-Generated Text using Style RepresentationsPoster19 citations
- Generative Modeling of Regular and Irregular Time Series Data via Koopman VAEsPoster19 citations
- How connectivity structure shapes rich and lazy learning in neural circuitsPoster19 citations
- LEMON: Lossless model expansionPoster19 citations
- LILO: Learning Interpretable Libraries by Compressing and Documenting CodePoster19 citations
- Learning Energy Decompositions for Partial Inference in GFlowNetsOral19 citations
- Learning to design protein-protein interactions with enhanced generalizationPoster19 citations
- Probabilistically Rewired Message-Passing Neural NetworksPoster19 citations
- Query-Policy Misalignment in Preference-Based Reinforcement LearningSpotlight19 citations
- Rethinking Complex Queries on Knowledge Graphs with Neural Link PredictorsPoster19 citations
- Sentence-level Prompts Benefit Composed Image RetrievalSpotlight19 citations
- Sin3DM: Learning a Diffusion Model from a Single 3D Textured ShapePoster19 citations
- Structuring Representation Geometry with Rotationally Equivariant Contrastive LearningPoster19 citations
- Supervised Knowledge Makes Large Language Models Better In-context LearnersPoster19 citations
- Test-time Adaptation against Multi-modal Reliability BiasPoster19 citations
- A Lightweight Method for Tackling Unknown Participation Statistics in Federated AveragingSpotlight18 citations
- AirPhyNet: Harnessing Physics-Guided Neural Networks for Air Quality PredictionPoster18 citations
- Beyond task performance: evaluating and reducing the flaws of large multimodal models with in-context-learningPoster18 citations
- CABINET: Content Relevance-based Noise Reduction for Table Question AnsweringSpotlight18 citations
- CODE REPRESENTATION LEARNING AT SCALEPoster18 citations
- Correlated Noise Provably Beats Independent Noise for Differentially Private LearningPoster18 citations
- Demystifying Embedding Spaces using Large Language ModelsPoster18 citations
- Don't Play Favorites: Minority Guidance for Diffusion ModelsPoster18 citations
- Efficient Subgraph GNNs by Learning Effective Selection PoliciesPoster18 citations
- Federated Orthogonal Training: Mitigating Global Catastrophic Forgetting in Continual Federated LearningPoster18 citations
- GENOME: Generative Neuro-Symbolic Visual Reasoning by Growing and Reusing ModulesPoster18 citations
- How Realistic Is Your Synthetic Data? Constraining Deep Generative Models for Tabular DataPoster18 citations
- Identifying Representations for Intervention ExtrapolationPoster18 citations
- Light Schrödinger BridgePoster18 citations
- Maximum Entropy Heterogeneous-Agent Reinforcement LearningSpotlight18 citations
- Multimodal Learning Without Labeled Multimodal Data: Guarantees and ApplicationsPoster18 citations
- Multimodal Molecular Pretraining via Modality BlendingPoster18 citations
- Multimodal Patient Representation Learning with Missing Modalities and LabelsPoster18 citations
- On the Provable Advantage of Unsupervised PretrainingSpotlight18 citations
- Parametric Augmentation for Time Series Contrastive LearningPoster18 citations
- Score-based generative models break the curse of dimensionality in learning a family of sub-Gaussian distributionsPoster18 citations
- Subtractive Mixture Models via Squaring: Representation and LearningSpotlight18 citations
- TOSS: High-quality Text-guided Novel View Synthesis from a Single ImagePoster18 citations
- Tackling the Data Heterogeneity in Asynchronous Federated Learning with Cached Update CalibrationPoster18 citations
- ValUES: A Framework for Systematic Validation of Uncertainty Estimation in Semantic SegmentationOral18 citations
- "What Data Benefits My Classifier?" Enhancing Model Performance and Interpretability through Influence-Based Data SelectionOral17 citations
- A Versatile Causal Discovery Framework to Allow Causally-Related Hidden VariablesPoster17 citations
- Adaptive Rational Activations to Boost Deep Reinforcement LearningSpotlight17 citations
- Analyzing Feed-Forward Blocks in Transformers through the Lens of Attention MapsSpotlight17 citations
- BatchPrompt: Accomplish more with lessPoster17 citations
- Bayes Conditional Distribution Estimation for Knowledge Distillation Based on Conditional Mutual InformationPoster17 citations
- Breaking Physical and Linguistic Borders: Multilingual Federated Prompt Tuning for Low-Resource LanguagesPoster17 citations
- CPPO: Continual Learning for Reinforcement Learning with Human FeedbackPoster17 citations
- Constrained Bi-Level Optimization: Proximal Lagrangian Value Function Approach and Hessian-free AlgorithmSpotlight17 citations
- DOS: Diverse Outlier Sampling for Out-of-Distribution DetectionPoster17 citations
- Debiasing Algorithm through Model AdaptationPoster17 citations
- Energy-Based Concept Bottleneck Models: Unifying Prediction, Concept Intervention, and Probabilistic InterpretationsPoster17 citations
- Energy-guided Entropic Neural Optimal TransportPoster17 citations
- FairSeg: A Large-Scale Medical Image Segmentation Dataset for Fairness Learning Using Segment Anything Model with Fair Error-Bound ScalingPoster17 citations
- Get What You Want, Not What You Don't: Image Content Suppression for Text-to-Image Diffusion ModelsPoster17 citations
- Graph Lottery Ticket AutomatedPoster17 citations
- Looped Transformers are Better at Learning Learning AlgorithmsPoster17 citations
- MOTOR: A Time-to-Event Foundation Model For Structured Medical RecordsSpotlight17 citations
- Multi-Scale Representations by Varying Window Attention for Semantic SegmentationPoster17 citations
- NOLA: Compressing LoRA using Linear Combination of Random BasisPoster17 citations
- Navigating Dataset Documentations in AI: A Large-Scale Analysis of Dataset Cards on HuggingFacePoster17 citations
- Non-Exchangeable Conformal Risk ControlPoster17 citations
- OVOR: OnePrompt with Virtual Outlier Regularization for Rehearsal-Free Class-Incremental LearningPoster17 citations
- Object centric architectures enable efficient causal representation learningPoster17 citations
- On Differentially Private Federated Linear Contextual BanditsPoster17 citations
- Pre-Training and Fine-Tuning Generative Flow NetworksSpotlight17 citations
- Pre-training Sequence, Structure, and Surface Features for Comprehensive Protein Representation LearningPoster17 citations
- Quasi-Monte Carlo for 3D Sliced WassersteinSpotlight17 citations
- Revisit and Outstrip Entity Alignment: A Perspective of Generative ModelsPoster17 citations
- Scalable Language Model with Generalized Continual LearningPoster17 citations
- Sparse Model Soups: A Recipe for Improved Pruning via Model AveragingPoster17 citations
- Stabilizing Contrastive RL: Techniques for Robotic Goal Reaching from Offline DataSpotlight17 citations
- Stable Neural Stochastic Differential Equations in Analyzing Irregular Time Series DataSpotlight17 citations
- Statistical Perspective of Top-K Sparse Softmax Gating Mixture of ExpertsPoster17 citations
- Submodular Reinforcement LearningSpotlight17 citations
- The Generalization Gap in Offline Reinforcement LearningPoster17 citations
- The Joint Effect of Task Similarity and Overparameterization on Catastrophic Forgetting — An Analytical ModelPoster17 citations
- Towards a statistical theory of data selection under weak supervisionOral17 citations
- Training Unbiased Diffusion Models From Biased DatasetPoster17 citations
- Backdoor Federated Learning by Poisoning Backdoor-Critical LayersPoster16 citations
- Bayesian Neural Controlled Differential Equations for Treatment Effect EstimationPoster16 citations
- Benchmarking Algorithms for Federated Domain GeneralizationSpotlight16 citations
- Class Incremental Learning via Likelihood Ratio Based Task PredictionPoster16 citations
- CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative DecodingPoster16 citations
- Complete and Efficient Graph Transformers for Crystal Material Property PredictionPoster16 citations
- Cross-Modal Contextualized Diffusion Models for Text-Guided Visual Generation and EditingPoster16 citations
- Diffusion in Diffusion: Cyclic One-Way Diffusion for Text-Vision-Conditioned GenerationPoster16 citations
- Domain-Agnostic Molecular Generation with Chemical FeedbackPoster16 citations
- DreamFlow: High-quality text-to-3D generation by Approximating Probability FlowSpotlight16 citations
- ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language ModelsPoster16 citations
- HYPO: Hyperspherical Out-Of-Distribution GeneralizationPoster16 citations
- Harnessing Density Ratios for Online Reinforcement LearningSpotlight16 citations
- How I Warped Your Noise: a Temporally-Correlated Noise Prior for Diffusion ModelsOral16 citations
- Idempotence and Perceptual Image CompressionSpotlight16 citations
- ImageNet-OOD: Deciphering Modern Out-of-Distribution Detection AlgorithmsPoster16 citations
- Learning Hierarchical World Models with Adaptive Temporal Abstractions from Discrete Latent DynamicsSpotlight16 citations
- Learning Optimal Contracts: How to Exploit Small Action SpacesPoster16 citations
- Lion Secretly Solves a Constrained Optimization: As Lyapunov PredictsSpotlight16 citations
- LitCab: Lightweight Language Model Calibration over Short- and Long-form ResponsesPoster16 citations
- Logical Languages Accepted by Transformer Encoders with Hard AttentionPoster16 citations
- MBR and QE Finetuning: Training-time Distillation of the Best and Most Expensive Decoding MethodsPoster16 citations
- MetaCoCo: A New Few-Shot Classification Benchmark with Spurious CorrelationPoster16 citations
- Mirage: Model-agnostic Graph Distillation for Graph ClassificationPoster16 citations
- ODICE: Revealing the Mystery of Distribution Correction Estimation via Orthogonal-gradient UpdateSpotlight16 citations
- Rethinking Channel Dimensions to Isolate Outliers for Low-bit Weight Quantization of Large Language ModelsPoster16 citations
- Social-Transmotion: Promptable Human Trajectory PredictionPoster16 citations
- SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous ManipulationPoster16 citations
- Understanding Augmentation-based Self-Supervised Representation Learning via RKHS Approximation and RegressionSpotlight16 citations
- Understanding Certified Training with Interval Bound PropagationPoster16 citations
- Understanding Convergence and Generalization in Federated Learning through Feature Learning TheoryPoster16 citations
- UniTabE: A Universal Pretraining Protocol for Tabular Foundation Model in Data SciencePoster16 citations
- Unprocessing Seven Years of Algorithmic FairnessOral16 citations
- 3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud PretrainingPoster15 citations
- A Restoration Network as an Implicit PriorPoster15 citations
- Active Test-Time Adaptation: Theoretical Analyses and An AlgorithmPoster15 citations
- Adversarial Adaptive Sampling: Unify PINN and Optimal Transport for the Approximation of PDEsPoster15 citations
- Adversarial Training Should Be Cast as a Non-Zero-Sum GamePoster15 citations
- Benign Oscillation of Stochastic Gradient Descent with Large Learning RatePoster15 citations
- CLIP the Bias: How Useful is Balancing Data in Multimodal Learning?Poster15 citations
- Causal Modelling Agents: Causal Graph Discovery through Synergising Metadata- and Data-driven ReasoningPoster15 citations
- CausalTime: Realistically Generated Time-series for Benchmarking of Causal DiscoveryPoster15 citations
- CircuitNet 2.0: An Advanced Dataset for Promoting Machine Learning Innovations in Realistic Chip Design EnvironmentPoster15 citations
- Compressed Context Memory for Online Language Model InteractionPoster15 citations
- ConR: Contrastive Regularizer for Deep Imbalanced RegressionPoster15 citations
- Context-Aware Meta-LearningPoster15 citations
- Contrastive Difference Predictive CodingPoster15 citations
- DecompOpt: Controllable and Decomposed Diffusion Models for Structure-based Molecular OptimizationPoster15 citations
- Denoising Task Routing for Diffusion ModelsPoster15 citations
- Distinguished In Uniform: Self-Attention Vs. Virtual NodesPoster15 citations
- Dual-Encoders for Extreme Multi-label ClassificationPoster15 citations
- Enhancing One-Shot Federated Learning Through Data and Ensemble Co-BoostingPoster15 citations
- Exploring Diffusion Time-steps for Unsupervised Representation LearningPoster15 citations
- FairerCLIP: Debiasing CLIP's Zero-Shot Predictions using Functions in RKHSsPoster15 citations
- Feature emergence via margin maximization: case studies in algebraic tasksSpotlight15 citations
- GRANDE: Gradient-Based Decision Tree Ensembles for Tabular DataPoster15 citations
- Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMsPoster15 citations
- Ghost on the Shell: An Expressive Representation of General 3D ShapesOral15 citations
- HAZARD Challenge: Embodied Decision Making in Dynamically Changing EnvironmentsPoster15 citations
- Hierarchical Context Merging: Better Long Context Understanding for Pre-trained LLMsPoster15 citations
- Identifiable Latent Polynomial Causal Models through the Lens of ChangePoster15 citations
- Image Clustering via the Principle of Rate Reduction in the Age of Pretrained ModelsPoster15 citations
- Improving Convergence and Generalization Using Parameter SymmetriesOral15 citations
- Label-Agnostic Forgetting: A Supervision-Free Unlearning in Deep ModelsPoster15 citations
- Language Model Detectors Are Easily Optimized AgainstPoster15 citations
- Learning the greatest common divisor: explaining transformer predictionsSpotlight15 citations
- LoTa-Bench: Benchmarking Language-oriented Task Planners for Embodied AgentsPoster15 citations
- Maximum Likelihood Estimation is All You Need for Well-Specified Covariate ShiftPoster15 citations
- Neuro-Inspired Information-Theoretic Hierarchical Perception for Multimodal LearningPoster15 citations
- Parallelizing non-linear sequential models over the sequence lengthPoster15 citations
- Pre-Training Goal-based Models for Sample-Efficient Reinforcement LearningOral15 citations
- Provable Reward-Agnostic Preference-Based Reinforcement LearningSpotlight15 citations
- Proximal Policy Gradient Arborescence for Quality Diversity Reinforcement LearningSpotlight15 citations
- Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training StagesPoster15 citations
- SAN: Inducing Metrizability of GAN with Discriminative Normalized Linear LayerPoster15 citations
- SCHEMA: State CHangEs MAtter for Procedure Planning in Instructional VideosPoster15 citations
- SYMBOL: Generating Flexible Black-Box Optimizers through Symbolic Equation LearningPoster15 citations
- Searching for High-Value Molecules Using Reinforcement Learning and TransformersPoster15 citations
- Selective Visual Representations Improve Convergence and Generalization for Embodied AISpotlight15 citations
- Self-Supervised Speech Quality Estimation and Enhancement Using Only Clean SpeechPoster15 citations
- Sliced Wasserstein Estimation with Control VariatesPoster15 citations
- Soft Robust MDPs and Risk-Sensitive MDPs: Equivalence, Policy Gradient, and Sample ComplexityPoster15 citations
- The Devil is in the Neurons: Interpreting and Mitigating Social Biases in Language ModelsPoster15 citations
- Towards Robust Fidelity for Evaluating Explainability of Graph Neural NetworksPoster15 citations
- USB-NeRF: Unrolling Shutter Bundle Adjusted Neural Radiance FieldsPoster15 citations
- Uncertainty-aware Constraint Inference in Inverse Constrained Reinforcement LearningPoster15 citations
- Understanding Transferable Representation Learning and Zero-shot Transfer in CLIPPoster15 citations
- Variance-aware Regret Bounds for Stochastic Contextual Dueling BanditsPoster15 citations
- Why is SAM Robust to Label Noise?Poster15 citations
- Yet Another ICU Benchmark: A Flexible Multi-Center Framework for Clinical MLPoster15 citations
- Zero and Few-shot Semantic Parsing with Ambiguous InputsPoster15 citations
- A Graph is Worth 1-bit Spikes: When Graph Contrastive Learning Meets Spiking Neural NetworksPoster14 citations
- ASID: Active Exploration for System Identification in Robotic ManipulationOral14 citations
- Abstractors and relational cross-attention: An inductive bias for explicit relational reasoning in TransformersPoster14 citations
- Accurate Forgetting for Heterogeneous Federated Continual LearningPoster14 citations
- An Efficient Tester-Learner for HalfspacesPoster14 citations
- Clifford Group Equivariant Simplicial Message Passing NetworksPoster14 citations
- Compositional Generative Inverse DesignSpotlight14 citations
- Deep SE(3)-Equivariant Geometric Reasoning for Precise Placement TasksPoster14 citations
- Dissecting Sample Hardness: A Fine-Grained Analysis of Hardness Characterization Methods for Data-Centric AIPoster14 citations
- Entity-Centric Reinforcement Learning for Object Manipulation from PixelsSpotlight14 citations
- FedCompass: Efficient Cross-Silo Federated Learning on Heterogeneous Client Devices Using a Computing Power-Aware SchedulerPoster14 citations
- Federated Q-Learning: Linear Regret Speedup with Low Communication CostPoster14 citations
- GNNX-BENCH: Unravelling the Utility of Perturbation-based GNN Explainers through In-depth BenchmarkingPoster14 citations
- Generative Modeling with Phase Stochastic BridgeOral14 citations
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.