← All conferences

AAAI 2025 Accepted Papers

The full list of 3,478 papers accepted at AAAI 2025 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Technical: 3,478
  1. Language Prompt for Autonomous DrivingTechnical238 citations
  2. U-KAN Makes Strong Backbone for Medical Image Segmentation and GenerationTechnical155 citations
  3. FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual PromptsTechnical146 citations
  4. EfficientVMamba: Atrous Selective Scan for Light Weight Visual MambaTechnical115 citations
  5. Point Cloud Mamba: Point Cloud Learning via State Space ModelTechnical83 citations
  6. Segment Any 3D GaussiansTechnical82 citations
  7. SatCLIP: Global, General-Purpose Location Embeddings with Satellite ImageryTechnical75 citations
  8. Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient InferenceTechnical72 citations
  9. LiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR UnderstandingTechnical68 citations
  10. IMAGDressing-v1: Customizable Virtual DressingTechnical67 citations
  11. DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video GenerationTechnical62 citations
  12. OOTDiffusion: Outfitting Fusion Based Latent Diffusion for Controllable Virtual Try-OnTechnical62 citations
  13. Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion ModelsTechnical58 citations
  14. EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark ConditionsTechnical53 citations
  15. Follow-Your-Click: Open-domain Regional Image Animation via Motion PromptsTechnical52 citations
  16. Deep Reinforcement Learning for Robotics: A Survey of Real-World SuccessesTechnical48 citations
  17. Augmenting Math Word Problems via Iterative Question ComposingTechnical47 citations
  18. Evaluating Mathematical Reasoning Beyond AccuracyTechnical39 citations
  19. XCOT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought ReasoningTechnical39 citations
  20. Key-Point-Driven Data Synthesis with Its Enhancement on Mathematical ReasoningTechnical37 citations
  21. ELLA-V: Stable Neural Codec Language Modeling with Alignment-Guided Sequence ReorderingTechnical36 citations
  22. DiffScene: Diffusion-Based Safety-Critical Scenario Generation for Autonomous VehiclesTechnical34 citations
  23. AnalogCoder: Analog Circuit Design via Training-Free Code GenerationTechnical29 citations
  24. Boosting Multimodal Large Language Models with Visual Tokens Withdrawal for Rapid InferenceTechnical29 citations
  25. Visual Prompting Upgrades Neural Network Sparsification: A Data-Model PerspectiveTechnical29 citations
  26. SafetyPrompts: A Systematic Review of Open Datasets for Evaluating and Improving Large Language Model SafetyTechnical27 citations
  27. DME-Driver: Integrating Human Decision Logic and 3D Scene Perception in Autonomous DrivingTechnical25 citations
  28. MARS: Mixture of Auto-Regressive Models for Fine-grained Text-to-image SynthesisTechnical25 citations
  29. CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition AbilitiesTechnical24 citations
  30. Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI FeedbackTechnical24 citations
  31. Revisiting Multimodal Emotion Recognition in Conversation from the Perspective of Graph SpectrumTechnical24 citations
  32. V2Xum-LLM: Cross-Modal Video Summarization with Temporal Prompt Instruction TuningTechnical24 citations
  33. VTG-LLM: Integrating Timestamp Knowledge into Video LLMs for Enhanced Video Temporal GroundingTechnical24 citations
  34. Calibrating Large Language Models with Sample ConsistencyTechnical22 citations
  35. DiT4Edit: Diffusion Transformer for Image EditingTechnical22 citations
  36. Image Conductor: Precision Control for Interactive Video SynthesisTechnical22 citations
  37. WebPilot: A Versatile and Autonomous Multi-Agent System for Web Task Execution with Strategic ExplorationTechnical21 citations
  38. LLM4GEN: Leveraging Semantic Representation of LLMs for Text-to-Image GenerationTechnical20 citations
  39. MENTOR: Multi-level Self-supervised Learning for Multimodal RecommendationTechnical20 citations
  40. Open Models, Closed Minds? On Agents Capabilities in Mimicking Human Personalities through Open Large Language ModelsTechnical20 citations
  41. TinySAM: Pushing the Envelope for Efficient Segment Anything ModelTechnical20 citations
  42. Unlearning Concepts in Diffusion Model via Concept Domain Correction and Concept Preserving GradientTechnical20 citations
  43. GFlow: Recovering 4D World from Monocular VideoTechnical19 citations
  44. Math-PUMA: Progressive Upward Multimodal Alignment to Enhance Mathematical ReasoningTechnical19 citations
  45. MultiBooth: Towards Generating All Your Concepts in an Image from TextTechnical19 citations
  46. Ultra-High Resolution Segmentation via Boundary-Enhanced Patch-Merging TransformerTechnical19 citations
  47. VerilogCoder: Autonomous Verilog Coding Agents with Graph-based Planning and Abstract Syntax Tree (AST)-based Waveform Tracing ToolTechnical19 citations
  48. BLADE: Enhancing Black-Box Large Language Models with Small Domain-Specific ModelsTechnical18 citations
  49. Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction CycleTechnical18 citations
  50. Language-Models-as-a-Service: Overview of a New Paradigm and its ChallengesTechnical18 citations
  51. OpenVIS: Open-vocabulary Video Instance SegmentationTechnical18 citations
  52. ParGo: Bridging Vision-Language with Partial and Global ViewsTechnical18 citations
  53. Selective Forgetting: Advancing Machine Unlearning Techniques and Evaluation in Language ModelsTechnical18 citations
  54. Axioms for AI Alignment from Human FeedbackTechnical17 citations
  55. LazyDiT: Lazy Learning for the Acceleration of Diffusion TransformersTechnical17 citations
  56. Unleashing the Potential of Large Language Models as Prompt Optimizers: Analogical Analysis with Gradient-based Model OptimizersTechnical17 citations
  57. CALF: Aligning LLMs for Time Series Forecasting via Cross-modal Fine-TuningTechnical16 citations
  58. Causal Prompting: Debiasing Large Language Model Prompting Based on Front-Door AdjustmentTechnical16 citations
  59. HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language ModelsTechnical16 citations
  60. Improving Complex Reasoning over Knowledge Graph with Logic-Aware Curriculum TuningTechnical16 citations
  61. Read, Watch and Scream! Sound Generation from Text and VideoTechnical16 citations
  62. Transformer Layers as PaintersTechnical16 citations
  63. End-to-End Autonomous Driving Through V2X CooperationTechnical15 citations
  64. Learning Personalized Decision Support PoliciesTechnical15 citations
  65. Fair Text-to-Image Diffusion via Fair MappingTechnical14 citations
  66. PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud LearningTechnical14 citations
  67. 3DMambaIPF: A State Space Model for Iterative Point Cloud Filtering via Differentiable RenderingTechnical13 citations
  68. Fit and Prune: Fast and Training-free Visual Token Pruning for Multi-modal Large Language ModelsTechnical13 citations
  69. Learning to Prompt with Text Only Supervision for Vision-Language ModelsTechnical13 citations
  70. QJL: 1-Bit Quantized JL Transform for KV Cache Quantization with Zero OverheadTechnical13 citations
  71. Attentive Eraser: Unleashing Diffusion Model’s Object Removal Potential via Self-Attention Redirection GuidanceTechnical12 citations
  72. CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and CompatibilityTechnical12 citations
  73. Increased Compute Efficiency and the Diffusion of AI CapabilitiesTechnical12 citations
  74. JEN-1 Composer: A Unified Framework for High-Fidelity Multi-Track Music GenerationTechnical12 citations
  75. MAGIC: Generating Self-Correction Guideline for In-Context Text-to-SQLTechnical12 citations
  76. MUSE: Mamba Is Efficient Multi-scale Learner for Text-video RetrievalTechnical12 citations
  77. Toward Falsifying Causal Graphs Using a Permutation-Based TestTechnical12 citations
  78. TranSplat: Generalizable 3D Gaussian Splatting from Sparse Multi-View Images with TransformersTechnical12 citations
  79. Prompt Compression with Context-Aware Sentence Encoding for Fast and Improved LLM InferenceTechnical11 citations
  80. ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained GuidanceTechnical11 citations
  81. SCALM: Detecting Bad Practices in Smart Contracts Through LLMsTechnical11 citations
  82. SWIFT: A Scalable Lightweight Infrastructure for Fine-TuningTechnical11 citations
  83. Scalable Quantum-Inspired Optimization Through Dynamic Qubit CompressionTechnical11 citations
  84. SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject ControlTechnical11 citations
  85. Towards Adversarially Robust Dataset Distillation by Curvature RegularizationTechnical11 citations
  86. TrackGo: A Flexible and Efficient Method for Controllable Video GenerationTechnical11 citations
  87. B2Opt: Learning to Optimize Black-box Optimization with Little BudgetTechnical10 citations
  88. BindGPT: A Scalable Framework for 3D Molecular Design via Language Modeling and Reinforcement LearningTechnical10 citations
  89. C2P-CLIP: Injecting Category Common Prompt in CLIP to Enhance Generalization in Deepfake DetectionTechnical10 citations
  90. C3oT: Generating Shorter Chain-of-Thought Without Compromising EffectivenessTechnical10 citations
  91. ChatTime: A Unified Multimodal Time Series Foundation Model Bridging Numerical and Textual DataTechnical10 citations
  92. Epsilon: Exploring Comprehensive Visual-Semantic Projection for Multi-Label Zero-Shot LearningTechnical10 citations
  93. Evaluating the Evaluator: Measuring LLMs’ Adherence to Task Evaluation InstructionsTechnical10 citations
  94. Explore In-Context Segmentation via Latent Diffusion ModelsTechnical10 citations
  95. FoldToken: Learning Protein Language via Vector Quantization and BeyondTechnical10 citations
  96. MuMA-ToM: Multi-modal Multi-Agent Theory of MindTechnical10 citations
  97. Numerical Pruning for Efficient Autoregressive ModelsTechnical10 citations
  98. ResAdapter: Domain Consistent Resolution Adapter for Diffusion ModelsTechnical10 citations
  99. VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion ModelsTechnical10 citations
  100. AutoMMLab: Automatically Generating Deployable Models from Language Instructions for Computer Vision TasksTechnical9 citations
  101. ChemVLM: Exploring the Power of Multimodal Large Language Models in Chemistry AreaTechnical9 citations
  102. Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language ModelsTechnical9 citations
  103. Envisioning Class Entity Reasoning by Large Language Models for Few-shot LearningTechnical9 citations
  104. Grounded Multi-Hop VideoQA in Long-Form Egocentric VideosTechnical9 citations
  105. Spectral Motion Alignment for Video Motion Transfer Using Diffusion ModelsTechnical9 citations
  106. StyO: Stylize Your Face in Only One-ShotTechnical9 citations
  107. Towards a Comprehensive, Efficient and Promptable Anatomic Structure Segmentation Model Using 3D Whole-Body CT ScansTechnical9 citations
  108. Unlocking the Power of LSTM for Long Term Time Series ForecastingTechnical9 citations
  109. VQA4CIR: Boosting Composed Image Retrieval with Visual Question AnsweringTechnical9 citations
  110. Yuan: Yielding Unblemished Aesthetics Through a Unified Network for Visual Imperfections Removal in Generated ImagesTechnical9 citations
  111. Adaptive Guidance: Training-free Acceleration of Conditional Diffusion ModelsTechnical8 citations
  112. Affordances-Oriented Planning Using Foundation Models for Continuous Vision-Language NavigationTechnical8 citations
  113. DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual SlimmingTechnical8 citations
  114. Enhancing Decision-Making for LLM Agents via Step-Level Q-Value ModelsTechnical8 citations
  115. Evolutionary Large Language Model for Automated Feature TransformationTechnical8 citations
  116. Exploiting Multimodal Spatial-temporal Patterns for Video Object TrackingTechnical8 citations
  117. Flash Diffusion: Accelerating Any Conditional Diffusion Model for Few Steps Image GenerationTechnical8 citations
  118. Graphic Design with Large Multimodal ModelTechnical8 citations
  119. Harnessing Multimodal Large Language Models for Multimodal Sequential RecommendationTechnical8 citations
  120. InstructAvatar: Text-Guided Emotion and Motion Control for Avatar GenerationTechnical8 citations
  121. Is Sarcasm Detection a Step-by-Step Reasoning Process in Large Language Models?Technical8 citations
  122. KITS: Inductive Spatio-Temporal Kriging with Increment Training StrategyTechnical8 citations
  123. Learning Logic Specifications for Policy Guidance in POMDPs: an Inductive Logic Programming ApproachTechnical8 citations
  124. MagicMan: Generative Novel View Synthesis of Humans with 3D-Aware Diffusion and Iterative RefinementTechnical8 citations
  125. MegActor-Sigma: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion TransformerTechnical8 citations
  126. MindTuner: Cross-Subject Visual Decoding with Visual Fingerprint and Semantic CorrectionTechnical8 citations
  127. One Token Can Help! Learning Scalable and Pluggable Virtual Tokens for Retrieval-Augmented Large Language ModelsTechnical8 citations
  128. Stable-Hair: Real-World Hair Transfer via Diffusion ModelTechnical8 citations
  129. Stochastic Online Instrumental Variable Regression: Regrets for Endogeneity and Bandit FeedbackTechnical8 citations
  130. Structured Packing in LLM Training Improves Long Context UtilizationTechnical8 citations
  131. Synergistic Multi-Agent Framework with Trajectory Learning for Knowledge-Intensive TasksTechnical8 citations
  132. Tuning-Free Accountable Intervention for LLM Deployment – a Metacognitive ApproachTechnical8 citations
  133. Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models ReasoningTechnical8 citations
  134. VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion TransformersTechnical8 citations
  135. A Comprehensive Overhaul of Multimodal Assistant with Small Language ModelsTechnical7 citations
  136. A Domain-Independent Agent Architecture for Adaptive Operation in Evolving Open WorldsTechnical7 citations
  137. AGLLDiff: Guiding Diffusion Models Towards Unsupervised Training-free Real-world Low-light Image EnhancementTechnical7 citations
  138. CaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with DiffusionTechnical7 citations
  139. Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language ModelTechnical7 citations
  140. DELTA: Pre-Train a Discriminative Encoder for Legal Case Retrieval via Structural Word AlignmentTechnical7 citations
  141. DiffuseHigh: Training-Free Progressive High-Resolution Image Synthesis Through Structure GuidanceTechnical7 citations
  142. DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view InputTechnical7 citations
  143. ExcluIR: Exclusionary Neural Information RetrievalTechnical7 citations
  144. FastLGS: Speeding Up Language Embedded Gaussians with Feature Grid MappingTechnical7 citations
  145. Geolocation Representation from Large Language Models Are Generic Enhancers for Spatio-Temporal LearningTechnical7 citations
  146. Improving Retrieval Augmented Language Model with Self-ReasoningTechnical7 citations
  147. L4DR: LiDAR-4DRadar Fusion for Weather-Robust 3D Object DetectionTechnical7 citations
  148. Learning 2D Invariant Affordance Knowledge for 3D Affordance GroundingTechnical7 citations
  149. MV-VTON: Multi-View Virtual Try-On with Diffusion ModelsTechnical7 citations
  150. Multi-Objective Evolution of Heuristic Using Large Language ModelTechnical7 citations
  151. On Effects of Steering Latent Representation for Large Language Model UnlearningTechnical7 citations
  152. ParZC: Parametric Zero-Cost Proxies for Efficient NASTechnical7 citations
  153. Perception-Guided Jailbreak Against Text-to-Image ModelsTechnical7 citations
  154. RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style GuidanceTechnical7 citations
  155. Re2LLM: Reflective Reinforcement Large Language Model for Session-based RecommendationTechnical7 citations
  156. S^3cMath: Spontaneous Step-Level Self-Correction Makes Large Language Models Better Mathematical ReasonersTechnical7 citations
  157. SafeInfer: Context Adaptive Decoding Time Safety Alignment for Large Language ModelsTechnical7 citations
  158. Shield Synthesis for LTL Modulo TheoriesTechnical7 citations
  159. SpikingSSMs: Learning Long Sequences with Sparse and Parallel Spiking State Space ModelsTechnical7 citations
  160. Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language ModelsTechnical7 citations
  161. Advancing Spiking Neural Networks Towards Multiscale Spatiotemporal Interaction LearningTechnical6 citations
  162. An Item Is Worth a Prompt: Versatile Image Editing with Disentangled ControlTechnical6 citations
  163. Audio Entailment: Assessing Deductive Reasoning for Audio UnderstandingTechnical6 citations
  164. Boosting Segment Anything Model Towards Open-Vocabulary LearningTechnical6 citations
  165. CustomContrast: A Multilevel Contrastive Perspective for Subject-Driven Text-to-Image CustomizationTechnical6 citations
  166. DABL: Detecting Semantic Anomalies in Business Processes Using Large Language ModelsTechnical6 citations
  167. DPLUT: Unsupervised Low-light Image Enhancement with Lookup Tables and Diffusion PriorsTechnical6 citations
  168. EBBS: An Ensemble with Bi-Level Beam Search for Zero-Shot Machine TranslationTechnical6 citations
  169. Frame Order Matters: A Temporal Sequence-Aware Model for Few-Shot Action RecognitionTechnical6 citations
  170. HandDiffuse: Generative Controllers for Two-Hand Interactions via Diffusion ModelsTechnical6 citations
  171. LEARN: Knowledge Adaptation from Large Language Model to Recommendation for Practical Industrial ApplicationTechnical6 citations
  172. Local Conditional Controlling for Text-to-Image Diffusion ModelsTechnical6 citations
  173. MSP-MVS: Multi-Granularity Segmentation Prior Guided Multi-View StereoTechnical6 citations
  174. OV-DQUO: Open-Vocabulary DETR with Denoising Text Query Training and Open-World Unknown Objects SupervisionTechnical6 citations
  175. Object-level Geometric Structure Preserving for Natural Image StitchingTechnical6 citations
  176. PNVC: Towards Practical INR-based Video CompressionTechnical6 citations
  177. Patch-level Sounding Object Tracking for Audio-Visual Question AnsweringTechnical6 citations
  178. Pedestrian Attribute Recognition: A New Benchmark Dataset and a Large Language Model Augmented FrameworkTechnical6 citations
  179. Personalized Federated Collaborative Filtering: A Variational AutoEncoder ApproachTechnical6 citations
  180. PhishAgent: A Robust Multimodal Agent for Phishing Webpage DetectionTechnical6 citations
  181. Resolving Multi-Condition Confusion for Finetuning-Free Personalized Image GenerationTechnical6 citations
  182. Robust Performance Incentivizing Algorithms for Multi-Armed Bandits with Strategic AgentsTechnical6 citations
  183. SlerpFace: Face Template Protection via Spherical Linear InterpolationTechnical6 citations
  184. TableBench: A Comprehensive and Complex Benchmark for Table Question AnsweringTechnical6 citations
  185. TextToucher: Fine-Grained Text-to-Touch GenerationTechnical6 citations
  186. The Bandit Whisperer: Communication Learning for Restless BanditsTechnical6 citations
  187. Towards Generalizable Multi-Camera 3D Object Detection via Perspective RenderingTechnical6 citations
  188. VIoTGPT: Learning to Schedule Vision Tools Towards Intelligent Video Internet of ThingsTechnical6 citations
  189. Verifying Proportionality in Temporal VotingTechnical6 citations
  190. What Are Step-Level Reward Models Rewarding? Counterintuitive Findings from MCTS-Boosted Mathematical ReasoningTechnical6 citations
  191. AI-Driven Virtual Teacher for Enhanced Educational Efficiency: Leveraging Large Pretrain Models for Autonomous Error Analysis and CorrectionTechnical5 citations
  192. Adaptive Computation Modules: Granular Conditional Computation for Efficient InferenceTechnical5 citations
  193. Adaptive Multi-Scale Decomposition Framework for Time Series ForecastingTechnical5 citations
  194. AttackBench: Evaluating Gradient-based Attacks for Adversarial ExamplesTechnical5 citations
  195. Automating Thought of Search: A Journey Towards Soundness and Completeness (Student Abstract)Technical5 citations
  196. Bayesian Low-Rank Learning (Bella): A Practical Approach to Bayesian Neural NetworksTechnical5 citations
  197. CLIP-CID: Efficient CLIP Distillation via Cluster-Instance DiscriminationTechnical5 citations
  198. CVLUE: A New Benchmark Dataset for Chinese Vision-Language Understanding EvaluationTechnical5 citations
  199. Can We Get Rid of Handcrafted Feature Extractors? SparseViT: Nonsemantics-Centered, Parameter-Efficient Image Manipulation Localization Through Spare-Coding TransformerTechnical5 citations
  200. ChatBug: A Common Vulnerability of Aligned LLMs Induced by Chat TemplatesTechnical5 citations
  201. CoMT: A Novel Benchmark for Chain of Multi-modal Thought on Large Vision-Language ModelsTechnical5 citations
  202. ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language ModelsTechnical5 citations
  203. ConfigX: Modular Configuration for Evolutionary Algorithms via Multitask Reinforcement LearningTechnical5 citations
  204. Conformal Thresholded Intervals for Efficient RegressionTechnical5 citations
  205. Conformalized Interval Arithmetic with Symmetric CalibrationTechnical5 citations
  206. CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAGTechnical5 citations
  207. DeMo: Decoupled Feature-Based Mixture of Experts for Multi-Modal Object Re-IdentificationTechnical5 citations
  208. DisCo: Graph-Based Disentangled Contrastive Learning for Cold-Start Cross-Domain RecommendationTechnical5 citations
  209. Efficient 3D Recognition with Event-driven Spike Sparse ConvolutionTechnical5 citations
  210. Empowering LLMs with Pseudo-Untrimmed Videos for Audio-Visual Temporal UnderstandingTechnical5 citations
  211. Epistemic EFX Allocations Exist for Monotone ValuationsTechnical5 citations
  212. Exploring Enhanced Contextual Information for Video-Level Object TrackingTechnical5 citations
  213. Fields of The World: A Machine Learning Benchmark Dataset for Global Agricultural Field Boundary SegmentationTechnical5 citations
  214. From PEFT to DEFT: Parameter Efficient Finetuning for Reducing Activation Density in TransformersTechnical5 citations
  215. GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and LocalizationTechnical5 citations
  216. HSEvo: Elevating Automatic Heuristic Design with Diversity-Driven Harmony Search and Genetic Algorithm Using LLMsTechnical5 citations
  217. Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMsTechnical5 citations
  218. Large Language Model Meets Graph Neural Network in Knowledge DistillationTechnical5 citations
  219. Learning Deep Dissipative DynamicsTechnical5 citations
  220. MM-CamObj: A Comprehensive Multimodal Dataset for Camouflaged Object ScenariosTechnical5 citations
  221. MOS: Model Surgery for Pre-Trained Model-Based Class-Incremental LearningTechnical5 citations
  222. Mamba YOLO: A Simple Baseline for Object Detection with State Space ModelTechnical5 citations
  223. MoE-LPR: Multilingual Extension of Large Language Models Through Mixture-of-Experts with Language Priors RoutingTechnical5 citations
  224. Multi-Level Optimal Transport for Universal Cross-Tokenizer Knowledge Distillation on Language ModelsTechnical5 citations
  225. NightHaze: Nighttime Image Dehazing via Self-Prior LearningTechnical5 citations
  226. Recoverable Compression: A Multimodal Vision Token Recovery Mechanism Guided by Text InformationTechnical5 citations
  227. STD-PLM: Understanding Both Spatial and Temporal Properties of Spatial-Temporal Data with PLMTechnical5 citations
  228. SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement LearningTechnical5 citations
  229. Scaling Combinatorial Optimization Neural Improvement Heuristics with Online Search and AdaptationTechnical5 citations
  230. SparX: A Sparse Cross-Layer Connection Mechanism for Hierarchical Vision Mamba and Transformer NetworksTechnical5 citations
  231. Sum of Squares CircuitsTechnical5 citations
  232. Sweeping Heterogeneity with Smart MoPs: Mixture of Prompts for LLM Task AdaptationTechnical5 citations
  233. The AI Race: Why Current Neural Network-based Architectures are a Poor Basis for Artificial General IntelligenceTechnical5 citations
  234. TimeCMA: Towards LLM-Empowered Multivariate Time Series Forecasting via Cross-Modality AlignmentTechnical5 citations
  235. Trusted Unified Feature-Neighborhood Dynamics for Multi-View ClassificationTechnical5 citations
  236. Unsupervised Audio-Visual Segmentation with Modality AlignmentTechnical5 citations
  237. UrBench: A Comprehensive Benchmark for Evaluating Large Multimodal Models in Multi-View Urban ScenariosTechnical5 citations
  238. Video Diffusion Models Are Strong Video InpainterTechnical5 citations
  239. Why AI Is WEIRD and Shouldn't Be This Way: Towards AI for Everyone, with Everyone, by EveryoneTechnical5 citations
  240. A Comprehensive Evaluation on Event Reasoning of Large Language ModelsTechnical4 citations
  241. ACPBench: Reasoning About Action, Change, and PlanningTechnical4 citations
  242. AE-NeRF: Augmenting Event-Based Neural Radiance Fields for Non-ideal Conditions and Larger ScenesTechnical4 citations
  243. AIM: Let Any Multimodal Large Language Models Embrace Efficient In-Context LearningTechnical4 citations
  244. Adaptive Draft-Verification for Efficient Large Language Model DecodingTechnical4 citations
  245. AutoSGNN: Automatic Propagation Mechanism Discovery for Spectral Graph Neural NetworksTechnical4 citations
  246. Braess’s Paradox of Generative AITechnical4 citations
  247. Can Generative Models Improve Self-Supervised Representation Learning?Technical4 citations
  248. Can LVLMs Obtain a Driver’s License? A Benchmark Towards Reliable AGI for Autonomous DrivingTechnical4 citations
  249. Can Watermarking Large Language Models Prevent Copyrighted Text Generation and Hide Training Data?Technical4 citations
  250. CoRA: Collaborative Information Perception by Large Language Model’s Weights for RecommendationTechnical4 citations
  251. CoRe: Context-Regularized Text Embedding Learning for Text-to-Image PersonalizationTechnical4 citations
  252. Cross-Validated Off-Policy EvaluationTechnical4 citations
  253. CustomTTT: Motion and Appearance Customized Video Generation via Test-Time TrainingTechnical4 citations
  254. CyberPal.AI: Empowering LLMs with Expert-Driven Cybersecurity InstructionsTechnical4 citations
  255. DEEPTalk: Dynamic Emotion Embedding for Probabilistic Speech-Driven 3D Face AnimationTechnical4 citations
  256. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code GenerationTechnical4 citations
  257. DVP-MVS: Synergize Depth-Edge and Visibility Prior for Multi-View StereoTechnical4 citations
  258. Debate on Graph: A Flexible and Reliable Reasoning Framework for Large Language ModelsTechnical4 citations
  259. Deep Generative Model for Mechanical System Configuration DesignTechnical4 citations
  260. Design Principle Transfer in Neural Architecture Search via Large Language ModelsTechnical4 citations
  261. Diff-Shadow: Global-guided Diffusion Model for Shadow RemovalTechnical4 citations
  262. DiffCalib: Reformulating Monocular Camera Calibration as Diffusion-Based Dense Incident Map GenerationTechnical4 citations
  263. Differential Private Stochastic Optimization with Heavy-tailed Data: Towards Optimal RatesTechnical4 citations
  264. Driving in the Occupancy World: Vision-Centric 4D Occupancy Forecasting and Planning via World Models for Autonomous DrivingTechnical4 citations
  265. EWMoE: An Effective Model for Global Weather Forecasting with Mixture-of-ExpertsTechnical4 citations
  266. EXCGEC: A Benchmark for Edit-Wise Explainable Chinese Grammatical Error CorrectionTechnical4 citations
  267. Effective Diffusion Transformer Architecture for Image Super-ResolutionTechnical4 citations
  268. EvoChart: A Benchmark and a Self-Training Approach Towards Real-World Chart UnderstandingTechnical4 citations
  269. Exploring Activation Patterns of Parameters in Language ModelsTechnical4 citations
  270. FOCUS: Towards Universal Foreground SegmentationTechnical4 citations
  271. Falcon: Faster and Parallel Inference of Large Language Models Through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding TreeTechnical4 citations
  272. FlowPolicy: Enabling Fast and Robust 3D Flow-Based Policy via Consistency Flow Matching for Robot ManipulationTechnical4 citations
  273. Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy LeakageTechnical4 citations
  274. Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences Through f-Divergence MinimizationTechnical4 citations
  275. Generative Medical SegmentationTechnical4 citations
  276. GenesisTex2: Stable, Consistent and High-Quality Text-to-Texture GenerationTechnical4 citations
  277. HS-FPN: High Frequency and Spatial Perception FPN for Tiny Object DetectionTechnical4 citations
  278. Hand1000: Generating Realistic Hands from Text with Only 1,000 ImagesTechnical4 citations
  279. Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful ComparatorsTechnical4 citations
  280. In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement LearningTechnical4 citations
  281. LLM-Powered User Simulator for Recommender SystemTechnical4 citations
  282. Light-T2M: A Lightweight and Fast Model for Text-to-motion GenerationTechnical4 citations
  283. LogicAD: Explainable Anomaly Detection via VLM-based Text Feature ExtractionTechnical4 citations
  284. MAPF-GPT: Imitation Learning for Multi-Agent Pathfinding at ScaleTechnical4 citations
  285. MMGDreamer: Mixed-Modality Graph for Geometry-Controllable 3D Indoor Scene GenerationTechnical4 citations
  286. Multi-Pair Temporal Sentence Grounding via Multi-Thread Knowledge Transfer NetworkTechnical4 citations
  287. On the Relationship Between Monotone and Squared Probabilistic CircuitsTechnical4 citations
  288. PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head SynthesisTechnical4 citations
  289. Prototypical Calibrating Ambiguous Samples for Micro-Action RecognitionTechnical4 citations
  290. Pruning Large Language Models with Semi-Structural Adaptive Sparse TrainingTechnical4 citations
  291. RLLTE: Long-Term Evolution Project of Reinforcement LearningTechnical4 citations
  292. Retrieval-Augmented Dynamic Prompt Tuning for Incomplete Multimodal LearningTechnical4 citations
  293. SNAP: Semantic Stories for Next Activity PredictionTechnical4 citations
  294. Scalable Surrogate Verification of Image-Based Neural Network Control Systems Using Composition and UnrollingTechnical4 citations
  295. Security Attacks on LLM-based Code Completion ToolsTechnical4 citations
  296. Seeing Your Speech Style: A Novel Zero-Shot Identity-Disentanglement Face-based Voice ConversionTechnical4 citations
  297. Semantic Convergence: Harmonizing Recommender Systems via Two-Stage Alignment and Behavioral Semantic TokenizationTechnical4 citations
  298. Sequence to Sequence Reward Modeling: Improving RLHF by Language FeedbackTechnical4 citations
  299. TG-LLaVA: Text Guided LLaVA via Learnable Latent EmbeddingsTechnical4 citations
  300. TRANSFORMER EXPLAINER: Interactive Learning of Text-Generative ModelsTechnical4 citations
  301. TimeCAP: Learning to Contextualize, Augment, and Predict Time Series Events with Large Language Model AgentsTechnical4 citations
  302. Towards Scientific Discovery with Generative AI: Progress, Opportunities, and ChallengesTechnical4 citations
  303. TrustUQA: A Trustful Framework for Unified Structured Data Question AnsweringTechnical4 citations
  304. USDRL: Unified Skeleton-Based Dense Representation Learning with Multi-Grained Feature DecorrelationTechnical4 citations
  305. Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code RewritingTechnical4 citations
  306. Unleashing the Temporal-Spatial Reasoning Capacity of GPT for Training-Free Audio and Language Referenced Video Object SegmentationTechnical4 citations
  307. What Kind of Visual Tokens Do We Need? Training-Free Visual Token Pruning for Multi-Modal Large Language Models from the Perspective of GraphTechnical4 citations
  308. (1+1) Genetic Programming with Functionally Complete Instruction Sets Can Evolve Boolean Conjunctions and Disjunctions with Arbitrarily Small ErrorTechnical3 citations
  309. A No Free Lunch Theorem for Human-AI CollaborationTechnical3 citations
  310. ABQ-LLM: Arbitrary-Bit Quantized Inference Acceleration for Large Language ModelsTechnical3 citations
  311. Against All Odds: Overcoming Typology, Script, and Language Confusion in Multilingual Embedding Inversion AttacksTechnical3 citations
  312. Attack-in-the-Chain: Bootstrapping Large Language Models for Attacks Against Black-Box Neural Ranking ModelsTechnical3 citations
  313. Augmenting Sequential Recommendation with Balanced Relevance and DiversityTechnical3 citations
  314. Automatically Generating Numerous Context-Driven SFT Data for LLMs Across Diverse GranularityTechnical3 citations
  315. Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term EstimationTechnical3 citations
  316. Bias Unveiled: Investigating Social Bias in LLM-Generated CodeTechnical3 citations
  317. Boosting Short Text Classification with Multi-Source Information Exploration and Dual-Level Contrastive LearningTechnical3 citations
  318. Breaking Barriers in Physical-World Adversarial Examples: Improving Robustness and Transferability via Robust FeatureTechnical3 citations
  319. Bridging the User-side Knowledge Gap in Knowledge-aware Recommendations with Large Language ModelsTechnical3 citations
  320. CP-Guard: Malicious Agent Detection and Defense in Collaborative Bird’s Eye View PerceptionTechnical3 citations
  321. CTD4 – a Deep Continuous Distributional Actor-Critic Agent with a Kalman Fusion of Multiple CriticsTechnical3 citations
  322. DASK: Distribution Rehearsing via Adaptive Style Kernel Learning for Exemplar-Free Lifelong Person Re-IdentificationTechnical3 citations
  323. DLF: Disentangled-Language-Focused Multimodal Sentiment AnalysisTechnical3 citations
  324. Discovering Conceptual Knowledge with Analytic Ontology Templates for Articulated ObjectsTechnical3 citations
  325. Efficient Multi-Policy Evaluation for Reinforcement LearningTechnical3 citations
  326. Efficient Rectification of Neuro-Symbolic Reasoning Inconsistencies by Abductive ReflectionTechnical3 citations
  327. Enhance Vision-Language Alignment with NoiseTechnical3 citations
  328. Enhancing Portuguese Variety Identification with Cross-Domain ApproachesTechnical3 citations
  329. Enhancing Trustworthiness of Graph Neural Networks with Rank-Based Conformal TrainingTechnical3 citations
  330. Exploring Semantic Consistency and Style Diversity for Domain Generalized Semantic SegmentationTechnical3 citations
  331. FLAME: Learning to Navigate with Multimodal LLM in Urban EnvironmentsTechnical3 citations
  332. Fair Graph U-Net: A Fair Graph Learning Framework Integrating Group and Individual AwarenessTechnical3 citations
  333. Federated Graph Condensation with Information Bottleneck PrinciplesTechnical3 citations
  334. Forward KL Regularized Preference Optimization for Aligning Diffusion PoliciesTechnical3 citations
  335. G-VEval: A Versatile Metric for Evaluating Image and Video Captions Using GPT-4oTechnical3 citations
  336. GLAD: Improving Latent Graph Generative Modeling with Simple QuantizationTechnical3 citations
  337. GRPose: Learning Graph Relations for Human Image Generation with Pose PriorsTechnical3 citations
  338. GVMGen: A General Video-to-Music Generation Model with Hierarchical AttentionsTechnical3 citations
  339. Game4Loc: A UAV Geo-Localization Benchmark from Game DataTechnical3 citations
  340. GaussianSR: High Fidelity 2D Gaussian Splatting for Arbitrary-Scale Image Super-ResolutionTechnical3 citations
  341. Generalized Dimension Reduction Using Semi-Relaxed Gromov-Wasserstein DistanceTechnical3 citations
  342. Generative Planning with 3D-Vision Language Pre-training for End-to-End Autonomous DrivingTechnical3 citations
  343. GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object DetectionTechnical3 citations
  344. GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language ModelsTechnical3 citations
  345. GraphAvatar: Compact Head Avatars with GNN-Generated 3D GaussiansTechnical3 citations
  346. Guided Real Image Dehazing Using YCbCr Color SpaceTechnical3 citations
  347. HC-LLM: Historical-Constrained Large Language Models for Radiology Report GenerationTechnical3 citations
  348. Harmonizing Visual and Textual Embeddings for Zero-Shot Text-to-Image CustomizationTechnical3 citations
  349. Hierarchical Classification Auxiliary Network for Time Series ForecastingTechnical3 citations
  350. Importance Weighting Can Help Large Language Models Self-ImproveTechnical3 citations
  351. Instruction-guided Multi-Granularity Segmentation and Captioning with Large Multimodal ModelTechnical3 citations
  352. KnowPO: Knowledge-Aware Preference Optimization for Controllable Knowledge Selection in Retrieval-Augmented Language ModelsTechnical3 citations
  353. LLM Attributor: Interactive Visual Attribution for LLM GenerationTechnical3 citations
  354. Language Ranker: A Metric for Quantifying LLM Performance Across High and Low-Resource LanguagesTechnical3 citations
  355. Learned Image Transmission with Hierarchical Variational AutoencoderTechnical3 citations
  356. Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network InferenceTechnical3 citations
  357. Learning Language Structures Through GroundingTechnical3 citations
  358. Learning to Manipulate Under Limited InformationTechnical3 citations
  359. Lessons for Editors of AI Incidents from the AI Incident DatabaseTechnical3 citations
  360. Leveraging Large Language Models for Node Generation in Few-Shot Learning on Text-Attributed GraphsTechnical3 citations
  361. Locate Anything on Earth: Advancing Open-Vocabulary Object Detection for Remote Sensing CommunityTechnical3 citations
  362. MTL-LoRA: Low-Rank Adaptation for Multi-Task LearningTechnical3 citations
  363. MUC: Mixture of Uncalibrated Cameras for Robust 3D Human Body ReconstructionTechnical3 citations
  364. MaFeRw: Query Rewriting with Multi-Aspect Feedbacks for Retrieval-Augmented Large Language ModelsTechnical3 citations
  365. MambaPro: Multi-Modal Object Re-identification with Mamba Aggregation and Synergistic PromptTechnical3 citations
  366. Massively Parallel Continuous Local Search for Hybrid SAT Solving on GPUsTechnical3 citations
  367. Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis PredictionTechnical3 citations
  368. Multi-modal and Multi-scale Spatial Environment Understanding for Immersive Visual Text-to-SpeechTechnical3 citations
  369. Multimodal Class-aware Semantic Enhancement Network for Audio-Visual Video ParsingTechnical3 citations
  370. NEST: A Neuromodulated Small-world Hypergraph Trajectory Prediction Model for Autonomous DrivingTechnical3 citations
  371. On the Distortion of Committee Election with 1-Euclidean Preferences and Few Distance QueriesTechnical3 citations
  372. Online Guidance Graph Optimization for Lifelong Multi-Agent Path FindingTechnical3 citations
  373. Online and Streaming Algorithms for Constrained k-Submodular MaximizationTechnical3 citations
  374. Optimize Incompatible Parameters Through Compatibility-aware Knowledge IntegrationTechnical3 citations
  375. Optimizing Vital Sign Monitoring in Resource-Constrained Maternal Care: An RL-Based Restless Bandit ApproachTechnical3 citations
  376. PRAGA: Prototype-aware Graph Adaptive Aggregation for Spatial Multi-modal Omics AnalysisTechnical3 citations
  377. Pinwheel-shaped Convolution and Scale-based Dynamic Loss for Infrared Small Target DetectionTechnical3 citations
  378. Pose Magic: Efficient and Temporally Consistent Human Pose Estimation with a Hybrid Mamba-GCN NetworkTechnical3 citations
  379. PoseMamba: Monocular 3D Human Pose Estimation with Bidirectional Global-Local Spatio-Temporal State Space ModelTechnical3 citations
  380. Promptable Anomaly Segmentation with SAM Through Self-Perception TuningTechnical3 citations
  381. RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted BehaviorsTechnical3 citations
  382. RTP-LX: Can LLMs Evaluate Toxicity in Multilingual Scenarios?Technical3 citations
  383. Real-Time Recurrent Reinforcement LearningTechnical3 citations
  384. RealisHuman: A Two-Stage Approach for Refining Malformed Human Parts in Generated ImagesTechnical3 citations
  385. Relation-Aware Equivariant Graph Networks for Epitope-Unknown Antibody Design and Specificity OptimizationTechnical3 citations
  386. Robust Tracking via Mamba-based Context-aware Token LearningTechnical3 citations
  387. SCKD: Semi-Supervised Cross-Modality Knowledge Distillation for 4D Radar Object DetectionTechnical3 citations
  388. SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding AlteringTechnical3 citations
  389. Safe Planner: Empowering Safety Awareness in Large Pre-Trained Models for Robot Task PlanningTechnical3 citations
  390. Sequential Conditional Transport on Probabilistic Graphs for Interpretable Counterfactual FairnessTechnical3 citations
  391. Sign-IDD: Iconicity Disentangled Diffusion for Sign Language ProductionTechnical3 citations
  392. Single Character Perturbations Break LLM AlignmentTechnical3 citations
  393. Single Image Rolling Shutter Removal with Diffusion ModelsTechnical3 citations
  394. StableVC: Style Controllable Zero-Shot Voice Conversion with Conditional Flow MatchingTechnical3 citations
  395. Structural Entropy Guided Probabilistic CodingTechnical3 citations
  396. To Err Is AI: A Case Study Informing LLM Flaw Reporting PracticesTechnical3 citations
  397. Towards Unifying Evaluation of Counterfactual Explanations: Leveraging Large Language Models for Human-Centric AssessmentsTechnical3 citations
  398. Training-Free and Hardware-Friendly Acceleration for Diffusion Models via Similarity-based Token PruningTechnical3 citations
  399. UniDet3D: Multi-dataset Indoor 3D Object DetectionTechnical3 citations
  400. UniMuMo: Unified Text, Music, and Motion GenerationTechnical3 citations
  401. Universality of Real Minimal Complexity ReservoirTechnical3 citations
  402. Using Explainable AI and Hierarchical Planning for Outreach with RobotsTechnical3 citations
  403. VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality AssessmentTechnical3 citations
  404. ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy PredictionTechnical3 citations
  405. Video Repurposing from User Generated Content: A Large-scale Dataset and BenchmarkTechnical3 citations
  406. WEPO: Web Element Preference Optimization for LLM-based Web NavigationTechnical3 citations
  407. A Many-Objective Problem Where Crossover Is Provably IndispensableTechnical2 citations
  408. A Simple Graph Contrastive Learning Framework for Short Text ClassificationTechnical2 citations
  409. AGFSync: Leveraging AI-Generated Feedback for Preference Optimization in Text-to-Image GenerationTechnical2 citations
  410. AGMixup: Adaptive Graph Mixup for Semi-supervised Node ClassificationTechnical2 citations
  411. AIF-SFDA: Autonomous Information Filter Driven Source-Free Domain Adaptation for Medical Image SegmentationTechnical2 citations
  412. Accurate and Regret-Aware Numerical Problem Solver for Tabular Question AnsweringTechnical2 citations
  413. Agent4Edu: Generating Learner Response Data by Generative Agents for Intelligent Education SystemsTechnical2 citations
  414. Arbitrary Reading Order Scene Text Spotter with Local Semantics GuidanceTechnical2 citations
  415. Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language ModelsTechnical2 citations
  416. Asynchronous Federated Clustering with Unknown Number of ClustersTechnical2 citations
  417. Autonomous LLM-Enhanced Adversarial Attack for Text-to-MotionTechnical2 citations
  418. BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous DrivingTechnical2 citations
  419. Backdoor Attacks Against No-Reference Image Quality Assessment Models via a Scalable TriggerTechnical2 citations
  420. Bi-level Contrastive Learning for Knowledge-Enhanced Molecule RepresentationsTechnical2 citations
  421. Bootstraping Clustering of Gaussians for View-consistent 3D Scene UnderstandingTechnical2 citations
  422. Bridge Then Begin Anew: Generating Target-Relevant Intermediate Model for Source-Free Visual Emotion AdaptationTechnical2 citations
  423. Bridging the Gap for Test-Time Multimodal Sentiment AnalysisTechnical2 citations
  424. Bridging the Gap: Enhancing LLM Performance for Low-Resource African Languages with New Benchmarks, Fine-Tuning, and Cultural AdjustmentsTechnical2 citations
  425. CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute EditingTechnical2 citations
  426. CL-Attack: Textual Backdoor Attacks via Cross-Lingual TriggersTechnical2 citations
  427. COSEE: Consistency-Oriented Signal-Based Early Exiting via Calibrated Sample Weighting MechanismTechnical2 citations
  428. Can Go AIs Be Adversarially Robust?Technical2 citations
  429. Can LLMs Obfuscate Code? A Systematic Analysis of Large Language Models into Assembly Code ObfuscationTechnical2 citations
  430. Chain-of-Instructions: Compositional Instruction Tuning on Large Language ModelsTechnical2 citations
  431. Channel Merging: Preserving Specialization for Merged ExpertsTechnical2 citations
  432. Characterising Simulation-Based Program EquilibriaTechnical2 citations
  433. CoPRA: Bridging Cross-domain Pretrained Sequence Models with Complex Structures for Protein-RNA Binding Affinity PredictionTechnical2 citations
  434. CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based VerificationTechnical2 citations
  435. Concept Conductor: Orchestrating Multiple Personalized Concepts in Text-to-Image SynthesisTechnical2 citations
  436. Context-aware Inductive Knowledge Graph Completion with Latent Type Constraints and Subgraph ReasoningTechnical2 citations
  437. Cradle-VAE: Enhancing Single-Cell Gene Perturbation Modeling with Counterfactual Reasoning-based Artifact DisentanglementTechnical2 citations
  438. Cross-Lingual Text-Rich Visual Comprehension: An Information Theory PerspectiveTechnical2 citations
  439. Cross-Silo Feature Space Alignment for Federated Learning on Clients with Imbalanced DataTechnical2 citations
  440. Cross-View Referring Multi-Object TrackingTechnical2 citations
  441. DMF-Net: Image-Guided Point Cloud Completion with Dual-Channel Modality Fusion and Shape-Aware Upsampling TransformerTechnical2 citations
  442. Debiased All-in-one Image Restoration with Task Uncertainty RegularizationTechnical2 citations
  443. Decentralized and Uncoordinated Learning of Stable Matchings: A Game-Theoretic ApproachTechnical2 citations
  444. Decoupling Appearance Variations with 3D Consistent Features in Gaussian SplattingTechnical2 citations
  445. DeepSN: A Sheaf Neural Framework for Influence MaximizationTechnical2 citations
  446. Dense Audio-Visual Event Localization Under Cross-Modal Consistency and Multi-Temporal Granularity CollaborationTechnical2 citations
  447. Depth-Centric Dehazing and Depth-Estimation from Real-World Hazy Driving VideoTechnical2 citations
  448. Diversifying Query: Region-Guided Transformer for Temporal Sentence GroundingTechnical2 citations
  449. DreamFit: Garment-Centric Human Generation via a Lightweight Anything-Dressing EncoderTechnical2 citations
  450. DuMo: Dual Encoder Modulation Network for Precise Concept ErasureTechnical2 citations
  451. DutyTTE: Deciphering Uncertainty in Origin-Destination Travel Time EstimationTechnical2 citations
  452. EMHI: A Multimodal Egocentric Human Motion Dataset with HMD and Body-Worn IMUsTechnical2 citations
  453. ENCODER: Entity Mining and Modification Relation Binding for Composed Image RetrievalTechnical2 citations
  454. EOV-Seg: Efficient Open-Vocabulary Panoptic SegmentationTechnical2 citations
  455. Efficient Attention-Sharing Information Distillation Transformer for Lightweight Single Image Super-ResolutionTechnical2 citations
  456. Enhancing Fine-Grained Vision-Language Pretraining with Negative Augmented SamplesTechnical2 citations
  457. Enhancing Multimodal Large Language Models Complex Reason via Similarity ComputationTechnical2 citations
  458. Even-if Explanations: Formal Foundations, Priorities and ComplexityTechnical2 citations
  459. Every Bit Helps: Achieving the Optimal Distortion with a Few QueriesTechnical2 citations
  460. Expensive Multi-Objective Bayesian Optimization Based on Diffusion ModelsTechnical2 citations
  461. Exploring Unbiased Deepfake Detection via Token-Level Shuffling and MixingTechnical2 citations
  462. FD2-Net: Frequency-Driven Feature Decomposition Network for Infrared-Visible Object DetectionTechnical2 citations
  463. FIDLAR: Forecast-Informed Deep Learning Architecture for Flood MitigationTechnical2 citations
  464. Fairness-Accuracy Trade-Offs: A Causal PerspectiveTechnical2 citations
  465. Fast and Interpretable Mixed-Integer Linear Program Solving by Learning Model ReductionTechnical2 citations
  466. FatesGS: Fast and Accurate Sparse-View Surface Reconstruction Using Gaussian Splatting with Depth-Feature ConsistencyTechnical2 citations
  467. Feature Clipping for Uncertainty CalibrationTechnical2 citations
  468. FedPIA – Permuting and Integrating Adapters Leveraging Wasserstein Barycenters for Finetuning Foundation Models in Multi-Modal Federated LearningTechnical2 citations
  469. FedSPU: Personalized Federated Learning for Resource-Constrained Devices with Stochastic Parameter UpdateTechnical2 citations
  470. Federated AssembliesTechnical2 citations
  471. Federated Unsupervised Domain Generalization Using Global and Local Alignment of GradientsTechnical2 citations
  472. Federated t-SNE and UMAP for Distributed Data VisualizationTechnical2 citations
  473. Filling Memory Gaps: Enhancing Continual Semantic Parsing via SQL Syntax Variance-Guided LLMs Without Real Data ReplayTechnical2 citations
  474. FlowMamba: Learning Point Cloud Scene Flow with Global Motion PropagationTechnical2 citations
  475. Foreground-Covering Prototype Generation and Matching for SAM-Aided Few-Shot SegmentationTechnical2 citations
  476. From Logistic Regression to the Perceptron Algorithm: Exploring Gradient Descent with Large Step SizesTechnical2 citations
  477. From Words to Worth: Newborn Article Impact Prediction with LLMTechnical2 citations
  478. Fusing Pruned and Backdoored Models: Optimal Transport-based Data-free Backdoor MitigationTechnical2 citations
  479. Generalization of Graph Neural Networks Is Robust to Model MismatchTechnical2 citations
  480. H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous DrivingTechnical2 citations
  481. HDT: Hierarchical Discrete Transformer for Multivariate Time Series ForecastingTechnical2 citations
  482. HeGTa: Leveraging Heterogeneous Graph-enhanced Large Language Models for Few-shot Complex Table UnderstandingTechnical2 citations
  483. HeMeNet: Heterogeneous Multichannel Equivariant Network for Protein Multi-task LearningTechnical2 citations
  484. Hypergraph Attacks via Injecting Homogeneous Nodes into Elite HyperedgesTechnical2 citations
  485. Identifying Macro Conditional Independencies and Macro Total Effects in Summary Causal Graphs with Latent ConfoundingTechnical2 citations
  486. Improved Maximin Share Approximations for Chores by Bin PackingTechnical2 citations
  487. Infer Human’s Intentions Before Following Natural Language InstructionsTechnical2 citations
  488. Internal Activation Revision: Safeguarding Vision Language Models Without Parameter UpdateTechnical2 citations
  489. Inverse Reinforcement Learning by Estimating Expertise of DemonstratorsTechnical2 citations
  490. IsUMap: Manifold Learning and Data Visualization Leveraging Vietoris-Rips FiltrationsTechnical2 citations
  491. JEN-1 DreamStyler: Customized Musical Concept Learning via Pivotal Parameters TuningTechnical2 citations
  492. KPL: Training-Free Medical Knowledge Mining of Vision-Language ModelsTechnical2 citations
  493. LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled PretrainingTechnical2 citations
  494. LNS2+RL: Combining Multi-agent Reinforcement Learning with Large Neighborhood Search in Multi-agent Path FindingTechnical2 citations
  495. Label-Free Backdoor Attacks in Vertical Federated LearningTechnical2 citations
  496. Language Model Can Listen While SpeakingTechnical2 citations
  497. Language Model Meets Prototypes: Towards Interpretable Text Classification Models through Prototypical NetworksTechnical2 citations
  498. Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement LearningTechnical2 citations
  499. Learn2Aggregate: Supervised Generation of Chvatal-Gomory Cuts Using Graph Neural NetworksTechnical2 citations
  500. Learning About Algorithm Auditing in Five Steps: Scaffolding How High School Youth Can Systematically and Critically Evaluate Machine Learning ApplicationsTechnical2 citations
  501. Learning Production Functions for Supply Chains with Graph Neural NetworksTechnical2 citations
  502. Less Is More: Adaptive Program Repair with Bug Localization and Preference LearningTechnical2 citations
  503. Leveraging Large Vision-Language Model as User Intent-Aware Encoder for Composed Image RetrievalTechnical2 citations
  504. Limitations in Employing Natural Language Supervision for Sensor-Based Human Activity Recognition - And Ways to Overcome ThemTechnical2 citations
  505. LoRID: Low-Rank Iterative Diffusion for Adversarial PurificationTechnical2 citations
  506. Look Inside for More: Internal Spatial Modality Perception for 3D Anomaly DetectionTechnical2 citations
  507. MAPLE: A Framework for Active Preference Learning Guided by Large Language ModelsTechnical2 citations
  508. MIA-Tuner: Adapting Large Language Models as Pre-training Text DetectorTechnical2 citations
  509. MLAAN: Scaling Supervised Local Learning with Multilaminar Leap Augmented Auxiliary NetworkTechnical2 citations
  510. Measuring Human and AI Values Based on Generative Psychometrics with Large Language ModelsTechnical2 citations
  511. Mesoscopic Insights: Orchestrating Multi-Scale & Hybrid Architecture for Image Manipulation LocalizationTechnical2 citations
  512. MoDiTalker: Motion-Disentangled Diffusion Model for High-Fidelity Talking Head GenerationTechnical2 citations
  513. Modality-Independent Graph Neural Networks with Global Transformers for Multimodal RecommendationTechnical2 citations
  514. More Text, Less Point: Towards 3D Data-Efficient Point-Language UnderstandingTechnical2 citations
  515. Motif Guided Graph Transformers with Combinatorial Skeleton Prototype Learning for Skeleton-Based Person Re-IdentificationTechnical2 citations
  516. Motion-aware Contrastive Learning for Temporal Panoptic Scene Graph GenerationTechnical2 citations
  517. MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal ControlsTechnical2 citations
  518. Multi Agent Reinforcement Learning for Sequential Satellite Assignment ProblemsTechnical2 citations
  519. Multi-Reference Preference Optimization for Large Language ModelsTechnical2 citations
  520. NLSR: Neuron-Level Safety Realignment of Large Language Models Against Harmful Fine-TuningTechnical2 citations
  521. NeSyCoCo: A Neuro-Symbolic Concept Composer for Compositional GeneralizationTechnical2 citations
  522. Nearly Tight Bounds for Exploration in Streaming Multi-Armed Bandits with Known Optimality GapTechnical2 citations
  523. Neighbor Does Matter: Density-Aware Contrastive Learning for Medical Semi-supervised SegmentationTechnical2 citations
  524. Neural Continuous-Time Supermartingale CertificatesTechnical2 citations
  525. Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning TasksTechnical2 citations
  526. Noisy Node Classification by Bi-level Optimization Based Multi-Teacher DistillationTechnical2 citations
  527. NumbOD: A Spatial-Frequency Fusion Attack Against Object DetectorsTechnical2 citations
  528. OmniCount: Multi-label Object Counting with Semantic-Geometric PriorsTechnical2 citations
  529. On the Convergence of Tâtonnement for Linear Fisher MarketsTechnical2 citations
  530. On the Power of Convolution-Augmented TransformerTechnical2 citations
  531. One Node One Model: Featuring the Missing-Half for Graph ClusteringTechnical2 citations
  532. Out of Length Text Recognition with Sub-String MatchingTechnical2 citations
  533. PSMGD: Periodic Stochastic Multi-Gradient Descent for Fast Multi-Objective OptimizationTechnical2 citations
  534. PersonaMagic: Stage-Regulated High-Fidelity Face Customization with Tandem EquilibriumTechnical2 citations
  535. Personalized Federated Learning for Spatio-Temporal Forecasting: A Dual Semantic Alignment-Based Contrastive ApproachTechnical2 citations
  536. Personalized Lip Reading: Adapting to Your Unique Lip Movements with Vision and LanguageTechnical2 citations
  537. Physics-Guided Foundation Model for Scientific Discovery: An Application to Aquatic ScienceTechnical2 citations
  538. Planning in the Dark: LLM-Symbolic Planning Pipeline Without ExpertsTechnical2 citations
  539. Precision-Enhanced Human-Object Contact Detection via Depth-Aware Perspective Interaction and Object Texture RestorationTechnical2 citations
  540. Private Blotto: Viewpoint Competition with Polarized AgentsTechnical2 citations
  541. ProcTag: Process Tagging for Assessing the Efficacy of Document Instruction DataTechnical2 citations
  542. Proportional Representation in Practice: Quantifying Proportionality in Ordinal ElectionsTechnical2 citations
  543. ProtCLIP: Function-Informed Protein Multi-Modal LearningTechnical2 citations
  544. Qsco: A Quantum Scoring Module for Open-Set Supervised Anomaly DetectionTechnical2 citations
  545. Quantified Linear and Polynomial Arithmetic Satisfiability via Template-based SkolemizationTechnical2 citations
  546. Queryable Prototype Multiple Instance Learning with Vision-Language Models for Incremental Whole Slide Image ClassificationTechnical2 citations
  547. RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion MambaTechnical2 citations
  548. RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMsTechnical2 citations
  549. RaCMC: Residual-Aware Compensation Network with Multi-Granularity Constraints for Fake News DetectionTechnical2 citations
  550. Radiology Report Generation via Multi-objective Preference OptimizationTechnical2 citations
  551. Re-Attentional Controllable Video Diffusion EditingTechnical2 citations
  552. Realistic Noise Synthesis with Diffusion ModelsTechnical2 citations
  553. Reasoning About Actual Causes in Nondeterministic DomainsTechnical2 citations
  554. Relational Neurosymbolic Markov ModelsTechnical2 citations
  555. Retention Score: Quantifying Jailbreak Risks for Vision Language ModelsTechnical2 citations
  556. Rethinking Open-Vocabulary Segmentation of Radiance Fields in 3D SpaceTechnical2 citations
  557. Revisiting Attention for Multivariate Time Series ForecastingTechnical2 citations
  558. Revisiting Multimodal Fusion for 3D Anomaly Detection from an Architectural PerspectiveTechnical2 citations
  559. Runtime Analysis for Multi-Objective Evolutionary Algorithms in Unbounded Integer SpacesTechnical2 citations
  560. SAFIRE: Segment Any Forged Image RegionTechnical2 citations
  561. SCott: Accelerating Diffusion Models with Stochastic Consistency DistillationTechnical2 citations
  562. SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated ResponsesTechnical2 citations
  563. SGTC: Semantic-Guided Triplet Co-training for Sparsely Annotated Semi-Supervised Medical Image SegmentationTechnical2 citations
  564. SQLFixAgent: Towards Semantic-Accurate Text-to-SQL Parsing via Consistency-Enhanced Multi-Agent CollaborationTechnical2 citations
  565. ST3: Accelerating Multimodal Large Language Model by Spatial-Temporal Visual Token TrimmingTechnical2 citations
  566. SUTrack: Towards Simple and Unified Single Object TrackingTechnical2 citations
  567. ScriptSmith: A Unified LLM Framework for Enhancing IT Operations via Automated Bash Script Generation, Assessment, and RefinementTechnical2 citations
  568. SeFAR: Semi-supervised Fine-grained Action Recognition with Temporal Perturbation and Learning StabilizationTechnical2 citations
  569. SegFace: Face Segmentation of Long-Tail ClassesTechnical2 citations
  570. Self-Evolutionary Large Language Models Through Uncertainty-Enhanced Preference OptimizationTechnical2 citations
  571. Sequential Decision Making in Stochastic Games with Incomplete Preferences over Temporal ObjectivesTechnical2 citations
  572. Simulate and Eliminate: Revoke Backdoors for Generative Large Language ModelsTechnical2 citations
  573. Single Exposure Quantitative Phase Imaging with a Conventional Microscope Using Diffusion ModelsTechnical2 citations
  574. Sparis: Neural Implicit Surface Reconstruction of Indoor Scenes from Sparse ViewsTechnical2 citations
  575. Spike2Former: Efficient Spiking Transformer for High-performance Image SegmentationTechnical2 citations
  576. SpotActor: Training-Free Layout-Controlled Consistent Image GenerationTechnical2 citations
  577. Stable Mean Teacher for Semi-supervised Video Action DetectionTechnical2 citations
  578. Standing on the Shoulders of Giants: Reprogramming Visual-Language Model for General Deepfake DetectionTechnical2 citations
  579. StarVector: Generating Scalable Vector Graphics Code from Images and TextTechnical2 citations
  580. StoryWeaver: A Unified World Model for Knowledge-Enhanced Story Character CustomizationTechnical2 citations
  581. StressPrompt: Does Stress Impact Large Language Models and Human Performance Similarly?Technical2 citations
  582. Surgical Workflow Recognition and Blocking Effectiveness Detection in Laparoscopic Liver Resection with Pringle ManeuverTechnical2 citations
  583. TCPFormer: Learning Temporal Correlation with Implicit Pose Proxy for 3D Human Pose EstimationTechnical2 citations
  584. Text2midi: Generating Symbolic Music from CaptionsTechnical2 citations
  585. Thin-Plate Spline-based Interpolation for Animation Line InbetweeningTechnical2 citations
  586. Time Series Supplier Allocation via Deep Black-Litterman ModelTechnical2 citations
  587. TimeDP: Learning to Generate Multi-Domain Time Series with Domain PromptsTechnical2 citations
  588. Token Highlighter: Inspecting and Mitigating Jailbreak Prompts for Large Language ModelsTechnical2 citations
  589. Towards Effective, Efficient and Unsupervised Social Event Detection in the Hyperbolic SpaceTechnical2 citations
  590. Towards Open-Vocabulary Remote Sensing Image Semantic SegmentationTechnical2 citations
  591. Towards Trustworthy Knowledge Graph Reasoning: An Uncertainty Aware PerspectiveTechnical2 citations
  592. Towards a Theory of AI PersonhoodTechnical2 citations
  593. Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal CluesTechnical2 citations
  594. Training on the Benchmark Is Not All You NeedTechnical2 citations
  595. Tri-Ergon: Fine-Grained Video-to-Audio Generation with Multi-Modal Conditions and LUFS ControlTechnical2 citations
  596. Unlocking the Potential of Reverse Distillation for Anomaly DetectionTechnical2 citations
  597. Usage Governance Advisor: From Intent to AI GovernanceTechnical2 citations
  598. Using Case Studies to Teach Responsible AI to Industry PractitionersTechnical2 citations
  599. Utilize the Flow Before Stepping into the Same River Twice: Certainty Represented Knowledge Flow for Refusal-Aware Instruction TuningTechnical2 citations
  600. VHM: Versatile and Honest Vision Language Model for Remote Sensing Image AnalysisTechnical2 citations
  601. ViG: Linear-complexity Visual Sequence Learning with Gated Linear AttentionTechnical2 citations
  602. When Witnesses Defend: A Witness Graph Topological Layer for Adversarial Graph LearningTechnical2 citations
  603. Whole Genome Transformer for Gene Interaction Effects in Microbiome Habitat SpecificityTechnical2 citations
  604. WiFi CSI Based Temporal Activity Detection via Dual Pyramid NetworkTechnical2 citations
  605. World Knowledge-Enhanced Reasoning Using Instruction-Guided Interactor in Autonomous DrivingTechnical2 citations
  606. WorldAPIs: The World Is Worth How Many APIs? A Thought ExperimentTechnical2 citations
  607. Zero-Shot Scene Change DetectionTechnical2 citations
  608. Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language ModelsTechnical2 citations
  609. 3D Denoisers Are Good 2D Teachers: Molecular Pretraining via Denoising and Cross-Modal DistillationTechnical1 citations
  610. 3D-RPE: Enhancing Long-Context Modeling Through 3D Rotary Position EncodingTechnical1 citations
  611. A Deployed Online Reinforcement Learning Algorithm in an Oral Health Clinical TrialTechnical1 citations
  612. A Method for Enhancing Generalization of Adam by Multiple IntegrationsTechnical1 citations
  613. A Multiagent Path Search Algorithm for Large-Scale Coalition Structure GenerationTechnical1 citations
  614. A Pioneering Neural Network Method for Efficient and Robust Fuel Sloshing Simulation in AircraftTechnical1 citations
  615. A Scalable and Effective Alternative to Graph TransformersTechnical1 citations
  616. A Versatile Low-Cost Kit for Teaching Novice Learners AI Using Robotics Components and a No-Code Development PlaygroundTechnical1 citations
  617. A Vision for Reinventing Credible Elections with Artificial IntelligenceTechnical1 citations
  618. A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal AdapterTechnical1 citations
  619. A-VL: Adaptive Attention for Large Vision-Language ModelsTechnical1 citations
  620. AI Chef Trainer: Introducing Students to the Importance of Data in Machine LearningTechnical1 citations
  621. ASER: Activation Smoothing and Error Reconstruction for Large Language Model QuantizationTechnical1 citations
  622. AWRaCLe: All-Weather Image Restoration Using Visual In-Context LearningTechnical1 citations
  623. Accelerated Methods with Compressed Communications for Distributed Optimization Problems Under Data SimilarityTechnical1 citations
  624. Accessible, At-Home Detection of Parkinson’s Disease via Multi-Task Video AnalysisTechnical1 citations
  625. Accurate Link Prediction for Edge-Incomplete Graphs via PU LearningTechnical1 citations
  626. Achieving Maximin Share and EFX/EF1 Guarantees SimultaneouslyTechnical1 citations
  627. Action-Agnostic Point-Level Supervision for Temporal Action DetectionTechnical1 citations
  628. Active Large Language Model-Based Knowledge Distillation for Session-Based RecommendationTechnical1 citations
  629. Adapting to Non-Stationary Environments: Multi-Armed Bandit Enhanced Retrieval-Augmented Generation on Knowledge GraphsTechnical1 citations
  630. Adaptive Calibration: A Unified Conversion Framework of Spiking Neural NetworksTechnical1 citations
  631. Adaptive Prompting for Continual Relation Extraction: A Within-Task Variance PerspectiveTechnical1 citations
  632. Adaptive Prototype Replay for Class Incremental Semantic SegmentationTechnical1 citations
  633. Advancing Feature Extraction in Healthcare through the Integration of Knowledge Graphs and Large Language ModelsTechnical1 citations
  634. AgentMixer: Multi-Agent Correlated Policy FactorizationTechnical1 citations
  635. AirRadar: Inferring Nationwide Air Quality in China with Deep Neural NetworksTechnical1 citations
  636. Aligning Language Models Using Follow-up Likelihood as Reward SignalTechnical1 citations
  637. Aligning Large Language Models for Faithful Integrity Against Opposing ArgumentTechnical1 citations
  638. All-in-One: Transferring Vision Foundation Models into Stereo MatchingTechnical1 citations
  639. Alleviate and Mining: Rethinking Unsupervised Domain Adaptation for Mitochondria Segmentation from Pseudo-Label PerspectiveTechnical1 citations
  640. AlphaForge: A Framework to Mine and Dynamically Combine Formulaic Alpha FactorsTechnical1 citations
  641. An Application-Agnostic Automatic Target Recognition System Using Vision Language ModelsTechnical1 citations
  642. An Evaluation Framework for Product Images Background Inpainting Based on Human Feedback and Product ConsistencyTechnical1 citations
  643. Anytime Multi-Agent Path Finding with an Adaptive Delay-Based HeuristicTechnical1 citations
  644. Approximating Metric Magnitude of Point SetsTechnical1 citations
  645. Architecture-Aware Learning Curve Extrapolation via Graph Ordinary Differential EquationTechnical1 citations
  646. Attention Bootstrapping for Multi-Modal Test-Time AdaptationTechnical1 citations
  647. Attribution Analysis Meets Model Editing: Advancing Knowledge Correction in Vision Language Models with VisEditTechnical1 citations
  648. AugRefer: Advancing 3D Visual Grounding via Cross-Modal Augmentation and Spatial Relation-based ReferringTechnical1 citations
  649. Autoregressive Sequence Modeling for 3D Medical Image RepresentationTechnical1 citations
  650. A²RNet: Adversarial Attack Resilient Network for Robust Infrared and Visible Image FusionTechnical1 citations
  651. BLS-GAN: A Deep Layer Separation Framework for Eliminating Bone Overlap in Conventional RadiographsTechnical1 citations
  652. Balanced and Fair Partitioning of FriendsTechnical1 citations
  653. Batch Ensemble for Variance Dependent Regret in Stochastic BanditsTechnical1 citations
  654. Benchmarking and Understanding Compositional Relational Reasoning of LLMsTechnical1 citations
  655. Beyond Human Data: Aligning Multimodal Large Language Models by Iterative Self-EvolutionTechnical1 citations
  656. Bi-Directional Multi-Scale Graph Dataset Condensation via Information BottleneckTechnical1 citations
  657. BiDeV: Bilateral Defusing Verification for Complex Claim Fact-CheckingTechnical1 citations
  658. Boosting Image De-Raining via Central-Surrounding Synergistic ConvolutionTechnical1 citations
  659. Bootstrapping Heterogeneous Graph Representation Learning via Large Language Models: A Generalized ApproachTechnical1 citations
  660. BrainGuard: Privacy-Preserving Multisubject Image Reconstructions from Brain ActivitiesTechnical1 citations
  661. Breaking Data Silos in Parkinson’s Disease Diagnosis: An Adaptive Federated Learning Approach for Privacy-Preserving Facial Expression AnalysisTechnical1 citations
  662. Bridge 2D-3D: Uncertainty-aware Hierarchical Registration Network with Domain AlignmentTechnical1 citations
  663. Bridging Training and Execution via Dynamic Directed Graph-Based Communication in Cooperative Multi-Agent SystemsTechnical1 citations
  664. C2PD: Continuity-Constrained Pixelwise Deformation for Guided Depth Super-ResolutionTechnical1 citations
  665. CAD-GPT: Synthesising CAD Construction Sequence with Spatial Reasoning-Enhanced Multimodal LLMsTechnical1 citations
  666. CALLIC: Content Adaptive Learning for Lossless Image CompressionTechnical1 citations
  667. CAMSIC: Content-aware Masked Image Modeling Transformer for Stereo Image CompressionTechnical1 citations
  668. CMT: A Memory Compression Method for Continual Knowledge Learning of Large Language ModelsTechnical1 citations
  669. CNC: Cross-modal Normality Constraint for Unsupervised Multi-class Anomaly DetectionTechnical1 citations
  670. COLUMBUS: Evaluating COgnitive Lateral Understanding Through Multiple-Choice reBUSesTechnical1 citations
  671. CSR:Achieving 1 Bit Key-Value Cache via Sparse RepresentationTechnical1 citations
  672. CVE-LLM: Ontology-Assisted Automatic Vulnerability Evaluation Using Large Language ModelsTechnical1 citations
  673. Can LLMs Reliably Simulate Human Learner Actions? A Simulation Authoring Framework for Open-Ended Learning EnvironmentsTechnical1 citations
  674. CasFT: Future Trend Modeling for Information Popularity Prediction with Dynamic Cues-Driven Diffusion ModelsTechnical1 citations
  675. Causal Discovery by Interventions via Integer ProgrammingTechnical1 citations
  676. Causal-Inspired Multitask Learning for Video-Based Human Pose EstimationTechnical1 citations
  677. ChangeDiff: A Multi-Temporal Change Detection Data Generator with Flexible Text Prompts via Diffusion ModelTechnical1 citations
  678. Cherry-Picking in Time Series Forecasting: How to Select Datasets to Make Your Model ShineTechnical1 citations
  679. Citations and Trust in LLM Generated ResponsesTechnical1 citations
  680. Cluster-guided Contrastive Class-imbalanced Graph ClassificationTechnical1 citations
  681. CodecNeRF: Toward Fast Encoding and Decoding, Compact, and High-quality Novel-view SynthesisTechnical1 citations
  682. CognitionCapturer: Decoding Visual Stimuli from Human EEG Signal with Multimodal InformationTechnical1 citations
  683. Column-Oriented Datalog on the GPUTechnical1 citations
  684. Complex-Cycle-Consistent Diffusion Model for Monaural Speech EnhancementTechnical1 citations
  685. Comprehensive Multi-Modal Prototypes Are Simple and Effective Classifiers for Vast-Vocabulary Object DetectionTechnical1 citations
  686. Computing Game Symmetries and Equilibria That Respect ThemTechnical1 citations
  687. ConDSeg: A General Medical Image Segmentation Framework via Contrast-Driven Feature EnhancementTechnical1 citations
  688. ConSense: Continually Sensing Human Activity with WiFi via Growing and PickingTechnical1 citations
  689. Conditional Diffusion Models Based Conditional Independence TestingTechnical1 citations
  690. Confidence Estimation for Error Detection in Text-to-SQL SystemsTechnical1 citations
  691. Configuring Data Augmentations to Reduce Variance Shift in Positional Embedding of Vision TransformersTechnical1 citations
  692. Conformal Inference of Individual Treatment Effects Using Conditional Density EstimatesTechnical1 citations
  693. Constrained Fair and Efficient AllocationsTechnical1 citations
  694. Constrained Offline Black-Box Optimization via Risk Evaluation and ManagementTechnical1 citations
  695. Constraint-Adaptive Policy Switching for Offline Safe Reinforcement LearningTechnical1 citations
  696. ContextHOI: Spatial Context Learning for Human-Object Interaction DetectionTechnical1 citations
  697. Contextual Stochastic Optimization for School Desegregation PolicymakingTechnical1 citations
  698. Continual Learning Using a Kernel-Based Method Over Foundation ModelsTechnical1 citations
  699. Controllable Distortion-Perception Tradeoff Through Latent Diffusion for Neural Image CompressionTechnical1 citations
  700. Controlling Large Language Models Through Concept Activation VectorsTechnical1 citations
  701. Cross-Modal Few-Shot Learning with Second-Order Neural Ordinary Differential EquationsTechnical1 citations
  702. Cross-View Graph Consistency Learning for Invariant Graph RepresentationsTechnical1 citations
  703. Cross-modulated Attention Transformer for RGBT TrackingTechnical1 citations
  704. Curriculum Conditioned Diffusion for Multimodal RecommendationTechnical1 citations
  705. DARR: A Dual-Branch Arithmetic Regression Reasoning Framework for Solving Machine Number ReasoningTechnical1 citations
  706. DECIDER: Difference-aware Contrastive Diffusion Model with Adversarial Perturbations for Image Change CaptioningTechnical1 citations
  707. DG-Mamba: Robust and Efficient Dynamic Graph Structure Learning with Selective State Space ModelsTechnical1 citations
  708. DGFamba: Learning Flow Factorized State Space for Visual Domain GeneralizationTechnical1 citations
  709. DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person RetrievalTechnical1 citations
  710. DR-Encoder: Encode Low-rank Gradients with Random Prior for Large Language Models Differentially PrivatelyTechnical1 citations
  711. DR-VAE: Debiased and Representation-enhanced Variational Autoencoder for Collaborative RecommendationTechnical1 citations
  712. DSRC: Learning Density-Insensitive and Semantic-Aware Collaborative Representation Against CorruptionsTechnical1 citations
  713. Debiased Multimodal Understanding for Human Language SequencesTechnical1 citations
  714. Decentralized Federated Learning with Model Caching on Mobile AgentsTechnical1 citations
  715. Deep Hypergraph Neural Networks with Tight FrameletsTechnical1 citations
  716. Delay as Payoff in MABTechnical1 citations
  717. Densely Connected Parameter-Efficient Tuning for Referring Image SegmentationTechnical1 citations
  718. Detecting and Corrupting Convolution-based Unlearnable ExamplesTechnical1 citations
  719. Deterministic Policy Gradient Primal-Dual Methods for Continuous-Space Constrained MDPsTechnical1 citations
  720. DiffCLIP: Few-shot Language-driven Multimodal ClassifierTechnical1 citations
  721. DiffGrasp: Whole-Body Grasping Synthesis Guided by Object Motion Using a Diffusion ModelTechnical1 citations
  722. Digging into Intrinsic Contextual Information for High-fidelity 3D Point Cloud CompletionTechnical1 citations
  723. Dimension Reduction with Locally Adjusted GraphsTechnical1 citations
  724. Discrete Curvature Graph Information BottleneckTechnical1 citations
  725. Disentangle Nighttime Lens Flares: Self-supervised Generation-based Lens Flare RemovalTechnical1 citations
  726. Disentangled Motion Modeling for Video Frame InterpolationTechnical1 citations
  727. Distilling Structured Rationale from Large Language Models to Small Language Models for Abstractive SummarizationTechnical1 citations
  728. Distribution-Consistency-Guided Multi-modal HashingTechnical1 citations
  729. Distribution-Level Feature Distancing for Machine Unlearning: Towards a Better Trade-off Between Model Utility and ForgettingTechnical1 citations
  730. DivGCL: A Graph Contrastive Learning Model for Diverse RecommendationTechnical1 citations
  731. DiveR-CT: Diversity-enhanced Red Teaming Large Language Model Assistants with Relaxing ConstraintsTechnical1 citations
  732. Do Transformer Interpretability Methods Transfer to RNNs?Technical1 citations
  733. Does Your AI Agent Get You? A Personalizable Framework for Approximating Human Models from Argumentation-based Dialogue TracesTechnical1 citations
  734. Domain Generalized Medical Landmark Detection via Robust Boundary-Aware Pre-TrainingTechnical1 citations
  735. DriveGazen: Event-Based Driving Status Recognition Using Conventional CameraTechnical1 citations
  736. Drop the Beat! Freestyler for Accompaniment Conditioned Rapping Voice GenerationTechnical1 citations
  737. Dual Conditioned Motion Diffusion for Pose-Based Video Anomaly DetectionTechnical1 citations
  738. Dual Information Purification for Lightweight SAR Object DetectionTechnical1 citations
  739. DualDynamics: Synergizing Implicit and Explicit Methods for Robust Irregular Time Series AnalysisTechnical1 citations
  740. ECLAIR: Enhanced Clarification for Interactive ResponsesTechnical1 citations
  741. EDGE: Unknown-aware Multi-label Learning by Energy Distribution Gap ExpansionTechnical1 citations
  742. Each Fake News Is Fake in Its Own Way: An Attribution Multi-Granularity Benchmark for Multimodal Fake News DetectionTechnical1 citations
  743. EditBoard: Towards a Comprehensive Evaluation Benchmark for Text-Based Video Editing ModelsTechnical1 citations
  744. Efficient Few-Shot Neural Architecture Search by Counting the Number of Nonlinear FunctionsTechnical1 citations
  745. Efficient Gaussian Splatting for Monocular Dynamic Scene Rendering via Sparse Time-Variant Attribute ModelingTechnical1 citations
  746. Efficient Image-to-Image Diffusion Classifier for Adversarial RobustnessTechnical1 citations
  747. Efficient Language-instructed Skill Acquisition via Reward-Policy Co-EvolutionTechnical1 citations
  748. Efficient Self-Supervised Video Hashing with Selective State SpacesTechnical1 citations
  749. Efficient Traffic Prediction Through Spatio-Temporal DistillationTechnical1 citations
  750. Efficient Training of Neural Fractional-Order Differential Equation via Adjoint BackpropagationTechnical1 citations
  751. Eliminating Majority Illusion Is EasyTechnical1 citations
  752. Enhancing Close-up Novel View Synthesis via Pseudo-labelingTechnical1 citations
  753. Enhancing Contrastive Learning Inspired by the Philosophy of “The Blind Men and the Elephant”Technical1 citations
  754. Enhancing Diffusion Model with Auxiliary Information Mining-Exploration and Efficient Sampling Mechanism for Sequential RecommendationTechnical1 citations
  755. Enhancing Elusive Clues in Knowledge Learning by Contrasting Attention of Language ModelsTechnical1 citations
  756. Enhancing Identity-Deformation Disentanglement in StyleGAN for One-Shot Face Video Re-EnactmentTechnical1 citations
  757. Enhancing Multi-Robot Semantic Navigation Through Multimodal Chain-of-Thought Score CollaborationTechnical1 citations
  758. Enhancing SQL Query Generation with Neurosymbolic ReasoningTechnical1 citations
  759. Enhancing Uncertainty Modeling with Semantic Graph for Hallucination DetectionTechnical1 citations
  760. Equal Merit Does Not Imply Equality: Discrimination at Equilibrium in a Hiring Market with Symmetric AgentsTechnical1 citations
  761. Error Bounds for Gaussian Process Regression Under Bounded Support Noise with Applications to Safety CertificationTechnical1 citations
  762. Error Diversity Matters: An Error-Resistant Ensemble Method for Unsupervised Dependency ParsingTechnical1 citations
  763. EvalAssist: LLM-as-a-Judge SimplifiedTechnical1 citations
  764. Evaluating Image Hallucination in Text-to-Image Generation with Question-AnsweringTechnical1 citations
  765. Event-Enhanced Blurry Video Super-ResolutionTechnical1 citations
  766. EventSum: A Large-Scale Event-Centric Summarization Dataset for Chinese Multi-News DocumentsTechnical1 citations
  767. Every Component Counts: Rethinking the Measure of Success for Medical Semantic Segmentation in Multi-Instance Segmentation TasksTechnical1 citations
  768. Explaining Decisions of Agents in Mixed-Motive GamesTechnical1 citations
  769. Exploiting Continuous Motion Clues for Vision-Based Occupancy PredictionTechnical1 citations
  770. Exploiting Diffusion Prior for Real-World Image Dehazing with Unpaired TrainingTechnical1 citations
  771. Exploring Iterative Enhancement for Improving Learnersourced Multiple-Choice Question Explanations with Large Language ModelsTechnical1 citations
  772. Exploring Query Efficient Data Generation Towards Data-Free Model Stealing in Hard Label SettingTechnical1 citations
  773. Expressive Power of Temporal Message PassingTechnical1 citations
  774. Extract Free Dense Misalignment from CLIPTechnical1 citations
  775. Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster InferenceTechnical1 citations
  776. FairGP: A Scalable and Fair Graph Transformer Using Graph PartitioningTechnical1 citations
  777. Fairness Issues and Mitigations in (Differentially Private) Socio-Demographic Data ProcessesTechnical1 citations
  778. Feature Denoising Diffusion Model for Blind Image Quality AssessmentTechnical1 citations
  779. Fed-DFA: Federated Distillation for Heterogeneous Model Fusion Through the Adversarial LensTechnical1 citations
  780. FedPop: Federated Population-based Hyperparameter TuningTechnical1 citations
  781. Federated Foundation Models on Heterogeneous Time SeriesTechnical1 citations
  782. Federated Unlearning with Gradient Descent and Conflict MitigationTechnical1 citations
  783. Filter or Compensate: Towards Invariant Representation from Distribution Shift for Anomaly DetectionTechnical1 citations
  784. Forecasting Competitions with Correlated EventsTechnical1 citations
  785. Formal Quality Measures for Predictors in Markov Decision ProcessesTechnical1 citations
  786. Formally Verified Approximate Policy IterationTechnical1 citations
  787. Fostering Epistemic Insights into AI Ethics through a Constructionist Pedagogy: An Interdisciplinary Approach to AI LiteracyTechnical1 citations
  788. FriendsQA: A New Large-Scale Deep Video Understanding Dataset with Fine-grained Topic Categorization for Story VideosTechnical1 citations
  789. From 2D CAD Drawings to 3D Parametric Models: A Vision-Language ApproachTechnical1 citations
  790. From Pairwise to Ranking: Climbing the Ladder to Ideal Collaborative Filtering with Pseudo-RankingTechnical1 citations
  791. Fully Test-time Adaptation for Tabular DataTechnical1 citations
  792. GCAD: Anomaly Detection in Multivariate Time Series from the Perspective of Granger CausalityTechnical1 citations
  793. GGS: Generalizable Gaussian Splatting for Lane Switching in Autonomous DrivingTechnical1 citations
  794. Gaze Label Alignment: Alleviating Domain Shift for Gaze EstimationTechnical1 citations
  795. Generalizable Disaster Damage Assessment via Change Detection with Vision Foundation ModelTechnical1 citations
  796. GraSP: Simple Yet Effective Graph Similarity PredictionsTechnical1 citations
  797. Gradient Alignment Improves Test-Time Adaptation for Medical Image SegmentationTechnical1 citations
  798. Gradient Weight-normalized Low-rank Projection for Efficient LLM TrainingTechnical1 citations
  799. Graph Coarsening via Supervised Granular-Ball for Scalable Graph Neural Network TrainingTechnical1 citations
  800. Graph Mixture of Experts and Memory-augmented Routers for Multivariate Time Series Anomaly DetectionTechnical1 citations
  801. Graph-Based Cross-Domain Knowledge Distillation for Cross-Dataset Text-to-Image Person RetrievalTechnical1 citations
  802. HGSFusion: Radar-Camera Fusion with Hybrid Generation and Synchronization for 3D Object DetectionTechnical1 citations
  803. HVIS: A Human-like Vision and Inference System for Human Motion PredictionTechnical1 citations
  804. HYGENE: A Diffusion-Based Hypergraph Generation MethodTechnical1 citations
  805. Hansel: Output Length Controlling Framework for Large Language ModelsTechnical1 citations
  806. Harnessing Large Language Models for Knowledge Graph Question Answering via Adaptive Multi-Aspect Retrieval-AugmentationTechnical1 citations
  807. HiCM²: Hierarchical Compact Memory Modeling for Dense Video CaptioningTechnical1 citations
  808. Hierarchical Alignment-enhanced Adaptive Grounding Network for Generalized Referring Expression ComprehensionTechnical1 citations
  809. Hierarchically Controlled Deformable 3D Gaussians for Talking Head SynthesisTechnical1 citations
  810. How Many Lines to Paint the City: Exact Edge-Cover in Temporal GraphsTechnical1 citations
  811. How Your Location Relates to Health: Variable Importance and Interpretable Machine Learning for Environmental and Sociodemographic DataTechnical1 citations
  812. Human-in-the-loop or AI-in-the-loop? Automate or Collaborate?Technical1 citations
  813. IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal CapabilitiesTechnical1 citations
  814. ICE-T: Interactions-aware Cross-column Contrastive Embedding for Heterogeneous Tabular DatasetsTechnical1 citations
  815. IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression SegmentationTechnical1 citations
  816. ITP: Instance-Aware Test Pruning for Out-of-Distribution DetectionTechnical1 citations
  817. Identifying Predictions That Influence the Future: Detecting Performative Concept Drift in Data StreamsTechnical1 citations
  818. Identity-Text Video Corpus GroundingTechnical1 citations
  819. Imperceptible 3D Point Cloud Attacks on Lattice-based Barycentric CoordinatesTechnical1 citations
  820. Improved Fixed-Parameter Bounds for Min-Sum-Radii and Diameters k-Clustering and Their Fair VariantsTechnical1 citations
  821. Improving Generalization of Deep Neural Networks by Optimum ShiftingTechnical1 citations
  822. Improving Generalization of Universal Adversarial Perturbation via Dynamic Maximin OptimizationTechnical1 citations
  823. Improving Integrated Gradient-based Transferable Adversarial Examples by Refining the Integration PathTechnical1 citations
  824. Improving Pareto Set Learning for Expensive Multi-objective Optimization via Stein Variational HypernetworksTechnical1 citations
  825. In-depth Analysis of Low-rank Matrix Factorisation in a Federated SettingTechnical1 citations
  826. Incomplete Modality Disentangled Representation for Ophthalmic Disease Grading and DiagnosisTechnical1 citations
  827. Instruction-Augmented Long-Horizon Planning: Embedding Grounding Mechanisms in Embodied Mobile ManipulationTechnical1 citations
  828. Integrating Symbolic Reasoning into Neural Generative Models for Design GenerationTechnical1 citations
  829. Intelligent OPC Engineer Assistant for Semiconductor ManufacturingTechnical1 citations
  830. Interacted Object Grounding in Spatio-Temporal Human-Object InteractionsTechnical1 citations
  831. Interpretable Solutions for Multi-Physics PDEs Using T-NNGPTechnical1 citations
  832. Is There No Such Thing as a Bad Question? H4R: HalluciBot for Ratiocination, Rewriting, Ranking, and RoutingTechnical1 citations
  833. Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly DetectionTechnical1 citations
  834. Knowledge Tagging with Large Language Model Based Multi-Agent SystemTechnical1 citations
  835. Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language ModelsTechnical1 citations
  836. LATTE: Improving Latex Recognition for Tables and Formulae with Iterative RefinementTechnical1 citations
  837. LEGEND: Leveraging Representation Engineering to Annotate Safety Margin for Preference DatasetsTechnical1 citations
  838. LLM+AL: Bridging Large Language Models and Action Languages for Complex Reasoning About ActionsTechnical1 citations
  839. LLM-RG4: Flexible and Factual Radiology Report Generation Across Diverse Input ContextsTechnical1 citations
  840. LLaVA Needs More Knowledge: Retrieval Augmented Natural Language Generation with Knowledge Graph for Explaining Thoracic PathologiesTechnical1 citations
  841. LOMA: Language-assisted Semantic Occupancy Network via Triplane MambaTechnical1 citations
  842. LTLf Synthesis Under Unreliable InputTechnical1 citations
  843. Langevin Monte Carlo Beyond Lipschitz Gradient ContinuityTechnical1 citations
  844. Learnability of Parameter-Bounded Bayes NetsTechnical1 citations
  845. Learning Fine-grained Domain Generalization via Hyperbolic State Space HallucinationTechnical1 citations
  846. Learning Physics Informed Neural ODEs with Partial MeasurementsTechnical1 citations
  847. Leveraging Consistent Spatio-Temporal Correspondence for Robust Visual OdometryTechnical1 citations
  848. Leveraging Group Classification with Descending Soft Labeling for Deep Imbalanced RegressionTechnical1 citations
  849. Leveraging Large Language Models for Wind Energy AssessmentTechnical1 citations
  850. Leveraging RGB-D Data with Cross-Modal Context Mining for Glass Surface DetectionTechnical1 citations
  851. MCGAN: Enhancing GAN Training with Regression-Based Generator LossTechnical1 citations
  852. MDD-5k: A New Diagnostic Conversation Dataset for Mental Disorders Synthesized via Neuro-Symbolic LLM AgentsTechnical1 citations
  853. MOL-Mamba: Enhancing Molecular Representation with Structural & Electronic InsightsTechnical1 citations
  854. MPQ-DM: Mixed Precision Quantization for Extremely Low Bit Diffusion ModelsTechnical1 citations
  855. MTGA: Multi-View Temporal Granularity Aligned Aggregation for Event-Based Lip-ReadingTechnical1 citations
  856. MagicNaming: Consistent Identity Generation by Finding a “Name Space” in T2I Diffusion ModelsTechnical1 citations
  857. Make Domain Shift a Catastrophic Forgetting Alleviator in Class-Incremental LearningTechnical1 citations
  858. MalCL: Leveraging GAN-Based Generative Replay to Combat Catastrophic Forgetting in Malware ClassificationTechnical1 citations
  859. MambaLCT: Boosting Tracking via Long-term Context State Space ModelTechnical1 citations
  860. MapExpert: Online HD Map Construction with Simple and Efficient Sparse Map Element ExpertTechnical1 citations
  861. Masked Language Modeling Becomes Conditional Density Estimation for Tabular Data SynthesisTechnical1 citations
  862. MathSpeech: Leveraging Small LMs for Accurate Conversion in Mathematical Speech-to-FormulaTechnical1 citations
  863. MeRino: Entropy-Driven Design for Generative Language Models on IoT DevicesTechnical1 citations
  864. Measuring Error Alignment for Decision-Making SystemsTechnical1 citations
  865. Medical MLLM Is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language ModelsTechnical1 citations
  866. Medical Manifestation-Aware De-IdentificationTechnical1 citations
  867. Medical Multimodal Model Stealing Attacks via Adversarial Domain AlignmentTechnical1 citations
  868. Mixture of Experts Based Multi-Task Supervise Learning from CrowdsTechnical1 citations
  869. MoRe: Class Patch Attention Needs Regularization for Weakly Supervised Semantic SegmentationTechnical1 citations
  870. Modeling Inter-Intra Heterogeneity for Graph Federated LearningTechnical1 citations
  871. MonoBox: Tightness-Free Box-Supervised Polyp Segmentation Using Monotonicity ConstraintTechnical1 citations
  872. Multi-Agent Motion Planning for Differential Drive Robots Through Stationary State SearchTechnical1 citations
  873. Multi-Agent Security Tax: Trading Off Security and Collaboration Capabilities in Multi-Agent SystemsTechnical1 citations
  874. Multi-Grained Query-Guided Set Prediction Network for Grounded Multimodal Named Entity RecognitionTechnical1 citations
  875. Multi-Modal Grounded Planning and Efficient Replanning for Learning Embodied Agents with a Few ExamplesTechnical1 citations
  876. Multi-Objective Molecular Design Through Learning Latent Pareto SetTechnical1 citations
  877. Multi-Robot Task Allocation Using Global Games with Negative Feedback: The Colony Maintenance ProblemTechnical1 citations
  878. Multi-Scale Contrastive Learning for Video Temporal GroundingTechnical1 citations
  879. Multi-View Incremental Learning with Structured Hebbian Plasticity for Enhanced Fusion EfficiencyTechnical1 citations
  880. Multi-clue Consistency Learning to Bridge Gaps Between General and Oriented Object in Semi-supervised DetectionTechnical1 citations
  881. Multi-task Visual Grounding with Coarse-to-Fine Consistency ConstraintsTechnical1 citations
  882. Multifaceted User Modeling in Recommendation: A Federated Foundation Models ApproachTechnical1 citations
  883. Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource LanguagesTechnical1 citations
  884. Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and EnglishTechnical1 citations
  885. Multimodal Commonsense Knowledge Distillation for Visual Question Answering (Student Abstract)Technical1 citations
  886. NLGT: Neighborhood-based and Label-enhanced Graph Transformer Framework for Node ClassificationTechnical1 citations
  887. Navigating Label Ambiguity for Facial Expression Recognition in the WildTechnical1 citations
  888. Nearly Tight Bounds on Approximate Equilibria in Spatial Competition on the LineTechnical1 citations
  889. Neural Collapse Inspired Knowledge DistillationTechnical1 citations
  890. Neural Reasoning Networks: Efficient Interpretable Neural Networks with Automatic Textual ExplanationsTechnical1 citations
  891. Neural Variable-Order Fractional Differential Equation NetworksTechnical1 citations
  892. NeuralFlix: A Simple While Effective Framework for Semantic Decoding of Videos from Non-invasive Brain RecordingsTechnical1 citations
  893. Noise-Resilient Symbolic Regression with Dynamic Gating Reinforcement LearningTechnical1 citations
  894. ODDN: Addressing Unpaired Data Challenges in Open-World Deepfake Detection on Online Social NetworksTechnical1 citations
  895. OGP-Net: Optical Guidance Meets Pixel-Level Contrastive Distillation for Robust Multi-Modal and Missing Modality SegmentationTechnical1 citations
  896. OLiDM: Object-aware LiDAR Diffusion Models for Autonomous DrivingTechnical1 citations
  897. Offline-to-Online Hyperparameter Transfer for Stochastic BanditsTechnical1 citations
  898. OmniSR: Shadow Removal Under Direct and Indirect LightingTechnical1 citations
  899. On Corruption-Robustness in Performative Reinforcement LearningTechnical1 citations
  900. On Oversquashing in Graph Neural Networks Through the Lens of Dynamical SystemsTechnical1 citations
  901. On the Consideration of AI Openness: Can Good Intent Be Abused?Technical1 citations
  902. On the Power of Strategic Corpus Enrichment in Content Creation GamesTechnical1 citations
  903. On the Trainability and Classical Simulability of Learning Matrix Product States VariationallyTechnical1 citations
  904. Operationalising Rawlsian Ethics for Fairness in Norm Learning AgentsTechnical1 citations
  905. Optimizing Human Pose Estimation Through Focused Human and Joint RegionsTechnical1 citations
  906. Orchestrating the Symphony of Prompt Distribution Learning for Human-Object Interaction DetectionTechnical1 citations
  907. PALM: Pushing Adaptive Learning Rate Mechanisms for Continual Test-Time AdaptationTechnical1 citations
  908. PAT: Pruning-Aware Tuning for Large Language ModelsTechnical1 citations
  909. PEARL: Input-Agnostic Prompt Enhancement with Negative Feedback Regulation for Class-Incremental LearningTechnical1 citations
  910. PIXELS: Progressive Image Xemplar-based Editing with Latent SurgeryTechnical1 citations
  911. PLATYPUS: Progressive Local Surface Estimator for Arbitrary-Scale Point Cloud UpsamplingTechnical1 citations
  912. PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud RegistrationTechnical1 citations
  913. PanAdapter: Two-Stage Fine-Tuning with Spatial-Spectral Priors Injecting for PansharpeningTechnical1 citations
  914. Pareto Set Learning for Multi-Objective Reinforcement LearningTechnical1 citations
  915. ParseCaps: An Interpretable Parsing Capsule Network for Medical Image DiagnosisTechnical1 citations
  916. Partially Blinded Unlearning: Class Unlearning for Deep Networks from Bayesian PerspectiveTechnical1 citations
  917. PatentLMM: Large Multimodal Model for Generating Descriptions for Patent FiguresTechnical1 citations
  918. Personalized Sleep Staging Leveraging Source-free Unsupervised Domain AdaptationTechnical1 citations
  919. Pilot: Building the Federated Multimodal Instruction Tuning FrameworkTechnical1 citations
  920. Pioneer: Physics-informed Riemannian Graph ODE for Entropy-increasing DynamicsTechnical1 citations
  921. Pixel Is Not a Barrier: An Effective Evasion Attack for Pixel-Domain Diffusion ModelsTechnical1 citations
  922. PlanLLM: Video Procedure Planning with Refinable Large Language ModelsTechnical1 citations
  923. Point Cloud Semantic Segmentation with Sparse and Inhomogeneous AnnotationsTechnical1 citations
  924. Political Actor Agent: Simulating Legislative System for Roll Call Votes Prediction with Large Language ModelsTechnical1 citations
  925. PowerMLP: An Efficient Version of KANTechnical1 citations
  926. Practicable Black-Box Evasion Attacks on Link Prediction in Dynamic Graphs—a Graph Sequential Embedding MethodTechnical1 citations
  927. Prediction-Feedback DETR for Temporal Action DetectionTechnical1 citations
  928. Probabilistic Explanations for Linear ModelsTechnical1 citations
  929. Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language ModelsTechnical1 citations
  930. Promptable Representation Distribution Learning and Data Augmentation for Gigapixel Histopathology WSI AnalysisTechnical1 citations
  931. ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech SynthesisTechnical1 citations
  932. Provable Discriminative Hyperspherical Embedding for Out-of-Distribution DetectionTechnical1 citations
  933. Putting People in LLMs’ Shoes: Generating Better Answers via Question RewriterTechnical1 citations
  934. QCS:Feature Refining from Quadruplet Cross Similarity for Facial Expression RecognitionTechnical1 citations
  935. QORT-Former: Query-optimized Real-time Transformer for Understanding Two Hands Manipulating ObjectsTechnical1 citations
  936. Quantifying Misalignment Between Agents: Towards a Sociotechnical Understanding of AlignmentTechnical1 citations
  937. RCTrans: Radar-Camera Transformer via Radar Densifier and Sequential Decoder for 3D Object DetectionTechnical1 citations
  938. RETQA: A Large-Scale Open-Domain Tabular Question Answering Dataset for Real Estate SectorTechnical1 citations
  939. RI-MAE: Rotation-Invariant Masked AutoEncoders for Self-Supervised Point Cloud Representation LearningTechnical1 citations
  940. RaDIO: Real-Time Hallucination Detection with Contextual Index Optimized Query Formulation for Dynamic Retrieval Augmented GenerationTechnical1 citations
  941. ReX: A Framework for Incorporating Temporal Information in Model-Agnostic Local Explanation TechniquesTechnical1 citations
  942. RealisID: Scale-Robust and Fine-Controllable Identity Customization via Local and Global ComplementationTechnical1 citations
  943. Rebalancing Multi-Label Class-Incremental LearningTechnical1 citations
  944. Recording for Eyes, Not Echoing to Ears: Contextualized Spoken-to-Written Conversion of ASR TranscriptsTechnical1 citations
  945. Region-Based Optimization in Continual Learning for Audio Deepfake DetectionTechnical1 citations
  946. Regional Expected Improvement for Efficient Trust Region Selection in High-Dimensional Bayesian OptimizationTechnical1 citations
  947. Regret Analysis of Multi-task Representation Learning for Linear-Quadratic Adaptive ControlTechnical1 citations
  948. Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph GenerationTechnical1 citations
  949. Relaxed Class-consensus Consistency for Semi-supervised Semantic SegmentationTechnical1 citations
  950. Replicating Electoral SuccessTechnical1 citations
  951. Rethinking Cancer Gene Identification Through Graph Anomaly AnalysisTechnical1 citations
  952. Rethinking Pseudo-Label Guided Learning for Weakly Supervised Temporal Action Localization from the Perspective of Noise CorrectionTechnical1 citations
  953. Revisiting Projection-Free Online Learning with Time-Varying ConstraintsTechnical1 citations
  954. RhythmMamba: Fast, Lightweight, and Accurate Remote Physiological MeasurementTechnical1 citations
  955. Riemann-based Multi-scale Attention Reasoning Network for Text-3D RetrievalTechnical1 citations
  956. RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference DataTechnical1 citations
  957. Robust SAM: On the Adversarial Robustness of Vision Foundation ModelsTechnical1 citations
  958. RouterRetriever: Routing over a Mixture of Expert Embedding ModelsTechnical1 citations
  959. SAIL: Sample-Centric In-Context Learning for Document Information ExtractionTechnical1 citations
  960. SCOPE: Sign Language Contextual Processing with Embedding from LLMsTechnical1 citations
  961. SEAL: Systematic Error Analysis for Value ALignmentTechnical1 citations
  962. SECodec: Structural Entropy-based Compressive Speech Representation Codec for Speech Language ModelsTechnical1 citations
  963. SKI Models: Skeleton Induced Vision-Language Embeddings for Understanding Activities of Daily LivingTechnical1 citations
  964. SMMF: Square-Matricized Momentum Factorization for Memory-Efficient OptimizationTechnical1 citations
  965. SMamba: Sparse Mamba for Event-based Object DetectionTechnical1 citations
  966. SMoSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control TasksTechnical1 citations
  967. SS-GEN: A Social Story Generation Framework with Large Language ModelsTechnical1 citations
  968. STAIR: Manipulating Collaborative and Multimodal Information for E-Commerce RecommendationTechnical1 citations
  969. SUMI-IFL: An Information-Theoretic Framework for Image Forgery Localization with Sufficiency and Minimality ConstraintsTechnical1 citations
  970. SalM²: An Extremely Lightweight Saliency Mamba Model for Real-Time Cognitive Awareness of Driver AttentionTechnical1 citations
  971. ScaleOT: Privacy-utility-scalable Offsite-tuning with Dynamic LayerReplace and Selective Rank CompressionTechnical1 citations
  972. SceneX: Procedural Controllable Large-Scale Scene GenerationTechnical1 citations
  973. Selective Uncertainty Propagation in Offline RLTechnical1 citations
  974. Selective Visual Prompting in Vision MambaTechnical1 citations
  975. Self-Corrected Flow Distillation for Consistent One-Step and Few-Step Image GenerationTechnical1 citations
  976. Semi-Implicit Neural Ordinary Differential EquationsTechnical1 citations
  977. Sensing Surface Patches in Volume Rendering for Inferring Signed Distance FunctionsTechnical1 citations
  978. Sequence Matters: Harnessing Video Models in 3D Super-ResolutionTechnical1 citations
  979. Sharpening Neural Implicit Functions with Frequency Consolidation PriorsTechnical1 citations
  980. SigStyle: Signature Style Transfer via Personalized Text-to-Image ModelsTechnical1 citations
  981. Simulation-Free Hierarchical Latent Policy Planning for Proactive DialoguesTechnical1 citations
  982. Skeleton-based Action Recognition with Non-linear Dependency Modeling and Hilbert-Schmidt Independence CriterionTechnical1 citations
  983. SkillTree: Explainable Skill-Based Deep Reinforcement Learning for Long-Horizon Control TasksTechnical1 citations
  984. Smoothness Really Matters: A Simple Yet Effective Approach for Unsupervised Graph Domain AdaptationTechnical1 citations
  985. Solving Robust Markov Decision Processes: Generic, Reliable, EfficientTechnical1 citations
  986. SongGLM: Lyric-to-Melody Generation with 2D Alignment Encoding and Multi-Task Pre-TrainingTechnical1 citations
  987. SpatioTemporal Learning for Human Pose Estimation in Sparsely-Labeled VideosTechnical1 citations
  988. Speech Is Not Enough: Interpreting Nonverbal Indicators of Common Knowledge and EngagementTechnical1 citations
  989. Speech Watermarking with Discrete Intermediate RepresentationsTechnical1 citations
  990. Speeding Up the NSGA-II with a Simple Tie-Breaking RuleTechnical1 citations
  991. Speedup Techniques for Switchable Temporal Plan Graph OptimizationTechnical1 citations
  992. Spiking Point Transformer for Point Cloud ClassificationTechnical1 citations
  993. Statistical Methodologies for Decision-Making and Uncertainty Reduction in Machine LearningTechnical1 citations
  994. Step-Calibrated Diffusion for Biomedical Optical Image RestorationTechnical1 citations
  995. Storynizor: Consistent Story Generation via Inter-Frame Synchronized and Shuffled ID InjectionTechnical1 citations
  996. Strategyproof Matching of Roommates and RoomsTechnical1 citations
  997. Synthetic Tabular Data Generation for Imbalanced Classification: The Surprising Effectiveness of an Overlap ClassTechnical1 citations
  998. S³-Mamba: Small-Size-Sensitive Mamba for Lesion SegmentationTechnical1 citations
  999. TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion ModelsTechnical1 citations
  1000. TEncDM: Understanding the Properties of the Diffusion Model in the Space of Language Model EncodingsTechnical1 citations

Looking for submission deadlines instead? See the conference deadline calendar.