← All conferences

AAAI 2026 Accepted Papers

The full list of 4,902 papers accepted at AAAI 2026 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Technical: 4,902
  1. Self-Supervised One-Step Diffusion Refinement for Snapshot Compressive ImagingTechnical
  2. Self-Supervised Representation Learning with Joint Embedding Predictive Architecture for Automotive LiDAR Object DetectionTechnical
  3. Self-supervised Multiplex Consensus Mamba for General Image FusionTechnical
  4. Semantic Alignment of Malicious Question Based on Contrastive Semantic Networks and Data Augmentation (Abstract Reprint)Technical
  5. Semantic Document Derendering: SVG Reconstruction via Vision-Language ModelingTechnical
  6. Semantic Embedding and Synthetic Augmentation for Longitudinal Survey Prediction (Student Abstract)Technical
  7. Semantic Feature Purification for Adversarially-Aware RGB-T TrackingTechnical
  8. Semantic Guided Part Relation-aware Network for Point Cloud CompletionTechnical
  9. Semantic Volume: Quantifying and Detecting Both External and Internal Uncertainty in LLMsTechnical
  10. Semantic-Augmented Image Clustering via Adaptive Multi-Modal CollaborationTechnical
  11. Semantic-Aware Data Augmentation for Sequential RecommendationTechnical
  12. Semantic-Aware Feature Enhancement for Partial Label LearningTechnical
  13. Semantic-Consistent Bidirectional Contrastive Hashing for Noisy Multi-Label Cross-Modal RetrievalTechnical
  14. Semantic-Driven Visual Progressive Refinement for Aerial-Ground Person ReID: A Challenging Large-Scale BenchmarkTechnical
  15. Semantic-Guided Sketch-to-RGB Image Generation via Controlled Diffusion for Improved Sketch Recognition (Student Abstract)Technical
  16. SemanticNN: Compressive and Error-Resilient Semantic Offloading for Extremely Weak DevicesTechnical
  17. SemanticVLA: Semantic-Aligned Sparsification and Enhancement for Efficient Robotic ManipulationTechnical
  18. Semantics and Content Matter: Towards Multi-Prior Hierarchical Mamba for Image DerainingTechnical
  19. Semantics-Preserving Adversarial Attacks on Event-Driven Stock Prediction ModelsTechnical
  20. Semi-Supervised High Dynamic Range Image Reconstructing via Bi-Level Uncertain Area MaskingTechnical
  21. Semi-Supervised Regression by Preserving Ranking Relationships Between Close Unlabeled SamplesTechnical
  22. Semi-Supervised Semantic Segmentation via Derivative Label PropagationTechnical
  23. Semi-Supervised Synthetic Data Generation with Fine-Grained Relevance Control for Short Video Search Relevance ModelingTechnical
  24. Semi-supervised Latent Disentangled Diffusion Model for Textile Pattern GenerationTechnical
  25. Semore: VLM-guided Enhanced Semantic Motion Representations for Visual Reinforcement LearningTechnical
  26. Sensor Model Identification via Simultaneous Model Selection and State Variable Determination (Abstract Reprint)Technical
  27. Sentient: Detecting APTs via Capturing Indirect Dependencies and Behavioral LogicTechnical
  28. SepPrune: Structured Pruning for Efficient Deep Speech SeparationTechnical
  29. SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical PlanningTechnical
  30. Sequence-Free for Compound Protein Interaction PredictionTechnical
  31. Sequential Selling with Sunk Cost BiasTechnical
  32. ShaLa: Multimodal Shared Latent Generative ModellingTechnical
  33. ShadeEdit: A Utility-Preserving and Defense-Evasive Knowledge Manipulation Attack in Federated LLMsTechnical
  34. Shadows in the Code: Exploring the Risks and Defenses of LLM-based Multi-Agent Software Development SystemsTechnical
  35. ShapBPT: Image Feature Attributions Using Data-Aware Binary Partition TreesTechnical
  36. Shaping Human–AI Collaboration in Education: Effects of AI-Assisted Decision-Making Paradigms and Human–AI Decision Consistency on Pre-Service Teachers’ Psychological States and PerformanceTechnical
  37. Shaping Parameter Contribution Patterns for Out-of-Distribution DetectionTechnical
  38. Shaping Without Tearing: Controllable Diffeomorphic Deformations for Topology-Preserving 3D Point Cloud AugmentationTechnical
  39. Shapley Value Approximation Based on k-Additive GamesTechnical
  40. Share Your Attention: Transformer Weight Sharing via Matrix-based Dictionary LearningTechnical
  41. Shared & Domain Self-Adaptive Experts with Frequency-Aware Discrimination for Continual Test-Time AdaptationTechnical
  42. SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse PreferencesTechnical
  43. Sharp Eyes and Memory for VideoLLMs: Information-Aware Visual Token Pruning for Efficient and Reliable VideoLLM ReasoningTechnical
  44. Sheaf Graph Neural Networks via PAC-Bayes Spectral OptimizationTechnical
  45. Shedding the Facades, Connecting the Domains: Detecting Shifting Multimodal Hate Video with Test-Time AdaptationTechnical
  46. SheetBrain: A Neuro-Symbolic Agent for Accurate Reasoning over Complex and Large SpreadsheetsTechnical
  47. ShieldRAG: Safeguarding Retrieval-Augmented Generation from Untrusted Knowledge BasesTechnical
  48. ShoppingBench: A Real-World Intent-Grounded Shopping Benchmark for LLM-based AgentsTechnical
  49. ShortageSim: Simulating Drug Shortages Under Information AsymmetryTechnical
  50. Shortcut Learning Susceptibility in Vision Classifiers (Student Abstract)Technical
  51. Should You Use LLMs to Simulate Opinions? Quality Checks for Early-Stage DeliberationTechnical
  52. Shrinking the Teacher: An Adaptive Teaching Paradigm for Asymmetric EEG-Vision AlignmentTechnical
  53. SigFusion: Unified Signal-Level Self-Supervised Learning Paradigm for Image FusionTechnical
  54. Sign-Aware Multimodal Graph RecommendationTechnical
  55. Signal Enhancement via Multi-view Dynamic Representation and Alignment-aware FusionTechnical
  56. Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-IdentificationTechnical
  57. Silenced Biases: The Dark Side LLMs Learned to RefuseTechnical
  58. Sim-to-Real: An Unsupervised Noise Layer for Screen-Camera Watermarking RobustnessTechnical
  59. Sim4Seg: Boosting Multimodal Multi-disease Medical Diagnosis Segmentation with Region-Aware Vision-Language Similarity MasksTechnical
  60. SimDiff: Simpler Yet Better Diffusion Model for Time Series Point ForecastingTechnical
  61. SimLabel: Similarity-Weighted Semi-supervision for Multi-annotator Learning with Missing LabelsTechnical
  62. SimROD: A Simple Baseline for Raw Object Detection with Global and Local EnhancementsTechnical
  63. Simba: Towards High-Fidelity and Geometrically-Consistent Point Cloud Completion via Transformation DiffusionTechnical
  64. SimpleDiffusion: A Lightweight and Efficient Conditional Diffusion Model for Multi-Modal Salient Object DetectionTechnical
  65. Simulated Rewards, Skewed Strategies: Tracing the Acquired Preference Bias in LLM-Based Dialogue PlannersTechnical
  66. Simulating Dispute Mediation with LLM-Based Agents for Legal ResearchTechnical
  67. Simulating Distribution Dynamics: Liquid Temporal Feature Evolution for Single-Domain Generalized Object DetectionTechnical
  68. Simulating Human-Like Counseling: A Path- and Scenario-Guided Framework for Psychological Support DialogueTechnical
  69. Simulation-Driven Railway Delay Prediction: An Imitation Learning ApproachTechnical
  70. SinBasis Networks: Matrix-Equivalent Feature Extraction for Wave-Like Optical SpectrogramsTechnical
  71. SineLoRA∆: Sine-Activated Delta CompressionTechnical
  72. Single-Stage fMRI-to-3D Reconstruction via Viewpoint-Aware Embedding and Hierarchical GuidanceTechnical
  73. Situating Youth Agency in Designing AI & Art PoliciesTechnical
  74. Skeletons Speak Louder than Text: A Motion-Aware Pretraining Paradigm for Video-Based Person Re-IdentificationTechnical
  75. Sketch-Guided Anime Hair Editing Using Multimodal Diffusion Transformer (Student Abstract)Technical
  76. Skill Path: Unveiling Language Skills from Circuit GraphsTechnical
  77. SkillGen: Learning Domain Skills for In-Context Sequential Decision MakingTechnical
  78. SkipCat: Rank-Maximized Low-Rank Compression of Large Language Models via Shared Projection and Block SkippingTechnical
  79. SkyMoE: A Vision-Language Foundation Model for Enhancing Geospatial Interpretation with Mixture of ExpertsTechnical
  80. SkySplat: Generalizable 3D Gaussian Splatting from Multi-Temporal Sparse Satellite ImagesTechnical
  81. Sleep-Like Replay Reduces Loss-Landscape Sharpness to Improve Generalization (Student Abstract)Technical
  82. Slender3D: Curve-Guided Multi-View Reconstruction of Slender StructuresTechnical
  83. SlideBot: A Multi-Agent Framework for Generating Informative, Reliable, Multi-Modal PresentationsTechnical
  84. SlideTailor: Personalized Presentation Slide Generation for Scientific PapersTechnical
  85. Sliding-Window Merging for Compacting Patch-Redundant Layers in LLMsTechnical
  86. SlimInfer: Accelerating Long-Context LLM Inference via Dynamic Token PruningTechnical
  87. Small Models Exhibit Limited Answer Consistency in Repetition Trials of the Multiple-Choice MMLU-Redux and MedQA BenchmarksTechnical
  88. Small but Mighty: Dynamic Wavelet Expert-Guided Fine-Tuning of Large-Scale Models for Optical Remote Sensing Object SegmentationTechnical
  89. SmartAgent: Chain-of-User-Thought for Embodied Personalized Agent in Cyber WorldTechnical
  90. SmartEyes: Plug-and-Play Event Detection for Retail Loss PreventionTechnical
  91. SmartSight: Mitigating Hallucination in Video-LLMs Without Compromising Video Understanding via Temporal Attention CollapseTechnical
  92. SmartSplat: Feature-Smart Gaussians for Scalable Compression of Ultra-High-Resolution ImagesTechnical
  93. SoMe: A Realistic Benchmark for LLM-based Social Media AgentsTechnical
  94. Social Behavior as a Key to Learning-Based Multi-Agent Pathfinding Dilemmas (Abstract Reprint)Technical
  95. Social Influence-Based Mutual Acknowledgement Token Exchange (Student Abstract)Technical
  96. Socrates or Smartypants: Testing Logic Reasoning Capabilities of Large Language Models with Logic Programming-Based Test OraclesTechnical
  97. Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement LearningTechnical
  98. Sonic4D: Spatial Audio Generation for Immersive 4D Scene ExplorationTechnical
  99. Sonnet: Spectral Operator Neural Network for Multivariable Time Series ForecastingTechnical
  100. Sortblock: Similarity-Aware Feature Reuse for Diffusion ModelTechnical
  101. Sound-AI: A Pedagogical Tool for Exploring AI in Audio and Bioacoustic ResearchTechnical
  102. Source-Free Graph Foundation Model Adaptation via Pseudo-Source ReconstructionTechnical
  103. SpaCRD: Multimodal Deep Fusion of Histology and Spatial Transcriptomics for Cancer Region DetectionTechnical
  104. Space Alignment Matters: The Missing Piece for Inducing Neural Collapse in Long-Tailed LearningTechnical
  105. SpaceVLLM: Endowing Multimodal Large Language Model with Spatio-Temporal Video Grounding CapabilityTechnical
  106. SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel PruningTechnical
  107. Sparse Additive Model Pruning for Order-Based Causal Structure LearningTechnical
  108. Sparse Attention Across Multiple-Context KV CacheTechnical
  109. Sparse Poisson Gamma Belief Networks for High-Dimensional Sparse Count DataTechnical
  110. Sparse Tuning Enhances Plasticity in PTM-based Continual LearningTechnical
  111. Sparse-Scale Transformer with Bidirectional Awareness for Time Series ForecastingTechnical
  112. Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache EvictionTechnical
  113. Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion TransformersTechnical
  114. Sparse3DPR: Training-Free 3D Hierarchical Scene Parsing and Task-Adaptive Subgraph Reasoning from Sparse RGB ViewsTechnical
  115. Sparse4DGS: 4D Gaussian Splatting for Sparse-Frame Dynamic Scene ReconstructionTechnical
  116. SparseCoop: Cooperative Perception with Kinematic-Grounded QueriesTechnical
  117. SparseRM: A Lightweight Preference Modeling with Sparse AutoencoderTechnical
  118. SparseSurf: Sparse-View 3D Gaussian Splatting for Surface ReconstructionTechnical
  119. SparseWorld: A Flexible, Adaptive, and Efficient 4D Occupancy World Model Powered by Sparse and Dynamic QueriesTechnical
  120. Spatial Branch-and-Bound for Computing Multiplayer Nash EquilibriumTechnical
  121. Spatial Graph Attention Network Modeling for Neighborhood-Scale Lead Contamination Risk Prediction Using Publicly Available DataTechnical
  122. Spatial-Frequency Spiking Neural Network for Underwater Object DetectionTechnical
  123. Spatial-Spectral Homogeneous Attacks on Physical-World Large Vision-Language ModelsTechnical
  124. Spatial-Temporal Feedback Diffusion Guidance for Controlled Traffic ImputationTechnical
  125. SpatialActor: Exploring Disentangled Spatial Representations for Robust Robotic ManipulationTechnical
  126. SpatialLogic-Bench: A Diagnostic Benchmark for Task-Oriented Spatiotemporal ReasoningTechnical
  127. Spatially Grouped Curriculum Learning for Multi-Agent Path FindingTechnical
  128. Spatially-Guided Self-Attention Refinement for Zero-Shot Hair Segmentation (Student Abstract)Technical
  129. Spatio-Temporal Context Learning with Temporal Difference Convolution for Moving Infrared Small Target DetectionTechnical
  130. Spatio-Temporal Distortion Aware Omnidirectional Video Super-ResolutionTechnical
  131. Spatio-Temporal Hierarchical Causal ModelsTechnical
  132. SpatioTemporal Difference Network for Video Depth Super-ResolutionTechnical
  133. Spatiotemporal Transformers with Multiple Instance Learning for Label-Efficient Behavioral Analysis in Autism (Student Abstract)Technical
  134. Spatiotemporal-Untrammelled Mixture of Experts for Multi-Person Motion PredictionTechnical
  135. Speaker Anonymization for ChildrenTechnical
  136. SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language ModelsTechnical
  137. SpecDetect: Simple, Fast, and Training-Free Detection of LLM-Generated Text via Spectral AnalysisTechnical
  138. SpecDiff: Accelerating Diffusion Model Inference with Self-SpeculationTechnical
  139. SpecQuant: Spectral Decomposition and Adaptive Truncation for Ultra-Low-Bit LLMs QuantizationTechnical
  140. Specification-Guided Reinforcement LearningTechnical
  141. Spectral Basis Learning for Expressive Graph Neural Networks in Link PredictionTechnical
  142. Spectral Property-Driven Data Augmentation for Hyperspectral Single-Source Domain GeneralizationTechnical
  143. Spectrally Adaptive Channel-aware Unrolling Network for Compressed SensingTechnical
  144. Speech Recognition Model Improves Text-to-Speech Synthesis Using Fine-Grained RewardTechnical
  145. Speech-Aware Long Context Pruning and Integration for Contextualized Automatic Speech RecognitionTechnical
  146. SphereDiff: Tuning-free 360° Static and Dynamic Panorama Generation via Spherical Latent RepresentationTechnical
  147. Spherical Geometry Diffusion: Generating High-quality 3D Face Geometry via Sphere-anchored RepresentationsTechnical
  148. SpiderGen: Towards Procedure Generation for Carbon Life Cycle Assessments with Generative AITechnical
  149. SpikCommander: A High-performance Spiking Transformer with Multi-view Learning for Efficient Speech Command RecognitionTechnical
  150. Spike Imaging Velocimetry: Dense Motion Estimation of Fluids Using Spike StreamsTechnical
  151. Spike Stream Memory Transfer for Dynamic Scene ReconstructionTechnical
  152. Spiking Heterogeneous Graph Attention NetworksTechnical
  153. Spiking-Aided Neural Architecture for Efficient and Robust WiFi SensingTechnical
  154. SpikingIR: A Novel Converted Spiking Neural Network for Efficient Image RestorationTechnical
  155. Spikingformer: A Key Foundation Model for Spiking Neural NetworksTechnical
  156. Splat-SAP: Feed-Forward Gaussian Splatting for Human-Centered Scene with Scale-Aware Point Map ReconstructionTechnical
  157. SplatSSC: Decoupled Depth-Guided Gaussian Splatting for Semantic Scene CompletionTechnical
  158. Splats in Splats: Robust and Effective 3D Steganography Towards Gaussian SplattingTechnical
  159. Split-Layer: Enhancing Implicit Neural Representation by Maximizing the Dimensionality of Feature SpaceTechnical
  160. Spontaneous Yet Predictable: Shapelet-Driven, Channel-Aware Intention Decoding from Multi-Region ECoGTechnical
  161. Stability-Aware Reinforcement Learning for Robust Class Integration Test Order GenerationTechnical
  162. Stabilizing Cross-Modal Bidirectional Attribution: Few-Shot Adversarial Prompt Tuning for Robust Vision-Language ModelsTechnical
  163. Stabilizing Policy Gradient Methods via Reward ProfilingTechnical
  164. Stabilizing Self-Consuming Diffusion Models with Latent Space FilteringTechnical
  165. Stabilizing Spiking Neurons Through Biologically Inspired PolarizationTechnical
  166. Stable Voting and the Splitting of CyclesTechnical
  167. Stable and Adaptive Fusion for Multi-domain Multi-task RecommendationTechnical
  168. Stage-Aware Graph Contrastive Learning with Node-oriented Mixture of ExpertsTechnical
  169. Start Small, Think Big: Curriculum-based Relative Policy Optimization for Visual GroundingTechnical
  170. State Mamba: Spatiotemporal EEG State-Space Model with Dynamic Brain Alignment for Cross-Subject RepresentationTechnical
  171. State Proficiency-Based Adaptive Fine-Tuning for Offline-to-Online Reinforcement LearningTechnical
  172. State-Derivative-Aware Neural Controlled Differential Equations for Multivariate Time Series Anomaly Detection and DiagnosisTechnical
  173. State-Space Hierarchical Compression with Gated Attention and Learnable Sampling for Hour-Long Video Understanding in Large Multimodal ModelsTechnical
  174. Stationary and Clustering Transformer Hashing for Cross-modal RetrievalTechnical
  175. Statistical Learning Theory for Distributional ClassificationTechnical
  176. Statistically Robust Sparse High-order Interaction ModelTechnical
  177. SteerMusic: Enhanced Musical Consistency for Zero-shot Text-Guided and Personalized Music EditingTechnical
  178. Steering One-Step Diffusion Model with Fidelity-Rich Decoder for Fast Image CompressionTechnical
  179. Steering Pretrained Drafters During Speculative DecodingTechnical
  180. Steering Representations, Safeguarding Privacy: A Cross-Modal Privacy Protection Method for Generative AITechnical
  181. Steering Sparse Autoencoder Latents to Control Dynamic Head Pruning in Vision Transformers (Student Abstract)Technical
  182. Steering Visuomotor Policy in Open Worlds via Cross-View Goal AlignmentTechnical
  183. StegaVAR: Privacy-Preserving Video Action Recognition via Steganographic Domain AnalysisTechnical
  184. Step Back to Leap Forward: Self-Backtracking for Symbolic Reasoning and Planning in Language ModelsTechnical
  185. Step-GRPO: Enhancing Reasoning Quality and Efficiency via Structured PRM-Based Reinforcement LearningTechnical
  186. Step-by-step Layered Design GenerationTechnical
  187. StepFun-Formalizer: Unlocking the Autoformalization Potential of LLMs Through Knowledge-Reasoning FusionTechnical
  188. Stepwise Contrastive Reasoning for Retrieval-Augmented Generation over Knowledge GraphsTechnical
  189. Steve: Your Personal AI Career CoachTechnical
  190. Stochastic Decentralized Optimization of Non-Smooth Convex and Convex-Concave Problems over Time-Varying NetworksTechnical
  191. Stochastic Universal Adversarial Perturbations with Fixed Optimization Constraint and Ensured High-probability TransferabilityTechnical
  192. Stop Mixing Things Up! BISCUIT Teaches Vision-Language Models to Learn New Concepts from Images on the SpotTechnical
  193. StoryBox: Collaborative Multi-Agent Simulation for Hybrid Bottom-Up Long-Form Story Generation Using Large Language ModelsTechnical
  194. Strategic Reasoning over Golog Programs in the Nondeterministic Situation CalculusTechnical
  195. Strategic Tool Enhanced AI Agent for Multi-Issue Negotiation (Student Abstract)Technical
  196. Stratified Knowledge-Density Super-Network for Scalable Vision TransformersTechnical
  197. Stratos: An End-to-End Distillation Pipeline for Customized LLMs Under Distributed Cloud EnvironmentsTechnical
  198. StreamKV: Streaming Video Question-Answering with Segment-based KV Cache Retrieval and CompressionTechnical
  199. StreamSTGS: Streaming Spatial and Temporal Gaussian Grids for Real-Time Free-Viewpoint VideoTechnical
  200. Streaming Generated Gaussian Process Experts for Online Learning and ControlTechnical
  201. Streaming Generation of Co-Speech Gestures via Accelerated Rolling DiffusionTechnical
  202. StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion ModelTechnical
  203. Strip R-CNN: Large Strip Convolution for Remote Sensing Object DetectionTechnical
  204. StrokeFusion: Vector Sketch Generation via Joint Stroke-UDF Encoding and Latent Sequence DiffusionTechnical
  205. Structural Approach to Guiding a Present-Biased AgentTechnical
  206. Structural Entropy Guided Incremental Learning for Open-World Multimodal Social Event DetectionTechnical
  207. Structure Detection for Contextual Reinforcement LearningTechnical
  208. Structure-Aware Encodings of Argumentation Properties for Clique-widthTechnical
  209. Structure-Enhanced Adapter for Self-Supervised Heterogeneous Graph LearningTechnical
  210. Structure-based RNA Design by Step-wise Optimization of Latent Diffusion ModelTechnical
  211. Structures Meet Semantics: Multimodal Fusion via Graph Contrastive LearningTechnical
  212. Studying Classifier(-Free) Guidance from a Classifier-Centric PerspectiveTechnical
  213. Style-First Authorship Verification for Academic Integrity in the Generative AI Era (Student Abstract)Technical
  214. Style4D-Bench: A Benchmark Suite for 4D StylizationTechnical
  215. StyleBreak: Revealing Alignment Vulnerabilities in Large Audio-Language Models via Style-Aware Audio JailbreakTechnical
  216. StyleDrive: Towards Driving-Style Aware Benchmarking of End-To-End Autonomous DrivingTechnical
  217. StyleFM: Frequency Manipulation Empowered by Recursive Attention on Diffusion Models for Arbitrary Style TransferTechnical
  218. StyleProto: Style-Augmented Prototype Learning for Cross-Domain Few-Shot Object DetectionTechnical
  219. StyleSentinel: Reliable Artistic Copyright Verification via Stylistic FingerprintsTechnical
  220. StyleTailor: Towards Personalized Fashion Styling via Hierarchical Negative FeedbackTechnical
  221. Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert MergingTechnical
  222. SubGCache: Accelerating Graph-based RAG with Subgraph-level KV CacheTechnical
  223. Subgraph Encoding with Bicentric Sphere Node Labeling and Pooling for Link PredictionTechnical
  224. Subspace-Aware Graph Construction and Contrastive Alignment for Multimodal Recommendation with Large Language ModelsTechnical
  225. Suit the Remedy to the Retriever: Interpretable Query Optimization with Retriever Preference Alignment for Vision-Language RetrievalTechnical
  226. Super Level Sets and Exponential Decay: A Synergistic Approach to Stable Neural Network Training (Abstract Reprint)Technical
  227. Superior Runtime Guarantees for the MOEA/D Multi-Objective Optimizer via Weighted-Sum DecompositionTechnical
  228. Supervised Dynamic Dimension Reduction with Deep Neural NetworkTechnical
  229. SurgPub-Video: A Comprehensive Surgical Video Framework for Enhanced Surgical Intelligence in Vision-Language ModelTechnical
  230. Surgical AI Copilot: Energy-Based Fourier Gradient Low-Rank Adaptation for Surgical LLM Agent Reasoning and PlanningTechnical
  231. Surrogate as Teacher: Distillation-Guided Graph Poisoning AttackTechnical
  232. SwiftVideo: A Unified Framework for Few-Step Video Generation Through Trajectory-Distribution AlignmentTechnical
  233. Syllogism-Inspired TableQA: Evidentialization Makes Decomposition Reasoning and Answer Verification More ReliableTechnical
  234. SymGS: Leveraging Reflective Symmetries for 3DGS CompressionTechnical
  235. Symbolic Planning and Multi-Agent Path Finding in Extremely Dense Environments with Unassigned AgentsTechnical
  236. Symbolic Task Inference in Deep Reinforcement Learning (Abstract Reprint)Technical
  237. Symmetric Aggregation of Conformity Scores for Efficient Uncertainty SetsTechnical
  238. Symmetrical Flow Matching: Unified Image Generation, Segmentation, and Classification with Score-Based Generative ModelsTechnical
  239. Symmetries and Other Variations of “End-Recursive” HTN Problems: Mapping the Border Between Decidable and Undecidable RestrictionsTechnical
  240. Symmetry Breaking for Inductive Logic ProgrammingTechnical
  241. Symmetry-Aware Transformer Training for Automated PlanningTechnical
  242. Symphony-MoE: Harmonizing Disparate Pre-trained Models into a Coherent Mixture-of-ExpertsTechnical
  243. SynWeather: Weather Observation Data Synthesis Across Multiple Regions and Variables via a General Diffusion TransformerTechnical
  244. SyncBrain: Exploring Brain Functional Dynamics Through Neural Oscillatory SynchronizationTechnical
  245. SynerDetect: Hierarchical Synergistic Learning for Generalizable AI-Generated Image DetectionTechnical
  246. Synergizing Multigrid Algorithms with Vision Transformer: A Novel Approach to Enhance the Seismic Foundation ModelTechnical
  247. Synthetic Forgetting Without Access: A Few-Shot Zero-Glance Framework for Machine UnlearningTechnical
  248. Synthetic-to-Real Transfer Learning for League of Legends Minimap Object Detection (Student Abstract)Technical
  249. System L: Toward System 2-Style Legal ReasoningTechnical
  250. S²Drug: Bridging Protein Sequence and 3D Structure in Contrastive Representation Learning for Virtual ScreeningTechnical
  251. S²Flow: Towards Fast and Authentic Training-Free High-Resolution Video GenerationTechnical
  252. S²HyRec: Self-Supervised Hypergraph Sequential RecommendationTechnical
  253. S²Teacher: Step-by-step Teacher for Sparsely Annotated Oriented Object DetectionTechnical
  254. S³-MSD: Large Vision-Language Model for Explainable and Generalizable Multi-modal Sarcasm DetectionTechnical
  255. S³: Spiking Neurons as an Isolating Segmenter for Brain Signal DecodingTechnical
  256. T-APT: Text-Guided Modality-Aware Prompt Tuning for Arbitrary Multimodal Remote Sensing Data Joint ClassificationTechnical
  257. T-GVC: Trajectory-Guided Generative Video Coding at Ultra-Low BitratesTechnical
  258. T-LoRA: Single Image Diffusion Model Customization Without OverfittingTechnical
  259. T-Retriever: Tree-based Hierarchical Retrieval Augmented Generation for Textual GraphsTechnical
  260. T-Rex-Omni: Integrating Negative Visual Prompt in Generic Object DetectionTechnical
  261. T-SKM-Net: Trainable Neural Network Framework for Linear Constraint Satisfaction via Sampling Kaczmarz-Motzkin MethodTechnical
  262. T2Agent: A Tool-augmented Multimodal Misinformation Detection Agent with Monte Carlo Tree SearchTechnical
  263. T2I-RiskyPrompt: A Benchmark for Safety Evaluation, Attack, and Defense on Text-to-Image ModelTechnical
  264. T3Time: Tri-Modal Time Series Forecasting via Adaptive Multi-Head Alignment and Residual FusionTechnical
  265. T3former: Temporal Graph Classification with Topological Machine LearningTechnical
  266. T4NMTD: Transition-Centric Reinforcement Learning for Non-Markovian Task DecompositionTechnical
  267. TAPO: Dynamic Teacher and Perturbed Answer Injection for Policy OptimizationTechnical
  268. TARA: Token-Aware LoRA for Composable Personalization in Diffusion ModelsTechnical
  269. TASE: Token Awareness and Structured Evaluation for Multilingual Language ModelsTechnical
  270. TAdaRAG: Task Adaptive Retrieval-Augmented Generation via On-the-Fly Knowledge Graph ConstructionTechnical
  271. TCoT: Trajectory Chain-of-Thoughts for Robotic Manipulation with Failure Recovery in Vision-Language-Action ModelTechnical
  272. TDSNNs: Competitive Topographic Deep Spiking Neural Networks for Visual Cortex ModelingTechnical
  273. TDSS: Task Dynamic-Synergistic Skill Adaptation for Boosting Efficient and Scalable Multi-Task Learning in Dense Visual PredictionTechnical
  274. TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT AlignmentTechnical
  275. TFD-Net: Towards Intelligent Time-Frequency Mode Decomposition with Practical ApplicationsTechnical
  276. TFRank: Think-Free Reasoning Enables Practical Pointwise LLM RankingTechnical
  277. TG-Field: Geometry-Aware Radiative Gaussian Fields for Tomographic ReconstructionTechnical
  278. TGCA-LLM: Time-Aware Graph-Text Contrastive Alignment for Enhancing LLMs in Temporal Knowledge Graph CompletionTechnical
  279. TGCD: A Framework for Generalized Category Discovery in Time-Series DataTechnical
  280. TGDD: Trajectory Guided Dataset Distillation with Balanced DistributionTechnical
  281. THGB: A Comprehensive Benchmark for Text-attributed Heterogeneous GraphsTechnical
  282. TIDE: Temporal-Aware Sparse Autoencoders for Interpretable Diffusion Transformers in Image GenerationTechnical
  283. TIM++: Transductive Information Maximization for Few-Shot CLIPTechnical
  284. TIMA: Text-Image Mutual Awareness for Balancing Zero-Shot Adversarial Robustness and Generalization AbilityTechnical
  285. TIME: Temporal-Sensitive Multi-Dimensional Instruction Tuning and Robust Benchmarking for Video-LLMsTechnical
  286. TIV: Thought Injection via Vectors for Efficient Reasoning in Large Reasoning ModelsTechnical
  287. TLAGC: Taylor Linear Attention-Guided Graph Convolutions for Revealing Spatial Domains in Spatial Multi-Omics DataTechnical
  288. TMAE:Learning Targeted Multi-Agent Exploration via Causal InferenceTechnical
  289. TMDC: A Two-Stage Modality Denoising and Complementation Framework for Multimodal Sentiment Analysis with Missing and Noisy ModalitiesTechnical
  290. TO-GATE: Clarifying Questions and Summarizing Responses with Trajectory Optimization for Eliciting Human PreferenceTechnical
  291. TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language ModelsTechnical
  292. TOP-RL: Task-Optimized Progressive Token Pruning with Reinforcement Learning for Vision Language ModelsTechnical
  293. TOPOGRAPH: Topology-Preserving Graph Reduction with Adaptive Structure for Persistent HomologyTechnical
  294. TORA: Train Once, Realign Anytime for Offline Multi-Objective Reinforcement LearningTechnical
  295. TOSC: Task-Oriented Shape Completion for Open-World Dexterous Grasp Generation from Partial Point CloudsTechnical
  296. TPR: A Training Procedure Representation to Augment XR Simulations with LLMsTechnical
  297. TR-DQ: Time-Rotation Diffusion QuantizationTechnical
  298. TRACE: A Generalizable Drift Detector for Streaming Data-Driven OptimizationTechnical
  299. TRACE: Textual Relevance Augmentation and Contextual Encoding for Multimodal Hate DetectionTechnical
  300. TRACE: Trajectory-based Activation Change Estimation for Task-specific Data SelectionTechnical
  301. TRACE: Transformation-Aware Graph Refinement for Reaction Condition PredictionTechnical
  302. TRIPLE: Theory-Driven Integration of Planned and Habitual Behaviors for LLM-based PersonalizationTechnical
  303. TRT: Harnessing Tensor Ring Transformer for Hyperspectral Image Super-ResolutionTechnical
  304. TRUST: Leveraging Text Robustness for Unsupervised Domain AdaptationTechnical
  305. TRUST: Transaction Risk via Unified Sequence and TopologyTechnical
  306. TSBOW – Traffic Surveillance Benchmark for Occluded Vehicles Under Various Weather ConditionsTechnical
  307. TSGDiff: Rethinking Synthetic Time Series Generation from a Pure Graph PerspectiveTechnical
  308. TSPE-GS: Probabilistic Depth Extraction for Semi-Transparent Surface Reconstruction via 3D Gaussian SplattingTechnical
  309. TSPO: Temporal Sampling Policy Optimization for Long-form Video Language UnderstandingTechnical
  310. TTA-Bench: A Comprehensive Benchmark for Evaluating Text-to-Audio ModelsTechnical
  311. TTF-VLA: Temporal Token Fusion via Pixel-Attention Integration for Vision-Language-Action ModelsTechnical
  312. TTF: A Trapezoidal Temporal Fusion Framework for LTV Forecasting in DouyinTechnical
  313. TTVAE: Transformer-Based Generative Modeling for Tabular Data Generation (Abstract Reprint)Technical
  314. TVChain: Leveraging Textual-Visual Prompt Chains for Jailbreaking Large Vision-Language ModelsTechnical
  315. TW-CRL: Time-Weighted Contrastive Reward Learning for Efficient Inverse Reinforcement LearningTechnical
  316. TWINFUZZ: Dual-Model Fuzzing for Robustness Generalization in Deep LearningTechnical
  317. TWiST: Temporal Weakly-Supervised Triplets Recognition in Surgical Videos (Student Abstract)Technical
  318. TaREx: Reinforcement Learning for Code-Driven Table ReasoningTechnical
  319. Tab-PET: Graph-Based Positional Encodings for Tabular TransformersTechnical
  320. TabFlash: Efficient Table Understanding with Progressive Question Conditioning and Token FocusingTechnical
  321. TabGeoFlow: A Geometric Flow Matching Model for Tabular Data SynthesisTechnical
  322. Tabular Learnwares Can Be Repurposed for Seemingly Irrelevant New TasksTechnical
  323. Tackling Dual-stage Missing Modalities in Brain Tumor Segmentation via Robust Modality Reconstruction and Prompt-guided Modality AdaptationTechnical
  324. Tackling Resource-Constrained and Data-Heterogeneity in Federated Learning with Double-Weight Sparse PackTechnical
  325. TacpAgent: Enhancing Student Engagement in Classroom Exercises Through LLM-Generated FeedbackTechnical
  326. TactGen: Tactile Sensory Data Generation via Zero-Shot Sim-to-Real Transfer (Abstract Reprint)Technical
  327. Tailored ViT Slimming: Budget-Aware Multi-Dimensional Sparsity Regularization for Vision Transformers Pruning (Student Abstract)Technical
  328. Talk, Snap, Complain: Validation-Aware Multimodal Expert Framework for Fine-Grained Customer GrievancesTechnical
  329. Talk2Code: A Multi-Turn Interaction Benchmark with Dual-Track Evaluation for Code GenerationTechnical
  330. Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and EditingTechnical
  331. Talking Trails: LLM-Enhanced Spatiotemporal Trajectory Modeling for E-Bike Delivery Route PlanningTechnical
  332. Talon: Breaking the Synchronization Barrier in Speculative Decoding with Hybrid Model-based and Retrieve-based DraftingTechnical
  333. Taming Cascaded Mixture-of-Experts for Modality-missing Multi-modal Salient Object DetectionTechnical
  334. Taming the Phantom: Token-Asymmetric Filtering for Hallucination Mitigation in Large Vision-Language ModelsTechnical
  335. Tapas Are Free! Training-Free Adaptation of Programmatic Agents via LLM-Guided Program Synthesis in Dynamic EnvironmentsTechnical
  336. TarPro: Targeted Protection Against Malicious Image EditingTechnical
  337. Target Refocusing via Attention Redistribution for Open-Vocabulary Semantic Segmentation: An Explainability PerspectiveTechnical
  338. Target-Balanced Score DistillationTechnical
  339. TargetVAU: Multimodal Anomaly-Aware Reasoning for Target Behavior Understanding in VideosTechnical
  340. Targeted Data Protection for Diffusion Model by Matching Training TrajectoryTechnical
  341. Targeted Pathway Inference for Biological Knowledge Bases via Graph Learning and ExplanationTechnical
  342. Targeting Borderline Fraudsters: Multi-View Hypergraph Fraud Detection with LLM-Guided Contrastive LearningTechnical
  343. Targeting Misalignment: A Conflict-Aware Framework for Reward-Model-based LLM AlignmentTechnical
  344. Targeting in Multi-Criteria Decision MakingTechnical
  345. Task Prototype-Based Knowledge Retrieval for Multi-Task Learning from Partially Annotated DataTechnical
  346. Task-Aware 3D Affordance Segmentation via 2D Guidance and Geometric RefinementTechnical
  347. Task-Aware Meta-Learning on Heterogeneous Knowledge Graph for POI RecommendationTechnical
  348. Task-Aware Retrieval Augmentation for Dynamic RecommendationTechnical
  349. Task-Specific Distance Correlation Matching for Few-Shot Action RecognitionTechnical
  350. TawPipe: Topology-Aware Weight Pipeline Parallelism for Accelerating Long-Context Large Models TrainingTechnical
  351. TaxReasoning: Benchmarking Knowledge-Intensive Mathematical Reasoning with Evolving Tax LawsTechnical
  352. Teach AI What It Doesn’t KnowTechnical
  353. Teaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement LearningTechnical
  354. TechCoach: Towards Technical-Point-Aware Descriptive Action CoachingTechnical
  355. Tell as You Want: Customizing Image Narrative with Knowledge and ThoughtsTechnical
  356. Template-Theorems Graph Construction to Enhance Mathematical Reasoning Capabilities of LLMTechnical
  357. Temporal Calibrating and Distilling for Scene-Text Aware Text-Video RetrievalTechnical
  358. Temporal Dynamics Enhancer for Directly Trained Spiking Object DetectorsTechnical
  359. Temporal Inconsistency Guidance for Super-resolution Video Quality AssessmentTechnical
  360. Temporal Object-Aware Vision Transformer for Few-Shot Video Object DetectionTechnical
  361. Temporal Properties of Conditional Independence in Dynamic Bayesian NetworksTechnical
  362. Temporal and Spatial Representation Learning for Multimodal Low-Beam 3D Object DetectionTechnical
  363. Temporal-Consistent Video Restoration with Pre-trained Diffusion ModelsTechnical
  364. Tensor Decomposition and Language Description for Open-Vocabulary Object DetectionTechnical
  365. Tensorized Label Learning via Balanced Tensor RegressionTechnical
  366. TermGPT: Multi-Level Contrastive Fine-Tuning for Terminology Adaptation in Legal and Financial DomainsTechnical
  367. Test-Time Preference Optimization for Image RestorationTechnical
  368. Test-Time Reinforcement Learning for GUI Grounding via Region ConsistencyTechnical
  369. Test-driven Reinforcement Learning in Continuous ControlTechnical
  370. Test-time Diverse Reasoning by Riemannian Activation SteeringTechnical
  371. Test-time Prompt InterventionTechnical
  372. Testing Under Strategic Manipulation: Mechanism Design for Human and AI InstitutionsTechnical
  373. Text-Guided Channel Perturbation and Pre-Trained Knowledge Integration for Unified Multi-Modality Image FusionTechnical
  374. Text-Guided Gradient Refinement: Resolving Multimodal Gradient Conflicts to Boost Adversarial Attacks on Vision-Language ModelsTechnical
  375. Text-based Aerial-Ground Person RetrievalTechnical
  376. Text-guided Controllable Diffusion for Realistic Camouflage Images GenerationTechnical
  377. Text-to-Scene with Large Reasoning ModelsTechnical
  378. TextGround4M: A Prompt-Aligned Dataset for Layout-Aware Text RenderingTechnical
  379. TextShield-R1: Reinforced Reasoning for Tampered Text DetectionTechnical
  380. Textual Self-Attention Network: Test-Time Preference Optimization Through Textual Gradient-Based AttentionTechnical
  381. Textured Geometry Evaluation: Perceptual 3D Textured Shape Metric via 3D Latent-Geometry NetworkTechnical
  382. The Alignment Game: A Theory of Long-Horizon Alignment Through Recursive CurationTechnical
  383. The Avengers: A Routing Recipe for Collective Intelligence in Language ModelsTechnical
  384. The Confidence Trap: Gender Bias and Predictive Certainty in LLMsTechnical
  385. The Correspondence Between Bounded Graph Neural Networks and Fragments of First-Order LogicTechnical
  386. The Cost and Complexity of Minimizing Envy in House Allocations (Abstract Reprint)Technical
  387. The Curious Case of Analogies: Investigating Analogical Reasoning in Large Language ModelsTechnical
  388. The Emotional Baby Is Truly Deadly: Does Your Multimodal Large Reasoning Model Have Emotional Flattery Towards Humans?Technical
  389. The Essentials of AI for Life and Society: A Full-Scale AI Literacy Course Accessible to AllTechnical
  390. The Finer the Better: Towards Granular-aware Open-set Domain GeneralizationTechnical
  391. The Fixed-Point of Distrust: A Formal Theory of Perceived Systemic IncompetenceTechnical
  392. The Future Is Neuro-Symbolic: Where Has It Been, and Where Is It Going?Technical
  393. The GATTACA Framework: Graph Neural Network-Based Reinforcement Learning for Controlling Biological NetworksTechnical
  394. The Illusion of Fairness: Auditing Fairness Interventions in Algorithmic Hiring with Audit StudiesTechnical
  395. The Last Byte: Learning Just Enough for Machine-Oriented Image CompressionTechnical
  396. The Limitations and Power of NP-Oracle Based Functional Synthesis TechniquesTechnical
  397. The Other Mind: How Language Models Exhibit Human Temporal CognitionTechnical
  398. The Power of Initial Investigation in Audit GamesTechnical
  399. The Publication Choice ProblemTechnical
  400. The River Voting MethodTechnical
  401. The Search for Stability: Learning Dynamics of Strategic Publishers with Initial Documents (Abstract Reprint)Technical
  402. The Semantic Architect: How FEAML Bridges Structured Data and LLMs for Multi-Label TasksTechnical
  403. The Shepherd Test: How Will Super Intelligent Agents Balance Care and Control in Asymmetric Relationships?Technical
  404. The Silent Amplifier: In-Context Examples Fuel Bias in Large Language ModelsTechnical
  405. The Strong Lottery Ticket Hypothesis for Multi-Head Attention MechanismsTechnical
  406. The Structure-Equivalent Prior: Unifying Temporal Dynamics and 3D Evolution in 4D Latent SpaceTechnical
  407. The Tatort Test of Intelligence: Towards Narrative Comprehension as a Benchmark for AITechnical
  408. The Visual Prism: Refracting Images into Parallel Multilingual Descriptions with Structured Visual GuidanceTechnical
  409. Themis: Automated Constraint-Aware Test Synthesis Framework for Code Reinforcement LearningTechnical
  410. Theoretical Guarantees for Domain Adaptation with Hierarchical Optimal Transport (Abstract Reprint)Technical
  411. Theoretical and Empirical Analysis of Lehmer Codes to Search Permutation Spaces with Evolutionary AlgorithmsTechnical
  412. Theory-of-Mind in Partially Observed, Mixed-Motive GamesTechnical
  413. Thermal-Physics Guided Infrared Image Super-Resolution with Dynamic High-Frequency AmplificationTechnical
  414. Think Before You Segment: An Object-aware Reasoning Agent for Referring Audio-Visual SegmentationTechnical
  415. Think How Your Teammates Think: Active Inference Can Benefit Decentralized ExecutionTechnical
  416. Think Then Rewrite: Reasoning Enhanced Query Rewriting for Domain Specific RetrievalTechnical
  417. Think Wise, Collaborate Effectively: A Rationale-Aware LLM-Based Recommender with Reinforcement Learning from Collaborative SignalsTechnical
  418. Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-MakingTechnical
  419. Think-J: Learning to Think for Generative LLM-as-a-JudgeTechnical
  420. Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn InteractionTechnical
  421. Thinking Aesthetics Assessment of Image Color Temperature: Models, Datasets and BenchmarksTechnical
  422. Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented ReasoningTechnical
  423. Thinking Through the Hands: An Exploratory Study of Hand Movements to Assess Students Problem-Solving in Mechanistic Reasoning TasksTechnical
  424. Through the Water: Refractive Gaussian Splatting for Water Surface ScenesTechnical
  425. TiCAL:Typicality-Based Consistency-Aware Learning for Multimodal Emotion RecognitionTechnical
  426. Tight Robustness Certification Through the Convex Hull of ℓ₀ AttacksTechnical
  427. Tighter Truncated Rectangular Prism Approximation for RNN Robustness VerificationTechnical
  428. TileGS: Adaptive Gaussian Densification Through Tile-Guided Perceptual AnalysisTechnical
  429. Time Series Class-Incremental Learning via Confidence-guided Mask Distillation and Prototype-guided Contrastive LearningTechnical
  430. Time Series Forecasting via Direct Per-Step Probability Distribution ModelingTechnical
  431. Time Shuffle: A Transferability-Booster for Multiple Audio Adversarial TasksTechnical
  432. Time-Frequency Augmented Multi-level Contrastive Clustering for Time SeriesTechnical
  433. Time-Frequency Token Advantage Clipping for Training Efficient Large Reasoning ModelTechnical
  434. Time-Series Anomaly Detection with Graph-Based Self-Supervised Learning and Foundation Models: Towards Real-World ApplicationsTechnical
  435. Time2Agri: Temporal Pretext Tasks for Agricultural MonitoringTechnical
  436. TimeBill: Time-Budgeted Inference for Large Language ModelsTechnical
  437. TimeCAP: A Channel-Aware Pre-Training Framework for Multivariate Time Series ForecastingTechnical
  438. TimeMosaic: Temporal Heterogeneity Guided Time Series Forecasting via Adaptive Granularity Patch and Segment-wise DecodingTechnical
  439. Timestep-Compressed Attack on Spiking Neural Networks Through Timestep-Level BackpropagationTechnical
  440. TinyChemVL: Advancing Chemical Vision-Language Models via Efficient Visual Token Reduction and Complex Reaction TasksTechnical
  441. To Align or Not to Align: Strategic Multimodal Representation Alignment for Optimal PerformanceTechnical
  442. ToC: Tree-of-Claims Search with Multi-Agent Language ModelsTechnical
  443. Token Painter: Training-Free Text-Guided Image Inpainting via Mask Autoregressive ModelsTechnical
  444. Token-Context Attention for NLI: An Alternative to Self-AttentionTechnical
  445. TokenPowerBench: Benchmarking the Power Consumption of LLM InferenceTechnical
  446. Tokenize Once, Recommend Anywhere: Unified Item Tokenization for Multi-domain LLM-based RecommendationTechnical
  447. TongUI: Internet-Scale Trajectories from Multimodal Web Tutorials for Generalized GUI AgentsTechnical
  448. Too Sure for Our Own Good: A User Study on AI Confidence and Human RelianceTechnical
  449. ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool learningTechnical
  450. ToolSmith: A Multi-Agent Framework for Enterprise Tool CreationTechnical
  451. Top-Down Semantic Refinement for Image CaptioningTechnical
  452. Topo-GraT: Learning to Grow with Causal Graph Transformers (Student Abstract)Technical
  453. Topological Federated Clustering via Gravitational Potential Fields Under Local Differential PrivacyTechnical
  454. Topology-Aware Vision Transformers for Enhanced Scene RecognitionTechnical
  455. Topology-Enhanced and Label Correlation-Aware Model for Protein-Protein Interaction PredictionTechnical
  456. Topology-Inspired Backward-Free Framework for Test-Time Adaptation in Medical DetectionTechnical
  457. Topology-aware Knowledge Preservation for Class-Incremental LearningTechnical
  458. TouchFormer: A Robust Transformer-based Framework for Multimodal Material PerceptionTechnical
  459. Toward Artificial MetacognitionTechnical
  460. Toward Better EHR Reasoning in LLMs: Reinforcement Learning with Expert Attention GuidanceTechnical
  461. Toward Causal Foundation World Models: From Representation to Decision-MakingTechnical
  462. Toward Controllable and Trustworthy LLM Reasoning: From Failure Mapping to Cognition-inspired Control and Real-world ImpactTechnical
  463. Toward Gaze Target Detection of Young Autistic ChildrenTechnical
  464. Toward Multimodal Fake News Detection by Multi-perspective Rationale Generation and VerificationTechnical
  465. Toward Real-World High-Precision Image Matting and SegmentationTechnical
  466. Toward Simulating Networked Societies with Formal Institutions Using AI AgentsTechnical
  467. Toward Time-Continuous Data Inference in Sparse Urban CrowdSensingTechnical
  468. Toward Trustworthy AI for Decision Making in Population HealthTechnical
  469. Toward the Frontiers of Reliable Diffusion Sampling via Adversarial Sinkhorn Attention GuidanceTechnical
  470. Towards 3D Object-Centric Feature Learning for Semantic Scene CompletionTechnical
  471. Towards Accurate 3D Object Detection in Adverse Weather by Leveraging 4D Radar for LiDAR Geometry EnhancementTechnical
  472. Towards Acyclic Preference Evaluation of Language Models via Multiple EvaluatorsTechnical
  473. Towards Adaptive Humanoid Control via Multi-Behavior Distillation and Reinforced Fine-TuningTechnical
  474. Towards Affordance-Aware Robotic Dexterous Grasping with Human-like PriorsTechnical
  475. Towards Agents That Exhibit Human-Like Autonomy in Complex EnvironmentsTechnical
  476. Towards Aligned and Efficient Large Language ModelsTechnical
  477. Towards Authentic Movie Dubbing with Retrieve-Augmented Director-Actor Interaction LearningTechnical
  478. Towards Automated Self-Supervised Learning for Truly Unsupervised Graph Anomaly Detection (Abstract Reprint)Technical
  479. Towards Autonomous UAV Visual Object Search in City Space: Benchmark and Agentic MethodologyTechnical
  480. Towards Benchmarking Privacy Vulnerabilities in Selective Forgetting with Large Language ModelsTechnical
  481. Towards Better Code Understanding in Decoder-Only Models with Contrastive LearningTechnical
  482. Towards Better Correctness and Efficiency in Code GenerationTechnical
  483. Towards Better IncomLDL: We Are Unaware of Hidden Labels in AdvanceTechnical
  484. Towards Capable and Secure Autonomous Computer-Use Agents (Student Abstract)Technical
  485. Towards Closed-Loop Embodied Empathy Evolution: Probing LLM-Centric Lifelong Empathic Motion Generation in Unseen ScenariosTechnical
  486. Towards Continually-Evolving AI: Selective and Expandable Multimodal Memory SystemTechnical
  487. Towards Data-Efficient Deep Learning for RNA 3D Structure Prediction and DesignTechnical
  488. Towards Distance-Invariant Radio Frequency Fingerprinting via Augmented Unsupervised LearningTechnical
  489. Towards Effective Code-Integrated ReasoningTechnical
  490. Towards Effective Offensive Security LLM Agents: Hyperparameter Tuning, LLM as a Judge, and a Lightweight CTF BenchmarkTechnical
  491. Towards Effective and Efficient Context-aware Nucleus Detection in Histopathology Whole Slide ImagesTechnical
  492. Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation ModelsTechnical
  493. Towards Efficient Low-rate Image Compression with Frequency-aware Diffusion Prior RefinementTechnical
  494. Towards Efficient and Effective Interactive 3D SegmentationTechnical
  495. Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action ModelingTechnical
  496. Towards Explainable Video Camouflaged Object Detection: SAM2 with Eventstream-Inspired DataTechnical
  497. Towards Fairness in Transportation Gig Markets: Identifying, Imitating, and Mitigating Algorithm Discrimination via Deep Reinforcement LearningTechnical
  498. Towards Federated Clustering: A Client-wise Private Graph Aggregation FrameworkTechnical
  499. Towards Generalist Robot Learning from Internet Video: A Survey (Abstract Reprint)Technical
  500. Towards High Resolution Probabilistic Coastal Inundation Forecasting from Sparse ObservationsTechnical
  501. Towards High-Fidelity 3D Portrait Generation with Rich Details by Cross-View Prior-Aware DiffusionTechnical
  502. Towards High-Resolution 3D Anomaly Detection: A Scalable Dataset and Real-Time Framework for Subtle Industrial DefectsTechnical
  503. Towards Human-centered Proactive Conversational AITechnical
  504. Towards Illumination-Aware Restoration of Metalens-Captured Images: A New Dataset and a Strong BaselineTechnical
  505. Towards Inclusive AI: Advancing Multilingual Large Language ModelsTechnical
  506. Towards LLM-Empowered Knowledge Tracing via LLM-Student Hierarchical Behavior Alignment in Hyperbolic SpaceTechnical
  507. Towards Long-window Anchoring in Vision-Language Model DistillationTechnical
  508. Towards Multimodal Continual Knowledge Embedding with Modality Forgetting ModulationTechnical
  509. Towards Multiple Missing Values-resistant Unsupervised Graph Anomaly DetectionTechnical
  510. Towards Non-Stationary Time Series Forecasting with Temporal Stabilization and Frequency DifferencingTechnical
  511. Towards Nonlinear Sparse AUC Maximization via Compositional Stochastic Hard ThresholdingTechnical
  512. Towards OOD Generalization in Dynamic Graphs via Causal Invariant LearningTechnical
  513. Towards Offline Imitation Learning: Strictly Batch Settings, Generalization, and Variability in ExpertiseTechnical
  514. Towards Privacy-Protected Generalized Gaze Estimation Using Diffusion Models and Domain Stability Adaptation FrameworkTechnical
  515. Towards Provably Secure and Highly Robust Generative Image Steganography Leveraging Latent Diffusion ModelTechnical
  516. Towards Provably Unlearnable Examples via Bayes Error OptimizationTechnical
  517. Towards Real-Time Neutral Atom Array Assembly via Unsupervised Hologram Generation and Path OptimizationTechnical
  518. Towards Reinforcement Learning from Neural Feedback: Mapping fNIRS Signals to Agent PerformanceTechnical
  519. Towards Robust Edge Model Adaptation via Elastic Architecture SearchTechnical
  520. Towards Robust Event-Based Depth Estimation: Bridging Synthetic and Real Domains with Motion AdaptationTechnical
  521. Towards Robust Human–AI Decision-Making via Learning-to-DeferTechnical
  522. Towards Robust Text-Attributed Federated Graph Learning: Multimodal Threats and DefenseTechnical
  523. Towards Robust and Interpretable Event–Frame Fusion for Autonomous DrivingTechnical
  524. Towards Robust, Reliable, and Generalized Medical AITechnical
  525. Towards Scalable Web Accessibility Audit with MLLMs as CopilotsTechnical
  526. Towards Single Exponential Time for Temporal and Spatial Reasoning: A Study via Redundancy and Dynamic ProgrammingTechnical
  527. Towards Spatially Consistent Image Generation: On Incorporating Intrinsic Scene Properties into Diffusion ModelsTechnical
  528. Towards Synthesizing High-Dimensional Tabular Data with Limited SamplesTechnical
  529. Towards Temporal Fusion Beyond the Field of View for Camera-based Semantic Scene CompletionTechnical
  530. Towards Test-time Efficient Visual Place Recognition via Asymmetric Query ProcessingTechnical
  531. Towards Training-Free and Accurate ANN-to-SNN Conversion via Activation-Aware RedistributionTechnical
  532. Towards Trustworthy Multimodal AI SystemsTechnical
  533. Towards Ultrasound-based Reliable Disease Diagnosis Using Causal InferenceTechnical
  534. Towards Understanding Generalization in DP-GD: A Case Study in Training Two-Layer CNNsTechnical
  535. Towards Understanding In-Context Learning of Transformers Under Non-I.I.D. ScenariosTechnical
  536. Towards Unified Vision-Language Models with Incomplete Multi-Modal InputsTechnical
  537. Towards Zero-Shot Diabetic Retinopathy Grading: Learning Generalized Knowledge via Prompt-Driven Matching and EmulatingTechnical
  538. Towards a Common Framework for AutoformalizationTechnical
  539. Towards a Rigorous Understanding of the Population Dynamics of the NSGA-III: Tight Runtime BoundsTechnical
  540. Towards an Ontology-Driven Approach to Document Bias (Abstract Reprint)Technical
  541. TowerMind: A Tower Defence Game Learning Environment and Benchmark for LLM as AgentsTechnical
  542. TraceTrans: Translation and Spatial Tracing for Surgical PredictionTechnical
  543. Tracing the Heart’s Pathways: ECG Representation Learning from a Cardiac Conduction PerspectiveTechnical
  544. TrackGS: Optimizing COLMAP-Free 3D Gaussian Splatting with Global Track ConstraintsTechnical
  545. Tracking and Segmenting Anything in Any ModalityTechnical
  546. Tracking the Unstable: Appearance-Guided Motion Modeling for Robust Multi-Object Tracking in UAV-Captured VideosTechnical
  547. Tractable Sharpness-Aware Learning of Probabilistic CircuitsTechnical
  548. Tractable Weighted First-Order Model Counting with Bounded Treewidth Binary EvidenceTechnical
  549. Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational CapabilitiesTechnical
  550. Traffic Signal Plans Explorer: A General Framework for Visualising Traffic EvolutionTechnical
  551. Trainable EEG Interpolation and Structure-Sharing Dual-Path Encoders for Brain-Assisted Target Speaker ExtractionTechnical
  552. Training and Inference Within 1 Second – Tackle Cross-Sensor Degradation of Real-World Pansharpening with Efficient Residual Feature TailoringTechnical
  553. Training-Free ANN-to-SNN Conversion for High-Performance Spiking TransformersTechnical
  554. Training-Free Multi-Character Audio-Driven Animation via Diffusion Transformer with Reward FeedbackTechnical
  555. Training-Free Spatio-temporal Decoupled Reasoning Video Segmentation with Adaptive Object MemoryTechnical
  556. Training-free Boosting for Few-shot Segmentation via Generalizing Semantic MiningTechnical
  557. TrajAgg: Dual-Scale Feature Aggregation with Hybrid Training for Trajectory Similarity Computation in Free SpaceTechnical
  558. TrajEvo: Trajectory Prediction Heuristics Design via LLM-driven EvolutionTechnical
  559. TransFR: Transferable Federated Recommendation with Adapter Tuning on Pre-trained Language ModelsTechnical
  560. TransMamba: A Sequence-Level Hybrid Transformer-Mamba Language ModelTechnical
  561. Transferability of Adversarial Attacks in Video-based MLLMs: A Cross-modal Image-to-Video ApproachTechnical
  562. Transferable Backdoor Attacks for Code Models via Sharpness-Aware Adversarial PerturbationTechnical
  563. Transferable Graph Condensation from the Causal PerspectiveTechnical
  564. Transferable Hypergraph Attack via Injecting Nodes into Pivotal HyperedgesTechnical
  565. Transferable Model-agnostic Vision-Language Model Adaptation for Efficient Weak-to-Strong GeneralizationTechnical
  566. Transferable RL for Real-World Navigation Using Semantic Segmentation and Bird’s-Eye View AbstractionTechnical
  567. Transferring Causal Driving Patterns for Generalizable Traffic Simulation with Diffusion-Based DistillationTechnical
  568. Transform-Free Feature Coding via Entropy-Constrained Vector QuantizationTechnical
  569. Transformer with Controlled Attention for Synchronous Motion CaptioningTechnical
  570. Transformers in Pseudo-Random Number Generation: A Dual Perspective on Theory and PracticeTechnical
  571. Transolver Is a Linear Transformer: Revisiting Physics-Attention Through the Lens of Linear AttentionTechnical
  572. Transparent Networks for Multivariate Time SeriesTechnical
  573. Trauma THOMPSON: A Dataset and Realistic Generative Framework for AI Copilots in Emergency CareTechnical
  574. TraveLLaMA: A Multimodal Travel Assistant with Large-Scale Dataset and Structured ReasoningTechnical
  575. Treatment Stitching with Schrödinger Bridge for Enhancing Offline Reinforcement Learning in Adaptive Treatment StrategiesTechnical
  576. Tree-Based Stochastic Optimization for Solving Large-Scale Urban Network Security GamesTechnical
  577. TreeBridge: Aligning LLM Embeddings in Industrial Recommender SystemsTechnical
  578. TriFusion-IDS: A Multimodal Graph-Tabular-Text Contrastive Framework for Cross-Dataset Intrusion DetectionTechnical
  579. Trimming the Fat: Redundancy-Aware Acceleration Framework for DGNNsTechnical
  580. TrinityDNA: A Bio-Inspired Foundational Model for Efficient Long-Sequence DNA ModelingTechnical
  581. TripleFDS: Triple Feature Disentanglement and Synthesis for Scene Text EditingTechnical
  582. Truncated Counterfactual Learning for Anytime Multi-Agent Path FindingTechnical
  583. TrustEnergy: A Unified Framework for Accurate and Reliable User-level Energy Usage PredictionTechnical
  584. Trusted Multi-view Learning for Long-tailed ClassificationTechnical
  585. Trustworthy AI-Assisted Programming: Detection and Repair of Unreliable CodeTechnical
  586. Trustworthy Autonomy Without Human Intervention in Uncertain DomainsTechnical
  587. Trustworthy Classification for Complex Social Surveys: A Memory-Enhanced Hierarchical Framework with Calibrated UncertaintyTechnical
  588. Truth, Justice, and Secrecy: Cake Cutting Under Privacy ConstraintsTechnical
  589. Truth-Tracking Evaluation in Opinion-Based ArgumentationTechnical
  590. TruthfulRAG: Resolving Factual-level Conflicts in Retrieval-Augmented Generation with Knowledge GraphsTechnical
  591. TubeRMC: Tube-conditioned Reconstruction with Mutual Constraints for Weakly-supervised Spatio-Temporal Video GroundingTechnical
  592. TuckA: Hierarchical Compact Tensor Experts for Efficient Fine-TuningTechnical
  593. Tuning Medical Foundation Models for Inner Ear Temporal CT Analysis with Plug-and-play Domain Knowledge AggregatorTechnical
  594. Tuning for Two Adversaries: Enhancing the Robustness Against Transfer and Query-Based Attacks Using Hyperparameter TuningTechnical
  595. Tuning-Free Amodal Segmentation via the Occlusion-Free Bias of Inpainting ModelsTechnical
  596. TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera TuningTechnical
  597. Turbo-VAED: Fast and Stable Transfer of Video-VAEs to Mobile DevicesTechnical
  598. TweezeEdit: Consistent and Efficient Image Editing with Path RegularizationTechnical
  599. Two Constraint Compilation Methods for Lifted PlanningTechnical
  600. Two Heads Are Better than One: Distilling Large Language Model Features into Small Models with Feature Decomposition and MixtureTechnical
  601. U2B: Scale-unbiased Representation Converter for Graph Classification with Imbalanced and Balanced Scale DistributionsTechnical
  602. U2UData+: A Scalable Swarm UAVs Autonomous Flight Dataset for Embodied Long-horizon TasksTechnical
  603. UAV4D: Dynamic Neural Rendering of Human-Centric UAV Imagery Using Gaussian SplattingTechnical
  604. UCPO: A Universal Constrained Combinatorial Optimization Method via Preference OptimizationTechnical
  605. UDA: Unsupervised Debiasing Alignment for Pair-wise LLM-as-a-JudgeTechnical
  606. UDCH: Unsupervised Dynamic Weighted Cluster-cooperative Hashing for Cross-modal RetreivalTechnical
  607. UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement LearningTechnical
  608. UM-Text: A Unified Multimodal Model for Image Understanding and Visual Text EditingTechnical
  609. UMNet: Uncertainty-guided Memory Network for Hyperspectral PansharpeningTechnical
  610. UNO! UNified Offline Training Paradigm for Learning Path RecommendationTechnical
  611. UNSEEN: Enhancing Dataset Pruning from a Generalization PerspectiveTechnical
  612. UNeMo: Collaborative Visual-Language Reasoning and Navigation via a Multimodal World ModelTechnical
  613. UQ-Bench: A Benchmark for Evaluating Multimodal LLMs on Underwater Image Quality AssessmentTechnical
  614. UQ-ViT: Harmonizing Extreme Activations with Hardware-Friendly Uniform Quantization in Vision TransformersTechnical
  615. URPO: A Unified Reward & Policy Optimization Framework for Large Language ModelsTechnical
  616. URaG: Unified Retrieval and Generation in Multimodal LLMs for Efficient Long Document UnderstandingTechnical
  617. USE: A Unified Model for Universal Sound Separation and ExtractionTechnical
  618. USPR: Learning a Unified Solver for Profiled RoutingTechnical
  619. UV-RGS: Relightable 3D Gaussian Splatting from Unposed Views Under Varied IlluminationsTechnical
  620. UVLM: Benchmarking Video Language Model for Underwater World UnderstandingTechnical
  621. UltraGen: High-Resolution Video Generation with Hierarchical AttentionTechnical
  622. Ultralight Polarity-Split Neuromorphic SNN for Event-Stream Super-ResolutionTechnical
  623. Unaligned UAV RGBT Tracking: A Largescale Benchmark and a Novel ApproachTechnical
  624. Unbiased Rectification for Sequential Recommender Systems Under Fake OrdersTechnical
  625. Uncertainty Quantification for Machine Learning: One Size Does Not Fit AllTechnical
  626. Uncertainty-Based Methods for Automated Process Reward Data Construction and Output Aggregation in Mathematical ReasoningTechnical
  627. Uncertainty-Guided View-Strength-Aware Feature Utilization for Multi-View ClassificationTechnical
  628. Uncertainty-Propelled Physics-MAE Fusion for Self-Supervised Diffusion-Weighted Image DenoisingTechnical
  629. Uncovering Bias Paths with LLM-guided Causal Discovery: An Active Learning and Dynamic Scoring ApproachTechnical
  630. Uncovering Hidden Degeneration: A Physics-Guided Bidirectional Inference Framework for Industrial Time Series PredictionTechnical
  631. Uncovering Pretraining Code in LLMs: A Syntax-Aware Attribution ApproachTechnical
  632. Uncovering and Aligning Anomalous Attention Heads to Defend Against NLP Backdoor AttacksTechnical
  633. Uncovering and Mitigating Destructive Multi-Embedding Attacks in Deepfake Proactive ForensicsTechnical
  634. Uncovering and Mitigating Transient Blindness in Multimodal Model EditingTechnical
  635. Under-Approximating Semantics in Clustered Assumption-Based ArgumentationTechnical
  636. Understanding Dynamic Scenes in Ego Centric 4D Point CloudsTechnical
  637. Understanding Interaction as You Need: Intention-Driven Pedestrian Behavior PredictionTechnical
  638. Understanding and Enhancing Differentiable Architecture Search from Information Bottleneck PerspectiveTechnical
  639. Understanding the Effects of GenAI as No-Code Alternative for Teaching Machine Learning WorkflowsTechnical
  640. Understanding the Impact of Proportionality in Approval-Based Multiwinner ElectionsTechnical
  641. Understanding the Management of Rape Trauma with AI and NeuroimagingTechnical
  642. UniABG: Unified Adversarial View Bridging and Graph Correspondence for Unsupervised Cross-View Geo-LocalizationTechnical
  643. UniAPO: Unified Multimodal Automated Prompt OptimizationTechnical
  644. UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and PerceptionTechnical
  645. UniC-Lift: Unified 3D Instance Segmentation via Contrastive LearningTechnical
  646. UniCUE: Unified Recognition and Generation Framework for Chinese Cued Speech Video-to-Speech GenerationTechnical
  647. UniFit: Towards Universal Virtual Try-on with MLLM-Guided Semantic AlignmentTechnical
  648. UniHOI: Unified Human-Object Interaction Understanding via Unified Token SpaceTechnical
  649. UniHR: Hierarchical Representation Learning for Unified Knowledge Graph Link PredictionTechnical
  650. UniME-V2: MLLM-as-a-Judge for Universal Multimodal Embedding LearningTechnical
  651. UniMGS: Unifying Mesh and 3D Gaussian Splatting with Single-Pass Rasterization and Proxy-Based DeformationTechnical
  652. UniMM-V2X: MoE-Enhanced Multi-Level Fusion for End-to-End Cooperative Autonomous DrivingTechnical
  653. UniMapGen: A Generative Framework for Large-Scale Map Construction from Multi-modal DataTechnical
  654. UniMo: Unified Motion Generation and Understanding with Chain of ThoughtTechnical
  655. UniScene-MoTion: Unified Scene & Motion-aware Diffusion Transition FrameworkTechnical
  656. UniSketch: A Unified Framework for Parametric Sketch Generation and Constraint PredictionTechnical
  657. UniVarFL: Uniformity and Variance Regularized Federated Learning for Heterogeneous Data (Student Abstract)Technical
  658. Unified Interaction Consistency Learning for Single-Source Domain-Generalized Object Detection in Urban SceneTechnical
  659. Unified Minimax Optimization Framework for Propensity Score Estimation in Debiased RecommendationTechnical
  660. Unified Mixture-of-Experts Framework for Joint Cardiac and Vascular Ultrasound Analysis and Report GenerationTechnical
  661. Unified Representation Causal Prompt Distillation for Re-Inference-Free Lifelong Person Re-IdentificationTechnical
  662. Unified Structural Factors for Transfer Learning Generalization with PAC-Bayesian GuaranteesTechnical
  663. Unified View Extraction with Low-Rankness and Smoothness Fusion for Multi-View Subspace ClusteringTechnical
  664. Unifying Channel Independence and Mixing: Multi-Scale Patch Recursion for Global–Local Representation Synergy in Multivariate Time Series ForecastingTechnical
  665. Unifying Locality of KANs and Feature Drift Compensation Projection for Data-Free Replay Based Continual Face Forgery DetectionTechnical
  666. Unifying Multi-View Knowledge for Graph Learning via Model CollaborationTechnical
  667. Unintended Misalignment from Agentic Fine-Tuning: Risks and MitigationTechnical
  668. Universal Adversarial Purification with DDIM Metric Loss for Stable DiffusionTechnical
  669. Universal Compressed Image Restoration via Codec-Aware Conditioning with Reinforcement LearningTechnical
  670. Universal EEG Epilepsy Detection via Evidential Multi-View De-BiasingTechnical
  671. Universal Learning of Stochastic Dynamics for Exact Belief Propagation Using Bernstein Normalizing FlowsTechnical
  672. Universal Safety Controllers with Learned PropheciesTechnical
  673. Unlearning in Cross-Modal Retrieval via Prior-Prototype Guided Partitioned DampeningTechnical
  674. Unleashing Semantic and Geometric Priors for 3D Scene CompletionTechnical
  675. Unleashing the Potential of Large Language Models for Text-to-Image Generation Through Autoregressive Representation AlignmentTechnical
  676. Unleashing the Power of Image-Tabular Self-Supervised Learning via Breaking Cross-Tabular BarriersTechnical
  677. Unlocking Dynamic Inter-Client Spatial Dependencies: A Federated Spatio-temporal Graph Learning Method for Traffic Flow ForecastingTechnical
  678. Unlocking Efficient Vehicle Dynamics Modeling via Analytic World ModelsTechnical
  679. Unlocking Multi-Modal Potentials for Link Prediction on Dynamic Text-Attributed GraphsTechnical
  680. Unlocking the Power of Large Multimodal Models for Robot Learning: Robustness, Generalization, and OpportunitiesTechnical
  681. Unnoticed Yet Effective: A Hybrid Physical Camouflage Framework Against DNNs and Human PerceptionTechnical
  682. Unpacking the Implicit Norm Dynamics of Sharpness-Aware Minimization in Tensorized ModelsTechnical
  683. Unplugged Activities on Machine Learning and Their Evaluation Through Mental States AttributionTechnical
  684. Unreal-MAP: Unreal-Engine-Based General Platform for Multi-agent Reinforcement LearningTechnical
  685. Unsupervised Combinatorial Probabilistic Reasoning: Probabilistic Coin Change ProblemTechnical
  686. Unsupervised Contrastive Learning for Efficient and Robust Spectral Shape MatchingTechnical
  687. Unsupervised Feature Selection Through Group DiscoveryTechnical
  688. Unsupervised Motion-Compensated Decomposition for Cardiac MRI Reconstruction via Neural RepresentationTechnical
  689. Unsupervised Multi-Parameter Inverse Solving for Reducing Ring Artifacts in 3D X-Ray CBCTTechnical
  690. Unsupervised Multi-View Visual Anomaly Detection via Progressive Homography-Guided AlignmentTechnical
  691. Unsupervised Semantic Discovery via Global and Local Semantic Alignment in Multimodal ClusteringTechnical
  692. Unsupervised Single-Channel Audio Separation with Diffusion Source PriorsTechnical
  693. Unveiling AI Safety in Fine-tuning Quantized ModelTechnical
  694. Unveiling the Attribute Misbinding Threat in Identity-Preserving ModelsTechnical
  695. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal OptimizationTechnical
  696. Unveiling the Landscape of Clinical Depression Assessment: From Behavioral Signatures to Psychiatric ReasoningTechnical
  697. Uplift Modeling with Delayed Feedback: Identifiability and AlgorithmsTechnical
  698. Urban Incident Prediction with Graph Neural Networks: Integrating Government Ratings and Crowdsourced ReportsTechnical
  699. UrbanNav: Learning Language-Guided Embodied Urban Navigation from Web-Scale Human TrajectoriesTechnical
  700. UrbanPG: An Efficient Framework with Personalized Context and General Backbone Interaction for Urban Spatio-Temporal LearningTechnical
  701. Using Certifying Constraint Solvers for Generating Step-wise ExplanationsTechnical
  702. Using Constraint Solvers to Construct Binary Codes with Good Error Correction PerformanceTechnical
  703. Utilitarian Guarantees for the Method of Equal SharesTechnical
  704. V-Pruner: A Fast and Globally-informed Token Pruning Framework for Vision TransformerTechnical
  705. V2VLoc: Robust GNSS-Free Collaborative Perception via LiDAR LocalizationTechnical
  706. VAEVQ: Enhancing Discrete Visual Tokenization Through Variational ModelingTechnical
  707. VALIANT: Prompt Instability for Active Learning in Black-Box Medical ImagingTechnical
  708. VBF++: Variational Bayesian Fusion with Context-Aware Priors and Recommendation-Guided Adversarial Refinement for Multimodal Video RecommendationTechnical
  709. VCGD: Visual Clue Guided Decoding with Caption Model for Mitigating Hallucination in Multimodal Large Language ModelsTechnical
  710. VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality EvaluationTechnical
  711. VEDA: Generation of 3D Molecules via Variance-Exploding Diffusion with AnnealingTechnical
  712. VFCionX: Bridging Large and Small Models for Robust Vulnerability-Fixing Commit IdentificationTechnical
  713. VGD: Value-Guided Diffusion Toward High-Utility Medical Image SegmentationTechnical
  714. VGGS: VGGT-guided Gaussian Splatting for Efficient and Faithful Sparse-View Surface ReconstructionTechnical
  715. VGGTFace: Topologically Consistent Facial Geometry Reconstruction in the WildTechnical
  716. VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement LearningTechnical
  717. VILTA: A VLM-in-the-Loop Adversary for Enhancing Driving Policy RobustnessTechnical
  718. VIR-Bench: Evaluating Geospatial and Temporal Understanding of MLLMs via Travel Video Itinerary ReconstructionTechnical
  719. VITA: Variational Pretraining of Transformers for Climate-Robust Crop Yield ForecastingTechnical
  720. VK-Det: Visual Knowledge Guided Prototype Learning for Open-Vocabulary Aerial Object DetectionTechnical
  721. VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action ModelTechnical
  722. VLHSA: Vision-Language Hierarchical Semantic Alignment for Jigsaw Puzzle Solving with Eroded Gaps (Student Abstract)Technical
  723. VMChill: A Dataset for Fine-Grained Visual-Musical SynergyTechnical
  724. VORTEX: Aligning Task Utility and Human Preferences Through LLM-Guided Reward ShapingTechnical
  725. VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language ModelsTechnical
  726. VPHO: Joint Visual-Physical Cue Learning and Aggregation for Hand-Object Pose EstimationTechnical
  727. VPN: Visual Prompt NavigationTechnical
  728. VPSentry: Semi-supervised Video Polyp Segmentation via Sentry-guided Long-term Prototype Fusion with Correlation Dynamic PropagationTechnical
  729. VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement LearningTechnical
  730. VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement LearningTechnical
  731. VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement LearningTechnical
  732. VSPO: Validating Semantic Pitfalls in Ontology via LLM-Based CQ GenerationTechnical
  733. VTD-CLIP: Video-to-Text Discretization via Prompting CLIPTechnical
  734. VTinker: Guided Flow Upsampling and Texture Mapping for High-Resolution Video Frame InterpolationTechnical
  735. VaccineRAG: Boosting Multimodal Large Language Models’ Immunity to Harmful RAG SamplesTechnical
  736. Value-Aligned Prompt Moderation via Zero-Shot Agentic Rewriting for Safe Image GenerationTechnical
  737. Value-Driven Memory-Augmented Generation for Agentic LLMs: Towards Structured and Adaptive Knowledge UtilizationTechnical
  738. Variance Computation for Weighted Model Counting with Knowledge Compilation ApproachTechnical
  739. Variance Reduction via Resampling and Experience ReplayTechnical
  740. Variation-Bounded Loss for Noise-Tolerant LearningTechnical
  741. Variational OOD State Correction for Offline Reinforcement LearningTechnical
  742. VasoMIM: Vascular Anatomy-Aware Masked Image Modeling for Vessel SegmentationTechnical
  743. Veli: Unsupervised Method and Unified Benchmark for Low-Cost Air Quality Sensor CorrectionTechnical
  744. Venom: Liquid Diffusion-Guided Gradient Inversion for Breaking Differential Privacy in Federated LearningTechnical
  745. Verb Mirage: Unveiling and Assessing Verb Concept Hallucinations in Multimodal Large Language ModelsTechnical
  746. VeriFlow: Modeling Distributions for Neural Network VerificationTechnical
  747. VerifyBench: A Systematic Benchmark for Evaluating Reasoning Verifiers Across DomainsTechnical
  748. Versatile Vision-Language Model for 3D Computed TomographyTechnical
  749. ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMsTechnical
  750. ViDia2Std: A Parallel Corpus and Methods for Low-Resource Vietnamese Dialect-to-Standard TranslationTechnical
  751. ViG-RAG: Video-aware Graph Retrieval-Augmented Generation via Temporal and Semantic Hybrid ReasoningTechnical
  752. ViTCoP: Accelerating Large Vision-Language Models via Visual and Textual Semantic Collaborative PruningTechnical
  753. ViTE: Virtual Graph Trajectory Expert Router for Pedestrian Trajectory PredictionTechnical
  754. ViType: High-Fidelity Visual Text Rendering via Glyph-Aware Multimodal DiffusionTechnical
  755. Video Camera Trajectory Editing with Generative Rendering from Estimated GeometryTechnical
  756. Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music GenerationTechnical
  757. Video Mirror Detection with the Motion-in-Depth CueTechnical
  758. Video SimpleQA: Towards Factuality Evaluation in Large Video Language ModelsTechnical
  759. Video Spatial Reasoning with Object-Centric 3D RolloutTechnical
  760. VideoChat-A1: Thinking with Long Videos by Chain-of-Shot ReasoningTechnical
  761. VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement LearningTechnical
  762. VietCheckMed: Explainable Regulatory Compliance Checking for Medical Advertisements on Vietnamese Social MediaTechnical
  763. View-on-Graph: Zero-Shot 3D Visual Grounding via Vision-Language Reasoning on Scene GraphsTechnical
  764. Views Attention Fusion of Granular-ball Fuzzy Representations Split for Improved Multi-view ClusteringTechnical
  765. VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-useTechnical
  766. Virtual Multiplex Staining for Histological Images Using a Marker-Wise Conditioned Diffusion ModelTechnical
  767. VirtualEnv: A Platform for Embodied AI ResearchTechnical
  768. VisAssist: A Visually Impaired-Captured Video Question Answering Benchmark for Assistive SystemsTechnical
  769. Vision Transformers Are Circulant Attention LearnersTechnical
  770. Vision-G1: Towards General Reasoning Vision-Language Models via Reinforcement LearningTechnical
  771. Vision-Language Models Guided Graph Concept Reasoning for Interpretable Diabetic Retinopathy DiagnosisTechnical
  772. Vision-Language Reasoning for Geolocalization: A Reinforcement Learning ApproachTechnical
  773. Vision-MoR: Scaling Vision Transformer via Patch-Level Mixture-of-RecursionsTechnical
  774. Vision-Only Gaussian Splatting for Collaborative Semantic Occupancy PredictionTechnical
  775. Vision-language Incremental Learning with Dual Class-individual MemoryTechnical
  776. VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video GenerationTechnical
  777. Vista: Scene-Aware Optimization for Streaming Video Question Answering Under Post-Hoc QueriesTechnical
  778. Visual Bridge: Universal Visual Perception Representations GeneratingTechnical
  779. Visual-Friendly Concept Protection via Selective Adversarial PerturbationsTechnical
  780. VitalDiagnosis: AI-Driven Ecosystem for 24/7 Vital Monitoring and Chronic Disease ManagementTechnical
  781. VividListener: Expressive and Controllable Listener Dynamics Modeling for Multi-Modal Responsive InteractionTechnical
  782. VoiceCloak: A Multi-Dimensional Defense Framework Against Unauthorized Diffusion-Based Voice CloningTechnical
  783. Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health UnderstandingTechnical
  784. Voting in Divisible Settings: A SurveyTechnical
  785. VulnBench: A Comprehensive Benchmark for Transformer-Based Vulnerability DetectionTechnical
  786. Vulnerability-Aware Robust Multimodal Adversarial TrainingTechnical
  787. W2S-AlignTree: Weak-to-Strong Inference-Time Alignment for Large Language Models via Monte Carlo Tree SearchTechnical
  788. WALKSAFE: Risk-aware Graph Random Walk with Bi-GRPO for LLM SafetyTechnical
  789. WDT-MD: Wavelet Diffusion Transformers for Microaneurysm Detection in Fundus ImagesTechnical
  790. WIET: Harmonizing Group-aware Model Weighting and Worker Allocation for Ensemble Temporal Prediction MaaSTechnical
  791. WRitEer: A Multi-Objective, Preference-Driven Multi-Agent Framework for Human-Like Advanced Text GenerationTechnical
  792. Walk Before You Dance: High-fidelity and Editable Dance Synthesis via Generative Masked Motion PriorTechnical
  793. Walking Further: Semantic-Aware Multimodal Gait Recognition Under Long-Range ConditionsTechnical
  794. Wasserstein-Aligned Hyperbolic Multi-View ClusteringTechnical
  795. Wasserstein-Aware Transfer: Class-Level Alignment for Robust Diffusion Model AdaptationTechnical
  796. WaterMod: Modular Token-Rank Partitioning for Probability-Balanced LLM WatermarkingTechnical
  797. WaveC2R: Wavelet-Driven Coarse-to-Refined Hierarchical Learning for Radar RetrievalTechnical
  798. WaveDiST: A Wavelet Diffusion Transformer for Spatio-Temporal Estimation on Unobserved LocationsTechnical
  799. WaveEx: Accelerating Flow Matching-based Speech Generation via Wavelet-guided ExtrapolationTechnical
  800. WaveFormer: Frequency-Time Decoupled Vision Modeling with Wave EquationTechnical
  801. Wavefront-Constrained Passive Obscured Object DetectionTechnical
  802. Wavelet Enhanced Adaptive Frequency Filter for Sequential RecommendationTechnical
  803. Weakest Bidder Types and New Core-Selecting Combinatorial AuctionsTechnical
  804. Weakly-Supervised Image Forgery Localization via Vision-Language Collaborative Reasoning FrameworkTechnical
  805. Wearable Intelligence for Healthcare Robotics: From Brain Activity to Body MovementsTechnical
  806. Weather-Robust LiDAR Perception: Point Cloud Restoration from Adverse WeatherTechnical
  807. WeatherEdit: Controllable Weather Editing with 4D Gaussian FieldTechnical
  808. Weight Entropy-Maximised Evidential Metamodel for Uncertainty Quantification (Student Abstract)Technical
  809. WeightFlow: Learning Stochastic Dynamics via Evolving Weight of Neural NetworkTechnical
  810. Well Begun, Half Done: Reinforcement Learning with Prefix Optimization for LLM ReasoningTechnical
  811. WenetSpeech-Yue: A Large-Scale Cantonese Speech Corpus with Multi-dimensional AnnotationTechnical
  812. What Are They Filtering Out? An Experimental Benchmark of Filtering Strategies for Harm Reduction in Pretraining DatasetsTechnical
  813. What Makes a Good Generated Image? Investigating Human and Multimodal LLM Image Preference AlignmentTechnical
  814. What Makes a Good Speech Tokenizer for LLM-Centric Speech Generation? A Systematic StudyTechnical
  815. What Voting Rules Actually Do: A Data-Driven Analysis of Multi-Winner VotingTechnical
  816. What You See Is What You Reach: Towards Spatial Navigation with High-Level Human InstructionsTechnical
  817. What to Ask Next? Probing the Imaginative Reasoning of LLMs with TurtleSoup PuzzlesTechnical
  818. What to Trust? A Trust-aware Knowledge-guided Method for Zero-shot Object State Understanding in VideosTechnical
  819. What, Whether and How? Unveiling Process Reward Models for Thinking with Images ReasoningTechnical
  820. What-Meets-Where: Unified Learning of Action and Contact Localization in ImagesTechnical
  821. When AI Meets AI: A Game-Theoretic Defense Framework Against AI Empowered Cyber ThreatsTechnical
  822. When Equal Isn’t Fair: Mitigating Over-Normalization in Large Language Models (Student Abstract)Technical
  823. When Eyes and Ears Disagree: Can MLLMs Discern Audio-Visual Confusion?Technical
  824. When Genes Speak: A Semantic-Guided Framework for Spatially Resolved Transcriptomics Data ClusteringTechnical
  825. When Human Preferences Flip: An Instance-Dependent Robust Loss for RLHFTechnical
  826. When Instinct Guides and Insight Grounds: Staged RL Training for LLM AgentsTechnical
  827. When Natural Strategies Meet Fuzziness and Resource-Bounded ActionsTechnical
  828. When Person Re-Identification Meets Event Camera: A Benchmark Dataset and an Attribute-Guided Re-Identification FrameworkTechnical
  829. When Privacy Meets Recovery: The Overlooked Half of Surrogate-Driven Privacy Preservation for MLLM EditingTechnical
  830. When Proxy Agents Disagree, Do Humans Mirror? Manipulating Human Behavior in Moral Dilemmas Through AgentsTechnical
  831. When Reasoning Collapses: A Depth-Aware Probe into LLM Reasoning (Student Abstract)Technical
  832. When Safe Unimodal Inputs Collide: Optimizing Reasoning Chains for Cross-Modal Safety in Multimodal Large Language ModelsTechnical
  833. When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs’ ToxicityTechnical
  834. When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video RecommendationTechnical
  835. When Trackers Date Fish: A Benchmark and Framework for Underwater Multiple Fish TrackingTechnical
  836. When Truth Is Overridden: Uncovering the Internal Origins of Sycophancy in Large Language ModelsTechnical
  837. When the Domain Expert Has No Time and the LLM Developer Has No Clinical Expertise: Real-World Lessons from LLM Co-Design in a Safety-Net HospitalTechnical
  838. Where It Moves, It Matters: Referring Surgical Instrument Segmentation via MotionTechnical
  839. Where Norms and References Collide: Evaluating LLMs on Normative ReasoningTechnical
  840. Where and What Matters: Sensitivity-Aware Task Vectors for Many-Shot Multimodal In-Context LearningTechnical
  841. Where to Start Alignment? Diffusion Large Language Model May Demand a Distinct PositionTechnical
  842. WhisperDiari: A Whisper-Based Speaker Diarization Framework in Token Space Leveraging Semantic and Speaker Information for Better Text AdaptabilityTechnical
  843. Whispering Agents: A Event-Driven Covert Communication Protocol for the Internet of AgentsTechnical
  844. Who Is Helping Whom? Analyzing Inter-Dependencies to Evaluate Cooperation in Human-AI TeamingTechnical
  845. Who Is a Better Matchmaker? Human vs. Algorithmic Judge Assignment in a High-Stakes Startup CompetitionTechnical
  846. Who Should I Trust? Explicit Confidence-Focused Multimodal Intent RecognitionTechnical
  847. Whole-Body Coordination for Dynamic Object Grasping with Legged ManipulatorsTechnical
  848. Whole-Field Action Sensing via Wearable Single-Channel EMG Sensors and Resource-Efficient Motion NetworkTechnical
  849. Why Do Open-Source LLMs Struggle with Data Analysis? A Systematic Empirical StudyTechnical
  850. Why Isn’t Relational Learning Taking Over the World?Technical
  851. Wi-CBR: Salient-aware Adaptive WiFi Sensing for Cross-domain Behavior RecognitionTechnical
  852. Wikatoni: An Agentic AI System for Energy Engineering WorkflowsTechnical
  853. WikiREVIEW: A Multi-Perspective Review Framework for Automatic Wiki-Style Article GenerationTechnical
  854. Wikontic: A Tool for Building Knowledge Graphs from Text Aligned with the Wikidata OntologyTechnical
  855. WinMamba: Multi-Scale Shifted Windows in State Space Model for 3D Object DetectionTechnical
  856. WingBeats and Snapshots: Fusing Sound and Vision for Mosquito Monitoring (Student Abstract)Technical
  857. WorldAgen: Unified State-Action Prediction with Test-Time World Model TrainingTechnical
  858. WorldGrow: Generating Infinite 3D WorldTechnical
  859. WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous DrivingTechnical
  860. X-MoGen: Unified Motion Generation Across Humans and AnimalsTechnical
  861. X-MuTeST: A Multilingual Benchmark for Explainable Hate Speech Detection and a Novel LLM-Consulted Explanation FrameworkTechnical
  862. X-ReID: Multi-granularity Information Interaction for Video-Based Visible-Infrared Person Re-IdentificationTechnical
  863. X-SAM: From Segment Anything to Any SegmentationTechnical
  864. X2Edit: Revisiting Arbitrary-Instruction Image Editing Through Self-Constructed Data and Task-Aware Representation LearningTechnical
  865. XLinear: A Lightweight and Accurate MLP-Based Model for Long-Term Time Series Forecasting with Exogenous InputsTechnical
  866. YOLO-IOD: Towards Real Time Incremental Object DetectionTechnical
  867. You Don’t Need Pre-Built Graphs for RAG: Retrieval Augmented Generation with Adaptive Reasoning StructuresTechnical
  868. You Only Need One Stage: Novel-View Synthesis from a Single Blind Face ImageTechnical
  869. Your AI-Generated Image Detector Can Secretly Achieve SOTA Accuracy, If CalibratedTechnical
  870. Your Prompts Are Not Safe: Output-Free Membership Inference via Prompt Vectors in Vision-Language TuningTechnical
  871. Yours or Mine? Overwriting Attacks Against Neural Audio WatermarkingTechnical
  872. ZeRCP: Towards Communication-Efficient Collaborative Perception and Future Scene Prediction via Request-Free Spatial FilteringTechnical
  873. Zero-Reference Joint Low-Light Enhancement and Deblurring via Visual Autoregressive Modeling with VLM-Derived ModulationTechnical
  874. Zero-Shot Open-Vocabulary Human Motion Grounding with Test-Time TrainingTechnical
  875. Zero-Shot Robotic Manipulation via 3D Gaussian Splatting-Enhanced Multimodal Retrieval-Augmented GenerationTechnical
  876. Zero-Shot Vision Language Reasoning via Dual-layer Scene Graph Chain of Thoughts (Student Abstract)Technical
  877. Zero-shot Implicit Neural Manifold Representation (INMR) for Ultra-high Temporal Resolution Dynamic MRITechnical
  878. Zero-shot Recommendation: Towards Class Semantic Relation Learning for Inferring Labels of Unseen Micro-videosTechnical
  879. Zero-to-Hero: Empowering Video Appearance Transfer with Zero-Shot Initialization and Holistic RestorationTechnical
  880. ZipLJP: Zipped Information Processor for Legal Judgment PredictionTechnical
  881. Zo3T: Zero-Shot 3D-Aware Trajectory-Guided Image-to-Video Generation via Test-Time TrainingTechnical
  882. Zooming In on Fakes: A Novel Dataset for Localized AI-Generated Image Detection with Forgery Amplification ApproachTechnical
  883. anyECG-chat: A Generalist ECG-MLLM for Flexible ECG Input and Multi-Task UnderstandingTechnical
  884. db-ECBS: Interaction-Aware Multirobot Kinodynamic Motion Planning (Abstract Reprint)Technical
  885. iCD: An Implicit Clustering Distillation Method for Structural Information Mining (Student Abstract)Technical
  886. iDT-diet: Toward Personalized Health Forecasting-An Intelligent Digital Twin Model for Diet-Influenced Biomarker Trajectories (Student Abstract)Technical
  887. iMAD: Intelligent Multi-Agent Debate for Efficient and Accurate LLM InferenceTechnical
  888. iSeal: Encrypted Fingerprinting for Reliable LLM Ownership VerificationTechnical
  889. mmJEPA-ECG: Cross-Posture Robust Contactless Electrocardiogram Monitoring via Millimeter Wave Radar SensingTechnical
  890. mmPred: Radar-based Human Motion Prediction in the DarkTechnical
  891. qa-FLoRA: Data-free query-adaptive Fusion of LoRAs for LLMsTechnical
  892. rMMEA: Robust Multi-Modal Entity Alignment with Missing and Noise Visual ModalityTechnical
  893. scCluBench: Comprehensive Benchmarking of Clustering Algorithms for Single-Cell RNA SequencingTechnical
  894. uCLIP: Parameter-Efficient Multilingual Extension of Vision-Language Models with Unpaired DataTechnical
  895. vMFCoOp: Towards Equilibrium on a Unified Hyperspherical Manifold for Prompting Biomedical VLMsTechnical
  896. xMHashSeg: Cross-modal Hash Learning for Training-free Unsupervised LiDAR Semantic SegmentationTechnical
  897. zkQML: Verifiable and Privacy-Preserving Inference for Quantum Machine Learning (Student Abstract)Technical
  898. Δt-Mamba3D: A Time‑Aware Spatio‑Temporal State‑Space Model for Breast Cancer Risk PredictionTechnical
  899. Ψ-Arena: Interactive Assessment and Optimization of LLM-based Psychological Counselors with Tripartite FeedbackTechnical
  900. ‘What Do Children Think About AI?’: Insights and Educational Implications from Primary School Students’ Perceptions of AITechnical
  901. “As Eastern Powers, I Will Veto.”: An Investigation of Nation-Level Bias of Large Language Models in International RelationsTechnical
  902. “Debate Guru”: Honing Public Speaking Skills Among Secondary School Students with AI Tutoring SystemsTechnical

Looking for submission deadlines instead? See the conference deadline calendar.