AAAI 2024 Accepted Papers
The full list of 2,861 papers accepted at AAAI 2024 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Technical: 2,861
- T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion ModelsTechnical1,010 citations
- Graph of Thoughts: Solving Elaborate Problems with Large Language ModelsTechnical872 citations
- Benchmarking Large Language Models in Retrieval-Augmented GenerationTechnical477 citations
- Preference Ranking Optimization for Human AlignmentTechnical240 citations
- Detecting and Preventing Hallucinations in Large Vision Language ModelsTechnical231 citations
- MemoryBank: Enhancing Large Language Models with Long-Term MemoryTechnical223 citations
- ExpeL: LLM Agents Are Experiential LearnersTechnical222 citations
- AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking HeadTechnical213 citations
- Visual Adversarial Examples Jailbreak Aligned Large Language ModelsTechnical209 citations
- From Statistical Relational to Neuro-Symbolic Artificial IntelligenceTechnical197 citations
- MedSegDiff-V2: Diffusion-Based Medical Image Segmentation with TransformerTechnical191 citations
- Follow Your Pose: Pose-Guided Text-to-Video Generation Using Pose-Free VideosTechnical180 citations
- BLIVA: A Simple Multimodal LLM for Better Handling of Text-Rich Visual QuestionsTechnical167 citations
- NavGPT: Explicit Reasoning in Vision-and-Language Navigation with Large Language ModelsTechnical165 citations
- Generalized Planning in PDDL Domains with Pretrained Large Language ModelsTechnical161 citations
- Knowledge Graph Prompting for Multi-Document Question AnsweringTechnical154 citations
- AnomalyGPT: Detecting Industrial Anomalies Using Large Vision-Language ModelsTechnical143 citations
- Zhongjing: Enhancing the Chinese Medical Capabilities of Large Language Model through Expert Feedback and Real-World Multi-Turn DialogueTechnical141 citations
- NuScenes-QA: A Multi-Modal Visual Question Answering Benchmark for Autonomous Driving ScenarioTechnical139 citations
- Bad Actor, Good Advisor: Exploring the Role of Large Language Models in Fake News DetectionTechnical138 citations
- Omni-Kernel Network for Image RestorationTechnical109 citations
- ResDiff: Combining CNN and Diffusion Model for Image Super-resolutionTechnical108 citations
- MotionGPT: Finetuned LLMs Are General-Purpose Motion GeneratorsTechnical107 citations
- PMET: Precise Model Editing in a TransformerTechnical106 citations
- ProAgent: Building Proactive Cooperative Agents with Large Language ModelsTechnical103 citations
- Exploring Large Language Model for Graph Data Understanding in Online Job RecommendationsTechnical96 citations
- Fast Machine Unlearning without Retraining through Selective Synaptic DampeningTechnical95 citations
- Graph Neural Prompting with Large Language ModelsTechnical94 citations
- MSGNet: Learning Multi-Scale Inter-series Correlations for Multivariate Time Series ForecastingTechnical94 citations
- A Diffusion-Based Framework for Multi-Class Anomaly DetectionTechnical93 citations
- Task Contamination: Language Models May Not Be Few-Shot AnymoreTechnical93 citations
- VadCLIP: Adapting Vision-Language Models for Weakly Supervised Video Anomaly DetectionTechnical90 citations
- FlexKBQA: A Flexible LLM-Powered Framework for Few-Shot Knowledge Base Question AnsweringTechnical87 citations
- SMILEtrack: SiMIlarity LEarning for Occlusion-Aware Multiple Object TrackingTechnical87 citations
- Mitigating Large Language Model Hallucinations via Autonomous Knowledge Graph-Based RetrofittingTechnical85 citations
- OUTFOX: LLM-Generated Essay Detection Through In-Context Learning with Adversarially Generated ExamplesTechnical84 citations
- Reliable Conflictive Multi-View LearningTechnical82 citations
- Hybrid-SORT: Weak Cues Matter for Online Multi-Object TrackingTechnical76 citations
- VIGC: Visual Instruction Generation and CorrectionTechnical76 citations
- Interpretable Long-Form Legal Question Answering with Retrieval-Augmented Large Language ModelsTechnical74 citations
- Investigating the Effectiveness of Task-Agnostic Prefix Prompt for Instruction FollowingTechnical72 citations
- AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion ModelTechnical71 citations
- Bi-directional Adapter for Multimodal TrackingTechnical70 citations
- SurgicalSAM: Efficient Class Promptable Surgical Instrument SegmentationTechnical70 citations
- VELMA: Verbalization Embodiment of LLM Agents for Vision and Language Navigation in Street ViewTechnical70 citations
- Constructing Dreams Using Generative AITechnical69 citations
- Fluctuation-Based Adaptive Structured Pruning for Large Language ModelsTechnical69 citations
- MmAP: Multi-Modal Alignment Prompt for Cross-Domain Multi-Task LearningTechnical69 citations
- ODTrack: Online Dense Temporal Token Learning for Visual TrackingTechnical69 citations
- PointAttN: You Only Need Attention for Point Cloud CompletionTechnical69 citations
- PromptMRG: Diagnosis-Driven Prompts for Medical Report GenerationTechnical69 citations
- MedAlign: A Clinician-Generated Dataset for Instruction Following with Electronic Medical RecordsTechnical67 citations
- SkyScript: A Large and Semantically Diverse Vision-Language Dataset for Remote SensingTechnical67 citations
- Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and DutiesTechnical67 citations
- Can Large Language Models Serve as Rational Players in Game Theory? A Systematic AnalysisTechnical66 citations
- Can Large Language Models Understand Real-World Complex Instructions?Technical66 citations
- Make RepVGG Greater Again: A Quantization-Aware ApproachTechnical66 citations
- DeepAccident: A Motion and Accident Prediction Benchmark for V2X Autonomous DrivingTechnical65 citations
- Model Reprogramming: Resource-Efficient Cross-Domain Machine LearningTechnical65 citations
- IT3D: Improved Text-to-3D Generation with Explicit View SynthesisTechnical64 citations
- Far3D: Expanding the Horizon for Surround-View 3D Object DetectionTechnical63 citations
- VMT-Adapter: Parameter-Efficient Transfer Learning for Multi-Task Dense Scene UnderstandingTechnical63 citations
- Compositional Text-to-Image Synthesis with Attention Map Control of Diffusion ModelsTechnical61 citations
- SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time SegmentationTechnical61 citations
- SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific ResearchTechnical61 citations
- Enhancing Job Recommendation through LLM-Based Generative Adversarial NetworksTechnical60 citations
- FedDAT: An Approach for Foundation Model Finetuning in Multi-Modal Heterogeneous Federated LearningTechnical60 citations
- Directed Diffusion: Direct Control of Object Placement through Attention GuidanceTechnical59 citations
- LDMVFI: Video Frame Interpolation with Latent Diffusion ModelsTechnical59 citations
- Xiezhi: An Ever-Updating Benchmark for Holistic Domain Knowledge EvaluationTechnical59 citations
- EcomGPT: Instruction-Tuning Large Language Models with Chain-of-Task Tasks for E-commerceTechnical58 citations
- Incomplete Contrastive Multi-View Clustering with High-Confidence GuidingTechnical58 citations
- FocalDreamer: Text-Driven 3D Editing via Focal-Fusion AssemblyTechnical56 citations
- Fully-Connected Spatial-Temporal Graph for Multivariate Time-Series DataTechnical56 citations
- OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language ModelsTechnical56 citations
- GPT4MTS: Prompt-based Large Language Model for Multimodal Time-series ForecastingTechnical55 citations
- SwitchTab: Switched Autoencoders Are Effective Tabular LearnersTechnical54 citations
- MetaDiff: Meta-Learning with Conditional Diffusion for Few-Shot LearningTechnical53 citations
- Fine-Grained Distillation for Long Document RetrievalTechnical52 citations
- Frequency-Aware Deepfake Detection: Improving Generalizability through Frequency Space Domain LearningTechnical52 citations
- Prot2Text: Multimodal Protein’s Function Generation with GNNs and TransformersTechnical52 citations
- IRPruneDet: Efficient Infrared Small Target Detection via Wavelet Structure-Regularized Soft Channel PruningTechnical51 citations
- RewriteLM: An Instruction-Tuned Large Language Model for Text RewritingTechnical51 citations
- AvatarVerse: High-Quality & Stable 3D Avatar Creation from Text and PoseTechnical50 citations
- Can LLM Replace Stack Overflow? A Study on Robustness and Reliability of Large Language Model Code GenerationTechnical50 citations
- Data Roaming and Quality Assessment for Composed Image RetrievalTechnical50 citations
- FedTGP: Trainable Global Prototypes with Adaptive-Margin-Enhanced Contrastive Learning for Data and Model Heterogeneity in Federated LearningTechnical50 citations
- Learning to Rank in Generative RetrievalTechnical50 citations
- MELO: Enhancing Model Editing with Neuron-Indexed Dynamic LoRATechnical50 citations
- SoftCLIP: Softer Cross-Modal Alignment Makes CLIP StrongerTechnical50 citations
- SpikingBERT: Distilling BERT to Train Spiking Language Models Using Implicit DifferentiationTechnical50 citations
- GLOP: Learning Global Partition and Local Construction for Solving Large-Scale Routing Problems in Real-TimeTechnical49 citations
- Teaching Large Language Models to Translate with ComparisonTechnical49 citations
- An Empirical Study of CLIP for Text-Based Person SearchTechnical48 citations
- Visual Instruction Tuning with Polite FlamingoTechnical48 citations
- BAT: Behavior-Aware Human-Like Trajectory Prediction for Autonomous DrivingTechnical47 citations
- Decoupled Contrastive Multi-View Clustering with High-Order Random WalksTechnical47 citations
- DocFormerv2: Local Features for Document UnderstandingTechnical47 citations
- MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language ModelsTechnical47 citations
- NeRF-LiDAR: Generating Realistic LiDAR Point Clouds with Neural Radiance FieldsTechnical47 citations
- UniCATS: A Unified Context-Aware Text-to-Speech Framework with Contextual VQ-Diffusion and VocodingTechnical47 citations
- AVSegFormer: Audio-Visual Segmentation with TransformerTechnical46 citations
- CoVR: Learning Composed Video Retrieval from Web Video CaptionsTechnical46 citations
- UCMCTrack: Multi-Object Tracking with Uniform Camera Motion CompensationTechnical46 citations
- Diverse and Aligned Audio-to-Video Generation via Text-to-Video Model AdaptationTechnical45 citations
- How to Protect Copyright Data in Optimization of Large Language Models?Technical45 citations
- Plug-In Diffusion Model for Sequential RecommendationTechnical45 citations
- SelfPromer: Self-Prompt Dehazing Transformers with Depth-ConsistencyTechnical45 citations
- Context-I2W: Mapping Images to Context-Dependent Words for Accurate Zero-Shot Composed Image RetrievalTechnical44 citations
- HGPrompt: Bridging Homogeneous and Heterogeneous Graphs for Few-Shot Prompt LearningTechnical44 citations
- HARDVS: Revisiting Human Activity Recognition with Dynamic Vision SensorsTechnical43 citations
- Spatial Transform Decoupling for Oriented Object DetectionTechnical43 citations
- SayCanPay: Heuristic Planning with Large Language Models Using Learnable Domain KnowledgeTechnical42 citations
- Explicit Visual Prompts for Visual Object TrackingTechnical41 citations
- Journey to the Center of the Knowledge Neurons: Discoveries of Language-Independent Knowledge Neurons and Degenerate Knowledge NeuronsTechnical41 citations
- KAM-CoT: Knowledge Augmented Multimodal Chain-of-Thoughts ReasoningTechnical41 citations
- LGMRec: Local and Global Graph Learning for Multimodal RecommendationTechnical41 citations
- Prompt-Based Distribution Alignment for Unsupervised Domain AdaptationTechnical41 citations
- SQLdepth: Generalizable Self-Supervised Fine-Structured Monocular Depth EstimationTechnical41 citations
- TimesURL: Self-Supervised Contrastive Learning for Universal Time Series Representation LearningTechnical41 citations
- UV-SAM: Adapting Segment Anything Model for Urban Village IdentificationTechnical41 citations
- Unsupervised Layer-Wise Score Aggregation for Textual OOD DetectionTechnical41 citations
- Confucius: Iterative Tool Learning from Introspection Feedback by Easy-to-Difficult CurriculumTechnical40 citations
- Dynamic Spiking Graph Neural NetworksTechnical40 citations
- FontDiffuser: One-Shot Font Generation via Denoising Diffusion with Multi-Scale Content Aggregation and Style Contrastive LearningTechnical40 citations
- Gated Attention Coding for Training High-Performance and Efficient Spiking Neural NetworksTechnical40 citations
- PathAsst: A Generative Foundation AI Assistant towards Artificial General Intelligence of PathologyTechnical40 citations
- V2A-Mapper: A Lightweight Solution for Vision-to-Audio Generation by Connecting Foundation ModelsTechnical40 citations
- Distribution Matching for Multi-Task Learning of Classification Tasks: A Large-Scale Study on Faces & BeyondTechnical39 citations
- An Attentive Inductive Bias for Sequential Recommendation beyond the Self-AttentionTechnical38 citations
- Bootstrapping Large Language Models for Radiology Report GenerationTechnical38 citations
- DiffusionEdge: Diffusion Probabilistic Model for Crisp Edge DetectionTechnical38 citations
- Hot or Cold? Adaptive Temperature Sampling for Code Generation with Large Language ModelsTechnical38 citations
- MINES: Message Intercommunication for Inductive Relation Reasoning over Neighbor-Enhanced SubgraphsTechnical38 citations
- PC-Conv: Unifying Homophily and Heterophily with Two-Fold FilteringTechnical38 citations
- Panoptic Scene Graph Generation with Semantics-Prototype LearningTechnical38 citations
- TR-DETR: Task-Reciprocal Transformer for Joint Moment Retrieval and Highlight DetectionTechnical38 citations
- Earthfarsser: Versatile Spatio-Temporal Dynamical Systems Modeling in One ModelTechnical37 citations
- Exposing the Deception: Uncovering More Forgery Clues for Deepfake DetectionTechnical37 citations
- Learning Content-Enhanced Mask Transformer for Domain Generalized Urban-Scene SegmentationTechnical36 citations
- Learning to Unlearn: Instance-Wise Unlearning for Pre-trained ClassifiersTechnical36 citations
- SECap: Speech Emotion Captioning with Large Language ModelTechnical36 citations
- TF-CLIP: Learning Text-Free CLIP for Video-Based Person Re-identificationTechnical36 citations
- Attribute-Missing Graph Clustering NetworkTechnical35 citations
- HDMixer: Hierarchical Dependency with Extendable Patch for Multivariate Time Series ForecastingTechnical35 citations
- Improving Automatic VQA Evaluation Using Large Language ModelsTechnical35 citations
- MASTER: Market-Guided Stock Transformer for Stock Price ForecastingTechnical35 citations
- Relax Image-Specific Prompt Requirement in SAM: A Single Generic Prompt for Segmenting Camouflaged ObjectsTechnical35 citations
- CLIPSyntel: CLIP and LLM Synergy for Multimodal Question Summarization in HealthcareTechnical34 citations
- DiffusionTrack: Diffusion Model for Multi-Object TrackingTechnical34 citations
- DreamIdentity: Enhanced Editability for Efficient Face-Identity Preserved Image GenerationTechnical34 citations
- Fact-Driven Logical Reasoning for Machine Reading ComprehensionTechnical34 citations
- Federated Graph Learning under Domain Shift with Generalizable PrototypesTechnical34 citations
- Generative Multi-Modal Knowledge Retrieval with Large Language ModelsTechnical34 citations
- Improving Audio-Visual Segmentation with Bidirectional GenerationTechnical34 citations
- Latent Diffusion Transformer for Probabilistic Time Series ForecastingTechnical34 citations
- Norm Tweaking: High-Performance Low-Bit Quantization of Large Language ModelsTechnical34 citations
- TEILP: Time Prediction over Knowledge Graphs via Logical ReasoningTechnical34 citations
- An Autoregressive Text-to-Graph Framework for Joint Entity and Relation ExtractionTechnical33 citations
- ArtBank: Artistic Style Transfer with Pre-trained Diffusion Model and Implicit Style Prompt BankTechnical33 citations
- Backdoor Attacks via Machine UnlearningTechnical33 citations
- CamoDiffusion: Camouflaged Object Detection via Conditional Diffusion ModelsTechnical33 citations
- FedASMU: Efficient Asynchronous Federated Learning with Dynamic Staleness-Aware Model UpdateTechnical33 citations
- Generative-Based Fusion Mechanism for Multi-Modal TrackingTechnical33 citations
- Referred by Multi-Modality: A Unified Temporal Transformer for Video Object SegmentationTechnical33 citations
- Revisiting Graph-Based Fraud Detection in Sight of Heterophily and SpectrumTechnical33 citations
- S2WAT: Image Style Transfer via Hierarchical Vision Transformer Using Strips Window AttentionTechnical33 citations
- A Chain-of-Thought Prompting Approach with LLMs for Evaluating Students’ Formative Assessment Responses in ScienceTechnical32 citations
- Automatic Short Answer Grading for Finnish with ChatGPTTechnical32 citations
- Brush Your Text: Synthesize Any Scene Text on Images via Diffusion ModelTechnical32 citations
- CLIP-Guided Federated Learning on Heterogeneity and Long-Tailed DataTechnical32 citations
- Hierarchical and Incremental Structural Entropy Minimization for Unsupervised Social Event DetectionTechnical32 citations
- Temporal Adaptive RGBT Tracking with Modality PromptTechnical32 citations
- Ternary Spike: Learning Ternary Spikes for Spiking Neural NetworksTechnical32 citations
- Aleth-NeRF: Illumination Adaptive NeRF with Concealing Field AssumptionTechnical31 citations
- Auto-Prox: Training-Free Vision Transformer Architecture Search via Automatic Proxy DiscoveryTechnical31 citations
- Devignet: High-Resolution Vignetting Removal via a Dual Aggregated Fusion Transformer with Adaptive Channel ExpansionTechnical31 citations
- Latent Space Editing in Transformer-Based Flow MatchingTechnical31 citations
- SFC: Shared Feature Calibration in Weakly Supervised Semantic SegmentationTechnical31 citations
- Spatio-Temporal Pivotal Graph Neural Networks for Traffic Flow ForecastingTechnical31 citations
- Strong Baselines for Parameter-Efficient Few-Shot Fine-TuningTechnical31 citations
- Watermarking Conditional Text Generation for AI Detection: Unveiling Challenges and a Semantic-Aware Watermark RemedyTechnical31 citations
- When to Show a Suggestion? Integrating Human Feedback in AI-Assisted ProgrammingTechnical31 citations
- A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue EvaluatorsTechnical30 citations
- Approximating the Shapley Value without Marginal ContributionsTechnical30 citations
- Correlation Matching Transformation Transformers for UHD Image RestorationTechnical30 citations
- GAMC: An Unsupervised Method for Fake News Detection Using Graph Autoencoder with MaskingTechnical30 citations
- Learning Cluster-Wise Anchors for Multi-View ClusteringTechnical30 citations
- Probabilities of Causation with Nonbinary Treatment and EffectTechnical30 citations
- Rolling-Unet: Revitalizing MLP’s Ability to Efficiently Extract Long-Distance Dependencies for Medical Image SegmentationTechnical30 citations
- T-SciQ: Teaching Multimodal Chain-of-Thought Reasoning via Large Language Model Signals for Science Question AnsweringTechnical30 citations
- CUTS+: High-Dimensional Causal Discovery from Irregular Time-SeriesTechnical29 citations
- Conformal Prediction Regions for Time Series Using Linear Complementarity ProgrammingTechnical29 citations
- DDDM-VC: Decoupled Denoising Diffusion Models with Disentangled Representation and Prior Mixup for Verified Robust Voice ConversionTechnical29 citations
- DI-V2X: Learning Domain-Invariant Representation for Vehicle-Infrastructure Collaborative 3D Object DetectionTechnical29 citations
- DreamStyler: Paint by Style Inversion with Text-to-Image Diffusion ModelsTechnical29 citations
- Elijah: Eliminating Backdoors Injected in Diffusion Models via Distribution ShiftTechnical29 citations
- EulerMormer: Robust Eulerian Motion Magnification via Dynamic Filtering within TransformerTechnical29 citations
- Personalization as a Shortcut for Few-Shot Backdoor Attack against Text-to-Image Diffusion ModelsTechnical29 citations
- Temporal Graph Contrastive Learning for Sequential RecommendationTechnical29 citations
- Towards Real-World Test-Time Adaptation: Tri-net Self-Training with Balanced NormalizationTechnical29 citations
- What to Remember: Self-Adaptive Continual Learning for Audio Deepfake DetectionTechnical29 citations
- Controllable Mind Visual Diffusion ModelTechnical28 citations
- Debiasing Multimodal Sarcasm Detection with Contrastive LearningTechnical28 citations
- Delving into Multimodal Prompting for Fine-Grained Visual ClassificationTechnical28 citations
- Is a Large Language Model a Good Annotator for Event Extraction?Technical28 citations
- MathAttack: Attacking Large Language Models towards Math Solving AbilityTechnical28 citations
- Prompt to Transfer: Sim-to-Real Transfer for Traffic Signal Control with Prompt LearningTechnical28 citations
- SkeletonGait: Gait Recognition Using Skeleton MapsTechnical28 citations
- Sparsity-Guided Holistic Explanation for LLMs with Interpretable Inference-Time InterventionTechnical28 citations
- TOP-ReID: Multi-Spectral Object Re-identification with Token PermutationTechnical28 citations
- UniGen: A Unified Generative Framework for Retrieval and Question Answering with Large Language ModelsTechnical28 citations
- When Do Program-of-Thought Works for Reasoning?Technical28 citations
- XKD: Cross-Modal Knowledge Distillation with Domain Alignment for Video Representation LearningTechnical28 citations
- AltDiffusion: A Multilingual Text-to-Image Diffusion ModelTechnical27 citations
- Arbitrariness and Social Prediction: The Confounding Role of Variance in Fair ClassificationTechnical27 citations
- CyberQ: Generating Questions and Answers for Cybersecurity Education Using Knowledge Graph-Augmented LLMsTechnical27 citations
- DeS3: Adaptive Attention-Driven Self and Soft Shadow Removal Using ViT SimilarityTechnical27 citations
- Detecting AI-Generated Code Assignments Using Perplexity of Large Language ModelsTechnical27 citations
- Editing Language Model-Based Knowledge Graph EmbeddingsTechnical27 citations
- Fine-Grained Prototypes Distillation for Few-Shot Object DetectionTechnical27 citations
- Improving Knowledge Extraction from LLMs for Task Learning through Agent AnalysisTechnical27 citations
- Large Language Models Are Neurosymbolic ReasonersTechnical27 citations
- Learning Domain-Independent Heuristics for Grounded and Lifted PlanningTechnical27 citations
- Parallel Vertex Diffusion for Unified Visual GroundingTechnical27 citations
- Reinforced Adaptive Knowledge Learning for Multimodal Fake News DetectionTechnical27 citations
- Runtime Analysis of the SMS-EMOA for Many-Objective OptimizationTechnical27 citations
- SlowTrack: Increasing the Latency of Camera-Based Perception in Autonomous Driving Using Adversarial ExamplesTechnical27 citations
- ADA-GAD: Anomaly-Denoised Autoencoders for Graph Anomaly DetectionTechnical26 citations
- AMD: Autoregressive Motion DiffusionTechnical26 citations
- Any-Size-Diffusion: Toward Efficient Text-Driven Synthesis for Any-Size HD ImagesTechnical26 citations
- LION: Implicit Vision Prompt TuningTechnical26 citations
- LatestEval: Addressing Data Contamination in Language Model Evaluation through Dynamic and Time-Sensitive Test ConstructionTechnical26 citations
- Learn to Follow: Decentralized Lifelong Multi-Agent Pathfinding via Planning and LearningTechnical26 citations
- Mixed Fair Division: A SurveyTechnical26 citations
- Noise-Aware Image Captioning with Progressively Exploring Mismatched WordsTechnical26 citations
- SGNet: Structure Guided Network via Gradient-Frequency Awareness for Depth Map Super-resolutionTechnical26 citations
- Sparse3D: Distilling Multiview-Consistent Diffusion for Object Reconstruction from Sparse ViewsTechnical26 citations
- Talk Funny! A Large-Scale Humor Response Dataset with Chain-of-Humor InterpretationTechnical26 citations
- Test-Time Domain Adaptation by Learning Domain-Aware Batch NormalizationTechnical26 citations
- Understanding the Role of the Projector in Knowledge DistillationTechnical26 citations
- VLCounter: Text-Aware Visual Representation for Zero-Shot Object CountingTechnical26 citations
- Vision-Language Pre-training with Object Contrastive Learning for 3D Scene UnderstandingTechnical26 citations
- A SAT Solver and Computer Algebra Attack on the Minimum Kochen-Specker Problem (Student Abstract)Technical25 citations
- Adaptive Integration of Partial Label Learning and Negative Learning for Enhanced Noisy Label LearningTechnical25 citations
- DS-AL: A Dual-Stream Analytic Learning for Exemplar-Free Class-Incremental LearningTechnical25 citations
- DrFuse: Learning Disentangled Representation for Clinical Multi-Modal Fusion with Missing Modality and Modal InconsistencyTechnical25 citations
- Exploring One-Shot Semi-supervised Federated Learning with Pre-trained Diffusion ModelsTechnical25 citations
- Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank CompensationTechnical25 citations
- FedMut: Generalized Federated Learning via Stochastic MutationTechnical25 citations
- Generating Images of Rare Concepts Using Pre-trained Diffusion ModelsTechnical25 citations
- LogFormer: A Pre-train and Tuning Pipeline for Log Anomaly DetectionTechnical25 citations
- Provably Powerful Graph Neural Networks for Directed MultigraphsTechnical25 citations
- Separate the Wheat from the Chaff: Model Deficiency Unlearning via Parameter-Efficient Module OperationTechnical25 citations
- Unsupervised Continual Anomaly Detection with Contrastively-Learned PromptTechnical25 citations
- Beyond TreeSHAP: Efficient Computation of Any-Order Shapley Interactions for Tree EnsemblesTechnical24 citations
- Does Few-Shot Learning Suffer from Backdoor Attacks?Technical24 citations
- Dynamic Semantic-Based Spatial Graph Convolution Network for Skeleton-Based Human Action RecognitionTechnical24 citations
- Efficient Toxic Content Detection by Bootstrapping and Distilling Large Language ModelsTechnical24 citations
- Graph Invariant Learning with Subgraph Co-mixup for Out-of-Distribution GeneralizationTechnical24 citations
- Learning Accurate and Bidirectional Transformation via Dynamic Embedding Transportation for Cross-Domain RecommendationTechnical24 citations
- Learning Continuous Implicit Field with Local Distance Indicator for Arbitrary-Scale Point Cloud UpsamplingTechnical24 citations
- M3D: Dataset Condensation by Minimizing Maximum Mean DiscrepancyTechnical24 citations
- Navigating Open Set Scenarios for Skeleton-Based Action RecognitionTechnical24 citations
- SasWOT: Real-Time Semantic Segmentation Architecture Search WithOut TrainingTechnical24 citations
- Turning Dust into Gold: Distilling Complex Reasoning Capabilities from LLMs by Leveraging Negative DataTechnical24 citations
- Adaptive Feature Imputation with Latent Graph for Deep Incomplete Multi-View ClusteringTechnical23 citations
- CFR-ICL: Cascade-Forward Refinement with Iterative Click Loss for Interactive Image SegmentationTechnical23 citations
- Code-Style In-Context Learning for Knowledge-Based Question AnsweringTechnical23 citations
- Concept-Guided Prompt Learning for Generalization in Vision-Language ModelsTechnical23 citations
- DGL: Dynamic Global-Local Prompt Tuning for Text-Video RetrievalTechnical23 citations
- DeepSpeed Data Efficiency: Improving Deep Learning Model Quality and Training Efficiency via Efficient Data Sampling and RoutingTechnical23 citations
- Dual Self-Paced Cross-Modal HashingTechnical23 citations
- EarnHFT: Efficient Hierarchical Reinforcement Learning for High Frequency TradingTechnical23 citations
- EarthVQA: Towards Queryable Earth via Relational Reasoning-Based Remote Sensing Visual Question AnsweringTechnical23 citations
- Feature Fusion from Head to Tail for Long-Tailed Visual RecognitionTechnical23 citations
- G-Adapter: Towards Structure-Aware Parameter-Efficient Transfer Learning for Graph Transformer NetworksTechnical23 citations
- Graph-Aware Contrasting for Multivariate Time-Series ClassificationTechnical23 citations
- MDGNN: Multi-Relational Dynamic Graph Neural Network for Comprehensive and Dynamic Stock Investment PredictionTechnical23 citations
- Prompting Segmentation with Sound Is Generalizable Audio-Visual Source LocalizerTechnical23 citations
- RGMComm: Return Gap Minimization via Discrete Communications in Multi-Agent Reinforcement LearningTechnical23 citations
- SAM-PARSER: Fine-Tuning SAM Efficiently by Parameter Space ReconstructionTechnical23 citations
- SimDistill: Simulated Multi-Modal Distillation for BEV 3D Object DetectionTechnical23 citations
- Sterling: Synergistic Representation Learning on Bipartite GraphsTechnical23 citations
- Towards Balanced Alignment: Modal-Enhanced Semantic Modeling for Video Moment RetrievalTechnical23 citations
- Truth Forest: Toward Multi-Scale Truthfulness in Large Language Models through Intervention without TuningTechnical23 citations
- Unifying Visual and Vision-Language Tracking via Contrastive LearningTechnical23 citations
- Weighted Envy-Freeness for Submodular ValuationsTechnical23 citations
- Agile-Quant: Activation-Guided Quantization for Faster Inference of LLMs on the EdgeTechnical22 citations
- BEV-MAE: Bird’s Eye View Masked Autoencoders for Point Cloud Pre-training in Autonomous Driving ScenariosTechnical22 citations
- Critic-Guided Decision Transformer for Offline Reinforcement LearningTechnical22 citations
- DTL: Disentangled Transfer Learning for Visual RecognitionTechnical22 citations
- DiffBEV: Conditional Diffusion Model for Bird’s Eye View PerceptionTechnical22 citations
- Fine-Tuning Large Language Model Based Explainable Recommendation with Explainable Quality RewardTechnical22 citations
- Low-Rank Kernel Tensor Learning for Incomplete Multi-View ClusteringTechnical22 citations
- NeuSurf: On-Surface Priors for Neural Surface Reconstruction from Sparse Input ViewsTechnical22 citations
- On the Importance of Application-Grounded Experimental Design for Evaluating Explainable ML MethodsTechnical22 citations
- Point-PEFT: Parameter-Efficient Fine-Tuning for 3D Pre-trained ModelsTechnical22 citations
- TC-LIF: A Two-Compartment Spiking Neuron Model for Long-Term Sequential ModellingTechnical22 citations
- Text2Analysis: A Benchmark of Table Question Answering with Advanced Data Analysis and Unclear QueriesTechnical22 citations
- Towards Compact 3D Representations via Point Feature Enhancement Masked AutoencodersTechnical22 citations
- VLM2Scene: Self-Supervised Image-Text-LiDAR Learning with Foundation Models for Autonomous Driving Scene UnderstandingTechnical22 citations
- WebVLN: Vision-and-Language Navigation on WebsitesTechnical22 citations
- z-SignFedAvg: A Unified Stochastic Sign-Based Compression for Federated LearningTechnical22 citations
- 3D-STMN: Dependency-Driven Superpoint-Text Matching Network for End-to-End 3D Referring Expression SegmentationTechnical21 citations
- Advancing Spatial Reasoning in Large Language Models: An In-Depth Evaluation and Enhancement Using the StepGame BenchmarkTechnical21 citations
- Efficient Deweahter Mixture-of-Experts with Uncertainty-Aware Feature-Wise Linear ModulationTechnical21 citations
- Emotion Rendering for Conversational Speech Synthesis with Heterogeneous Graph-Based Context ModelingTechnical21 citations
- Fairness-Aware Structured Pruning in TransformersTechnical21 citations
- Few Shot Part Segmentation Reveals Compositional Logic for Industrial Anomaly DetectionTechnical21 citations
- GLH-Water: A Large-Scale Dataset for Global Surface Water Detection in Large-Size Very-High-Resolution Satellite ImageryTechnical21 citations
- Gramformer: Learning Crowd Counting via Graph-Modulated TransformerTechnical21 citations
- Higher-Order Graph Convolutional Network with Flower-Petals Laplacians on Simplicial ComplexesTechnical21 citations
- Improved Graph Contrastive Learning for Short Text ClassificationTechnical21 citations
- Large Language Models Are Clinical Reasoners: Reasoning-Aware Diagnosis Framework with Prompt-Generated RationalesTechnical21 citations
- Learning Generalized Segmentation for Foggy-Scenes by Bi-directional Wavelet GuidanceTechnical21 citations
- OSFFNet: Omni-Stage Feature Fusion Network for Lightweight Image Super-ResolutionTechnical21 citations
- Object-Aware Adaptive-Positivity Learning for Audio-Visual Question AnsweringTechnical21 citations
- RadOcc: Learning Cross-Modality Occupancy Knowledge through Rendering Assisted DistillationTechnical21 citations
- Rethinking Propagation for Unsupervised Graph Domain AdaptationTechnical21 citations
- SD-MVS: Segmentation-Driven Deformation Multi-View Stereo with Spherical Refinement and EM OptimizationTechnical21 citations
- Structure-CLIP: Towards Scene Graph Knowledge to Enhance Multi-Modal Structured RepresentationsTechnical21 citations
- StyleSinger: Style Transfer for Out-of-Domain Singing Voice SynthesisTechnical21 citations
- Synergistic Multiscale Detail Refinement via Intrinsic Supervision for Underwater Image EnhancementTechnical21 citations
- Text-Guided Molecule Generation with Diffusion Language ModelTechnical21 citations
- Towards Multi-Intent Spoken Language Understanding via Hierarchical Attention and Optimal TransportTechnical21 citations
- Training-Free Quantum Architecture SearchTechnical21 citations
- eTag: Class-Incremental Learning via Embedding Distillation and Task-Oriented GenerationTechnical21 citations
- Chinese Spelling Correction as Rephrasing Language ModelTechnical20 citations
- Cross-Layer and Cross-Sample Feature Optimization Network for Few-Shot Fine-Grained Image ClassificationTechnical20 citations
- DGA-GNN: Dynamic Grouping Aggregation GNN for Fraud DetectionTechnical20 citations
- Exploring Sparse Visual Prompt for Domain Adaptive Dense PredictionTechnical20 citations
- Frequency Spectrum Is More Effective for Multimodal Representation and Fusion: A Multimodal Spectrum Rumor DetectorTechnical20 citations
- Less Is More: Label Recommendation for Weakly Supervised Point Cloud Semantic SegmentationTechnical20 citations
- Motif-Aware Riemannian Graph Neural Network with Generative-Contrastive LearningTechnical20 citations
- Multi-Prompts Learning with Cross-Modal Alignment for Attribute-Based Person Re-identificationTechnical20 citations
- No Prejudice! Fair Federated Graph Neural Networks for Personalized RecommendationTechnical20 citations
- Offline and Online Optical Flow Enhancement for Deep Video CompressionTechnical20 citations
- On the Affinity, Rationality, and Diversity of Hierarchical Topic ModelingTechnical20 citations
- SGFormer: Semantic Graph Transformer for Point Cloud-Based 3D Scene Graph GenerationTechnical20 citations
- STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language ModelsTechnical20 citations
- Sample-Level Cross-View Similarity Learning for Incomplete Multi-View ClusteringTechnical20 citations
- Towards Dynamic Spatial-Temporal Graph Learning: A Decoupled PerspectiveTechnical20 citations
- Towards Efficient Verification of Quantized Neural NetworksTechnical20 citations
- When Model Meets New Normals: Test-Time Adaptation for Unsupervised Time-Series Anomaly DetectionTechnical20 citations
- A Dual Stealthy Backdoor: From Both Spatial and Frequency PerspectivesTechnical19 citations
- A Non-parametric Graph Clustering Framework for Multi-View DataTechnical19 citations
- Adaptive Uncertainty-Based Learning for Text-Based Person RetrievalTechnical19 citations
- Adv-Diffusion: Imperceptible Adversarial Face Identity Attack via Latent Diffusion ModelTechnical19 citations
- Boosting Neural Cognitive Diagnosis with Student’s Affective State ModelingTechnical19 citations
- Conditional Variational Autoencoder for Sign Language Translation with Cross-Modal AlignmentTechnical19 citations
- Deep Active Learning with Noise StabilityTechnical19 citations
- Entropic Open-Set Active LearningTechnical19 citations
- Federated Adaptive Prompt Tuning for Multi-Domain Collaborative LearningTechnical19 citations
- Fewer Steps, Better Performance: Efficient Cross-Modal Clip Trimming for Video Moment Retrieval Using LanguageTechnical19 citations
- Hierarchical Multi-Marginal Optimal Transport for Network AlignmentTechnical19 citations
- History Matters: Temporal Knowledge Editing in Large Language ModelTechnical19 citations
- HyperFast: Instant Classification for Tabular DataTechnical19 citations
- Learning Hierarchical Prompt with Structured Linguistic Knowledge for Vision-Language ModelsTechnical19 citations
- Learning to Prompt Knowledge Transfer for Open-World Continual LearningTechnical19 citations
- STEM: Unleashing the Power of Embeddings for Multi-Task RecommendationTechnical19 citations
- Style2Talker: High-Resolution Talking Head Generation with Emotion Style and Art StyleTechnical19 citations
- Towards Continual Knowledge Graph Embedding via Incremental DistillationTechnical19 citations
- Towards Effective and General Graph Unlearning via Mutual EvolutionTechnical19 citations
- U-Mixer: An Unet-Mixer Architecture with Stationarity Correction for Time Series ForecastingTechnical19 citations
- A Generalized Neural Diffusion Framework on GraphsTechnical18 citations
- A Simple and Yet Fairly Effective Defense for Graph Neural NetworksTechnical18 citations
- AdvST: Revisiting Data Augmentations for Single Domain GeneralizationTechnical18 citations
- DC-NAS: Divide-and-Conquer Neural Architecture Search for Multi-Modal ClassificationTechnical18 citations
- DVANet: Disentangling View and Action Features for Multi-View Action RecognitionTechnical18 citations
- Diffusion Language-Shapelets for Semi-supervised Time-Series ClassificationTechnical18 citations
- Domain-Controlled Prompt LearningTechnical18 citations
- Efficient Spiking Neural Networks with Sparse Selective Activation for Continual LearningTechnical18 citations
- Explaining Generalization Power of a DNN Using Interactive ConceptsTechnical18 citations
- FFT-Based Dynamic Token Mixer for VisionTechnical18 citations
- Generating and Reweighting Dense Contrastive Patterns for Unsupervised Anomaly DetectionTechnical18 citations
- Graph Disentangled Contrastive Learning with Personalized Transfer for Cross-Domain RecommendationTechnical18 citations
- LLM vs Small Model? Large Language Model Based Text Augmentation Enhanced Personality Detection ModelTechnical18 citations
- Learning Generalized Medical Image Segmentation from Decoupled Feature QueriesTechnical18 citations
- MCL-NER: Cross-Lingual Named Entity Recognition via Multi-View Contrastive LearningTechnical18 citations
- MM-TTS: Multi-Modal Prompt Based Style Transfer for Expressive Text-to-Speech SynthesisTechnical18 citations
- Multi-Modal Latent Space Learning for Chain-of-Thought Reasoning in Language ModelsTechnical18 citations
- Object-Aware Domain Generalization for Object DetectionTechnical18 citations
- PREFER: Prompt Ensemble Learning via Feedback-Reflect-RefineTechnical18 citations
- Pre-trained Online Contrastive Learning for Insurance Fraud DetectionTechnical18 citations
- Rethinking Graph Masked Autoencoders through Alignment and UniformityTechnical18 citations
- SocialStigmaQA: A Benchmark to Uncover Stigma Amplification in Generative Language ModelsTechnical18 citations
- Students’ Perceptions and Preferences of Generative Artificial Intelligence Feedback for ProgrammingTechnical18 citations
- Sunshine to Rainstorm: Cross-Weather Knowledge Distillation for Robust 3D Object DetectionTechnical18 citations
- Symbolic Cognitive Diagnosis via Hybrid Optimization for Intelligent Education SystemsTechnical18 citations
- UniADS: Universal Architecture-Distiller Search for Distillation GapTechnical18 citations
- Visual Chain-of-Thought Prompting for Knowledge-Based Visual ReasoningTechnical18 citations
- WaveFormer: Wavelet Transformer for Noise-Robust Video InpaintingTechnical18 citations
- A Multimodal, Multi-Task Adapting Framework for Video Action RecognitionTechnical17 citations
- Adaptive Graph Learning for Multimodal Conversational Emotion DetectionTechnical17 citations
- Adversarial Socialbots Modeling Based on Structural Information PrinciplesTechnical17 citations
- All but One: Surgical Concept Erasing with Model Preservation in Text-to-Image Diffusion ModelsTechnical17 citations
- Attention Guided CAM: Visual Explanations of Vision Transformer Guided by Self-AttentionTechnical17 citations
- CI-STHPAN: Pre-trained Attention Network for Stock Selection with Channel-Independent Spatio-Temporal HypergraphTechnical17 citations
- Causality-Inspired Invariant Representation Learning for Text-Based Person RetrievalTechnical17 citations
- DVSAI: Diverse View-Shared Anchors Based Incomplete Multi-View ClusteringTechnical17 citations
- Decentralized Monte Carlo Tree Search for Partially Observable Multi-Agent PathfindingTechnical17 citations
- Dual-Channel Learning Framework for Drug-Drug Interaction Prediction via Relation-Aware Heterogeneous Graph TransformerTechnical17 citations
- Exploiting Auxiliary Caption for Video GroundingTechnical17 citations
- Exploiting Label Skews in Federated Learning with Model ConcatenationTechnical17 citations
- Feature Transportation Improves Graph Neural NetworksTechnical17 citations
- HR-Pro: Point-Supervised Temporal Action Localization via Hierarchical Reliability PropagationTechnical17 citations
- High-Order Structure Based Middle-Feature Learning for Visible-Infrared Person Re-identificationTechnical17 citations
- InstructDoc: A Dataset for Zero-Shot Generalization of Visual Document Understanding with InstructionsTechnical17 citations
- Learning to Reweight for Generalizable Graph Neural NetworkTechnical17 citations
- Multi-Domain Incremental Learning for Face Presentation Attack DetectionTechnical17 citations
- Multi-Label Supervised Contrastive LearningTechnical17 citations
- NodeMixup: Tackling Under-Reaching for Graph Neural NetworksTechnical17 citations
- Out-of-Distribution Detection in Long-Tailed Recognition with Calibrated Outlier Class LearningTechnical17 citations
- ProCC: Progressive Cross-Primitive Compatibility for Open-World Compositional Zero-Shot LearningTechnical17 citations
- Proportional Aggregation of Preferences for Sequential Decision MakingTechnical17 citations
- Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision ProcessesTechnical17 citations
- SeqGPT: An Out-of-the-Box Large Language Model for Open Domain Sequence UnderstandingTechnical17 citations
- Shrinking Your TimeStep: Towards Low-Latency Neuromorphic Object Recognition with Spiking Neural NetworksTechnical17 citations
- Token-Level Contrastive Learning with Modality-Aware Prompting for Multimodal Intent RecognitionTechnical17 citations
- Unit Selection with Nonbinary Treatment and EffectTechnical17 citations
- Wikiformer: Pre-training with Structured Information of Wikipedia for Ad-Hoc RetrievalTechnical17 citations
- X-RefSeg3D: Enhancing Referring 3D Instance Segmentation via Structured Cross-Modal Graph Neural NetworksTechnical17 citations
- A Framework for Approaching AI Education in Educator Preparation ProgramsTechnical16 citations
- A Huber Loss Minimization Approach to Byzantine Robust Federated LearningTechnical16 citations
- A Perspective of Q-value Estimation on Offline-to-Online Reinforcement LearningTechnical16 citations
- Audio Generation with Multiple Conditional Diffusion ModelTechnical16 citations
- Barely Supervised Learning for Graph-Based Fraud DetectionTechnical16 citations
- Beyond OOD State Actions: Supported Cross-Domain Offline Reinforcement LearningTechnical16 citations
- Beyond Traditional Threats: A Persistent Backdoor Attack on Federated LearningTechnical16 citations
- DMMR: Cross-Subject Domain Generalization for EEG-Based Emotion Recognition via Denoising Mixed Mutual ReconstructionTechnical16 citations
- Deep Variational Incomplete Multi-View Clustering: Exploring Shared Clustering StructuresTechnical16 citations
- Distilling Autoregressive Models to Obtain High-Performance Non-autoregressive Solvers for Vehicle Routing Problems with Faster Inference SpeedTechnical16 citations
- End-to-End RGB-D Image Compression via Exploiting Channel-Modality RedundancyTechnical16 citations
- FM-OV3D: Foundation Model-Based Cross-Modal Knowledge Blending for Open-Vocabulary 3D DetectionTechnical16 citations
- FedDiv: Collaborative Noise Filtering for Federated Learning with Noisy LabelsTechnical16 citations
- GIN-SD: Source Detection in Graphs with Incomplete Nodes via Positional Encoding and Attentive FusionTechnical16 citations
- GOODAT: Towards Test-Time Graph Out-of-Distribution DetectionTechnical16 citations
- GroundVLP: Harnessing Zero-Shot Visual Grounding from Vision-Language Pre-training and Open-Vocabulary Object DetectionTechnical16 citations
- How Teachers Can Use Large Language Models and Bloom’s Taxonomy to Create Educational QuizzesTechnical16 citations
- LAMM: Label Alignment for Multi-Modal Prompt LearningTechnical16 citations
- LLMRG: Improving Recommendations through Large Language Model Reasoning GraphsTechnical16 citations
- Learning Discriminative Noise Guidance for Image Forgery Detection and LocalizationTechnical16 citations
- MICA: Towards Explainable Skin Lesion Diagnosis via Multi-Level Image-Concept AlignmentTechnical16 citations
- Non-exemplar Online Class-Incremental Continual Learning via Dual-Prototype Self-Augment and RefinementTechnical16 citations
- Occluded Person Re-identification via Saliency-Guided Patch TransferTechnical16 citations
- On Optimal Tradeoffs between EFX and Nash WelfareTechnical16 citations
- Online Boosting Adaptive Learning under Concept Drift for Multistream ClassificationTechnical16 citations
- Propagation Tree Is Not Deep: Adaptive Graph Contrastive Learning Approach for Rumor DetectionTechnical16 citations
- Recasting Regional Lighting for Shadow RemovalTechnical16 citations
- Relevant Intrinsic Feature Enhancement Network for Few-Shot Semantic SegmentationTechnical16 citations
- Rethinking Reverse Distillation for Multi-Modal Anomaly DetectionTechnical16 citations
- SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-Form Layout-to-Image GenerationTechnical16 citations
- Say Anything with Any StyleTechnical16 citations
- Task-Agnostic Privacy-Preserving Representation Learning for Federated Learning against Attribute Inference AttacksTechnical16 citations
- Text-to-Image Generation for Abstract ConceptsTechnical16 citations
- Translate Meanings, Not Just Words: IdiomKB’s Role in Optimizing Idiomatic Translation with Language ModelsTechnical16 citations
- ViLT-CLIP: Video and Language Tuning CLIP with Multimodal Prompt Learning and Scenario-Guided OptimizationTechnical16 citations
- AMSP-UOD: When Vortex Convolution and Stochastic Perturbation Meet Underwater Object DetectionTechnical15 citations
- Contrastive Tuning: A Little Help to Make Masked Autoencoders ForgetTechnical15 citations
- Cooper: Coordinating Specialized Agents towards a Complex Dialogue GoalTechnical15 citations
- Disguise without Disruption: Utility-Preserving Face De-identificationTechnical15 citations
- Enhancing Cognitive Diagnosis Using Un-interacted Exercises: A Collaboration-Aware Mixed Sampling ApproachTechnical15 citations
- Evolving Parameterized Prompt Memory for Continual LearningTechnical15 citations
- Fine-Grained Knowledge Selection and Restoration for Non-exemplar Class Incremental LearningTechnical15 citations
- Generalization Analysis of Machine Learning Algorithms via the Worst-Case Data-Generating Probability MeasureTechnical15 citations
- Graph Contrastive Invariant Learning from the Causal PerspectiveTechnical15 citations
- Homophily-Related: Adaptive Hybrid Graph Filter for Multi-View Graph ClusteringTechnical15 citations
- Interpretable3D: An Ad-Hoc Interpretable Classifier for 3D Point CloudsTechnical15 citations
- Learning from Polar Representation: An Extreme-Adaptive Model for Long-Term Time Series ForecastingTechnical15 citations
- MDFL: Multi-Domain Diffusion-Driven Feature LearningTechnical15 citations
- MagiCapture: High-Resolution Multi-Concept Portrait CustomizationTechnical15 citations
- MaskDiff: Modeling Mask Distribution with Diffusion Probabilistic Model for Few-Shot Instance SegmentationTechnical15 citations
- Multi-Class Support Vector Machine with Maximizing Minimum MarginTechnical15 citations
- NILUT: Conditional Neural Implicit 3D Lookup Tables for Image EnhancementTechnical15 citations
- Principal-Agent Reward Shaping in MDPsTechnical15 citations
- Prompting Multi-Modal Image Segmentation with Semantic GroupingTechnical15 citations
- Regeneration Learning: A Learning Paradigm for Data GenerationTechnical15 citations
- Region-Disentangled Diffusion Model for High-Fidelity PPG-to-ECG TranslationTechnical15 citations
- SAMFlow: Eliminating Any Fragmentation in Optical Flow with Segment Anything ModelTechnical15 citations
- SA²VP: Spatially Aligned-and-Adapted Visual PromptTechnical15 citations
- SPEAL: Skeletal Prior Embedded Attention Learning for Cross-Source Point Cloud RegistrationTechnical15 citations
- TCI-Former: Thermal Conduction-Inspired Transformer for Infrared Small Target DetectionTechnical15 citations
- TopoGCL: Topological Graph Contrastive LearningTechnical15 citations
- Towards Detailed Text-to-Motion Synthesis via Basic-to-Advanced Hierarchical Diffusion ModelTechnical15 citations
- Towards Squeezing-Averse Virtual Try-On via Sequential DeformationTechnical15 citations
- Transformer-Based No-Reference Image Quality Assessment via Supervised Contrastive LearningTechnical15 citations
- Weakly-Supervised Temporal Action Localization by Inferring Salient Snippet-FeatureTechnical15 citations
- ACT: Empowering Decision Transformer with Dynamic Programming via Advantage ConditioningTechnical14 citations
- Adaptive FSS: A Novel Few-Shot Segmentation Framework via Prototype EnhancementTechnical14 citations
- Autoregressive Omni-Aware Outpainting for Open-Vocabulary 360-Degree Image GenerationTechnical14 citations
- Axiomatic Aggregations of Abductive ExplanationsTechnical14 citations
- Beyond Mimicking Under-Represented Emotions: Deep Data Augmentation with Emotional Subspace Constraints for EEG-Based Emotion RecognitionTechnical14 citations
- Catalyst for Clustering-Based Unsupervised Object Re-identification: Feature CalibrationTechnical14 citations
- CatmullRom Splines-Based Regression for Image Forgery LocalizationTechnical14 citations
- Chain of Generation: Multi-Modal Gesture Synthesis via Cascaded Conditional ControlTechnical14 citations
- ConceptBed: Evaluating Concept Learning Abilities of Text-to-Image Diffusion ModelsTechnical14 citations
- Coupled Confusion Correction: Learning from Crowds with Sparse AnnotationsTechnical14 citations
- Customizing Language Model Responses with Contrastive In-Context LearningTechnical14 citations
- DP-AdamBC: Your DP-Adam Is Actually DP-SGD (Unless You Apply Bias Correction)Technical14 citations
- DQSSA: A Quantum-Inspired Solution for Maximizing Influence in Online Social Networks (Student Abstract)Technical14 citations
- Decoupled Textual Embeddings for Customized Image GenerationTechnical14 citations
- Dense Projection for Anomaly DetectionTechnical14 citations
- Disentangled Diffusion-Based 3D Human Pose Estimation with Hierarchical Spatial and Temporal DenoiserTechnical14 citations
- Dual-Window Multiscale Transformer for Hyperspectral Snapshot Compressive ImagingTechnical14 citations
- Enhancing Student Performance Prediction on Learnersourced Questions with SGNN-LLM SynergyTechnical14 citations
- Fast Inter-frame Motion Prediction for Compressed Dynamic Point Cloud Attribute EnhancementTechnical14 citations
- Feature Unlearning for Pre-trained GANs and VAEsTechnical14 citations
- Frozen CLIP Transformer Is an Efficient Point Cloud EncoderTechnical14 citations
- GCNext: Towards the Unity of Graph Convolutions for Human Motion PredictionTechnical14 citations
- Generalized Planning for the Abstraction and Reasoning CorpusTechnical14 citations
- H2GFormer: Horizontal-to-Global Voxel Transformer for 3D Semantic Scene CompletionTechnical14 citations
- Heterogeneous Test-Time Training for Multi-Modal Person Re-identificationTechnical14 citations
- How to Overcome Curse-of-Dimensionality for Out-of-Distribution Detection?Technical14 citations
- LAFA: Multimodal Knowledge Graph Completion with Link Aware Fusion and AggregationTechnical14 citations
- LLMEval: A Preliminary Study on How to Evaluate Large Language ModelsTechnical14 citations
- Learning Optimal Advantage from Preferences and Mistaking It for RewardTechnical14 citations
- Leaving the Nest: Going beyond Local Loss Functions for Predict-Then-OptimizeTechnical14 citations
- MFABA: A More Faithful and Accelerated Boundary-Based Attribution Method for Deep Neural NetworksTechnical14 citations
- MLNet: Mutual Learning Network with Neighborhood Invariance for Universal Domain AdaptationTechnical14 citations
- Mimic: Speaking Style Disentanglement for Speech-Driven 3D Facial AnimationTechnical14 citations
- Pay Attention to Target: Relation-Aware Temporal Consistency for Domain Adaptive Video Semantic SegmentationTechnical14 citations
- Polyper: Boundary Sensitive Polyp SegmentationTechnical14 citations
- Robust Node Classification on Graph Data with Graph and Label NoiseTechnical14 citations
- Root Cause Analysis in Microservice Using Neural Granger Causal DiscoveryTechnical14 citations
- SHaRPose: Sparse High-Resolution Representation for Human Pose EstimationTechnical14 citations
- Signed Graph Neural Ordinary Differential Equation for Modeling Continuous-Time DynamicsTechnical14 citations
- TagCLIP: A Local-to-Global Framework to Enhance Open-Vocabulary Multi-Label Classification of CLIP without TrainingTechnical14 citations
- Temporally and Distributionally Robust Optimization for Cold-Start RecommendationTechnical14 citations
- Towards Automatic Boundary Detection for Human-AI Collaborative Hybrid Essay in EducationTechnical14 citations
- Towards Fair Graph Federated Learning via Incentive MechanismsTechnical14 citations
- Traffic Flow Optimisation for Lifelong Multi-Agent Path FindingTechnical14 citations
- Unifying Multi-Modal Uncertainty Modeling and Semantic Alignment for Text-to-Image Person Re-identificationTechnical14 citations
- Urban Region Embedding via Multi-View Contrastive PredictionTechnical14 citations
- VQCNIR: Clearer Night Image Restoration with Vector-Quantized CodebookTechnical14 citations
- What Makes Quantization for Large Language Model Hard? An Empirical Study from the Lens of PerturbationTechnical14 citations
- A Diffusion-Based Pre-training Framework for Crystal Property PredictionTechnical13 citations
- A New Benchmark and Model for Challenging Image Manipulation DetectionTechnical13 citations
- A Unified Self-Distillation Framework for Multimodal Sentiment Analysis with Uncertain Missing ModalitiesTechnical13 citations
- Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion InferenceTechnical13 citations
- AesFA: An Aesthetic Feature-Aware Arbitrary Neural Style TransferTechnical13 citations
- Attention-Induced Embedding Imputation for Incomplete Multi-View Partial Multi-Label ClassificationTechnical13 citations
- CLIP-Gaze: Towards General Gaze Estimation via Visual-Linguistic ModelTechnical13 citations
- CSL: Class-Agnostic Structure-Constrained Learning for Segmentation Including the UnseenTechnical13 citations
- CaMIL: Causal Multiple Instance Learning for Whole Slide Image ClassificationTechnical13 citations
- Compositional Inversion for Stable Diffusion ModelsTechnical13 citations
- ConditionVideo: Training-Free Condition-Guided Video GenerationTechnical13 citations
- ContraNovo: A Contrastive Learning Approach to Enhance De Novo Peptide SequencingTechnical13 citations
- Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text RetrievalTechnical13 citations
- Decoding AI’s Nudge: A Unified Framework to Predict Human Behavior in AI-Assisted Decision MakingTechnical13 citations
- DiffAIL: Diffusion Adversarial Imitation LearningTechnical13 citations
- EDA: Evolving and Distinct Anchors for Multimodal Motion PredictionTechnical13 citations
- FRIH: Fine-Grained Region-Aware Image HarmonizationTechnical13 citations
- FlightBERT++: A Non-autoregressive Multi-Horizon Flight Trajectory Prediction FrameworkTechnical13 citations
- Generalizable Task Representation Learning for Offline Meta-Reinforcement Learning with Data LimitationsTechnical13 citations
- GridFormer: Point-Grid Transformer for Surface ReconstructionTechnical13 citations
- Image Captioning with Multi-Context Synthetic DataTechnical13 citations
- Interpretability Benchmark for Evaluating Spatial Misalignment of Prototypical Parts ExplanationsTechnical13 citations
- Knowledge-Aware Explainable Reciprocal RecommendationTechnical13 citations
- LSTKC: Long Short-Term Knowledge Consolidation for Lifelong Person Re-identificationTechnical13 citations
- Learning to Optimize Permutation Flow Shop Scheduling via Graph-Based Imitation LearningTechnical13 citations
- Lifting by Image – Leveraging Image Cues for Accurate 3D Human Pose EstimationTechnical13 citations
- MESED: A Multi-Modal Entity Set Expansion Dataset with Fine-Grained Semantic Classes and Hard Negative EntitiesTechnical13 citations
- Mean Teacher DETR with Masked Feature Alignment: A Robust Domain Adaptive Detection Transformer FrameworkTechnical13 citations
- Merging AI Incidents Research with Political Misinformation Research: Introducing the Political Deepfakes Incidents DatabaseTechnical13 citations
- Multichannel AV-wav2vec2: A Framework for Learning Multichannel Multi-Modal Speech RepresentationTechnical13 citations
- Optimal Survival Trees: A Dynamic Programming ApproachTechnical13 citations
- Orthogonal Dictionary Guided Shape Completion Network for Point CloudTechnical13 citations
- PPO-Clip Attains Global Optimality: Towards Deeper Understandings of ClippingTechnical13 citations
- Personalized LoRA for Human-Centered Text UnderstandingTechnical13 citations
- R3CD: Scene Graph to Image Generation with Relation-Aware Compositional Contrastive Control DiffusionTechnical13 citations
- Relightable and Animatable Neural Avatars from VideosTechnical13 citations
- Repeated Fair Allocation of Indivisible ItemsTechnical13 citations
- Rethinking Multi-Scale Representations in Deep Deraining TransformerTechnical13 citations
- Small Language Model Can Self-CorrectTechnical13 citations
- Spectral Prompt Tuning: Unveiling Unseen Classes for Zero-Shot Semantic SegmentationTechnical13 citations
- Spiking NeRF: Representing the Real-World Geometry by a Discontinuous RepresentationTechnical13 citations
- Tensorized Label Learning on Anchor GraphTechnical13 citations
- TextGT: A Double-View Graph Transformer on Text for Aspect-Based Sentiment AnalysisTechnical13 citations
- Toward More Generalized Malicious URL Detection ModelsTechnical13 citations
- Towards Explainable Joint Models via Information Theory for Multiple Intent Detection and Slot FillingTechnical13 citations
- UPDP: A Unified Progressive Depth Pruner for CNN and Vision TransformerTechnical13 citations
- Weakly Supervised Open-Vocabulary Object DetectionTechnical13 citations
- WeditGAN: Few-Shot Image Generation via Latent Space RelocationTechnical13 citations
- Working Memory Capacity of ChatGPT: An Empirical StudyTechnical13 citations
- A Primal-Dual Algorithm for Hybrid Federated LearningTechnical12 citations
- A Privacy Preserving Federated Learning (PPFL) Based Cognitive Digital Twin (CDT) Framework for Smart CitiesTechnical12 citations
- A Sequentially Fair Mechanism for Multiple Sensitive AttributesTechnical12 citations
- Adaptive Anytime Multi-Agent Path Finding Using Bandit-Based Large Neighborhood SearchTechnical12 citations
- Adaptive Discovering and Merging for Incremental Novel Class DiscoveryTechnical12 citations
- Adaptive Hardness Negative Sampling for Collaborative FilteringTechnical12 citations
- Agile Multi-Source-Free Domain AdaptationTechnical12 citations
- Aligner²: Enhancing Joint Multiple Intent Detection and Slot Filling via Adjustive and Forced Cross-Task AlignmentTechnical12 citations
- CLIM: Contrastive Language-Image Mosaic for Region RepresentationTechnical12 citations
- Carbon Footprint Reduction for Sustainable Data Centers in Real-TimeTechnical12 citations
- ConcaveQ: Non-monotonic Value Function Factorization via Concave Representations in Deep Multi-Agent Reinforcement LearningTechnical12 citations
- Constrained Bayesian Optimization under Partial Observations: Balanced Improvements and Provable ConvergenceTechnical12 citations
- Cross-Gate MLP with Protein Complex Invariant Embedding Is a One-Shot Antibody DesignerTechnical12 citations
- Deep Hierarchical Video CompressionTechnical12 citations
- Deep Incomplete Multi-View Learning Network with Insufficient Label InformationTechnical12 citations
- E2HQV: High-Quality Video Generation from Event Camera via Theory-Inspired Model-Aided Deep LearningTechnical12 citations
- ECHO-GL: Earnings Calls-Driven Heterogeneous Graph Learning for Stock Movement PredictionTechnical12 citations
- Effective Comparative Prototype Hashing for Unsupervised Domain AdaptationTechnical12 citations
- Equity-Transformer: Solving NP-Hard Min-Max Routing Problems as Sequential Generation with Equity ContextTechnical12 citations
- Fairness with Censorship: Bridging the Gap between Fairness Research and Real-World DeploymentTechnical12 citations
- Fine-Tuning Graph Neural Networks by Preserving Graph Generative PatternsTechnical12 citations
- From Hope to Safety: Unlearning Biases of Deep Models via Gradient Penalization in Latent SpaceTechnical12 citations
- G^2SAM: Graph-Based Global Semantic Awareness Method for Multimodal Sarcasm DetectionTechnical12 citations
- Generalizable Sleep Staging via Multi-Level Domain AlignmentTechnical12 citations
- GradTree: Learning Axis-Aligned Decision Trees with Gradient DescentTechnical12 citations
- GxVAEs: Two Joint VAEs Generate Hit Molecules from Gene Expression ProfilesTechnical12 citations
- Influential Exemplar Replay for Incremental Learning in Recommender SystemsTechnical12 citations
- Keep the Faith: Faithful Explanations in Convolutional Neural Networks for Case-Based ReasoningTechnical12 citations
- Learning from History: Task-agnostic Model Contrastive Learning for Image RestorationTechnical12 citations
- Local-Global Multi-Modal Distillation for Weakly-Supervised Temporal Video GroundingTechnical12 citations
- M-BEV: Masked BEV Perception for Robust Autonomous DrivingTechnical12 citations
- MERGE: Fast Private Text GenerationTechnical12 citations
- MuST: Robust Image Watermarking for Multi-Source TracingTechnical12 citations
- NestE: Modeling Nested Relational Structures for Knowledge Graph ReasoningTechnical12 citations
- NightRain: Nighttime Video Deraining via Adaptive-Rain-Removal and Adaptive-CorrectionTechnical12 citations
- No More Shortcuts: Realizing the Potential of Temporal Self-SupervisionTechnical12 citations
- Non-stationary Projection-Free Online Learning with Dynamic and Adaptive Regret GuaranteesTechnical12 citations
- On the Concept Trustworthiness in Concept Bottleneck ModelsTechnical12 citations
- PSC-CPI: Multi-Scale Protein Sequence-Structure Contrasting for Efficient and Generalizable Compound-Protein Interaction PredictionTechnical12 citations
- Parameterized Approximation Algorithms for Sum of Radii Clustering and VariantsTechnical12 citations
- Patch-Wise Graph Contrastive Learning for Image TranslationTechnical12 citations
- Point-to-Spike Residual Learning for Energy-Efficient 3D Point Cloud ClassificationTechnical12 citations
- Preparing Lessons for Progressive Training on Language ModelsTechnical12 citations
- Protein 3D Graph Structure Learning for Robust Structure-Based Protein Property PredictionTechnical12 citations
- Quad Bayer Joint Demosaicing and Denoising Based on Dual Encoder Network with Joint Residual LearningTechnical12 citations
- REGLO: Provable Neural Network Repair for Global Robustness PropertiesTechnical12 citations
- Recurrent Partial Kernel Network for Efficient Optical Flow EstimationTechnical12 citations
- Refining Latent Homophilic Structures over Heterophilic Graphs for Robust Graph Convolution NetworksTechnical12 citations
- Robust Nonparametric Regression under Poisoning AttackTechnical12 citations
- SPGroup3D: Superpoint Grouping Network for Indoor 3D Object DetectionTechnical12 citations
- Scale Optimization Using Evolutionary Reinforcement Learning for Object Detection on Drone ImageryTechnical12 citations
- Simple Image-Level Classification Improves Open-Vocabulary Object DetectionTechnical12 citations
- Social Physics Informed Diffusion Model for Crowd SimulationTechnical12 citations
- StegaStyleGAN: Towards Generic and Practical Generative Image SteganographyTechnical12 citations
- StockMixer: A Simple Yet Strong MLP-Based Architecture for Stock Price ForecastingTechnical12 citations
- TAU: Trajectory Data Augmentation with Uncertainty for Next POI RecommendationTechnical12 citations
- Text-Based Occluded Person Re-identification via Multi-Granularity Contrastive Consistency LearningTechnical12 citations
- Trash to Treasure: Low-Light Object Detection via Decomposition-and-AggregationTechnical12 citations
- Tuning-Free Inversion-Enhanced Control for Consistent Image EditingTechnical12 citations
- Uncertainty Regularized Evidential RegressionTechnical12 citations
- Underwater Organism Color Fine-Tuning via Decomposition and GuidanceTechnical12 citations
- Unveiling Implicit Deceptive Patterns in Multi-Modal Fake News via Neuro-Symbolic ReasoningTechnical12 citations
- V2Meow: Meowing to the Visual Beat via Video-to-Music GenerationTechnical12 citations
- VITA: ‘Carefully Chosen and Weighted Less’ Is Better in Medication RecommendationTechnical12 citations
- Vision Transformer Off-the-Shelf: A Surprising Baseline for Few-Shot Class-Agnostic CountingTechnical12 citations
- ‘Why Didn’t You Allocate This Task to Them?’ Negotiation-Aware Task Allocation and Contrastive Explanation GenerationTechnical12 citations
- A Comprehensive Augmentation Framework for Anomaly DetectionTechnical11 citations
- A Multi-Modal Contrastive Diffusion Model for Therapeutic Peptide GenerationTechnical11 citations
- A Novel Energy Based Model Mechanism for Multi-Modal Aspect-Based Sentiment AnalysisTechnical11 citations
- A Two-Stage Information Extraction Network for Incomplete Multi-View Multi-Label ClassificationTechnical11 citations
- AdapterGNN: Parameter-Efficient Fine-Tuning Improves Generalization in GNNsTechnical11 citations
- Automatic Radiology Reports Generation via Memory Alignment NetworkTechnical11 citations
- BadRL: Sparse Targeted Backdoor Attack against Reinforcement LearningTechnical11 citations
- Beyond Attention: Breaking the Limits of Transformer Context Length with Recurrent MemoryTechnical11 citations
- Bi-ViT: Pushing the Limit of Vision Transformer QuantizationTechnical11 citations
- Boosting Adversarial Transferability across Model Genus by Deformation-Constrained WarpingTechnical11 citations
- Boosting Few-Shot Learning via Attentive Feature RegularizationTechnical11 citations
- CL2CM: Improving Cross-Lingual Cross-Modal Retrieval via Cross-Lingual Knowledge TransferTechnical11 citations
- CRA-PCN: Point Cloud Completion with Intra- and Inter-level Cross-Resolution TransformersTechnical11 citations
- Causal Walk: Debiasing Multi-Hop Fact Verification with Front-Door AdjustmentTechnical11 citations
- Combinatorial Stochastic-Greedy BanditTechnical11 citations
- Comparing the Robustness of Modern No-Reference Image- and Video-Quality Metrics to Adversarial AttacksTechnical11 citations
- Concealing Sensitive Samples against Gradient Leakage in Federated LearningTechnical11 citations
- Conformal Autoregressive Generation: Beam Search with Coverage GuaranteesTechnical11 citations
- Controllable 3D Face Generation with Conditional Style Code DiffusionTechnical11 citations
- Data-Free Generalized Zero-Shot LearningTechnical11 citations
- DataElixir: Purifying Poisoned Dataset to Mitigate Backdoor Attacks via Diffusion ModelsTechnical11 citations
- Deep Structural Knowledge Exploitation and Synergy for Estimating Node Importance Value on Heterogeneous Information NetworksTechnical11 citations
- DistilVPR: Cross-Modal Knowledge Distillation for Visual Place RecognitionTechnical11 citations
- EAT: Towards Long-Tailed Out-of-Distribution DetectionTechnical11 citations
- EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoETechnical11 citations
- FairSIN: Achieving Fairness in Graph Neural Networks through Sensitive Information NeutralizationTechnical11 citations
- FedCSL: A Scalable and Accurate Approach to Federated Causal Structure LearningTechnical11 citations
- FedFixer: Mitigating Heterogeneous Label Noise in Federated LearningTechnical11 citations
- G-NAS: Generalizable Neural Architecture Search for Single Domain Generalization Object DetectionTechnical11 citations
- G2P-DDM: Generating Sign Pose Sequence from Gloss Sequence with Discrete Diffusion ModelTechnical11 citations
- Gaussian Mixture Proposals with Pull-Push Learning Scheme to Capture Diverse Events for Weakly Supervised Temporal Video GroundingTechnical11 citations
- Geometric-Facilitated Denoising Diffusion Model for 3D Molecule GenerationTechnical11 citations
- GraFITi: Graphs for Forecasting Irregularly Sampled Time SeriesTechnical11 citations
- How to Use the Metropolis Algorithm for Multi-Objective Optimization?Technical11 citations
- HybridGait: A Benchmark for Spatial-Temporal Cloth-Changing Gait Recognition with Hybrid ExplorationsTechnical11 citations
- Improving Cross-Modal Alignment with Synthetic Pairs for Text-Only Image CaptioningTechnical11 citations
- Improving the Adversarial Transferability of Vision Transformers with Virtual Dense ConnectionTechnical11 citations
- LLMGuard: Guarding against Unsafe LLM BehaviorTechnical11 citations
- Learning Dense Correspondence for NeRF-Based Face ReenactmentTechnical11 citations
- Learning to Learn in Interactive Constraint AcquisitionTechnical11 citations
- Leveraging Partial Symmetry for Multi-Agent Reinforcement LearningTechnical11 citations
- MGQFormer: Mask-Guided Query-Based Transformer for Image Manipulation LocalizationTechnical11 citations
- Manifold Constraints for Imperceptible Adversarial Attacks on Point CloudsTechnical11 citations
- MeDM: Mediating Image Diffusion Models for Video-to-Video Translation with Temporal Correspondence GuidanceTechnical11 citations
- Memory-Efficient Reversible Spiking Neural NetworksTechnical11 citations
- Mono3DVG: 3D Visual Grounding in Monocular ImagesTechnical11 citations
- Multi-Architecture Multi-Expert Diffusion ModelsTechnical11 citations
- Multi-Modal Discussion Transformer: Integrating Text, Images and Graph Transformers to Detect Hate Speech on Social MediaTechnical11 citations
- Music Style Transfer with Time-Varying Inversion of Diffusion ModelsTechnical11 citations
- Mutual-Modality Adversarial Attack with Semantic PerturbationTechnical11 citations
- NarrativePlay: An Automated System for Crafting Visual Worlds in Novels for Role-PlayingTechnical11 citations
- Neural Oscillators for Generalization of Physics-Informed Machine LearningTechnical11 citations
- Offline Model-Based Optimization via Policy-Guided Gradient SearchTechnical11 citations
- On the Actionability of Outcome PredictionTechnical11 citations
- OntoFact: Unveiling Fantastic Fact-Skeleton of LLMs via Ontology-Driven Reinforcement LearningTechnical11 citations
- Optimal Attack and Defense for Reinforcement LearningTechnical11 citations
- Poincaré Differential Privacy for Hierarchy-Aware Graph EmbeddingTechnical11 citations
- PointPatchMix: Point Cloud Mixing with Patch ScoringTechnical11 citations
- Progressive High-Frequency Reconstruction for Pan-Sharpening with Implicit Neural RepresentationTechnical11 citations
- QAGait: Revisit Gait Recognition from a Quality PerspectiveTechnical11 citations
- Quantifying and Analyzing Entity-Level Memorization in Large Language ModelsTechnical11 citations
- Rating-Based Reinforcement LearningTechnical11 citations
- Restoring Speaking Lips from Occlusion for Audio-Visual Speech RecognitionTechnical11 citations
- Revealing the Proximate Long-Tail Distribution in Compositional Zero-Shot LearningTechnical11 citations
- SciSpace Copilot: Empowering Researchers through Intelligent Reading AssistanceTechnical11 citations
- Task-Driven Causal Feature Distillation: Towards Trustworthy Risk PredictionTechnical11 citations
- Transfer and Alignment Network for Generalized Category DiscoveryTechnical11 citations
- UMIE: Unified Multimodal Information Extraction with Instruction TuningTechnical11 citations
- Upper Bounding Barlow Twins: A Novel Filter for Multi-Relational ClusteringTechnical11 citations
- ViTEraser: Harnessing the Power of Vision Transformers for Scene Text Removal with SegMIM PretrainingTechnical11 citations
- Weisfeiler and Lehman Go Paths: Learning Topological Features via Path ComplexesTechnical11 citations
- ZO-AdaMU Optimizer: Adapting Perturbation by the Momentum and Uncertainty in Zeroth-Order OptimizationTechnical11 citations
- Zero-Shot Aerial Object Detection with Visual Description RegularizationTechnical11 citations
- A Dual-Way Enhanced Framework from Text Matching Point of View for Multimodal Entity LinkingTechnical10 citations
- A New Mechanism for Eliminating Implicit Conflict in Graph Contrastive LearningTechnical10 citations
- AE-NeRF: Audio Enhanced Neural Radiance Field for Few Shot Talking Head SynthesisTechnical10 citations
- AGS: Affordable and Generalizable Substitute Training for Transferable Adversarial AttackTechnical10 citations
- AI Risk Profiles: A Standards Proposal for Pre-deployment AI Risk DisclosuresTechnical10 citations
- AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image EditingTechnical10 citations
- Adaptive Reactive Synthesis for LTL and LTLf Modulo TheoriesTechnical10 citations
- Adversarial Attacks on the Interpretation of Neuron Activation MaximizationTechnical10 citations
- Aspect-Based Sentiment Analysis with Explicit Sentiment AugmentationsTechnical10 citations
- Attention Disturbance and Dual-Path Constraint Network for Occluded Person Re-identificationTechnical10 citations
- Augmented Commonsense Knowledge for Remote Object GroundingTechnical10 citations
- AutoMixer for Improved Multivariate Time-Series Forecasting on Business and IT Observability DataTechnical10 citations
- Beyond Prototypes: Semantic Anchor Regularization for Better Representation LearningTechnical10 citations
- CF-NeRF: Camera Parameter Free Neural Radiance Fields with Incremental LearningTechnical10 citations
- Chain-of-Thought Improves Text Generation with Citations in Large Language ModelsTechnical10 citations
- Compositional Generalization for Multi-Label Text Classification: A Data-Augmentation ApproachTechnical10 citations
- Compressing Image-to-Image Translation GANs Using Local Density Structures on Their Learned ManifoldTechnical10 citations
- ConsistentEE: A Consistent and Hardness-Guided Early Exiting Method for Accelerating Language Models InferenceTechnical10 citations
- Cross-Covariate Gait Recognition: A BenchmarkTechnical10 citations
- DART: Dual-Modal Adaptive Online Prompting and Knowledge Retention for Test-Time AdaptationTechnical10 citations
- Data Shunt: Collaboration of Small and Large Models for Lower Costs and Better PerformanceTechnical10 citations
- Decoupling Degradations with Recurrent Network for Video Restoration in Under-Display CameraTechnical10 citations
- Deep Homography Estimation for Visual Place RecognitionTechnical10 citations
- Deep Quantum Error CorrectionTechnical10 citations
- Deep Unfolded Network with Intrinsic Supervision for Pan-SharpeningTechnical10 citations
- Delivering Inflated ExplanationsTechnical10 citations
- DifAttack: Query-Efficient Black-Box Adversarial Attack via Disentangled Feature SpaceTechnical10 citations
- Differentiable Auxiliary Learning for Sketch Re-IdentificationTechnical10 citations
- Direction-Aware Video Demoiréing with Temporal-Guided Bilateral LearningTechnical10 citations
- Disjoint Partial Enumeration without Blocking ClausesTechnical10 citations
- Double-Descent Curves in Neural Networks: A New Perspective Using Gaussian ProcessesTechnical10 citations
- Dynamic Budget Throttling in Repeated Second-Price AuctionsTechnical10 citations
- Dynamic Feature Pruning and Consolidation for Occluded Person Re-identificationTechnical10 citations
- ESRL: Efficient Sampling-Based Reinforcement Learning for Sequence GenerationTechnical10 citations
- Enhancing Representation of Spiking Neural Networks via Similarity-Sensitive Contrastive LearningTechnical10 citations
- Enumerating Safe Regions in Deep Neural Networks with Provable Probabilistic GuaranteesTechnical10 citations
- Explicitly Perceiving and Preserving the Local Geometric Structures for 3D Point Cloud AttackTechnical10 citations
- Exploring Diverse Representations for Open Set RecognitionTechnical10 citations
- FLAME: A Small Language Model for Spreadsheet FormulasTechnical10 citations
- FRED: Towards a Full Rotation-Equivariance in Aerial Image Object DetectionTechnical10 citations
- Factorized Explainer for Graph Neural NetworksTechnical10 citations
- Faithful Model Explanations through Energy-Constrained Conformal CounterfactualsTechnical10 citations
- Federated Learning with Extremely Noisy Clients via Negative DistillationTechnical10 citations
- FoX: Formation-Aware Exploration in Multi-Agent Reinforcement LearningTechnical10 citations
- Frequency-Adaptive Pan-Sharpening with Mixture of ExpertsTechnical10 citations
- Goal Alignment: Re-analyzing Value Alignment Problems Using Human-Aware AITechnical10 citations
- Graph Neural Networks with Soft Association between Topology and AttributeTechnical10 citations
- Hypergraph Joint Representation Learning for Hypervertices and Hyperedges via Cross ExpansionTechnical10 citations
- Image as a Language: Revisiting Scene Text Recognition via Balanced, Unified and Synchronized Vision-Language Reasoning NetworkTechnical10 citations
- Improving Transferability for Cross-Domain Trajectory Prediction via Neural Stochastic Differential EquationTechnical10 citations
- Inspecting Prediction Confidence for Detecting Black-Box Backdoor AttacksTechnical10 citations
- Integrated Decision Gradients: Compute Your Attributions Where the Model Makes Its DecisionTechnical10 citations
- KGTS: Contrastive Trajectory Similarity Learning over Prompt Knowledge Graph EmbeddingTechnical10 citations
- Knowledge Graph Error Detection with Contrastive Confidence AdaptionTechnical10 citations
- Layer Attack Unlearning: Fast and Accurate Machine Unlearning via Layer Level Attack and Knowledge DistillationTechnical10 citations
- Learning MDL Logic Programs from Noisy DataTechnical10 citations
- Learning Time Slot Preferences via Mobility Tree for Next POI RecommendationTechnical10 citations
- Learning in Online Principal-Agent Interactions: The Power of MenusTechnical10 citations
- M3SOT: Multi-Frame, Multi-Field, Multi-Space 3D Single Object TrackingTechnical10 citations
- Machine Learning-Powered Combinatorial Clock AuctionTechnical10 citations
- Manipulation-Robust Selection of Citizens’ AssembliesTechnical10 citations
- Market-GAN: Adding Control to Financial Market Data Generation with Semantic ContextTechnical10 citations
- Mining Gaze for Contrastive Learning toward Computer-Assisted DiagnosisTechnical10 citations
- Mixed Geometry Message and Trainable Convolutional Attention Network for Knowledge Graph CompletionTechnical10 citations
- Multi-Source Collaborative Gradient Discrepancy Minimization for Federated Domain GeneralizationTechnical10 citations
- Negative Pre-aware for Noisy Cross-Modal MatchingTechnical10 citations
- Neural Causal AbstractionsTechnical10 citations
- Neural Closure CertificatesTechnical10 citations
- Neuromorphic Event Signal-Driven Network for Video De-rainingTechnical10 citations
- On the Robustness of Neural-Enhanced Video Streaming against Adversarial AttacksTechnical10 citations
- On the Role of Server Momentum in Federated LearningTechnical10 citations
- Online Markov Decision Processes Configuration with Continuous Decision SpaceTechnical10 citations
- ParaGuide: Guided Diffusion Paraphrasers for Plug-and-Play Textual Style TransferTechnical10 citations
- Progressive Feature Self-Reinforcement for Weakly Supervised Semantic SegmentationTechnical10 citations
- Progressive Poisoned Data Isolation for Training-Time Backdoor DefenseTechnical10 citations
- Promoting Counterfactual Robustness through DiversityTechnical10 citations
- Proportional Representation in Metric Spaces and Low-Distortion Committee SelectionTechnical10 citations
- Pseudo-Label Calibration Semi-supervised Multi-Modal Entity AlignmentTechnical10 citations
- QLABGrad: A Hyperparameter-Free and Convergence-Guaranteed Scheme for Deep LearningTechnical10 citations
- RedCore: Relative Advantage Aware Cross-Modal Representation Learning for Missing Modalities with Imbalanced Missing RatesTechnical10 citations
- RetLLM-E: Retrieval-Prompt Strategy for Question-Answering on Student Discussion ForumsTechnical10 citations
- Rethinking Dimensional Rationale in Graph Contrastive Learning from Causal PerspectiveTechnical10 citations
- Retrieval-Augmented Primitive Representations for Compositional Zero-Shot LearningTechnical10 citations
- Reverse Multi-Choice Dialogue Commonsense Inference with Graph-of-ThoughtTechnical10 citations
- Robust Test-Time Adaptation for Zero-Shot Prompt TuningTechnical10 citations
- SOGDet: Semantic-Occupancy Guided Multi-View 3D Object DetectionTechnical10 citations
- Spatial-Temporal Interplay in Human Mobility: A Hierarchical Reinforcement Learning Approach with Hypergraph RepresentationTechnical10 citations
- Stable Unlearnable Example: Enhancing the Robustness of Unlearnable Examples via Stable Error-Minimizing NoiseTechnical10 citations
- Structural Entropy Based Graph Structure Learning for Node ClassificationTechnical10 citations
- T2MAC: Targeted and Trusted Multi-Agent Communication through Selective Engagement and Evidence-Driven IntegrationTechnical10 citations
- TexFit: Text-Driven Fashion Image Editing with Diffusion ModelsTechnical10 citations
- Trust Region Methods for Nonconvex Stochastic Optimization beyond Lipschitz SmoothnessTechnical10 citations
- Unlocking the Power of Open Set: A New Perspective for Open-Set Noisy Label LearningTechnical10 citations
- A Generalized Shuffle Framework for Privacy Amplification: Strengthening Privacy Guarantees and Enhancing UtilityTechnical9 citations
- A Local-Ascending-Global Learning Strategy for Brain-Computer InterfaceTechnical9 citations
- AT4CTR: Auxiliary Match Tasks for Enhancing Click-Through Rate PredictionTechnical9 citations
- Adaptive Prompt Routing for Arbitrary Text Style Transfer with Pre-trained Language ModelsTechnical9 citations
- Almost Envy-Free Allocations of Indivisible Goods or Chores with EntitlementsTechnical9 citations
- Any-Stereo: Arbitrary Scale Disparity Estimation for Iterative Stereo MatchingTechnical9 citations
- Automated Design of Affine Maximizer Mechanisms in Dynamic SettingsTechnical9 citations
- Bidirectional Temporal Plan Graph: Enabling Switchable Passing Orders for More Efficient Multi-Agent Path Finding Plan ExecutionTechnical9 citations
- Binding-Adaptive Diffusion Models for Structure-Based Drug DesignTechnical9 citations
- Boosting Multiple Instance Learning Models for Whole Slide Image Classification: A Model-Agnostic Framework Based on Counterfactual InferenceTechnical9 citations
- Bootstrapping Cognitive Agents with a Large Language ModelTechnical9 citations
- Build Your Own Robot Friend: An Open-Source Learning Module for Accessible and Engaging AI EducationTechnical9 citations
- Building Minimal and Reusable Causal State Abstractions for Reinforcement LearningTechnical9 citations
- CAMEL: Capturing Metaphorical Alignment with Context Disentangling for Multimodal Emotion RecognitionTechnical9 citations
- COMBAT: Alternated Training for Effective Clean-Label Backdoor AttacksTechnical9 citations
- CONSIDER: Commonalities and Specialties Driven Multilingual Code Retrieval FrameworkTechnical9 citations
- Chronic Poisoning: Backdoor Attack against Split LearningTechnical9 citations
- Co-designing AI Education Curriculum with Cross-Disciplinary High School TeachersTechnical9 citations
- Collaborative Consortium of Foundation Models for Open-World Few-Shot LearningTechnical9 citations
- Complete Neural Networks for Complete Euclidean GraphsTechnical9 citations
- Convolutional Channel-Wise Competitive Learning for the Forward-Forward AlgorithmTechnical9 citations
- Cross-Modal Match for Language Conditioned 3D Object GroundingTechnical9 citations
- Cycle-Consistency Learning for Captioning and GroundingTechnical9 citations
- DHGCN: Dynamic Hop Graph Convolution Network for Self-Supervised Point Cloud LearningTechnical9 citations
- Data-Augmented Curriculum Graph Neural Architecture Search under Distribution ShiftsTechnical9 citations
- DexFuncGrasp: A Robotic Dexterous Functional Grasp Dataset Constructed from a Cost-Effective Real-Simulation Annotation SystemTechnical9 citations
- DiG-In-GNN: Discriminative Feature Guided GNN-Based Fraud Detector against Inconsistencies in Multi-Relation Fraud GraphTechnical9 citations
- Efficient Asynchronous Federated Learning with Prospective Momentum Aggregation and Fine-Grained CorrectionTechnical9 citations
- Exploring Transformer ExtrapolationTechnical9 citations
- FMRNet: Image Deraining via Frequency Mutual RevisionTechnical9 citations
- Fair Lotteries for Participatory BudgetingTechnical9 citations
- FedA3I: Annotation Quality-Aware Aggregation for Federated Medical Image Segmentation against Heterogeneous Annotation NoiseTechnical9 citations
- Federated Causality Learning with Explainable Adaptive OptimizationTechnical9 citations
- Frequency-Controlled Diffusion Model for Versatile Text-Guided Image-to-Image TranslationTechnical9 citations
- GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video RetrievalTechnical9 citations
- Gaussian Process Neural Additive ModelsTechnical9 citations
- Generating Diagnostic and Actionable Explanations for Fair Graph Neural NetworksTechnical9 citations
- Get an A in Math: Progressive Rectification PromptingTechnical9 citations
- Grab What You Need: Rethinking Complex Table Structure Recognition with Flexible Components DeliberationTechnical9 citations
- HGE: Embedding Temporal Knowledge Graphs in a Product Space of Heterogeneous Geometric SubspacesTechnical9 citations
- HiFi-Gas: Hierarchical Federated Learning Incentive Mechanism Enhanced Gas Usage EstimationTechnical9 citations
- Hybrid-Supervised Dual-Search: Leveraging Automatic Learning for Loss-Free Multi-Exposure Image FusionTechnical9 citations
- Hyp-OW: Exploiting Hierarchical Structure Learning with Hyperbolic Distance Enhances Open World Object DetectionTechnical9 citations
- Improving Neural Network Generalization on Data-Limited Regression with Doubly-Robust BoostingTechnical9 citations
- Improving Open Set Recognition via Visual Prompts Distilled from Common-Sense KnowledgeTechnical9 citations
- Joint Demosaicing and Denoising for Spike CameraTechnical9 citations
- LMD: Faster Image Reconstruction with Latent Masking DiffusionTechnical9 citations
- Layer Collaboration in the Forward-Forward AlgorithmTechnical9 citations
- Learning Planning Domains from Non-redundant Fully-Observed Traces: Theoretical Foundations and Complexity AnalysisTechnical9 citations
- Learning to Stop Cut Generation for Efficient Mixed-Integer Linear ProgrammingTechnical9 citations
- Long-Tailed Partial Label Learning by Head Classifier and Tail Classifier CooperationTechnical9 citations
- M2SD:Multiple Mixing Self-Distillation for Few-Shot Class-Incremental LearningTechnical9 citations
- Motion Deblurring via Spatial-Temporal Collaboration of Frames and EventsTechnical9 citations
- Neural Reasoning about Agents’ Goals, Preferences, and ActionsTechnical9 citations
- ORES: Open-Vocabulary Responsible Visual SynthesisTechnical9 citations
- OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy EnvironmentsTechnical9 citations
- Omnipotent Distillation with LLMs for Weakly-Supervised Natural Language Video Localization: When Divergence Meets ConsistencyTechnical9 citations
- On Disentanglement of Asymmetrical Knowledge Transfer for Modality-Task Agnostic Federated LearningTechnical9 citations
- Once and for All: Universal Transferable Adversarial Perturbation against Deep Hashing-Based Facial Image RetrievalTechnical9 citations
- Out of Thin Air: Exploring Data-Free Adversarial Robustness DistillationTechnical9 citations
- PNeRFLoc: Visual Localization with Point-Based Neural Radiance FieldsTechnical9 citations
- Perturbation-Invariant Adversarial Training for Neural Ranking Models: Improving the Effectiveness-Robustness Trade-OffTechnical9 citations
- ProxyDet: Synthesizing Proxy Novel Classes via Classwise Mixup for Open-Vocabulary Object DetectionTechnical9 citations
- Regulating Intermediate 3D Features for Vision-Centric Autonomous DrivingTechnical9 citations
- Relational Programming with Foundational ModelsTechnical9 citations
- Review-Enhanced Hierarchical Contrastive Learning for RecommendationTechnical9 citations
- SAVSR: Arbitrary-Scale Video Super-Resolution via a Learned Scale-Adaptive NetworkTechnical9 citations
- SCD-Net: Spatiotemporal Clues Disentanglement Network for Self-Supervised Skeleton-Based Action RecognitionTechnical9 citations
- SPD-DDPM: Denoising Diffusion Probabilistic Models in the Symmetric Positive Definite SpaceTechnical9 citations
- SURER: Structure-Adaptive Unified Graph Neural Network for Multi-View ClusteringTechnical9 citations
- Self-Distillation Regularized Connectionist Temporal Classification Loss for Text Recognition: A Simple Yet Effective ApproachTechnical9 citations
- Self-Interpretable Graph Learning with Sufficient and Necessary ExplanationsTechnical9 citations
- Semi-supervised Active Learning for Video Action DetectionTechnical9 citations
- Shadow Generation with Decomposed Mask Prediction and Attentive Shadow FillingTechnical9 citations
- SimFair: Physics-Guided Fairness-Aware Learning with Simulation ModelsTechnical9 citations
- Some Like It Small: Czech Semantic Embedding Models for Industry ApplicationsTechnical9 citations
- Stability in Online Coalition FormationTechnical9 citations
- Sustainability of Data Center Digital Twins with Reinforcement LearningTechnical9 citations
- Tackling Vision Language Tasks through Learning Inner MonologuesTechnical9 citations
- Task-Free Continual Generation and Representation Learning via Dynamic Expansionable Memory ClusterTechnical9 citations
- Taxonomy Driven Fast Adversarial TrainingTechnical9 citations
- Temporal Fairness in Multiwinner VotingTechnical9 citations
- The Evidence Contraction Issue in Deep Evidential Regression: Discussion and SolutionTechnical9 citations
- Towards Continual Learning Desiderata via HSIC-Bottleneck Orthogonalization and Equiangular EmbeddingTechnical9 citations
- Towards Transferable Adversarial Attacks with Centralized PerturbationTechnical9 citations
- Transformer as Linear Expansion of LearngeneTechnical9 citations
- Transformer-Based Selective Super-resolution for Efficient Image RefinementTechnical9 citations
- Transitivity-Preserving Graph Representation Learning for Bridging Local Connectivity and Role-Based SimilarityTechnical9 citations
- Tree-of-Reasoning Question Decomposition for Complex Question Answering with Large Language ModelsTechnical9 citations
- UniAP: Towards Universal Animal Perception in Vision via Few-Shot LearningTechnical9 citations
- Unveiling the Tapestry of Automated Essay Scoring: A Comprehensive Investigation of Accuracy, Fairness, and GeneralizabilityTechnical9 citations
- Weakly Supervised Semantic Segmentation for Driving ScenesTechnical9 citations
- π-Light: Programmatic Interpretable Reinforcement Learning for Resource-Limited Traffic Signal ControlTechnical9 citations
- A Dynamic GCN with Cross-Representation Distillation for Event-Based LearningTechnical8 citations
- Aligning Geometric Spatial Layout in Cross-View Geo-Localization via Feature RecombinationTechnical8 citations
- Another Way to the Top: Exploit Contextual Clustering in Learned Image CodingTechnical8 citations
- Arithmetic Feature Interaction Is Necessary for Deep Tabular LearningTechnical8 citations
- Bias-Conflict Sample Synthesis and Adversarial Removal Debias Strategy for Temporal Sentence Grounding in VideoTechnical8 citations
- Blind-Touch: Homomorphic Encryption-Based Distributed Neural Network Inference for Privacy-Preserving Fingerprint AuthenticationTechnical8 citations
- Bridging the Gap between 2D and 3D Visual Question Answering: A Fusion Approach for 3D VQATechnical8 citations
- Calibrated One Round Federated Learning with Bayesian Inference in the Predictive SpaceTechnical8 citations
- Combating Data Imbalances in Federated Semi-supervised Learning with Dual RegulatorsTechnical8 citations
- Continual Relation Extraction via Sequential Multi-Task LearningTechnical8 citations
- Continual Vision-Language Retrieval via Dynamic Knowledge RectificationTechnical8 citations
- Continuous Piecewise-Affine Based Motion Model for Image AnimationTechnical8 citations
- Contrastive Balancing Representation Learning for Heterogeneous Dose-Response Curves EstimationTechnical8 citations
- Contributing Dimension Structure of Deep Feature for Coreset SelectionTechnical8 citations
- Cross-Domain Contrastive Learning for Time Series ClusteringTechnical8 citations
- DGCLUSTER: A Neural Framework for Attributed Graph Clustering via Modularity MaximizationTechnical8 citations
- Data-Free Hard-Label Robustness Stealing AttackTechnical8 citations
- DiffSED: Sound Event Detection with Denoising DiffusionTechnical8 citations
- Dirichlet-Based Prediction Calibration for Learning with Noisy LabelsTechnical8 citations
- Dual-View Whitening on Pre-trained Text Embeddings for Sequential RecommendationTechnical8 citations
- Dynamic Sub-graph Distillation for Robust Semi-supervised Continual LearningTechnical8 citations
- Dynamic Weighted Combiner for Mixed-Modal Image RetrievalTechnical8 citations
- Electron Microscopy Images as Set of Fragments for Mitochondrial SegmentationTechnical8 citations
- Enhancing Hyperspectral Images via Diffusion Model and Group-Autoencoder Super-resolution NetworkTechnical8 citations
- Enhancing Multi-Scale Diffusion Prediction via Sequential Hypergraphs and Adversarial LearningTechnical8 citations
- Enhancing Neural Radiance Fields with Adaptive Multi-Exposure Fusion: A Bilevel Optimization Approach for Novel View SynthesisTechnical8 citations
- Explaining Reinforcement Learning Agents through Counterfactual Action OutcomesTechnical8 citations
- FairTrade: Achieving Pareto-Optimal Trade-Offs between Balanced Accuracy and Fairness in Federated LearningTechnical8 citations
- Fed-QSSL: A Framework for Personalized Federated Learning under Bitwidth and Data HeterogeneityTechnical8 citations
- FedCD: Federated Semi-Supervised Learning with Class Awareness Balance via Dual TeachersTechnical8 citations
- Federated Learning via Input-Output Collaborative DistillationTechnical8 citations
- Fine Structure-Aware Sampling: A New Sampling Training Scheme for Pixel-Aligned Implicit Models in Single-View Human ReconstructionTechnical8 citations
- Fine-Grained Multi-View Hand Reconstruction Using Inverse RenderingTechnical8 citations
- FoSp: Focus and Separation Network for Early Smoke SegmentationTechnical8 citations
- From GARCH to Neural Network for Volatility ForecastTechnical8 citations
- Fusion-Vital: Video-RF Fusion Transformer for Advanced Remote Physiological MeasurementTechnical8 citations
- FusionFormer: A Concise Unified Feature Fusion Transformer for 3D Pose EstimationTechnical8 citations
- GAD-PVI: A General Accelerated Dynamic-Weight Particle-Based Variational Inference FrameworkTechnical8 citations
- GSENet:Global Semantic Enhancement Network for Lane DetectionTechnical8 citations
- Game-Theoretic Unlearnable Example GeneratorTechnical8 citations
- Hierarchical Topology Isomorphism Expertise Embedded Graph Contrastive LearningTechnical8 citations
- High-Fidelity Gradient Inversion in Distributed LearningTechnical8 citations
- How to Evaluate the Generalization of Detection? A Benchmark for Comprehensive Open-Vocabulary DetectionTechnical8 citations
- Hyperspectral Image Reconstruction via Combinatorial Embedding of Cross-Channel Spatio-Spectral CluesTechnical8 citations
- IINet: Implicit Intra-inter Information Fusion for Real-Time Stereo MatchingTechnical8 citations
- Input Margins Can Predict Generalization TooTechnical8 citations
- Instance-Aware Multi-Camera 3D Object Detection with Structural Priors Mining and Self-Boosting LearningTechnical8 citations
- Instrumental Variable Estimation for Causal Inference in Longitudinal Data with Time-Dependent Latent ConfoundersTechnical8 citations
- Knowledge-Aware Parameter Coaching for Personalized Federated LearningTechnical8 citations
- LAMPAT: Low-Rank Adaption for Multilingual Paraphrasing Using Adversarial TrainingTechnical8 citations
- LF-ViT: Reducing Spatial Redundancy in Vision Transformer for Efficient Image RecognitionTechnical8 citations
- LINGO-Space: Language-Conditioned Incremental Grounding for SpaceTechnical8 citations
- LR-XFL: Logical Reasoning-Based Explainable Federated LearningTechnical8 citations
- Learning to Learn Better Visual PromptsTechnical8 citations
- Learning with Noisy Labels Using Hyperspherical Margin WeightingTechnical8 citations
- MIND: Multi-Task Incremental Network DistillationTechnical8 citations
- MKG-FENN: A Multimodal Knowledge Graph Fused End-to-End Neural Network for Accurate Drug–Drug Interaction PredictionTechnical8 citations
- MetaRLEC: Meta-Reinforcement Learning for Discovery of Brain Effective ConnectivityTechnical8 citations
- Minimum Coverage Sets for Training Robust Ad Hoc Teamwork AgentsTechnical8 citations
- Mitigating Idiom Inconsistency: A Multi-Semantic Contrastive Learning Method for Chinese Idiom Reading ComprehensionTechnical8 citations
- MobileInst: Video Instance Segmentation on the MobileTechnical8 citations
- Model-Driven Deep Neural Network for Enhanced AoA Estimation Using 5G gNBTechnical8 citations
- Modeling Adaptive Inter-Task Feature Interactions via Sentiment-Aware Contrastive Learning for Joint Aspect-Sentiment PredictionTechnical8 citations
- Multi-Dimensional Fair Federated LearningTechnical8 citations
- Multi-View Dynamic Reflection Prior for Video Glass Surface DetectionTechnical8 citations
- One Step Closer to Unbiased Aleatoric Uncertainty EstimationTechnical8 citations
- Online Restless Multi-Armed Bandits with Long-Term Fairness ConstraintsTechnical8 citations
- PCE-Palm: Palm Crease Energy Based Two-Stage Realistic Pseudo-Palmprint GenerationTechnical8 citations
- PORTAL: Automatic Curricula Generation for Multiagent Reinforcement LearningTechnical8 citations
- PPIDSG: A Privacy-Preserving Image Distribution Sharing Scheme with GAN in Federated LearningTechnical8 citations
- Parsing All Adverse Scenes: Severity-Aware Semantic Segmentation with Mask-Enhanced Cross-Domain ConsistencyTechnical8 citations
- PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell ModelingTechnical8 citations
- QI-IRA: Quantum-Inspired Interactive Ranking Aggregation for Person Re-identificationTechnical8 citations
- Quantile-Regression-Ensemble: A Deep Learning Algorithm for Downscaling Extreme PrecipitationTechnical8 citations
- RPSC: Robust Pseudo-Labeling for Semantic ClusteringTechnical8 citations
- Reachability of Fair Allocations via Sequential ExchangesTechnical8 citations
- Reinforcement Learning and Data-Generation for Syntax-Guided SynthesisTechnical8 citations
- Rethinking Mesh Watermark: Towards Highly Robust and Adaptable Deep 3D Mesh WatermarkingTechnical8 citations
- Rethinking Two-Stage Referring Expression Comprehension: A Novel Grounding and Segmentation Method Modulated by PointTechnical8 citations
- S2CycleDiff: Spatial-Spectral-Bilateral Cycle-Diffusion Framework for Hyperspectral Image Super-resolutionTechnical8 citations
- SCP: Spherical-Coordinate-Based Learned Point Cloud CompressionTechnical8 citations
- STDiff: Spatio-Temporal Diffusion for Continuous Stochastic Video PredictionTechnical8 citations
- Safe Abductive Learning in the Presence of Inaccurate RulesTechnical8 citations
- Scalable Geometric Fracture Assembly via Co-creation Space among AssemblersTechnical8 citations
- Scaling and Masking: A New Paradigm of Data Sampling for Image and Video Quality AssessmentTechnical8 citations
- Self-Supervised Disentangled Representation Learning for Robust Target Speech ExtractionTechnical8 citations
- Semantic-Guided Generative Image Augmentation Method with Diffusion Models for Image ClassificationTechnical8 citations
- Semi-Supervised Blind Image Quality Assessment through Knowledge Distillation and Incremental LearningTechnical8 citations
- Simplifying Complex Observation Models in Continuous POMDP Planning with Probabilistic Guarantees and PracticeTechnical8 citations
- Social, Legal, Ethical, Empathetic, and Cultural Rules: Compilation and ReasoningTechnical8 citations
AAAI accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.