← Search

Baolin Zheng

5 accepted papers

2025

Towards Visualization-of-Thought Jailbreak Attack against Large Visual Language Models

NeurIPS 2025poster

As Visual Language Models (VLMs) continue to evolve, they have demonstrated increasingly sophisticated logical reasoning capabilities and multimodal thought generation, opening doors to widespread applications. However, this advancement raises serious concerns about content security, particularly wh…

Cited by 0SourcecodeScholar
2024

From Toxic to Trustworthy: Using Self-Distillation and Semi-supervised Methods to Refine Neural Networks

AAAI 2024technical

Despite the tremendous success of deep neural networks (DNNs) across various fields, their susceptibility to potential backdoor attacks seriously threatens their application security, particularly in safety-critical or security-sensitive ones. Given this growing threat, there is a pressing need for…

Cited by 4SourcePDFScholar
2022

A Few Seconds Can Change Everything: Fast Decision-based Attacks against DNNs

IJCAI 2022poster

Previous researches have demonstrated deep learning models' vulnerabilities to decision-based adversarial attacks, which craft adversarial examples based solely on information from output decisions (top-1 labels). However, existing decision-based attacks have two major limitations, i.e., expensive q…