← Search

Jinsuk Park

1 accepted papers

2025

DarkBench: Benchmarking Dark Patterns in Large Language Models

ICLR 2025oral

We introduce DarkBench, a comprehensive benchmark for detecting dark design patterns—manipulative techniques that influence user behavior—in interactions with large language models (LLMs). Our benchmark comprises 660 prompts across six categories: brand bias, user retention, sycophancy, anthropomorp…

Cited by 34SourcePDFScholar