← Search

Chaoling Song

1 accepted papers

2024

SAFETY-J: Evaluating Safety with Critique

EMNLP 2024finding

The deployment of Large Language Models (LLMs) in content generation raises significant safety concerns, particularly regarding the transparency and interpretability of content evaluations. Current methods, primarily focused on binary safety classifications, lack mechanisms for detailed critique, li…