ModerationBench: Can Foundation Models Moderate Online Content? Ayan Majumdar Last updated on Sep 10, 2026 Go to Project Site PDF Code Citation analysis comparing instruction- vs. example-driven VLM policy operationalization Safety NLP Deep Learning Vision Generative Models Related Evaluating LLMs for Demographic-Targeted Social Bias Detection: A Comprehensive Benchmark Study Bias in Generative Models CARMA: Causal Algorithmic Recourse with (Neural) Model-based Amortization FairAll: Fair Decisions With Unlabeled Data Generating Counterfactuals for Causal Fairness Publications Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization The growing complexity of content moderation policies presents a critical challenge for their consistent operationalization. While … Ayan Majumdar, Shounak Paul, Pushpdeep Singh, Ines Abdelaziz, Sayeh Jarollahi, Seungeon Lee, Krishna P. Gummadi, Ingmar Weber, Abhisek Dash PDF Cite Code Project