Publications

(2026). Characterizing Bluesky Content Moderation Service: From Automation of Service to Landscape of Harms. ICWSM 2027.

PDF Cite

(2026). Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization. arXiv.

PDF Cite Code Project

(2026). From Universal to Individualized Actionability: Revisiting Personalization in Algorithmic Recourse. ACM FAccT 2026.

PDF Cite DOI

(2026). Evaluating LLMs for Detecting Demographic-Targeted Social Bias: A Comprehensive Benchmark Study. IAAI @ LREC 2026.

PDF Cite

(2025). A Causal Framework to Measure and Mitigate Non-binary Treatment Discrimination. AAAI 2026.

PDF Cite Code DOI

(2023). Do Invariances in Deep Neural Networks Align with Human Perception?. AAAI 2023.

PDF Cite Code DOI

(2022). Don't Throw it Away! The Utility of Unlabeled Data in Fair Decision Making. ACM FAccT 2022.

PDF Cite Code Project Slides DOI