▪ AI safety · alignment research unrulyabstractions.com
← unruly abstractions

Towards Local Bias Mitigation: Discovering How LLMs Treat LGBTQ+ Users Differently, Without Explicit Markers

Unruly Abstractions August 2026 Theoretical Queer in AI @ IJCAI
Figure from Towards Local Bias Mitigation: Discovering How LLMs Treat LGBTQ+ Users Differently, Without Explicit Markers

Abstract

Proposes a pipeline that discovers and measures how deployed LLMs treat queer and cisheterosexual users differently, without relying on explicit markers