Publications

2026

  1. Does Aurora Encode Atmospheric Structure? Latent Regime Analysis and Attribution
    Emma Kasteleyn and Ana Lucic
    ICLR Workshop on Scientific Methods for Understanding Deep Learning, 2026

2025

  1. Group Equivariance Meets Mechanistic Interpretability: Equivariant Sparse Autoencoders
    Ege Erdogan and Ana Lucic
    NeurIPS Workshop on Mechanistic Interpretability, 2025
  2. Three Desiderata for Faithfulness in Machine Learning Explanations: The Case for Causal Abstraction
    Mette Friis Andersen, Maria Heuss, and Ana Lucic
    NeurIPS Workshop on Mechanistic Interpretability, 2025