vix.ing · top · new · best · stats · spec

Hedström, Anna

  1. NoiseGrad: Enhancing Explanations by Introducing Stochasticity to Model Weights
    2021/06/18 by Kirill Bykov, Bykov, Kirill, Anna Karin Hedström +5 · 4 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification
  2. Capturing Polysemanticity with PRISM: A Multi-Concept Feature Description Framework
    2025/06/18 by Laura Kopf, Nils Feldhus, Kopf, Laura +12 · 5 voices · 4 citations
    Computer Science · #Explainable Artificial Intelligence (XAI) #Topic Modeling #Multimodal Machine Learning Applications
  3. Finding the right XAI method -- A Guide for the Evaluation and Ranking of Explainable AI Methods in Climate Science
    2023/03/01 by Philine Lou Bommer, Marlene Kretschmer, Bommer, Philine +7 · 3 citations
    Computer Science · #Explainable Artificial Intelligence (XAI)
  4. CoSy: Evaluating Textual Explanations of Neurons
    2024/05/30 by Laura Kopf, Philine Lou Bommer, Kopf, Laura +9 · 3 citations
    Computer Science · #Explainable Artificial Intelligence (XAI)
  5. Sanity Checks Revisited: An Exploration to Repair the Model Parameter Randomisation Test
    2024/01/12 by Anna Karin Hedström, Hedström, Anna, Leander Weber +5 · 2 citations
    Computer Science · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Credit Risk and Financial Regulations #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Healthcare #Methodology (stat.ME)
  6. A Fresh Look at Sanity Checks for Saliency Maps
    2024/05/03 by Anna Karin Hedström, Leander Weber, Hedström, Anna +5 · 2 citations
    Computer Science · Psychology · Engineering · #Visual Attention and Saliency Detection #Color perception and design #Design Education and Practice
  7. Quanda: An Interpretability Toolkit for Training Data Attribution Evaluation and Beyond
    2024/10/09 by Dilyara Bareeva, Bareeva, Dilyara, Galip Ümit Yolcu +11 · 1 citation
    Decision Sciences · Computer Science · #Data Quality and Management #Natural Language Processing Techniques
  8. To Steer or Not to Steer? Mechanistic Error Reduction with Abstention for Language Models
    2025/10/15 by Hedström, Anna, Salim I. Amoukou, Amoukou, Salim I. +6 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling