vix.ing · top · new · best · stats · spec

José Hernández‐Orallo

  1. Open Problems in Machine Unlearning for AI Safety
    2025/01/09 by Fazl Barez, Tingchen Fu, Barez, Fazl +39 · 6 voices · 26 citations
    Engineering · #Fault Detection and Control Systems
  2. Foundational Challenges in Assuring Alignment and Safety of Large Language Models
    2024/04/15 by Abulhair Saparov, Anwar, Usman, Saparov, Abulhair +76 · 50 citations
    Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computers and Society (cs.CY) #Data Quality and Management #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Topic Modeling
  3. Larger and more instructable language models become less reliable
    2024/09/25 by Lexin Zhou, Wout Schellaert, Fernando Martínez‐Plumed +3 · 1 voice · 26 citations
    Computer Science · Medicine · #Artificial Intelligence in Healthcare and Education #Explainable Artificial Intelligence (XAI) #Topic Modeling
  4. Dialectical language model evaluation: An initial appraisal of the commonsense spatial reasoning abilities of LLMs
    2023/04/22 by Anthony G. Cohn, Cohn, Anthony G, José Hernández‐Orallo +1 · 5 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling #Semantic Web and Ontologies
  5. 100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
    2024/09/05 by Lorenzo Pacchiardi, Pacchiardi, Lorenzo, Lucy G. Cheke +3 · 8 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Imbalanced Data Classification Techniques #Machine Learning (cs.LG) #Machine Learning and Data Classification #Natural Language Processing Techniques
  6. Inferring Capabilities from Task Performance with Bayesian Triangulation
    2023/09/21 by John Burden, Burden, John, Konstantinos Voudouris +9 · 3 citations
    Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #Bayesian Modeling and Causal Inference #Decision-Making and Behavioral Economics #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences
  7. Threshold Choice Methods: the Missing Link
    2011/12/12 by José Hernández‐Orallo, Peter Flach, Hernández-Orallo, José +3 · 1 citation
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Data Mining Algorithms and Applications #FOS: Computer and information sciences #Imbalanced Data Classification Techniques #Statistical Methods in Clinical Trials
  8. On the influence of intelligence in (social) intelligence testing\n environments
    2012/02/03 by Javier Insa-Cabrera, José-Luis Benacloch-Ayuso, Insa-Cabrera, Javier +3 · 1 citation
    Computer Science · Decision Sciences · Social Sciences · #Artificial Intelligence (cs.AI) #Computability, Logic, AI Algorithms #Evolutionary Algorithms and Applications #Evolutionary Game Theory and Cooperation #FOS: Computer and information sciences #Game Theory and Applications
  9. Fairness and Missing Values
    2019/05/29 by Fernando Martínez‐Plumed, Cèsar Ferri, Martínez-Plumed, Fernando +5 · 1 citation
    Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Ethics and Social Impacts of AI #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Privacy-Preserving Technologies in Data
  10. Predictable Artificial Intelligence
    2023/10/09 by Lexin Zhou, Zhou, Lexin, Pablo A. Moreno-Casares +27 · 2 citations
    Computer Science · Social Sciences · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Ethics and Social Impacts of AI #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #I.2
  11. On Potential Cognitive Abilities in the Machine Kingdom
    2013/01/10 by José Hernández‐Orallo, José Hernández-Orallo, David L. Dowe · 3 citations
    Computer Science · #Cognitive Science and Mapping #Computability, Logic, AI Algorithms #Evolutionary Algorithms and Applications
  12. Conversational Complexity for Assessing Risk in Large Language Models
    2024/09/02 by John Burden, Manuel Cebrian, Burden, John +3 · 3 citations
    Computer Science · #Topic Modeling
  13. CASP-DM: Context Aware Standard Process for Data Mining
    2017/09/19 by Fernando Martínez‐Plumed, Lidia Contreras-Ochando, Martínez-Plumed, Fernando +13 · 1 citation
    Computer Science · #Data Stream Mining Techniques #Data Mining Algorithms and Applications #Machine Learning and Data Classification
  14. Personalized Safety in LLMs: A Benchmark and A Planning-Based Agent Approach
    2025/05/24 by Yuchen Wu, Wu, Yuchen, Edward W. Sun +11 · 4 citations
    Business, Management and Accounting · Engineering · #Business Process Modeling and Analysis #Computers and Society (cs.CY) #FOS: Computer and information sciences #Safety Systems Engineering in Autonomy
  15. Evaluating Generalization Capabilities of LLM-Based Agents in Mixed-Motive Scenarios Using Concordia
    2025/12/03 by Chandler Smith, Smith, Chandler, Marwa Abdulhai +157 · 4 citations
    Computer Science · Medicine · #Multimodal Machine Learning Applications #Artificial Intelligence in Healthcare and Education #Topic Modeling
  16. Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI
    2025/03/27 by Danaja Rutar, Rutar, Danaja, Alva Markelius +7 · 1 citation
    Computer Science · #Cognitive Science and Mapping #Neural Networks and Applications #AI-based Problem Solving and Planning