Showing results (1-10 of 8) with videos related to

Sort By:
Pageof 1
Proceedings of the National Academy of Sciences of the United States of America|June 4, 2024
Deception abilities emerged in large language modelsThilo Hagendorff
Scientific Reports|August 26, 2025
Investigating toxicity and Bias in stable diffusion text-to-image modelsMatthias Schneider, Thilo Hagendorff
Nature Communications|February 5, 2026
Large reasoning models are autonomous jailbreak agentsThilo Hagendorff, Erik Derner, Nuria Oliver
Nature Computational Science|January 4, 2024
Human-like intuitive behavior and reasoning biases emerged in large language models but disappeared in ChatGPTThilo Hagendorff, Sarah Fabi, Michal Kosinski
Nature Communications|May 9, 2026
Large language models exhibit speciesist bias against animalsMonika Jotautaitė, Lucius Caviola, David A Brewster, et al.
PLOS Digital Health|February 22, 2023
To explain or not to explain?-Artificial intelligence explainability in clinical decision support systemsJulia Amann, Dennis Vetter, Stig Nikolaj Blomberg, et al.
Pageof 1