Nature

Evaluating large language models for accuracy incentivizes hallucinations

2026-04-22

Full text

DOI https://doi.org/10.1038/s41586-026-10549-w