ResearchAug 18, 2026
Large Language Models Show Metacognitive Sensitivity in Medical Reasoning
A new study on arXiv evaluates large language models using a psychophysics-inspired clinical benchmark, assessing diagnostic choice and confidence behavior in…
#LLM#Medical Reasoning#Benchmark#Metacognition#Benchmarks