← Search

Jonathan Larson

3 accepted papers

2023

Evaluating Cognitive Maps and Planning in Large Language Models with CogEval

NeurIPS 2023poster

Recently an influx of studies claims emergent cognitive abilities in large language models (LLMs). Yet, most rely on anecdotes, overlook contamination of training sets, or lack systematic Evaluation involving multiple tasks, control conditions, multiple iterations, and statistical robustness tests.…

Cited by 64SourcePDFScholar