Preprint
Jul 2026
Amortising Bayesian Experimental Design for Sequential Information Gathering in LLMs
Amortised Sequential Information Gathering (ASIG), a fine-tuning approach that amortises Bayesian Experimental Design into LLM policies via a multi-turn extension of Group Relative Policy Optimisation with an Expected Information Gain reward, is introduced.
Jakob Hartmann, James Harvey, Jhonathan Navott et al.
· 0 citations