This is a very simplified version of Benchmarking Large Language Models in Retrieval-Augmented Generation by Chen et al 2023