Scoring par LLM : la recherche abdique-t-elle son jugement ?
Contenu de l'épisode
En deux ans, la part des papiers arXiv confiant l’évaluation de leurs résultats à un modèle a bondi de 25 % à plus de 40 %. Face au volume exponentiel des expériences, l’arbitrage algorithmique promet un passage à l’échelle providentiel, mais risque de transformer la validation scientifique en boîte noire autoréférentielle. La recherche est-elle en train de sacrifier la solidité de la preuve sur l’autel de la vitesse ?
#modeles #meta-evergreen #recherche #evaluation