Un nouveau papier déposé sur arXiv remet en cause une hypothèse largement répandue dans l’IA appliquée : les progrès des grands modèles de langage (LLM) suffiraient à améliorer les décisions quantitatives à fort impact. Les auteurs citent des cas comme la tarification du risque, l’allocation de capital, le triage de patients ou encore la réponse à une intrusion réseau.

Leur argument central est que le langage n’est qu’une description du monde, et qu’une description reste une représentation incomplète des données quantitatives d’origine. Selon eux, cette perte d’information est irréversible : même un modèle plus puissant ne pourrait pas reconstruire ce qui n’a jamais été encodé dans le texte. Le problème tiendrait donc moins à la taille ou à la capacité du modèle qu’au substrat de représentation sur lequel il est entraîné.

Les auteurs identifient aussi plusieurs exigences propres aux domaines « conséquents » que le langage ne permettrait pas de satisfaire par construction. Ils mentionnent notamment la reproductibilité, la traçabilité entre chaque sortie du modèle et les enregistrements sources qui l’ont produite, ainsi qu’une incertitude calibrée. Ces propriétés seraient nécessaires lorsque les décisions ont des effets financiers, médicaux ou opérationnels importants.

Pour répondre à ces limites, l’article propose une classe distincte de systèmes baptisée Large Quantitative Model (LQM). À ce stade, il s’agit d’un cadre conceptuel présenté dans un preprint arXiv, et non d’un standard établi. Mais la thèse est claire : dans les usages où la précision, l’auditabilité et la fiabilité priment, l’avenir de l’IA ne passerait pas uniquement par des modèles centrés sur le langage, mais potentiellement par des architectures conçues d’emblée pour les données quantitatives.