Grands modèles de langue et infrastructures de recherche en SHS

  • Recherche
Publié le 22 septembre 2026 Mis à jour le 22 septembre 2026
Date(s)

du 14 octobre 2026 au 15 octobre 2026

du mercredi 14 h au jeudi 17 h 30
Lieu(x)

Campus Saint Jean d'Angely

Salle de conférence 031, MSHS Sud-Est

Conférence organisée par le consortium CORLI, en partenariat avec CLARIN et Huma-Num

Résumé

Les grands modèles linguistiques (LLM) et les outils d’intelligence artificielle qui s’appuient sur eux transforment en profondeur les pratiques de recherche en sciences humaines et sociales. En linguistique, ces modèles constituent le dernier maillon d’une longue tradition d’outils informatiques : des concordanciers des années 1970, qui facilitaient l’exploration des corpus tout en laissant l’interprétation au chercheur, aux méthodes textométriques qui ont permis de caractériser et de positionner les textes dans des espaces mathématiques, en passant par les représentations distributionnelles intégrant des dimensions sémantiques. Chaque étape a redéfini la frontière entre ce que la machine traite et ce qui relève de l’interprétation humaine.

Ces modèles offrent des capacités sans précédent pour l’exploration, l’annotation et l’analyse de corpus à grande échelle, mais leur utilisation intensive et mal contrôlée pose des risques méthodologiques majeurs : opacité du traitement, biais reproduits ou amplifiés, illusion d’objectivité et difficulté à distinguer les données de la génération. Au-delà des questions de méthode, ces transformations soulèvent des défis en matière d’infrastructure : accès aux modèles et aux ressources informatiques, souveraineté sur les données de recherche, reproductibilité des résultats et formation des communautés de recherche.

Programme

Inscription gratuite mais obligatoire avant le 5 octobre 2026


 / 1