« Frantext intégral 22.4 »

En date du 20/12/2022, le corpus Frantext intégral 22.4 comportait 5 597 textes de la période 950-2022. 345 284 035 éléments ont été indexés par le moteur Allegro 1.4.1.2 build 6709, soit 309 016 144 tokens (266 576 342 mots + 42 439 802 ponctuations) et 36 267 891 balises XML-TEI. Le corpus Frantext intégral 22.4 disposait également d'un ensemble de données prédéfinis : 9 corpus, 3 liste(s) de mots, 1 grammaire(s), 3 lexique(s) et 3 type(s) de données.

Nombre de textes et de tokens (mots + ponctuations)