Traitement de corpus

Comment mobiliser des approches de fouille de textes et d’extraction de la terminologie dans un contexte pluridisciplinaire ?
28/09/2021

Comment mobiliser des approches de fouille de textes et d’extraction de la terminologie dans un contexte pluridisciplinaire ?

« L’analyse des masses de données nécessite l’utilisation de méthodes mêlant harmonieusement différentes disciplines comme l’informatique, les mathématiques, les statistiques. L’ensemble de ces méthodes utiles pour traiter de telles données forme le socle de la « science des données ». Dans ce cadre, les approches de fouille de textes permettent de découvrir des…

fléche suivante Lire l'article complet
Journées MASA – Partager les archives et les données archéologiques, MASA au service de la communauté – 21-22 septembre 2021
17/08/2021

Journées MASA – Partager les archives et les données archéologiques, MASA au service de la communauté – 21-22 septembre 2021

« Cette rencontre, organisée par consortium le MASA, permettra de présenter l’écosystème numérique et la palette d’outils qui le compose, ainsi qu’une offre de formation aux bonnes pratiques à travers les principaux outils. L’objectif de cette rencontre est de diffuser largement les pratiques et les outils pour la mise à disposition…

fléche suivante Lire l'article complet
ITEXT-BIO: Intelligent Term EXTraction for BIOmedical analysis
19/07/2021

ITEXT-BIO: Intelligent Term EXTraction for BIOmedical analysis

« Here, we introduce ITEXT-BIO, an intelligent process for biomedical domain terminology extraction from textual documents and subsequent analysis. The proposed methodology consists of two complementary approaches, including free and driven term extraction. The first is based on term extraction with statistical measures, while the second considers morphosyntactic variation rules to…

fléche suivante Lire l'article complet
BnF DataLab : appel à projets 2021
10/06/2021

BnF DataLab : appel à projets 2021

« Le BnF DataLab
Depuis une vingtaine d’années, la BnF conduit une politique en matière de numérisation de masse, d’ouverture des licences sur les métadonnées, de mise en place d’outils de consultation, d’analyse et d’extraction, d’accueil et d’accompagnement d’équipes de recherche expérimentant des traitements de corpus et données numériques (archives…

fléche suivante Lire l'article complet