Traitement de corpus

14/05/2019

Le patrimoine numérique national à l’heure de l’intelligence artificielle. Le programme de recherche Corpus comme espace d’expérimentation pour les humanités numériques

« Dans un contexte d’augmentation des volumétries des données et de réduction des temps de traitement, la Bibliothèque nationale de France est confrontée à plusieurs défis et évolutions. Afin de collecter, préserver, décrire et permettre l’étude d’ensembles de données massifs et hétérogènes, elle fait non seulement appel aux méthodes relevant des…

fléche suivante Lire l'article complet
04/03/2019

Exploitation de l’hétérogénéité dans les données textuelles. Utilisation de données produites à Madagascar

« Depuis plusieurs décennies, on observe une utilisation croissante des systèmes d’information, ce qui provoque une augmentation exponentielle des données textuelles. Bien que l’aspect volumétrique de ces données textuelles soit résolu, sa dimension hétérogène reste un défi pour la communauté scientifique. (…) »

fléche suivante Lire l'article complet
21/02/2019

Grand Débat National : Lancement d’un appel à Manifestation d’Intérêt pour l’analyse des données par la Recherche

« (…) L’initiative est organisée en deux temps. Les chercheurs/ses et consortium académiques sont invités à envoyer une lettre d’intention avant le 8 mars 2019 à l’A.N.R.

L’A.N.R. et le C.N.R.S. constitueront un comité d’organisation qui analysera et retiendra un ensemble d’intentions. Celles-ci seront présentées lors d’une journée de rencontre prévue…

fléche suivante Lire l'article complet
19/02/2019

Indexer les corpus numériques – 1er février 2019 – Mise en ligne des interventions

« La première séance du séminaire « Indexer les corpus numériques », organisée par Fabienne Vial-Bonacci (CNRS, IHRIM) et Emmanuelle Perrin (Université Jean Monnet, IHRIM) s’est tenue le 1er février 2019 à l’université Jean Monnet – Saint-Étienne.

Soutenue par le consortium Cahier et la MSH Lyon-Saint-Etienne, cette séance a réuni…

fléche suivante Lire l'article complet
22/11/2018

A Text Mining Pipeline Using Active and Deep Learning Aimed at Curating Information in Computational Neuroscience

« The curation of neuroscience entities is crucial to ongoing efforts in neuroinformatics and computational neuroscience, such as those being deployed in the context of continuing large-scale brain modelling projects. However, manually sifting through thousands of articles for new information about modelled entities is a painstaking and low-reward task. Text mining…

fléche suivante Lire l'article complet