« La seconde séance du séminaire « Indexer les corpus numériques », organisée par Fabienne Vial-Bonacci (CNRS, IHRIM) et Emmanuelle Perrin (Université Jean Monnet, IHRIM) s’est tenue le 29 mars 2019 à l’université Jean Monnet – Saint-Étienne. (…) »
« Depuis quelques années, le milieu de la recherche, des bibliothèques et des institutions culturelles porte une attention de plus en plus marquée à l’étude de corpus documentaires, à leur numérisation et à leur exploitation. Les projets de numérisation de corpus reposent sur l’établissement de partenariats, de collaborations ou de contacts…
« La Bibliothèque nationale de France a parmi ses objectifs de créer un nouveau service de fourniture de données à destination de la recherche. Ce service fait l’objet du programme de recherche Corpus, inscrit dans le plan quadriennal de la recherche 2016-2019 et porté par la Direction des services et des…
« Méthodes, outils et aspects normatifs
Plan
CADRE GÉNÉRAL
ÉLÉMENTS MÉTHODOLOGIQUES
ÉLÉMENTS TECHNIQUES (…) »
« Le groupe de travail Correspondance du consortium Cahier a publié un guide méthodologique pour l’édition numérique de correspondances.
L’objet du guide n’est pas de présenter ou d’analyser des outils ou des langages. Il rassemble des recommandations qui veulent répondre aux problématiques spécifiques d’un projet éditorial et numérique…
« The Spoken Wikipedia project unites volunteer readers of Wikipedia articles. Hundreds of spoken articles in multiple languages are available to users who are – for one reason or another – unable or unwilling to consume the written version of the article. We turn this speech resource into a time-aligned corpus,…
« We are happy to announce that the OpenMinTeD platform for text and data mining is now ready to accept content. We invite publishers, repositories, libraries and other holders of scholarly publications to join the open call for content, by submitting a proposal by 29 October 2017 at the latest. (…) »
« Language experts at Lancaster University and Cambridge University Press have (…) published the largest ever public collection of transcribed British conversations, totalling 11.5 million words of spontaneous British English collected between 2012 and 2016.
The study has revealed that use of the word ‘like’ at the beginning of sentences has…
« L’Unesco vient d’inscrire une quarantaine de corpus documentaire au Registre Mémoire du Monde dont les archives scientifiques de Louis Pasteur. (…) »
« Dans le cadre du projet d’investissement d’avenir Istex, un nouveau corpus a été acquis.
Un nouveau corpus vient enrichir l’ensemble des ressources acquises en licence nationale.
La licence signée avec l’éditeur anglais Emerald est constituée de 362 revues, principalement en commerce,…