« La plateforme OpenEdition Journals dispose désormais d’un nouvel outil destiné aux équipes éditoriales : Checklist. Issu d’un projet débuté en 2016, Checklist permet de vérifier les métadonnées et la structuration des contenus des numéros et de chaque document avant publication, permettant ainsi aux utilisateurs et utilisatrices de gagner en autonomie.…
« (…) This present paper deploys TDM in CRIS to analyze, quantify, and correct the unstructured data and its quality issues. Bad data leads to increased costs or wrong decisions. Ensuring high data quality is an essential requirement when creating a CRIS project. User acceptance in a CRIS depends, among other…
« Scholarly publishers can help to increase data quality and reproducible research by promoting transparency and openness. Increasing transparency can be achieved by publishers in six key areas: (1) understanding researchers’ problems and motivations, by conducting and responding to the findings of surveys; (2) raising awareness of issues and encouraging behavioural…
« We present a large-scale analysis of the accuracy of citation data in the Web of Science and Scopus databases. The analysis is based on citations given in publications in Elsevier journals. We reveal significant data quality problems for both databases. Missing and incorrect references are important problems in Web of…
« En février 2017, l’Abes annonçait via les listes de diffusion des réseaux Sudoc et Thèses que les établissements intéressés pouvaient demander des traitements automatiques sur les notices de thèses du Sudoc. Ce billet fait le point sur les modifications réalisées entre février et novembre, ce à l’initiative soit des établissements,…
(…) Ainsi, on voit apparaître régulièrement des statistiques montrant que les « data scientists » passent presque 80% de leur temps à sélectionner, nettoyer et préparer les données (cf. ces articles du New York Times de 2014 et de Forbes en 2016). Vous y réfléchissez à deux fois…
« … Cambridge University Press (CUP) announced today that it has adopted the OrgRef dataset to help clean and de-duplicate its customer data. OrgRef is a free and open dataset which has been created by DataSalon for the benefit of the scholarly publishing community.
OrgRef shares structured…
« La qualité des données est essentielle pour passer à la prochaine étape de maturité en gestion des connaissances, soit le Web sémantique, les bases de données orientées graphe et la visualisation.
Jido2015 02-21 from Diane Mercier«
« … A lire notamment dans ce dossier :
– Écosystème numérique, culture et emploi, Joël de Rosnay
- Mobilearn : la réalité augmentée au service de l’apprentissage informel, Anca Ailincai et Elhadi Djebarri
- Les désarrois de la Machine catalographique, Philippe Le Pape
- « Faire le lien », un besoin vital, Aline Le Provost
– ezPaarse…
« … This collaboration will accelerate the scholarly publishing process by easing the previously cumbersome task of accurately identifying the institutional affiliation of authors and reviewers. The integration of Identify will enable ScholarOne Manuscripts users to quickly disambiguate complex institutional data and ensure accuracy by seamlessly connecting to more than…