CERCLES : lancement d’un nouveau chantier sur le corpus Arte Vidéo Campus par le SCDI de Montpellier

  • Auteur/autrice de la publication :
  • Post category:Sudoc

logo du dispositif CERCLES

En 2015, naissait le dispositif CERCLES (voir le billet) mis en place par l’Abes pour accompagner, aider et valoriser un établissement souhaitant s’investir sur l’enrichissement des données d’un corpus de documents spécifique.

En 2024, un nouveau corpus de ressources électroniques va bénéficier de ce dispositif : Arte Vidéo Campus.

Le corpus Arte Vidéo Campus

Guide d'utilisation du service Arte CampusEn décembre 2023, l’Abes informait le réseau Sudoc qu’un nouvel import réguliers de notices bibliographiques était mis en place : l’import des notices de vidéos en streaming de la plateforme de diffusion Arte Campus.
Arte Campus est la ressource pédagogique en ligne de la chaîne ARTE pour l’enseignement supérieur et la formation des adultes.
Le corpus se compose de 2.000 vidéos environ (en janvier 2024), disponibles et transcrites en 5 langues, qui prennent la forme de long-métrages documentaires, de magazines documentaires, de courts-métrages de fiction, de captations de pièces de théâtre, de ballets et d’opéras. Les domaines représentés sont les arts, la littérature, les langues, les sciences sociales, les sciences économiques et politiques la technologie et la santé.
Les services associés permettent aux établissements abonnés de visionner, télécharger, découper les vidéos, de rechercher dans les scripts.

L’investissement du SCDI de Montpellier

Le Service de Coopération Documentaire Interuniversitaire de Montpellier fut le partenaire de l’Abes pour concevoir cet import de notices, qui suppose une transformation préalable des métadonnées de JSON en UNIMARC, et c’est lui qui en assure les premières étapes (voir le billet).
Cet investissement est désormais reconnu et formalisé par un chantier CERCLES.

  • Corpus : 2 390 notices de vidéos en streaming, identifiée dans le Sudoc comme « notices de ressources électroniques (Oa) »
  • Période de travail : à partir du 1er janvier 2024
  • Responsable du chantier : Régis Griesser, coordinateur Sudoc
  • Référent Abes : Élodie Molières
  • Axes d’enrichissements :
    • récupération des métadonnées fournies par la plateforme
    • transformation des métadonnées en UNIMARC
    • création des notices UNIMARC
    • avertissement en cas de suppression de titres communiquée par l’éditeur

Les « + » du chantier :

  • une réponse aux besoins exprimés par le réseau (après enquête, de nombreux établissements avaient souhaité que ce corpus soit importé dans le Sudoc)
  • un travail en binôme, avec l’Abes
  • la maîtrise technique des conversions de données de Régis Griesser, le coordinateur Sudoc

Au nom du réseau, l’Abes remercie le SCDI de Montpellier pour son investissement dans ce nouveau chantier CERCLES  !

Consulter le document du suivi pour suivre la progression du travail

Continuer la lectureCERCLES : lancement d’un nouveau chantier sur le corpus Arte Vidéo Campus par le SCDI de Montpellier

Bilan du chantier Qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet3

  • Auteur/autrice de la publication :
  • Post category:IdRefSudoc

Troisième d’une série de 3 billets dressant le bilan du chantier de traitement des notices d’autorité Personnes physiques en statut 1  (dites notices Tp1), ce billet  présente  la dernière phase du chantier, menée de novembre 2022 au 21 mars 2024, avec le concours de collègues volontaires.

Le billet n°1 décrit la finalité et l’ampleur du chantier. Le billet n°2 décrit les opérations menées de janvier 2022 à octobre 2022, dont la sollicitation des correspondants autorité au printemps 2022 (étape qui a fait l’objet d’un billet Punktokomo ad hoc publié le 29 mars 2022).

Le chantier a été mené en quatre étapes en croisant différentes méthodologies. Ce billet détaille la méthodologie, strictement manuelle, utilisée de novembre 2022 à mars 2024 dans la joie et la bonne humeur, par un groupe de volontaires. Toutes les méthodes pour regrouper des cas similaires et les traiter en masse ayant été utilisées au préalable, il s’agissait désormais de traiter à la main, une par une, les 15 806 notices Tp1 restantes.

Novembre 2022 – mars 2024 : traitement manuel par des volontaires

Fin octobre 2022, l’Abes a envoyé une bouteille à la mer sur ses listes de diffusion : qui accepterait  du travail en plus était invité à se faire connaitre pour venir en renfort des 4 personnes du service Autorités & Référentiels déjà impliquées dans ce chantier.

Nombre de volontaires

Dès le lancement de l’appel au volontariat, le chantier a eu du succès : 42 personnes provenant de 38 établissements distincts ont répondu présents fin octobre 2022. En définitive, pendant les 17 mois qu’aura duré cette phase, plus de 70 personnes provenant de plus de 40 établissements auront été volontaires.

Répartition du travail

L’Abes a établi des paquets de 100 notices à distribuer aux volontaires et tenait à la disposition de ceux qui avaient épuisé leur liste, un nouveau lot si c’était souhaité. Les volontaires étaient également libres de renoncer et de rendre leur liste inachevée à l’Abes.

Rythme d’avancée du chantier

Chaque volontaire a reçu une liste de 100 notices Tp1. Dans la plupart des cas, cette liste était destinée à une seule personne qui l’a traitée de A à Z. Mais certains établissements ont choisi de tronçonner cette liste pour faire des paquets plus petits donnés à un groupe de catalogueurs. Aucun délai n’était imposé pour traiter cette liste. Plusieurs collègues ont ainsi pris 8 ou 9 listes (alors que d’autres, notamment à l’Abes, ont mis 17 mois à finir leur unique liste !). Peu importe, l’essentiel était d’en faire un peu, beaucoup, ou à la folie, le but étant de les traiter toutes.

Des temps d’échange collectifs

Même si assez peu d’échanges ont transité par cette voie, une liste de diffusion comportant l’ensemble des volontaires a été mise en place pour l’occasion.
Pour rendre la démarche conviviale, l’Abes a proposé régulièrement des « cafés Tp1 », temps d’échange collectifs, facultatifs, volontairement informels,  organisés en visio pendant la pause-café de 13h30 à 14h. Ainsi, sur la durée de ce chantier, une dizaine de « cafés Tp1 » ont été organisé au cours desquels, en moyenne, 14 volontaires se sont retrouvées, sans compter les participants Abes. Certains étaient très assidus, certains ne sont jamais venus. De fait, il n’y avait pas de corrélation entre la participation aux cafés et le rythme de traitement des listes.

Chaque café a donné lieu à la présentation par l’Abes d’un court diaporama qui donnait à voir l’avancée statistique du chantier. La discussion s’engageait ensuite sur des sujets variés en rapport avec le chantier, comme par exemple : comment traiter des homonymes ? quels usages de Paprika ? e…

Au fil des cafés, nous avons fêté ensemble les marronniers de l’année.

Les affiches des « cafés Tp1 »

Un poster aux Journées Abes 2023

Au printemps 2023, nous avons proposé aux volontaires de présenter un poster lors des Journées Abes 2023, défi relevé par les collègues de l’Université Paris Cité qui, cerise sur le gâteau, ont remporté le prix du meilleur poster !

Nous avons aussi profité du cocktail des Journées Abes pour faire une photo avec les volontaires présents.

Le tout dans une ambiance conviviale

Le traitement des Tp1 peut parfois s’apparenter à une mini-enquête : ce François Martin est-il le même que cet autre François Martin ? A moins qu’il ne s’agisse de Martin François ?! On déniche aussi des perles : « Médecin spécialiste en médecine générale » ou bien « né en 1883 et ayant soutenu une thèse en 1892 » ou des aptonymes : « nom de famille d’une personne qui est étroitement lié à son métier ou à ses occupations », selon la définition donnée par le Grand dictionnaire terminologique de l’Office québécois de la langue française.
Pour accompagner ce chantier, nous avons proposé à chacun de partager nos sourires, voire nos fou-rires, dans un fichier collaboratif commun ; nous avons également conçu ensemble la « playlist des identités » pour travailler en musique : c’est fou le nombre de chansons en rapport avec les Tp1 !

Enfin, lors du dernier café Tp1, en direct pendant la visioconférence, nous avons transformé les 3 dernières notices d’autorité Tp1 qui subsistaient. Le chantier était terminé !

En conclusion

L’Abes remercie très chaleureusement l’ensemble des participants à ce chantier, que ce soit les Correspondants Autorités sollicités au printemps 2022 ou les collègues qui ont répondu à l’appel à volontariat entre novembre 2022 et mars 2024.
La première satisfaction est bien sûr d’avoir atteint l’objectif fixé : en finir avec des notices d’autorité tellement pauvres qu’elles ne pouvaient « faire autorité ». En améliorant la qualité intrinsèque de dizaines de milliers de notices de Personnes physiques,  c’est l’ensemble des liens aux ressources bibliographiques qui ont été fiabilisés.
La seconde satisfaction, encore plus précieuse car moins anticipée, est d’avoir, très concrètement et pendant plusieurs mois, perçu ce que veut dire « faire réseau ». Plus qu’un principe, le catalogage partagé est une réalité très puissante.

Merci à tous !

Continuer la lectureBilan du chantier Qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet3

Bilan du chantier qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet2 

  • Auteur/autrice de la publication :
  • Post category:IdRefSudoc

Second d’une série de 3 billets dressant le bilan du chantier lancé début 2022 et terminé le 21 mars 2024 pour traiter des notices d’autorité Personnes physiques en statut 1  (dites notices Tp1), ce billet  décrit les opérations menées entre janvier 2022 et octobre 2022, dont la sollicitation des Correspondants Autorités au printemps 2022 (étape ayant fait l’objet d’un billet Punktokomo publié le 29 mars 2022).

Le billet n°1 décrit la finalité et l’ampleur du chantier et le billet n°3 présente la dernière phase du chantier, menée de novembre 2022 à mars 2024, avec le concours de collègues volontaires. 

Le chantier a été mené en quatre étapes en croisant différentes méthodologies. Ce billet détaille les opérations menées de janvier à octobre 2022. 

 Janvier – février 2022 : correction automatique de ce qui était automatisable

Début 2022, 11 295 notices d’autorité Tp1 avaient pour double caractéristique : 

  • de n’être liées qu’à une seule notice bibliographique 
  • le fait que l’Abes soit le dernier modificateur

Ces notices ont été isolées dans un projet OpenRefine. Après analyse humaine et multiples sondages pour vérifier que ce lot était homogène et pouvait faire l’objet d’un traitement en masse, l’Abes a décidé d’enrichir ces notices d’une zone A810 construite grâce à la notice bibliographique liée et de basculer le statut de 1 à 5.

Mars 2022 – août 2022 : travail manuel par ciblage vers des établissements précis

Parmi les 24 000 notices d’autorité Tp1 restant à l’issue de ces corrections, l’Abes a isolé environ 4 800 notices ayant un établissement du réseau Sudoc comme dernier modificateur. Un fichier a été généré puis partagé, enrichi de cette information, afin de ventiler le poids du chantier sur pdavantage d’acteurs. 134 Correspondants Autorités ont alors été sollicités pour prendre en charge les lignes les concernant. Pour accompagner les Correspondants Autorités dans ce chantier Qualité :

Ouvert fin mars, il était prévu que le chantier se termine fin juin 2022, ce qui a été le cas pour 70% des 134 établissements, effectivement intervenus dans les temps. Suite à un rappel fait fin juin sur les listes de diffusion puis de manière personnalisée auprès de 48 établissements, un nouveau pointage réalisé mi-aout montraient que seuls 16 établissements n’avaient pas encore corrigé les notices qui leur incombaient.  Sollicités individuellement, la plupart des retardataires ont corrigé les notices avant la fin août 2022.

Septembre 2022 – octobre 2022 : constitution de lots homogènes pour correction en masse

Début septembre, il restait 18 780 notices Tp1 encore présentes dans la base. Quatre personnes du service Autorités & Référentiels de l’Abes se sont attelées à la tâche. Après analyse, deux lots homogènes ont été constitués qui ont pu être traités en masse.

Pour ce faire, l’outil Bibliostratus  a été utilisé pour rapprocher les notices bibliographiques liées aux notices d’autorité Tp1 et les notices bibliographiques BnF identiques liées à une autorité BnF. Quand les données BnF étaient plus riches, les notices d’autorité BnF ont été dérivées puis fusionnées avec les notices Tp1. 1 965 notices d’autorité Tp1 ont ainsi été basculées en statut 5. 

Parmi les notices Tp1 restantes, les notices les plus riches ont été isolées, notamment du fait qu’elles contenaient des zones de notes (A300 ou A340). 749 notices d’autorité Tp1 ont ainsi été basculées en statut 5. 

Une fois ces travaux réalisés, nous avons conclu qu’il n’était plus possible de constituer des lots homogènes : l’analyse aurait pris plus de temps qu’un traitement à l’unité. L’équipe a donc décidé de faire appel aux bonnes volontés. 

La suite du chantier est détaillée dans le billet n°3. 

 

Continuer la lectureBilan du chantier qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet2 

Signalement des ressources électroniques entre contraintes techniques et ambition politique : la solution développée par l’UPEC pour les livres électroniques

  • Auteur/autrice de la publication :
  • Post category:baconSudoc

logo UPECLa volumétrie des ressources électroniques (plus de 300 000 documents pour une université moyenne comme l’Université Paris-Est Créteil – UPEC) interdit l’idée même d’un signalement manuel. La nécessité d’un suivi régulier – tant pour des raisons éditoriales (parution ou suppression de titres) que commerciales (ventes de bouquets d’un éditeur à l’autre) ou techniques (changement de plateforme, de système d’authentification) – renforce encore la nécessité de se fonder sur l’import de métadonnées préexistantes. Malheureusement, si les fournisseurs de données abondent, aucun ne peut garantir l’exhaustivité ni la fiabilité en termes de délai de signalement/désignalement.

Il s’avère alors impossible d’automatiser la comparaison de fichiers ou d’en prendre un comme référence et de le compléter, d’autant que certaines données fondamentales ne sont pas toujours disponibles.

Ce billet vise à présenter la solution développée par l’UPEC pour répondre au besoin de signalement des livres électroniques, avec 0,7 ETP.

L’environnement documentaire

La zone communautaire d’ExLibris

Disposant du logiciel Alma de la société Ex Libris, nous avons accès à une zone communautaire (ZC) dans laquelle sont proposés des bouquets.

La capture d’écran ci-dessous laisse entrevoir un monde idéal. Le bouquet proposé stipule qu’il est fondé sur BACON, BAse de COnnaissance Nationale de métadonnées pour le signalement des ressources électroniques gérée par l’Abes.

extrait de la présentation du bouquet dans l'application BACON

La réalité est un peu moins satisfaisante. Le bouquet comprend 2006 portfolios (titres) alors que son équivalent dans BACON en contient 2022. Bien que ces 16 titres d’écart représentent moins de 0, 3 % du contenu du bouquet, ils sont loin d’être négligeables, car ce sont probablement des nouveautés, que nous sommes désireux de signaler aussi vite que possible à nos usagers.
L’autre point à noter est l’indicateur de qualité des notices du bouquet , attribué par Ex Libris à partir de la présence de certaines métadonnées, dont celles liées à l’indexation (plus d’informations à ce sujet dans le document de l’université de Liège). Le bouquet ci-dessous doit donc être pensé comme contenant 68% de notices de qualité moyenne ou faible.

copie écran indicateur Qualité d'Ex Libris
nb : la première mention ”moyen” doit être comprise comme moyenne.

L’interface client du prestataire

Pour répondre à ce besoin de signalement, certains prestataires de ressources électroniques fournissent au choix :

  • des fichiers des titres sous forme d’une liste globale ou de listes séparées pour chaque bouquet commercial
  • un serveur OAI-PMH pour signaler dynamiquement les notices correspondantes à nos achats ou abonnements
  • des fichiers de notices (par exemple Cyberlibris) à télécharger et à importer dans son SIGB

Indépendamment de la qualité, c’est la diversité des formats et des modes de signalement qui condamne, cette fois, l’idée même de s’appuyer sur eux pour automatiser la mise à jour de notre base.

Les services de l’Abes

  1.  BACON propose des métadonnées de ressources électroniques labellisées, fournies sous forme de fichiers KBart (les masterlists des éditeurs étant découpées en autant de fichiers que de bouquets commerciaux). Pour plus d’informations
  2. Le Sudoc, catalogue collectif des bibliothèques de l’Enseignement Supérieur, contient des notices de ressources électroniques. Certaines d’entre-elles précisent le bouquet commercial auxquelles elles appartiennent (via une zone 035 $9). S’il est possible d’interroger la base professionnelle du Sudoc pour les repérer, les établissements membres du réseau le font plutôt à partir de la documentation dédiée aux imports de notices, puis ont recours aux webservices pour télécharger automatiquement un bouquet (ou, à l’inverse, les notices supprimées).
  3. Les chantiers CERCLES : n’étant pas un réservoir de notices, la mention de ces chantiers ici peut surprendre. Cependant, il importe de noter qu’à la logique de chantier ponctuel initial s’est substitué peu à peu un engagement sur un corpus donné. Les établissements deviennent de ce fait co-responsables de la complétude du signalement dans le Sudoc et éventuellement de la mise à jour des fichiers KBart. Nous ne saurions trop souligner l’importance et l’intérêt de ce dispositif. L’engagement d’un établissement correspond bien à la garantie d’un catalogage satisfaisant et le plus rapide possible.

À titre d’exemple, l’UPEC a pris la responsabilité du signalement de deux bouquets de l’éditeur Elsevier-Masson dans le domaine des sciences médicales et est en relation avec ce dernier pour obtenir la constitution de fichiers KBart adaptés.

L’environnement informatique

L’import des notices dans notre catalogue est bien évidemment proportionnel au fait; d’une part, de pouvoir signaler ces documents dans le Sudoc et, d’autre part, de récupérer les notices complètes. L’exemplarisation peut se faire à l’aide d’ITEM tandis que la récupération des notices est réalisée via les transferts réguliers. L’UPEC utilise avec bonheur le circuit de synchronisation des ressources électroniques mis en place par l’Abes et les universités de Bordeaux et de Toulouse qui consiste à publier celles de nos ressources électroniques pourvues d’un PPN dans un entrepôt OAI. Ce dernier est moissonné par l’Abes qui procède à la création d’un exemplaire dans le Sudoc [Guide méthodologique] et à l’envoi de la notice correspondante.

Nos objectifs et notre fonctionnement

Les motivations à la base de notre travail sont de deux types :

  • Un service aux usagers qui vise à :
    • signaler le plus tôt possible les ressources proposées par un éditeur quitte à avoir des notices minimalistes dans un premier temps
    • proposer des ressources de qualité, c’est à dire susceptibles de donner à l’usager les critères de choix qui lui sont proposés dans notre catalogue (année d’édition, langue, mots-clés).
  • Une démarche engagée qui souhaite :
    • placer le Sudoc au centre de nos fournisseurs de données
    • valoriser le travail collaboratif de l’ESR et particulièrement de CERCLES.

Le processus en œuvre à l’UPEC

Rappel : le traitement décrit ci-dessous est valide pour les livres électroniques francophones. Il est donc parallèle à l’import depuis la CZ des ouvrages anglophones.

La première base retenue pour l’import de notices francophones est BACON.copie écran BACON

La capture d’écran ci-contre montre la fréquence d’actualisation de la bibliothèque Dalloz. Celle-ci est certes une des plus régulièrement mise à jour, mais elle montre bien la réactivité vers laquelle nous devons tendre. Si ces fichiers sont de loin les plus à jour, leur format et leur contenu ne sont pas totalement adaptés à un import dans notre SIGB :

  • Les formats tout d’abord : un fichier texte (.txt) encodé en en UTF-8 contenant de nombreuses colonnes dédiées aux publications en série (et donc à supprimer dans notre cas) est en revanche relativement pauvre.
  • Les données que nous conservons sont néanmoins suffisantes pour une notice de base. Elles comprennent :
    • un titre
    • l’ISBN de l’édition imprimée (nous gardons celui-ci pour faciliter la comparaison des éditions) et celui de l’édition en ligne
    • l’URL du document
    • le nom du premier auteur
    • l’identifiant de la publication chez l’éditeur (que nous conservons systématiquement à des fins éventuelles de dédoublonnage en la faisant précéder de (Editeur_ID)
    • l’éditeur
    • la date de publication au format électronique.

La dernière colonne de ce fichier est le « best PPN » soit le résultat d’un algorithme qui détermine le n° PPN correspondant à ce titre. Les premiers essais réalisés avec celui-ci ne s’étaient pas révélés concluants ; nous avons donc choisi de ne pas l’utiliser. Il semble cependant que la qualité de ce « best PPN » progresse.

Étape 1 : complétude du fichier

À partir de ce seul fichier :

  • nous renommons les colonnes avec les en-têtes adaptés pour Alma
  • nous ajoutons un Leader
  • nous faisons précéder l’ISBN imprimé de la mention (ISBN-imprimé)
  • nous ajoutons une donnée locale BE pour Book electronic (pratique pour l’analyse statistique des collections).

Étape 2 : enrichissement des notices

À partir d’imports dans le Sudoc, un apport d’information enrichit les notices.

copie d'écran du manuel "Imports dans le Sudoc"

Le fichier obtenu est au format .xls. Il contient trois valeurs que nous souhaitons importer dans le fichier construit à partir de BACON : la langue, le pays d’édition et surtout le PPN.
La comparaison se fait sur l’URL, zone pour laquelle nous avons la plus haute probabilité d’obtenir une comparaison fiable.
Le fichier ainsi obtenu comprend donc les valeurs suivantes :

  • Leader
  • e-isbn
  • (isbn-imprimé)
  • (Editeur_ID)
  • langue du document
  • pays d’édition
  • titre
  • éditeur
  • année d’édition
  • auteur (suite de caractères alphabétiques sans lien)
  • URL de la ressource
  • PPN (s’il existe).

Étape 3 : import dans le SGB

Il suffit alors d’importer ce fichier dans Alma pour créer une notice bibliographique minimale ainsi qu’un portfolio, ce dernier correspondant plus ou moins à l’exemplaire d’une ressource électronique. Il recense diverses informations de liens (et notamment l’url d’accès construite sur le 856$u) et de disponibilité, peut être lié à une ligne de commande et surtout à une collection et une interface. Chaque fichier que nous importons est donc lié dans les paramètres d’import à une collection précise.
Grâce à la synchronisation décrite ci-dessus, toute nouvelle notice comprenant un PPN est publiée dans notre entrepôt OAI, moissonnée par le Sudoc qui crée un exemplaire et nous fournit par les Transferts réguliers, la notice complète.

Nos objectifs sont donc atteints : signalement minimal dès parution du fichier BACON et notice de qualité Sudoc dès que disponible.

L’automatisation du processus

L’ensemble des opérations décrites ci-dessus est chronophage et nécessite suffisamment de concentration pour ne pouvoir être réalisée « à la chaîne ». C’est alors qu’intervient la magie informatique. Toutes ces tâches peuvent être automatisées dans une macro Excel : ci-joint la macro initiale qui œuvre sur deux fichiers BACON.txt et Abes.xls enregistrés sur le bureau (le chemin des fichiers est à adapter à votre poste).

⇒ Télécharger la macro.

Le circuit complet de signalement des ressources électroniques
Le circuit complet de signalement des ressources électroniques

 

L’automatisation de cette tâche augmente de fait la fréquence à laquelle nous pouvons la faire, et c’est ainsi qu’avec son 0.7 ETP l’UPEC réussit à proposer un catalogue à jour, tout en participant aux chantiers CERCLES.

Conclusion

Pour conclure, le process décrit est bien évidemment réplicable à volonté par toute bibliothèque intéressée. Il peut cependant être largement optimisé. Bien plus que l’aspect technique somme toute secondaire, nous souhaitons mettre en avant dan ce billet l’importance et la qualité du dispositif CERCLES. C’est la garantie de la complétude de signalement qui rend l’automatisation intéressante.

Par ailleurs, nous suggérons quelques pistes d’évolution qui pourraient être utiles à ce process  :

  • proposer que les référents CERCLES prennent en charge l’ajout du PPN dans les fichiers KBart. Du fait qu’ils créent la notice Sudoc, ils sont les plus à même d’assurer la correspondance entre un titre et un PPN
  • faciliter l‘information sur l’évolution des signalements par une communication plus régulière. Celle-ci pourrait par exemple prendre la forme d’un abonnement RSS ou Atom
  • disposer d’un import fondé sur un critère “date de création de la notice”.

Nous espérons voir un maximum d’établissement rejoindre  le dispositif CERCLES et prendre en charge le suivi d’un ou plusieurs corpus.
Ainsi en combinant tous ensemble les quatre O (BacOn, ImpOrt, l’entrepôt Oai et le SudOc) qui gravitent autour de notre planète Alma respective, nous pourrons viser un objectif en or.

Jean Bouyssou, responsable du pôle Données
Service Commun de la Documentation de l’Université Paris-Est Créteil Val de Marne

 

Télécharger la macro

Continuer la lectureSignalement des ressources électroniques entre contraintes techniques et ambition politique : la solution développée par l’UPEC pour les livres électroniques

Bilan du chantier Qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet1 

  • Auteur/autrice de la publication :
  • Post category:IdRefSudoc

Premier d’une série de 3 billets dressant le bilan du chantier lancé début 2022 et terminé le 21 mars 2024 pour traiter des notices d’autorité Personnes physiques en statut 1 (dites notices Tp1), ce billet décrit la finalité et l’ampleur du chantier. Le billet n°2 décrit les opérations menées de janvier 2022 à octobre 2022, dont la participation des Correspondants Autorités au printemps 2022 (étape ayant fait l’objet d’un billet Punktokomo publié le 29 mars 2022). Le billet n°3  décrit la dernière phase du chantier, menée de novembre 2022 au 21 mars 2024, avec le concours de collègues volontaires. 

 17 mois, 4 phases de travail aux méthodologies distinctes, 150 catalogueurs de plusieurs dizaines d’établissements, beaucoup de café et de gâteaux, de la musique, de la convivialité auront été nécessaires pour améliorer la qualité de 35 000 notices d’autorité Personnes physiques et de leurs liens bibliographiques dans le Sudoc. 

Les mascottes du chantier Tp1
Mascottes du chantier Tp1

C’était quoi les notices Tp1 ? 

Le statut 1, précisé dans la zone A008, une zone UNIMARC spécifique au Sudoc, permet de distinguer des notices d’autorité Personnes physiques (Tp) particulièrement pauvres des autres. Le chantier visait à la disparition de ces notices au profit de notices enrichies et fiabilisées, basculées en statut 5 pour acter ces améliorations. 

Pourquoi des notices en statut 1 ?  

Ces notices provenaient du chargement initial, au début des années 2000, des données du catalogue de la BnF vers la base des autorités Sudoc.  Réduites à un simple point d’accès, ces notices d’autorité avaient été chargées avec un statut particulier indiquant leur faible complétude.  

Quels problèmes posaient ces notices d’autorité ? 

Les catalogueurs Sudoc pouvaient utiliser ces notices mais avaient pour consigne de les améliorer pour les basculer en statut 5. Plusieurs cas de figure étaient à distinguer :

  • Dans certains cas, les améliorations avaient été réalisées mais les catalogueurs avaient cependant oublié de modifier le statut. 
  • Dans d’autres cas, les notices n’avaient pas été retouchées et restaient très pauvres. Faute d’élément discriminant, les catalogueurs les avaient laissées en l’état, créant parfois d’autres notices en statut Tp5 qui se sont révélées être des doublons de notices Tp1. 
  • Dans d’autres cas encore, ces notices pauvres avaient tout de même été utilisées à des fins de liage. Ainsi, une notice d’autorité pauvre pouvait être dotée d’une douzaine de liens bibliographiques correspondants à plusieurs personnes « dans la vraie vie ». 

A partir de 2017,  quand l’Abes a commencé à développer et utiliser massivement des programmes d’alignement automatisés, ces notices Tp1 « attrape-tout » ont posé problème, notamment du fait qu’elles induisaient les programmes en erreur. 

L’ampleur du chantier 

Si, au milieu des années 2010, on décomptait jusqu’à 100 000 notices d’autorité en statut Tp1, dès 2017, l’Abes a cherché à en réduire le nombre. Début 2022, il restait environ 35 000 notices TP1 à traiter, il a donc été décidé de régler définitivement cette question par le lancement de ce chantier Qualité.

Dix-sept mois auront été nécessaires. Les billets n°2 et n°3 détaillent les méthodologies employées. 

Phases et rythme du chantier Tp1

Continuer la lectureBilan du chantier Qualité autour des notices d’autorité Personnes physiques de statut 1 - #billet1 

À la recherche des unicas de la bibliothèque Sainte-Geneviève

En janvier 2022, la bibliothèque Sainte-Geneviève a débuté un projet pluriannuel (2022-2024) de refonte de ses outils de politique documentaire, par la mise à jour du plan de développement des collections et de la charte documentaire.

Dans ce cadre, une analyse quantitative et qualitative de ses collections a été lancée, afin d’identifier et de caractériser plus finement ses pôles d’excellence et ses gisements documentaires rares et remarquables.

Ce billet retrace la méthodologie employée pour une des étapes de cette analyse qui consiste en la catégorisation thématique de l’ensemble des unicas. Pour mémoire, les unicas sont, dans le contexte du Sudoc, des notices bibliographiques sous lesquelles un seul établissement du réseau est localisé. 

L’équipe actuelle en charge de ces opérations se compose de trois personnes, dont deux catalogueuses, pour un total d’environ 30 heures de travail hebdomadaire. Ce chantier est réalisé avec l’appui de la monitrice étudiante et des magasiniers du département des Services aux publics pour les vérifications en magasin.
– Chef de projet “unica” : Emilie Trompille
– Chef de projet du plan de développement des collections : Timothée Rony
– Expertes catalogueuses : Marie Barbier, Clara Dauber
– Soutien informatique : Clément Croquet, Pauline Rivière et le service informatique de la bibliothèque.

Continuer la lectureÀ la recherche des unicas de la bibliothèque Sainte-Geneviève

CERCLES : lancement d’un nouveau chantier sur le corpus Lextenso par la BU Angers

  • Auteur/autrice de la publication :
  • Post category:Sudoc

Illustration crayons de couleurEn 2015, naissait le dispositif CERCLES (voir le billet) mis en place par l’Abes pour accompagner, aider et valoriser un établissement souhaitant s’investir sur l’enrichissement des données d’un corpus de documents spécifique.

En 2024, un nouveau corpus de ressources électroniques va bénéficier de ce dispositif : Lextenso.

Le corpus Lextenso

Proposant des ressources numériques (revues et  ebooks) de doctrine, de jurisprudence et de codes, la base Lextenso constitue un corpus utile et apprécié des usagers des bibliothèques en sciences juridiques et économiques. Les domaines couverts sont ceux du droit français (public et privé) mais aussi du droit international, de la fiscalité et des finances publiques. Parmi les ressources, on trouve également des collections de manuels juridiques et des documents pédagogiques (Carrés rouges Gualino, Mémentos Gualino, Cours LGDJ et Manuels LGDJ).

Continuer la lectureCERCLES : lancement d’un nouveau chantier sur le corpus Lextenso par la BU Angers

Nouvel import Sudoc : les notices des vidéos en streaming de la plateforme Arte Campus 

  • Auteur/autrice de la publication :
  • Post category:docelecSudoc

Pour répondre à la demande d’établissements du réseau Sudoc, l’Abes, en collaboration avec le Service de coopération documentaire interuniversitaire (SCDI) de Montpellier, a mis en place un nouveau flux d’import permettant de charger mensuellement les nouvelles notices disponibles depuis la plateforme de diffusion Arte Campus. L’import initial a eu lieu  fin novembre.

Naissance du projet  

Les besoins du réseau Sudoc concernant l’intégration de ce type de notices ont été évalués par un sondage initié par Marie Nikichine (SCDI) via la liste de diffusion Code2bib : c’est Arte Campus qui arrivait en tête des abonnements.

A l’initiative de Régis Griesser, coordinateur Sudoc au SCDI, un workflow – permettant la création des notices en local puis leur chargement dans leur SGB Alma – avait déjà été mis en place.  Après discussion, il a été décidé de créer un flux d’import régulier afin de mutualiser le signalement de ces ressources par l’intégration de leurs notices descriptives dans le Sudoc.

 

Continuer la lectureNouvel import Sudoc : les notices des vidéos en streaming de la plateforme Arte Campus 

CERCLES : lancement d’un nouveau chantier sur le corpus Clinical Key

  • Auteur/autrice de la publication :
  • Post category:Sudoc
Crédit image : David_Stewart

En 2015, naissait le dispositif CERCLES (voir le billet) mis en place par l’Abes pour accompagner, aider et valoriser un établissement souhaitant s’investir sur l’enrichissement des données d’un corpus de documents spécifique. 

En septembre 2023, un nouveau corpus de ressources électroniques va bénéficier de ce dispositif : Clinical Key. Le chantier est pris en charge par le SCD de l’Université Paris-Est Créteil Val de Marne. 

 

Le corpus Clinical Key

Clinical Key accompagne les professionnels de santé et les étudiants en médecine, toutes spécialités confondues, en leur offrant l’accès aux dernières publications. La plateforme de l’éditeur Elevier Masson permet de faire des recherches sur le texte inétgral de revues et de monographies.
La collection « Student » contient des images, vidéos en ebooks en santé, dont les Référentiels des collèges, les atlas d’anatomie Gray et Netter et les traités EMC (Encyclopédie médico-chirurgicale).
La collection « Nursing », dédiée aux soins infirmiers, propose des ebooks  (Essentiels en IFSI, guides pratiques) et des revues, ainsi que les EMC Savoirs et Soins infirmiers.

Pourquoi le SCD de l’Université Paris-Est Créteil Val de Marne a-t-il choisi ce corpus ?
La responsable du chantier, Sylvia, nous répond :
« Clinicalkey était un des derniers bouquets francophones pas encore pris en charge, et c’est une ressource importante pour nos étudiants en médecine. Ils sont très demandeurs des manuels type « Collèges » proposés sur cette plateforme. Nous avons envie d’être réactives et de signaler les titres rapidement après leur publication en produisant des bonnes notices pour les partager avec le réseau ».

 

Continuer la lectureCERCLES : lancement d’un nouveau chantier sur le corpus Clinical Key

CERCLES : lancement d’un nouveau chantier sur le corpus Strada lex

image CERCLES
source : DIYCandy

En 2015, naissait le dispositif CERCLES (voir le billet) mis en place par l’Abes pour accompagner, aider et valoriser un établissement souhaitant s’investir sur l’enrichissement des données d’un corpus de documents spécifique. 

En 2023, un nouveau corpus de ressources électroniques va bénéficier de ce dispositif : Strada lex. 

 

Le corpus Strada lex

Bien connue des établissements d’enseignement supérieur et universités à composante juridique, cette base de données donne accès à toute l’information juridique européenne.
Elle constitue un bon outil de veille (des actualités sont disponibles, ainsi que la jurisprudence) et une plateforme d’accès à des revues en texte intégral, aux codes et textes réglementaires ainsi qu’à un très grand nombre de monographies électroniques.
Déjà, en 2019, quatre établissements membres du réseau Sudoc, conscients de la nécessité de signaler finement ce corpus, s’étaient associés, de façon informelle, pour cataloguer un grand nombre d’ebooks. Ainsi, grâce à la volonté des SCD des universités de Rennes I (sa dénomination à l’époque), Lille, Paris II Panthéon Assas et Paris Dauphine, 400 notices d’ebooks avaient été créées dans le Sudoc. 

Continuer la lectureCERCLES : lancement d’un nouveau chantier sur le corpus Strada lex
Aller au contenu principal