30 décembre 2007

Calames et Calame...

Je découvre coup sur coup deux outils qui semblent être apparus récemment.
Pour Calames, c'est certain : depuis le 1er décembre 2007.
Il s'agit d'un catalogue collectif des manuscrits des bibliothèques universitaires de France. Ce projet suit évidemment l'encodage en EAD du Catalogue collectif des manuscrits des bibliothèques publiques de France.
L'écran de recherche est très intéressant : la souris qui survole le champ "Mots-clés" affiche une série d'exemples. Cela attire plus l'attention sur la syntaxe du moteur, qu'en mettant un petit paragraphe sous le champ de requête.
L'affichage des résultats, la consultation des notices, est très novatrice et je la trouve même grandiose. Rien à voir avec Pleade -- donc voici un nouveau logiciel de publication de documents EAD en ligne. La page A propos indique que c'est un outil développé par spécifiquement par l'ABES (Agence bibliographique de l'enseignement supérieur, qui gère notamment le Sudoc, catalogue collectif des BU), avec des "experts des bibliothèques Calames" (liste ici). Rien n'indique qu'on puisse en bénéficier (je doute que l'ABES fasse cela gratuitement).
Les moteurs de recherche connaissent la liste des documents et en indexent la notice (cf. sur Yahoo! Site Explorer : 978 pages référencées).
Calames dispose aussi d'un blog (je n'ai pas trouvé de lien vers ce blog depuis l'interface de Calames). Il y est notamment expliqué la philosophie adoptée vis-à-vis des moteurs web.

Calame, répertoire de bases de données en sciences humaines et sociales, est un outil plus classique mais tout aussi précieux. Il référence 187 bases de données actuellement (novembre 2007), 50 avec un contenu sur le Moyen Age. On peut naviguer par discipline (il aurait fallu aussi des sous-disciplines, car "Histoire" me semble un peu vaste), par période, zone géographique, type de contenu.
Je suis frustré par la page A propos, qui ne dit rien du projet, de ses perspectives d'évolution, des missions que se sont attribués ses concepteurs, du caractère systématiquement gratuit (ou non ?) des bases référencées, etc.
Un outil plus classique que le précédent, mais qui peut se révéler très utile à l'occasion.

Libellés : , ,

29 juin 2007

Excel vers EAD

Pour obtenir une base en EAD, c'est toujours une très mauvaise idée de saisir l'encodage XML. Le mieux est de partir des pratiques existantes, et de permettre aux personnes inventoriant leurs fonds de travailler avec des outils bureautiques classiques.
Donc en général on a deux types de documents à convertir : les inventaires sous Word, et les inventaires sous Excel.
Les premiers sont très différents des seconds. Les isous Word sont déjà structurés en parties, sous-parties, sous-sous-parties, etc., correspondant à peu près à la structure d'un document EAD. La conversion en XML, via OpenOffice (j'en ai déjà parlé) n'est une conversion des noms de balises (je simplifie un peu) : on remplace le tag "résumé" par une balise "abstract" et le style Titre 1 par <c level="series"><did><unitid>Texte en Titre 1</unitid> etc.

Sous Excel, c'est complètement différent : la même information est répétée à chaque ligne. Par exemple si j'ai une dizaine de monnaies de Corbie, l'information "Corbie" est répétée à chaque ligne, alors qu'en EAD c'est une information chapeau, indiquée une seule fois, et qui englobe toutes les monnaies.
J'ai donc mis au point une chaîne en plusieurs étapes, permettant la récupération d'un inventaire Excel en EAD :
  1. Publipostage : c'est une fonction qui existe dans Word, sous l'onglet "Outils". Pour chaque ligne Excel, je récupère l'information présente dans une colonne et je la mets sous une nouvelle mise en forme :
    <monnaie>
    <id>«Numéro»</id>
    <ref>«Référence»</ref>
    <atelier>«Les_conditions_de_lémission»</atelier>
    <type_d_atelier>«F6»</type_d_atelier>
    <siecle>«F28»</siecle>
    <dates>«F32»</dates>
    <seigneur>«F33»</seigneur>
    <nom_monnaie>«F16»</nom_monnaie>
    <metal>«F18»</metal>
    <avers_champ>«Description»</avers_champ>
    <revers_champ>«F73»</revers_champ>
    <avers_legende>«Légende»</avers_legende>
    <avers_legende_dvpt>«F114»</avers_legende_dvpt>
    <revers_legende>«F133»</revers_legende>
    <revers_legende_dvpt>«F134»</revers_legende_dvpt>
    <departement>«Localisation»</departement>
    <province_laique>«F21»</province_laique>
    <province_ecclesiastique>«F24»</province_ecclesiastique>
    <diocese>«F23»</diocese>
    </monnaie>

    Tout ce qui est entre guillemets, c'est l'appel d'une colonne, pour chaque ligne Excel. Ca produit un fichier XML (dans Word, à copier ensuite dans un éditeur XML) qui compte autant de <monnaie/> qu'il y a de lignes.

  2. Il faut ensuite les remettre en EAD, en groupant les <monnaie/> selon certains critères : géographique (par région), puis par atelier (triés par ordre alphabétique), puis par seigneur (triés par ordre chronologique), puis par métal, puis par type de monnaie.
Cette conversion EAD, avec regroupement, s'effectue avec une feuille XSL qui utilise la "méthode Muenchian" (que j'ai découverte pour l'occasion). Celle que j'ai paramétrée est encore très sommaire : elle ne trie que par atelier, et au sein de chaque atelier par ordre chronologique.
C'est à affiner progressivement.
Les tris successifs ne sont pas très compliqués à rajouter, une fois qu'on a le modèle. Il faudrait encore réfléchir à la valeur à donner aux attributs level des <c>
<?xml version="1.0" encoding="UTF-8"?>
<xsl:stylesheet version="2.0" xmlns:xsl="http://www.w3.org/1999/XSL/Transform" xmlns:xs="http://www.w3.org/2001/XMLSchema" xmlns:fn="http://www.w3.org/2005/02/xpath-functions" xmlns:xdt="http://www.w3.org/2005/02/xpath-datatypes" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:html="http://www.w3.org/1999/xhtml">
<xsl:output method="xml" version="1.0" encoding="UTF-8" indent="yes"/>
<xsl:key name="monnaies-par-atelier" match="monnaie" use="atelier"/>
<xsl:template match="/">
<ead>
<eadheader>
<xsl:call-template name="metadonnees"/>
</eadheader>
<archdesc>
<xsl:apply-templates/>
</archdesc>
</ead>
</xsl:template>
<xsl:template name="metadonnees">
<eadid countrycode="FR">ID<xsl:value-of select="generate-id()"/>
</eadid>
<filedesc>
<titlestmt>
<titleproper>Inventaire en EAD</titleproper>
<author>????</author>
</titlestmt>
</filedesc>
<profiledesc>
<creation>Tableau Excel extrait par publipostage, puis regroupement des notices par autorité (atelier), émetteur (personne physique), métal et type de monnaie</creation>
<!-- Description du fichier électronique, de la façon dont le document a été obtenu-->
<langusage>Document rédigé en <language langcode="fre">français</language>
</langusage>
</profiledesc>
</xsl:template>


<xsl:template match="monnaies">
<did>
<unitid>Inventaire EAD de monnaies</unitid>
</did>
<dsc>
<xsl:for-each select="monnaie[count(. | key('monnaies-par-atelier', atelier)[1])=1]">
<xsl:sort select="atelier"/>
<c>
<did>
<unittitle>
<xsl:value-of select="atelier"/>
</unittitle>
</did>
<xsl:for-each select="key('monnaies-par-atelier', atelier)">
<xsl:sort select="siecle"/>
<xsl:call-template name="notice_monnaie"/>
</xsl:for-each>
</c>
</xsl:for-each>
</dsc>
</xsl:template>


<xsl:template name="notice_monnaie">
<c>
<did>
<unittitle><xsl:value-of select="nom_monnaie"/></unittitle>
<unitid>
<xsl:value-of select="id"/>
</unitid>
<unitdate>
<xsl:choose>
<xsl:when test="dates/child::text()"><xsl:value-of select="dates"/>
<xsl:choose>
<xsl:when test="siecles/child::text()">[<xsl:value-of select="siecles"/></xsl:when>
</xsl:choose>
</xsl:when>
<xsl:otherwise>
<xsl:value-of select="siecle"/>
</xsl:otherwise>
</xsl:choose>

</unitdate>
<physdesc>
<physfacet type="metal">
<xsl:value-of select="metal"/>
</physfacet>
<dimensions type="weight">
<xsl:value-of select="poids"/>
</dimensions>
<dimensions type="angle">
<xsl:value-of select="angle"/>
</dimensions>
</physdesc>
</did>
<!--La balise <controlaccess> contient tous les mots clés : localisation géographique, indexation iconographique, etc.-->
<controlaccess>
<geogname source="dieudonne" role="province_laique"><xsl:value-of select="province_laique"/></geogname>
<geogname role="diocese"><xsl:value-of select="diocese"/></geogname>
<geogname role="province_eccl"><xsl:value-of select="province_eccl"/></geogname>
<geogname role="departement"><xsl:value-of select="departement"/></geogname>
<geogname role="region"><xsl:value-of select="region"/></geogname>
<occupation><xsl:value-of select="type_d_atelier"/></occupation>
</controlaccess>
<bibliography>
<bibref>
<xsl:value-of select="ref"/>
</bibref>
</bibliography>
<scopecontent>
<scopecontent dc:type="avers">
<p>
<xsl:attribute name="altrender"><xsl:value-of select="avers_legende_dvpt"/></xsl:attribute>
<xsl:value-of select="avers_legende"/>
</p>
<p>
<xsl:value-of select="avers_champ"/>
</p>
</scopecontent>
<scopecontent dc:type="revers">
<p>
<xsl:attribute name="altrender"><xsl:value-of select="revers_legende_dvpt"/></xsl:attribute>
<xsl:value-of select="revers_legende"/>
</p>
<p>
<xsl:value-of select="revers_champ"/>
</p>
</scopecontent>
</scopecontent>
</c>
</xsl:template>
</xsl:stylesheet>


Ce qui me donne un fichier de ce genre. J'ai 715 monnaies dans ce tableau à charger ainsi, avec aucune reprise à effectuer, dans ma base Pleade.
Seul gros défaut : mon tableau de fait référence à aucune image (alors que j'ai bien numérisé de nombreuses planches du XIXe siècle). Pour faire le lien, je pourrais rajouter une colonne pointant vers les images. En réalité, le plus logique est de modifier les noms de mes fichiers pour utiliser le champ "id" de chaque notice : chaque image devra s'appeler (par exemple) IX.A.1.jpg, et le lien vers l'image peut se construire dynamiquement, en utilisant l'identifiant et en rajoutant ".jpg" à la fin.
En terme d'encodage enfin, il faudra encore que je me décide sur ce que je fais de toute l'indexation iconographique : en effet j'ai à disposition dans mon tableau des colonnes "Alpha ou oméga : Oui/non", "Type iconographique/lettres", "Type religieux : oui/non", etc. Ce serait dommage que ça soit perdu.

Libellés : , , , , ,

30 mai 2007

Pleade : nouveau site

Pourquoi personne ne m'a-t-il dit (pourquoi n'ai-je vu ça nulle part ?) que Pleade avait un nouveau site : http://www.pleade.com, alors que l'ancien n'est plus à jour depuis 2005 (je crois) ?
La page A propos précise tout de même "ce site n'est pas le site officiel", "il s'agit plutôt d'un site géré par les sociétés Anaphore et AJLSM".
Sans doute. Mais celui-ci a une page d'actualité dont le dernier billet date du 10 mai 2007, il parle de la version 3.0 et de la feuille de route pour y parvenir, des nouveautés à attendre, etc.
Et il a un fil RSS pour chaque page ou presque, dont celui des actualités.
J'ai encore un gros regret : la page de documentation ne fait que renvoyer à celle de Pleade.org, avec cette promesse : "Prochainement, vous trouverez ici de la documentation complémentaire proposée par les sociétés AJLSM et Anaphore. "

Au moins, je découvre qu'on travaille encore à développer l'outil.
Parmi les promesses de la version 3.0 :
  • Une meilleure gestion des groupes d'instruments de recherche : rendre plus explicite les possibilités de recherche dans un groupe d'instruments de recherche, faciliter la navigation entre ces instruments de recherche, etc.
  • L'utilisation d'un cadre de classement pour organiser les instruments de recherche : ce cadre de classement pourra être utilisé pour consulter directement des instruments de recherche, mais il pourra également servir à une meilleure présentation des résultats de recherche.
  • L'utilisation autonome des feuilles de styles de conversion de l'EAD vers XHTML : ces feuilles de styles pourront donc être utilisées en-dehors de PLEADE afin de permettre de produire des instruments de recherche en format HTML statique, utilisables hors PLEADE.
  • Outil de gestion et de consultation de documents numériques : une puissante visionneuse de lots d'images sera intégrée à PLEADE, ainsi qu'un serveur d'images qui permettra d'offrir des fonctionnalités de consultation très intéressantes aux utilisateurs. Ces fonctions seront particulièrement utiles pour les archives numérisées. A noter que la consultation pourra se faire entièrement à l'aide du navigateur Web, sans l'utilisation de modules externes.

Libellés : , , ,

25 novembre 2006

Première implémentation de Pleade pour les monnaies


Voilà la première adaptation/appropriation de Pleade, pour les monnaies. De nombreuses choses sont encore à revoir (ça se voit sur cette copie d'écran), mais c'est déjà un début.
Il me manque encore une connaissance réellement approfondie de Pleade pour obtenir tout ce que je souhaite, et éviter certains bugs (des écrans d'affichage vides, etc.). De toute façon, toute la documentation est en ligne, et je finirai bien par en venir à bout.
Parallèlement, je travaille au mode de conversion automatique Word --> EAD.
Pour Pleade, il faut reprendre
  • La recherche avancée, afin de disposer de formulaires appropriés.
  • L'affichage des listes de résultats, où actuellement la notion hiérarchique (ensemble > sous-ensemble > sous-sous-ensemble) est trop fortement visible et ne correspond pas aux pratiques propres aux collections monétaires.
  • L'affichage des résultats proprement dits. A terme, il faudra générer automatiquement des rebonds vers d'autres monnaies. Par exemple, pour ce "gigliat" d'Hélion de Villeneuve :
    • un rebond vers les autres monnaies de ce grand maître de Malte
    • un rebond vers l'ensemble des gigliats de la base
    • un rebond vers d'autres bases (une définition de ce qu'est un gigliat, si elle existe quelque part sur un dictionnaire en ligne, etc.)
    • un rebond vers les autres monnaies de la base ayant le même type au droit, ou le même type au revers
    • un rebond comportant la même légende au droit, ou au revers.
    • etc.
Pour le dernier exemple donné, ça implique que la légende soit explicité en mode non affiché, afin de ne pas être gêné par les abréviations et la ponctuation. Par exemple "Hospital Sancti Johannis" est un libellé plus intéressant que HOSPTAL SCI IOhIS (pour précision : les points d'interrogation dans la légende correspondent à des caractères spéciaux qui ne parviennent pas à être reconnus. Encore une question à traiter).

Libellés : , ,

11 novembre 2006

Exemple de monnaie encodée en EAD

J'ai fait quelques tests, pas définitivement satisfaisants, pour encoder une description de monnaie en EAD. Une fois définie la destination, tout est obtenu automatiquement par conversion.
Ce n'est pas très satisfaisant pour la qualification des informations : manière d'indiquer que telle face est l'avers, et non le revers ; que telle information est une légende.
L'intérêt est différent pour la distinction avers/revers, et l'indication de légende.
Indiquer que c'est un avers ou un revers permet notamment de produire des affichages différents, si le besoin s'en fait sentir (pour permettre une lisibilité plus grande). En revanche la recherche d'un type se fera indifféremment sur l'avers ou le revers (sauf à définir clairement ce qu'est l'avers, ce qu'est le revers, or cela n'est pas toujours simple).
L'indication de légende permet de cibler une recherche uniquement sur le contenu des légendes. En outre, on peut en plus de la retranscription de la légende, fournir en texte caché une version "développée" de cette légende (MAX GALL serait développée en Maxima Galliarum, et l'internaute pourrait chercher "Maxima Galliarum").
Il faudrait repenser cette qualification de l'information (ce qui suit est un avers ; ce qui suit est la légende de cet avers) avec l'évolution de la DTD EAD d'une part, qui, devenue un schéma, permet l'insertion d'attributs non EAD.
En outre, je n'ai pas pensé à utiliser l'attribut autorisé pour tout document XML : xml:type, qui pourrait rendre également de grands services.
Le plus important serait certainement de mener une réflexion au niveau international, pour éviter des choix différents.
[j'ajoute qu'évidemment une telle notice est comprise dans un ensemble plus vaste contenant l'intégralité de l'inventaire. Mais les informations qui chapeautent la description d'une monnaie posent beaucoup moins de problèmes d'encodage]
<c level="item">
<did>
<unitid>De Voguë 1096.</unitid>
<unittitle>Gros d’argent. 1305-1319.</unittitle>
<unitdate>1305-1319.</unitdate>
<physdesc>
<physfacet type="metal">AR.</physfacet>
<dimensions type="weight">4,03 g.</dimensions>
<dimensions type="angle">5 h.</dimensions>
</physdesc>
</did>
<bibliography>
<bibref>S., IX, 16 ; M. 19, p. 296.</bibref>
</bibliography>
<c level="otherlevel" otherlevel="avers">
<did>
<abstract/>
</did>
<scopecontent>
<p>+ FR [.] FVLChO [.] D [.] VILLRTO [.] DI
[.] GRA<expan>...</expan>
</p>
<p>Le Grand Maître à g.,
agenouillé devant une croix haute à double
traverse posée sur trois degrés et accostée
de A et ω ; sous le piédestal, le crâne d’Adam ;
[.] IRL [.] dans le champ.</p>
</scopecontent>
</c>
<c level="otherlevel" otherlevel="revers">
<did>
<abstract/>
</did>
<scopecontent>
<p>+ IhERIL’[.] RODI En légende extérieure :
+ MRO [.] hOPITAL’I 9VET SCI [.]
IOhIS<expan>...</expan>
</p>
<p>Croix pattée.</p>
</scopecontent>
</c>
</c>

Les informations s'affichent selon les exigences de l'EAD, et non dans l'ordre dans lequel elles apparaissent pour un inventaire de monnaies : par exemple la cote (ici : Voguë 1096) apparaît en premier. C'est la logique archivistique. Mais cela n'a aucune conséquence sur le mode d'affichage à l'écran.
Avec une feuille de style appropriée, cet encodage pourrait s'afficher sur Internet par exemple comme ceci :

Gros d’argent. 1305-1319.

+ FR [.] FVLChO [.] D [.] VILLRTO [.] DI [.] GRA
Le Grand Maître à g., agenouillé devant une croix haute à double traverse posée sur trois degrés et accostée de A et ω ; sous le piédestal, le crâne d’Adam ; [.] IRL [.] dans le champ.

Rev : + IhERIL’[.] RODI En légende extérieure : + MRO [.] hOPITAL’I 9VET SCI [.] IOhIS
Croix pattée.
AR. 5 h. 4,03 g. De Voguë 1096.
S., IX, 16 ; M. 19, p. 296.

Je n'ai malheureusement pas la reproduction d'une telle monnaie. Mais vous la trouvez sur CoinArchives.com

Gros d'argent de Foulques de Villaret, grand maître de l'ordre de Saint Jean de Jérusalem

Libellés : ,

Mentions légales

MonnaieCe n'est pas un blog de collectionneur.
Je suis historien, un peu informaticien (j'adore les métadonnées !). D'où ce que vous pouvez lire ici.
Comme vous pouvez le constater, même si je le laisse en ligne, il n'est plus alimenté depuis longtemps.

Recherche sur le web numismate

Recherche dans les livres de numismatique de Google Book Search[...]

 

 

Généré par Blogger

Site Meter