Outils pour utilisateurs

Outils du site


td_histoire_numerique:exercice_4

Différences

Ci-dessous, les différences entre deux révisions de la page.

Lien vers cette vue comparative

Les deux révisions précédentes Révision précédente
Prochaine révision
Révision précédente
Prochaine révision Les deux révisions suivantes
td_histoire_numerique:exercice_4 [2016/01/05 11:24]
Francesco Beretta [Annotation de notices biographiques courtes issues de la BNF]
td_histoire_numerique:exercice_4 [2016/01/05 11:44]
Francesco Beretta [Exploration du lexique des notices]
Ligne 20: Ligne 20:
  
 ===== Exploration du lexique des notices ===== ===== Exploration du lexique des notices =====
 +
 +
 +Sur [[td_histoire_numerique:​exercice_2&#​creation_du_deuxieme_document_a_annoter|cette page]] on trouvera les indications concernant le processus d'​extraction des notices du site data.bnf.fr ainsi que la production du {{:​td_histoire_numerique:​liste_notices_bnf.odt|document à explorer}}. Grâce à un codage qui applique la méthode présentée si dessous, les notices ont été découpées et importées dans la base de données. On les trouvera dans la version la plus récente de la base de données qui peut être installée selon les [[installation_de_la_base_de_donnees&#​mise_a_jour_de_la_base_de_donnees
 +|instructions qui se trouvent sur cette page]].
 +
 +A partir de la base de données, les notices ont été recodées en ajoutant l'​année et le siècle de naissance en tant que métadonnées de chaque notice, tout en les recomposant dans un seul document selon le format d'​importation du logiciel Iramuteq. Nous disposons donc d'un {{:​td_histoire_numerique:​liste_notices_bnf_sans_url_iramuteq.txt.zip|nouveau document}} qui contient le même texte des 790 notices à encoder.
 +
 +
  
 {{ :​td_histoire_numerique:​graph_simi_9.png?​200 |}} {{ :​td_histoire_numerique:​graph_simi_9.png?​200 |}}
td_histoire_numerique/exercice_4.txt · Dernière modification: 2016/03/03 10:26 par Francesco Beretta