Connexion / Créer un compte

Dernière référence consultée  /  Dernière liste consultée

Référence en vue solo

Ben Saad, Myriam. Qualité des archives web: Modélisation et optimisation. Paris : Paris 6, 2011. 
Ajoutée par : wikiadmin (2016-12-13 21:06:42)
Type de référence: Thèse/Mémoire
Clé BibTeX: anon2011p
Envoyer cette référence par courriel à un quelqu'un
Voir tous les détails bibliographiques
Catégories: General
Mots-clés: Archivage électronique, Documents numériques, Web
Créateurs: Ben Saad
Éditeur: Paris 6 (Paris)
Consultations : 6/275
Indice de consultation : 24%
Indice de popularité : 6%
Pièces jointes    
Résumé     
Aujourd'hui, le Web est devenu le moyen le plus important pour véhiculer des informations qui peuvent avoir une grande valeur culturelle, scientifique, économique, etc. Archiver son contenu ou du moins une partie est devenu crucial afin de préserver certaines informations utiles pour les générations futures de chercheurs, écrivains, historiens, etc. Cependant, les archivistes doivent faire face à un grand défi qui consiste à préserver la qualité des données collectées pour garantir la plus grande fidélité du Web. C'est dans cette perspective d'améliorer la qualité des archives que nos travaux de thèse s'inscrivent. Nous nous intéressons aux deux mesures de qualité: la complétude temporelle et la cohérence temporelle qui sont très pertinentes pour évaluer les archives Web. Nous proposons une nouvelle approche d'archivage qui exploite le rendu visuel des pages pour y détecter les changements de la même manière que les utilisateurs les perçoivent. Nous proposons ensuite une méthode pour évaluer l'importance des changements visuels ainsi détectés. Par la suite, nous modélisons l'importance des changements sous forme de patterns, par le modèle PPaC (Pattern of Pages Changes). Contrairement aux modèles déjà existants basés sur un taux moyen de changements, PPaC permet de mieux prédire les moments les plus opportuns durant lesquels des modifications importantes sont censées survenir dans les pages. En se basant sur PPaC, nous proposons différentes stratégies de crawling qui visent à améliorer la complétude et/ou la cohérence temporelle. Nos différentes stratégies ont été implémentées puis expérimentées aussi bien sur des pages simulées que sur de vraies pages Web. Les résultats obtenus démontrent que le modèle PPaC basé sur l'importance des changements est un instrument utile pour améliorer considérablement la qualité des archives.
Ajoutée par : wikiadmin  
wikindx 4.2.2 ©2014 | Références totales : 4576 | Requêtes métadonnées : 52 | Exécution de script : 0.17348 secs | Style : PIAF-AFNOR (Association Française de NORmalisation) | Bibliographie : Bibliographie WIKINDX globale