Archivat web
El archivat web és el procés de recolecció de fraccions o parts de la World Wide Web i la garantia de que l'informació es conserve en un archive o sistema d'informació per a futurs investigadors, historiadors i el públic en general.[1] En este procés se solen amprar rastrejadors web para la captura automatisada per l'enorme tamany i cantitat d'informació en la web. L'organisació d'archivat web més gran és Wayback Machine, la qual es basa en un enfocament de rastreig massiu per a tractar de mantindre un archiu de tota la web.
Per la creixent porció de la cultura humana creada i registrada en la web, les biblioteques i els archius reconeixen a l'archivat web com una part essencial de les seues pràctiques.[2] Les biblioteques nacionals, els archius nacionals i varis consorcis d'organisacions participen en l'archivat de contingut web culturalment important.
També existix software i servicis comercials d'archivat web per a les organisacions que necessiten archivar el seu propi contingut web en fins normatius, llegals o d'herència corporativa.
Història i desenroll
[editar | editar còdic]
Si be la conservació i organisació de la web ha segut prevalente des dels mediats i fins de la década de 1990, un dels primers proyectes d'archivat web a gran escala va ser Internet Archive, una organisació sense fins de lucre creada en 1996 per Brewster Kahle.[3] En 2001, Internet Archive va llançar Wayback Machine, el seu propi motor de busca per a visualisar contingut web archivat.[3] En el 2018, Internet Archive albergava 40 petabytes de senyes.[4] Internet Archive també va desenrollar moltes de les seues pròpies ferramentes per a recopilar i almagasenar les seues senyes, inclós PetaBox per a almagasenar grans cantitats de senyes de manera eficient i segura, i Heritrix, un rastrejador web desenrollat en conjunt en les biblioteques nacionals nòrdiques.[3] Atres proyectes que varen iniciar al mateix temps varen incloure un proyecte d'archiu web de la Biblioteca Nacional de Canadà, Pandora d'Austràlia, archius web de Tasmania i Kulturarw3 de Suècia.[5][6] En Espanya, la Biblioteca Nacional d'Espanya va iniciar l'Archiu de la Web Espanyola en 2009.[7] A finals de 2013, la Biblioteca Nacional de Chile va desenrollar un proyecte pilot d'archivat web, el qual s'ha ampliat en els últims anys.[8]
El Consorci Internacional de Preservació d'Internet (IIPC), establit en 2003, ha facilitat la colaboració internacional en el desenroll d'estàndarts i ferramentes de còdic obert per a la creació d'archius web.[9] Actualment, més de 30 països formen part de el IIPC.[10]La ya desapareguda Internet Memory Foundation es va fundar en 2004 per la Comissió Europea per a archivar la web en Europa.[3] Este proyecte va desenrollar ferramentes de còdic obert para captura de mijos enriquits, coherència d'anàlisis temporal, evaluació de spam i detecció de l'evolució de la terminologia.[3] Les senyes de la fundació ara estan estajats en l'Internet Archive, pero actualment no són d'accés públic.[11]
Recolecció de la web
[editar | editar còdic]Els archivistas web generalment archiven varis tipos de contingut web, incloent pàgines web en HTML, fulls d'estil, JavaScript, imàgens i videos. També archiven metadatos sobre els recursos recopilats, com el temps d'accés, el tipo MIME i la duració del contingut. Estos metadatos són útils per a establir l'autenticació de la colecció archivada.
Referències
[editar | editar còdic]- ↑ González Flórez (2015). Archivamiento web: Conceptes bàsics, estratègies i millors pràctiques, Bogotà: Archiu General de la Nació de Colòmbia, p. 7. ISBN 978-958-8242-35-4.
- ↑ (2016).
- ↑ 3,0 3,1 3,2 3,3 3,4 Proceedings of the IEEE.100(Special Centennial Issue)
- 1441–1443.ISSN 0018-9219.doi:10.1109/JPROC.2012.2189920.
- ↑ «Inside Wayback Machine, the internet's clave capsule». The Hustle. Consultat el 2020-07-21.
- ↑ International Journal on Digital Libraries.18(3)
- 191–205.doi:10.1007/s00799-016-0171-9.
- ↑ (April 2011) «Web Archiving – Between Past, Present, and Future», Consalvo (ed.). The Handbook of Internet Studies, 1 edició (en en), Wiley, pp. 24–42. doi:10.1002/9781444314861. ISBN 978-1-4051-8588-2.
- ↑ «Archive de la Web Espanyola | Biblioteca Nacional d'Espanya» (en és). www.bne.es. Consultat el 2025-08-13.
- ↑ Consultat el 2023-01-02.
- ↑ «About the IIPC». IIPC. Consultat el 2022-04-17.
- ↑ «IIPC members» (en en-gb). IIPC. Consultat el 2025-08-13.
- ↑ «Internet Memory Foundation : Free Web : Free Download, Borrow and Streaming». archive.org. Internet Archive. Consultat el 2020-07-21.
Referències
[editar | editar còdic]
- Este artícul conté una traducció derivada de «Archivado web» de Wikipedia en castellà publicada baix la Llicència de documentació lliure de GNU i la Llicència Creative Commons Reconeiximent-CompartirIgual 4.0 Internacional.