Trwałość danych naukowych
Edycja Python Edycja JVM Blog … biblioteka —> Trwałość danych naukowych autorstwa Konrada Hinsena, opublikowano 29 maja 2015 r. W niedawnym wpisie na blogu Bret Victor zwięźle opisuje jedną z głównych słabości dzisiejszych technologii internetowych: nie zostały one zaprojektowane z myślą o żadnym konkretnym poziomie trwałości.
W rezultacie informacje publikowane w sieci są zbyt trwałe dla niektórych zastosowań (np. kwestie prywatności), a dla innych – niewystarczająco trwałe. Publikacje naukowe wyraźnie należą do tej drugiej kategorii. Dorobek naukowy powinien być tak trwały, jak tylko pozwalają na to warunki techniczne i ekonomiczne. Jak wskazuje Victor, możliwość rozproszonego archiwizowania ma kluczowe znaczenie dla zapewnienia trwałości informacji.
Kwestia ta od zawsze była ważna w rozwoju projektu ActivePapers. Aktywny Papier (ActivePaper) to plik, który każdy może kopiować i archiwizować dowolną liczbę razy. Do dystrybucji plików ActivePaper wykorzystuje się technologie internetowe, lecz ich istnienie nie zależy od tych technologii.
Ulubiony czytelnik: — Ścieżki analizy danych oparte na projektach z terminalem z przewodnikiem i rzeczywistymi zbiorami danych.
Tymczasem niektóre dane naukowe dostępne są wyłącznie za pośrednictwem serwerów WWW. Dotyczy to w szczególności oprogramowania udostępnianego w formie usług sieciowych (zob. także mój wcześniejszy wpis na ten temat), a także baz danych, które nie umożliwiają pobierania zbiorów danych w dobrze zdefiniowanych formatach plików. Takie dane mogą zniknąć w każdej chwili – wskutek przypadku lub błędu (wszyscy wiemy, jak bardzo niezawodna jest technologia komputerowa) bądź decyzji właściciela serwera WWW. komentarze obsługiwane przez Disqus
Warto przeczytać również
- Bret Victor — Wikipedia
Buduj portfolio danych, projekt po projekcie
Ścieżki analizy danych oparte na projektach z terminalem z przewodnikiem i rzeczywistymi zbiorami danych