Maszyny wirtualne i PDF: przyszłe relikty przeszłości
Edycja Python Edycja JVM Blog … biblioteka —> Maszyny wirtualne i PDF: przyszłe relikty przeszłości autor: Konrad Hinsen, opublikowano 09 września 2014 Niedawny tweet Grega Wilsona trafia w sedno: obrazy maszyn wirtualnych to po prostu pliki PDF, które można uruchomić. Jeśli dziś używamy ich do zapewnienia powtarzalności badań, jutro ludzie będą musieli tworzyć specjalistyczne narzędzia, aby wydobywać z nich dane.
W rzeczywistości zarówno maszyny wirtualne, jak i format PDF zostały zaprojektowane w bardzo konkretnym celu, który jednak nie ma nic wspólnego z publikowaniem prac naukowych. Format PDF powstał, aby wiernie odwzorowywać zawartość drukowanych stron papierowych w pliku komputerowym. Istnieją ku temu bardzo dobre powody – właśnie dlatego pliki PDF zyskały tak dużą popularność. Maszyny wirtualne stworzono natomiast po to, aby umożliwić przenoszenie kompletnego stosu oprogramowania – od systemu operacyjnego aż po aplikacje – z jednego komputera fizycznego na drugi.
Również i tutaj istnieją solidne uzasadnienia, co wyjaśnia rosnącą popularność maszyn wirtualnych. Zarówno PDF-y, jak i maszyny wirtualne zostały adoptowane w świecie publikacji naukowych głównie ze względu na wygodę: były to dobrze ugruntowane technologie, które zdawały się odpowiadać na bieżące potrzeby. Pliki PDF zastąpiły drukowany papier jako nośnik publikacji naukowych, co stanowiło minimalną zmianę w kierunku cyfryzacji wydawnictw – wymieniono jedynie nośnik.
Jeśli robisz zakupy: — Interaktywne kursy Python i data science, które kodujesz bezpośrednio w przeglądarce.
Tymczasem publikowanie elektroniczne mogłoby oferować znacznie więcej: surowe dane i metody obliczeniowe mogłyby być czytelne dla maszyn, a tym samym wielokrotnie wykorzystywane przez innych badaczy. Maszyny wirtualne zapewniają prosty sposób archiwizowania i udostępniania obliczeń przy minimalnym wysiłku, nie wymagając żadnych zmian w obecnie używanym oprogramowaniu ani formatach plików. Jednak ponownie przepuszczono ogromną szansę, by pójść o krok dalej i uczynić dane oraz kod naprawdę dostępnymi i możliwymi do ponownego wykorzystania.
ActivePapers zostało specjalnie zaprojektowane, aby rozwiązać te problemy, i jest prawdopodobnie pierwszym formatem plików, który priorytetowo traktuje potrzeby publikowania prac naukowych. Aktywny dokument (ActivePaper) łączy zbiory danych z kodem, który je przetwarza, w taki sposób, aby możliwe było wielokrotne wykorzystanie jednego, drugiego lub obu tych elementów – w pełni prześledzialny sposób.
Dla prowadzenia badań nie tylko w sposób powtarzalny, ale także otwarty, ma to kluczowe znaczenie. komentarze obsługiwane przez Disqus
Warto przeczytać
- Maszyna wirtualna — Wikipedia
Ucz się języka Python, kodując w przeglądarce
Interaktywne kursy Python i data science, które kodujesz bezpośrednio w przeglądarce