Virtuele machines en pdf: toekomstige relicten uit het verleden
Python-editie JVM-editie Blog … bibliotheek —> Virtuele machines en PDF: toekomstige relicten uit het verleden door Konrad Hinsen, geplaatst op 09 sep 2014 Een recente tweet van Greg Wilson raakt de spijker op zijn kop: VM-images zijn gewoon PDF’s die je kunt uitvoeren. Als we ze vandaag gebruiken voor reproduceerbaarheid, zullen mensen morgen tools moeten hacken om hun inhoud te ontginnen.
Sterker nog, zowel virtuele machines als PDF’s werden ontworpen voor een zeer specifiek doel, maar dat doel is niet wetenschappelijke publicatie. PDF’s werden ontworpen om de exacte inhoud van gedrukte papieren pagina’s vast te leggen in een computerbestand. Daar zijn uiteraard zeer goede redenen voor, en daarom zijn PDF’s zo populair geworden. Virtuele machines werden ontworpen om een complete softwarestack, van besturingssysteem tot applicatiesoftware, overdraagbaar te maken van de ene fysieke computer naar de andere.
Ook daar zijn zeer goede redenen voor, wat verklaart waarom virtuele machines populair zijn geworden. Zowel PDF’s als virtuele machines werden omwille van het gemak geadopteerd voor wetenschappelijke publicatie: het waren gevestigde technologieën die leken te beantwoorden aan een directe behoefte. PDF’s vervingen gedrukt papier als publicatiemedium voor de wetenschap in wat een minimale overstap naar elektronisch publiceren was: alleen het medium werd vervangen.
Als u aan het winkelen bent: — Interactieve Python- en datascience-cursussen die u rechtstreeks in de browser codeert.
Maar elektronisch publiceren had veel beter gekund: ruwe data en computationele methoden hadden machine-leesbaar en daarmee herbruikbaar voor anderen kunnen zijn. Virtuele machines bieden een manier met weinig inspanning om berekeningen op een minimale manier te archiveren en te publiceren, zonder wijzigingen aan de software en bestandsformaten die we vandaag gebruiken. Maar ook hier wordt een grote kans gemist om het beter te doen en data en code toegankelijk en herbruikbaar te maken.
ActivePapers werd specifiek ontworpen om deze problemen aan te pakken, en het is wellicht het eerste bestandsformat dat is ontworpen met de behoeften van wetenschappelijke publicatie als hoogste prioriteit. Een ActivePaper combineert datasets en de code die ermee werkt, op een manier die het mogelijk maakt om het een of het ander (of natuurlijk beide) op een volledig traceerbare manier opnieuw te gebruiken.
Voor het bedrijven van wetenschap, niet alleen reproduceerbaar maar ook open, is dat zeer belangrijk. comments powered by Disqus
Verder lezen
- Virtuele machine — Wikipedia
Leer Python door in uw browser te coderen
Interactieve Python- en datascience-cursussen die u rechtstreeks in de browser codeert