Virtuelle Maschinen und PDF: Bald Relikte der Vergangenheit
Python-Edition JVM-Edition Blog … Bibliothek —> Virtuelle Maschinen und PDF: Zukünftige Relikte der Vergangenheit von Konrad Hinsen, veröffentlicht am 09. Sep 2014 Ein kürzlicher Tweet von Greg Wilson trifft den Nagel auf den Kopf: VM-Images sind einfach nur ausführbare PDFs.
Wenn wir sie heute für Reproduzierbarkeit nutzen, werden Leute morgen Tools hacken müssen, um ihren Inhalt zu extrahieren. Tatsächlich wurden sowohl virtuelle Maschinen als auch PDFs für einen sehr spezifischen Zweck entwickelt, doch dieser Zweck ist nicht das wissenschaftliche Publizieren. PDFs wurden entwickelt, um den exakten Inhalt gedruckter Papierseiten in einer Computerdatei festzuhalten. Dafür gibt es natürlich sehr gute Gründe, und genau deshalb wurden PDFs so populär.
Virtuelle Maschinen wurden entwickelt, um einen kompletten Software-Stack – vom Betriebssystem bis zur Anwendungssoftware – von einem physischen Computer auf einen anderen übertragbar zu machen. Auch hierfür gibt es sehr gute Gründe, weshalb virtuelle Maschinen an Beliebtheit gewannen. Sowohl PDFs als auch virtuelle Maschinen wurden im wissenschaftlichen Publizieren aus Bequemlichkeit übernommen: Es handelte sich um etablierte Technologien, die einem unmittelbaren Bedarf zu entsprechen schienen.
Wenn Sie einkaufen: — Interaktive Python- und Data-Science-Kurse, bei denen Sie direkt im Browser programmieren.
PDFs ersetzten gedrucktes Papier als Publikationsmedium für die Wissenschaft in einem minimalen Übergang zum elektronischen Publizieren: Lediglich das Medium wurde ausgetauscht. Doch elektronisches Publizieren würde weit mehr ermöglichen: Rohdaten und rechnerische Methoden könnten maschinenlesbar und damit für andere wiederverwendbar sein. Virtuelle Maschinen bieten eine unkomplizierte Möglichkeit, Berechnungen auf minimale Weise zu archivieren und zu veröffentlichen, ohne Änderungen an der heute verwendeten Software und den Dateiformaten vorzunehmen.
Doch auch hier wird eine große Chance vertan, es besser zu machen und Daten sowie Code zugänglich und wiederverwendbar zu gestalten. ActivePapers wurde speziell entwickelt, um diese Probleme anzugehen, und ist vielleicht das erste Dateiformat, bei dem die Bedürfnisse des wissenschaftlichen Publizierens oberste Priorität haben.
Ein ActivePaper kombiniert Datensätze und den Code, der darauf angewendet wird, auf eine Weise, die die Wiederverwendung des einen oder des anderen (oder natürlich beider) in vollständig nachvollziehbarer Form erlaubt. Für ein Wissenschaftsbetreiben, das nicht nur reproduzierbar, sondern auch offen ist, ist dies von großer Bedeutung. Kommentare bereitgestellt von Disqus
Weiterführende Literatur
- Virtuelle Maschine — Wikipedia
Lernen Sie Python, indem Sie in Ihrem Browser programmieren
Interaktive Python- und Data-Science-Kurse, bei denen Sie direkt im Browser programmieren