科学数据的持久性
科学数据的持久性 作者:Konrad Hinsen,发布于2015年5月29日 在最近的一篇博客文章中,Bret Victor简洁地描述了当今Web技术的主要弱点之一:它在设计时并未考虑任何特定程度的持久性。因此,发布在Web上的信息对某些用途来说过于持久(隐私问题等),但对其他用途来说又不够持久。科学出版显然属于第二类。科学记录旨在在技术和经济可行的范围内尽可能持久。正如Victor所指出的,分布式归档的可能性对于确保信息的持久性非常重要。这一点在ActivePapers的发展中一直很重要。一个ActivePaper是一个文件,任何人都可以随意复制和归档。Web技术用于分发ActivePaper文件,但它们的存在并不依赖于Web技术。相比之下,一些科学数据只能通过Web服务器访问。这尤其包括以Web服务形式提供的软件(另见我早前关于此主题的博客文章),但也包括不允许以明确定义的文件格式下载数据集的数据库。此类数据可能在任何时刻消失,无论是由于意外或错误(我们都知道计算机技术有多可靠),还是由于Web服务器所有者的决定。评论由Disqus提供支持
延伸阅读
- Bret Victor — 维基百科
Learn Python by coding in your browser
Interactive Python and data-science courses you code directly in the browser