科学データの永続性
科学データの永続性について(Konrad Hinsen 著、2015 年 5 月 29 日投稿) 最近のブログ記事において、Bret Victor は現代の Web テクノロジーが抱える主要な弱点の一つを簡潔に指摘しています。それは、Web が当初から特定のレベルの「永続性」を念頭に置いて設計されていないという点です。その結果、Web 上に公開された情報は、プライバシー懸念など某些の用途にとっては「永続的すぎ」、一方で他の用途にとっては「十分に永続的ではない」という状況が生じています。科学出版は明らかに後者のカテゴリーに属します。科学記録は、技術的・経済的に可能な限り永続的なものであるべきです。Victor が指摘するように、情報の永続性を確保する上で分散型アーカイブの可能性は極めて重要です。この点は、ActivePapers の開発において常に重視されてきました。ActivePaper とはファイルであり、誰でも任意の回数コピーし、アーカイブすることができます。ActivePaper ファイルの配布には Web テクノロジーが利用されますが、その存在自体は Web テクノロジーに依存しません。対照的に、一部の科学データは Web サーバーを介さなければアクセスできません。これには特に、Web サービスとして提供されるソフトウェア(この話題に関する以前の私のブログ記事も参照)や、明確に定義されたファイル形式でのデータセットダウンロードを許可しないデータベースが含まれます。こうしたデータは、偶然やミス(コンピュータ技術の信頼性がどれほどのものか、私たちはよく知っています)、あるいは Web サーバーの所有者の判断によって、いつでも消失する可能性があります。comments powered by Disqus
さらに読む
- Bret Victor — Wikipedia
ブラウザでコーディングして Python を学習する
ブラウザーで直接コーディングするインタラクティブな Python およびデータ サイエンス コース