A permanência dos dados científicos
Edição Python Edição JVM Blog … biblioteca —> A permanência dos dados científicos por Konrad Hinsen, publicado em 29 de maio de 2015 Em uma recente publicação de blog , Bret Victor descreve de forma sucinta uma das principais fraquezas da tecnologia Web atual: ela não foi projetada com nenhum nível específico de permanência em mente. Como resultado, as informações publicadas na Web são permanentes demais para alguns usos (preocupações com privacidade, etc.), mas não o suficiente para outros.
A publicação científica claramente se enquadra nesta segunda categoria. O registro científico deve ser tão permanente quanto técnica e economicamente viável. Como Victor aponta, a possibilidade de arquivamento distribuído é importante para garantir a permanência das informações. Este ponto sempre foi crucial no desenvolvimento do ActivePapers.
Um ActivePaper é um arquivo , que qualquer pessoa pode copiar e arquivar quantas vezes desejar. A tecnologia Web é usada para distribuir arquivos ActivePaper, mas sua existência não depende da tecnologia Web. Em contraste, alguns dados científicos são acessíveis apenas através de servidores Web.
Favorito do leitor: — Caminhos de ciência de dados baseados em projetos com um terminal guiado e conjuntos de dados reais.
Isso inclui, em particular, softwares oferecidos na forma de serviços Web (veja também minha postagem anterior no blog sobre este tópico), mas também bancos de dados que não permitem o download de conjuntos de dados em formatos de arquivo bem definidos. Tais dados podem desaparecer a qualquer momento, seja por acidente ou erro (todos sabemos quão confiável é a tecnologia de computadores), ou por decisão de quem quer que seja o proprietário do servidor Web. comentários fornecidos pelo Disqus
Leitura complementar
- Bret Victor — Wikipedia
Crie um portfólio de dados, projeto por projeto
Caminhos de ciência de dados baseados em projetos com um terminal guiado e conjuntos de dados reais