가상 머신과 PDF: 과거의 유물이 될 미래
가상 머신과 PDF: 과거의 유물이 될 미래 by Konrad Hinsen, 2014 년 9 월 9 일 게시 Greg Wilson 의 최근 트윗이 핵심을 찌릅니다. “VM 이미지는 실행 가능한 PDF 와 다를 바 없습니다. 오늘날 재현성을 위해 이를 사용한다면, 내일 사람들은 그 내용을 추출하기 위해 도구를 해킹해야 할 것입니다.” 사실 가상 머신과 PDF 모두 매우 특정한 목적으로 설계되었지만, 그 목적은 과학 출판이 아닙니다.
PDF 는 인쇄된 종이 페이지의 정확한 내용을 컴퓨터 파일로 캡처하도록 설계되었습니다. 물론 이렇게 설계된 데에는 타당한 이유가 있으며, 바로 그 때문에 PDF 가 대중화되었습니다. 가상 머신은 운영체제부터 애플리케이션 소프트웨어에 이르는 완전한 소프트웨어 스택을 한 물리적 컴퓨터에서 다른 컴퓨터로 이동 가능하게 만들기 위해 설계되었습니다. 이 역시 매우 타당한 이유가 있어 가상 머신이 널리 쓰이게 되었습니다. PDF 와 가상 머신 모두 과학 출판에 채택된 것은 편의성 때문입니다. 이들은 이미 잘 정립된 기술이었으며 당장의 필요를 충족하는 것처럼 보였습니다. PDF 는 과학 출판 매체로서 인쇄된 종이를 대체했는데, 이는 전자 출판으로의 전환 중에서도 가장 최소한의 변화였습니다. 단지 매체만 바뀌었을 뿐입니다. 하지만 전자 출판은 훨씬 더 나은 가능성을 제공했습니다. 원시 데이터와 계산 방법을 기계가 읽을 수 있게 만들어 다른 사람들도 재사용할 수 있게 할 수 있었기 때문입니다. 가상 머신은 오늘날 우리가 사용하는 소프트웨어와 파일 형식을 전혀 변경하지 않아도 되므로, 계산을 아카이빙하고 출판하는 데 있어 노력도 적고 최소한의 방식으로 접근할 수 있는 방법을 제공합니다. 그러나 다시 한번 더 나은 방향으로 나아갈 큰 기회를 놓치며, 데이터와 코드를 접근 가능하고 재사용 가능하게 만드는 데 실패했습니다.
ActivePapers 는 바로 이러한 문제점을 해결하기 위해 특별히 설계되었으며, 아마도 과학 출판의 요구 사항을 최우선으로 고려해 설계된 최초의 파일 형식일 것입니다. ActivePaper 는 데이터세트와 이를 처리하는 코드를 결합하여, 각각 또는 둘 다 완전히 추적 가능한 방식으로 재사용할 수 있도록 합니다. 과학을 단순히 재현 가능하게 수행하는 것을 넘어 개방적으로 수행하기 위해서는 이것이 매우 중요합니다. 댓글 제공: Disqus
추가 읽기 자료
- 가상 머신 — 위키백과
브라우저에서 코딩하여 Python을 배우세요
브라우저에서 직접 코딩하는 대화형 Python 및 데이터 과학 과정