This article was accepted into the corpus but its outbound wikilinks were never NER-processed — typical at the deepest BFS hop or when the run's entity cap was reached. No expansion funnel to show.
| Data Conservancy | |
|---|---|
| Name | Data Conservancy |
| Type | Research consortium |
| Founded | 2009 |
| Headquarters | United States |
| Focus | Data curation, digital preservation, scholarly communication |
Data Conservancy The Data Conservancy is a research and service initiative focused on long-term stewardship of digital research outputs, academic datasets, and domain-specific collections. It brings together academic institutions, libraries, archives, and technology partners to design preservation architectures, metadata schemas, and curation workflows aligned with funder mandates and community practices. The initiative interacts with national funding agencies, university libraries, and international standards bodies to enable reproducible scholarship and sustainable access to scientific, cultural, and social research data.
The Conservancy model combines expertise from Johns Hopkins University, University of North Carolina at Chapel Hill, University of Michigan, Cornell University, and University of California, San Diego with partnerships involving Library of Congress, National Science Foundation, Wellcome Trust, European Research Council, and National Institutes of Health stakeholders. It emphasizes interoperable architectures referencing technologies and frameworks such as OAI-PMH, Dublin Core, PREMIS, ORCID, and DataCite. The program aligns with policy initiatives including FAIR data principles, Open Access, Plan S, NIH Public Access Policy, and coordinates with repositories like Zenodo, Dryad, Figshare, GenBank, and ICPSR.
Origins trace to collaborations among research libraries and informatics groups influenced by programs at Library of Congress, initiatives like Digital Preservation Coalition, and funding from National Science Foundation grants aimed at cyberinfrastructure and e‑research. Early phases involved technical work informed by projects including DuraCloud, Fedora Commons, DSpace, Hydra (project), and LOCKSS. The Conservancy engaged with disciplinary communities represented by American Geophysical Union, American Chemical Society, Society for Industrial and Applied Mathematics, and international consortia such as Research Data Alliance and CODATA to evolve requirements for persistent identifiers, metadata registries, and preservation workflows.
Governance has included steering committees composed of representatives from institutions such as Princeton University, Yale University, Massachusetts Institute of Technology, Harvard University, and Stanford University, with advisory input from vendors and nonprofits including Amazon Web Services, Google Cloud Platform, Internet Archive, Open Preservation Foundation, and Creative Commons. Operational teams align with library units like British Library liaison groups, museum partners including Smithsonian Institution, and archives such as National Archives and Records Administration. Funding oversight has interfaced with program officers from National Endowment for the Humanities, European Commission, and foundation donors like Gates Foundation.
Service components address lifecycle activities: ingestion, metadata enhancement, storage, preservation, access, and reuse. Technical stacks have incorporated software from GitHub, Jenkins (software), Docker, Kubernetes, and databases such as PostgreSQL, MongoDB, and Elasticsearch. Workflow integration leverages standards and identifiers including Handle System, Digital Object Identifier, Linked Data, Schema.org, and vocabularies from Getty Research Institute and Library of Congress Subject Headings. User services interface with campus units like Research Information Management offices, institutional repositories, and disciplinary archives including PANGAEA and arXiv.
Research efforts span data citation, provenance, and reproducibility with collaborators from Carnegie Mellon University, University of California, Berkeley, University of Illinois Urbana-Champaign, Scripps Institution of Oceanography, and National Center for Atmospheric Research. Projects intersect with initiatives such as DataONE, KBase, OpenAIRE, CERN Open Data Portal, Human Cell Atlas, and Global Biodiversity Information Facility. Methodological work engages with provenance models like W3C PROV, data carpentry training through The Carpentries, and scholarly communication platforms including ScholComm and Crossref.
The Conservancy contributes to community best practices by aligning with standards from International Organization for Standardization, NISO, W3C, and ISO 16363. Policy alignment includes machine-actionable data management plans influenced by DMPTool, funder policies from Horizon 2020, NSF Data Management Plan, and mandates from Wellcome Trust and NIH. Preservation practice references metrics and certification frameworks such as TRAC, CoreTrustSeal, and mapping workflows to OAIS functional model.
Adoption spans university libraries, domain repositories, and consortia; case studies involve implementations at institutions like Johns Hopkins University, University of North Carolina at Chapel Hill, Cornell University, University of Washington, and University of California, San Diego. Evaluations cite improved compliance with mandates from National Science Foundation, enhanced discoverability via DataCite DOIs, and interoperability with aggregators such as Europeana and OpenAIRE. Impact assessments reference collaborations with projects in biodiversity (Global Biodiversity Information Facility), astronomy (Sloan Digital Sky Survey), genomics (GenBank), and social science (ICPSR), demonstrating reuse, reproducibility, and long-term stewardship outcomes.
Category:Digital preservation organizations