Je to těžké. Myslím, že skutečná změna přijde až s novou generací. Když bude taková práce s daty běžná už pro studenty, stane se přirozenou součástí výzkumu. Už dnes ale máme v komunitě MATECH (komunita zaměřená na materiálové vědy) řadu lidí, kteří se chtějí zapojit.
Nechceme vědcům diktovat, jak mají s daty pracovat, proto zjišťujeme, co skutečně potřebují. Zároveň se snažíme ukládání dat co nejvíc zjednodušit. Například propojením repozitáře s elektronickými laboratorními deníky nebo přímým nahráváním dat z přístrojů přes API.
Jaké jsou hlavní kroky k vybudování repozitáře?
Hlavně je to o komunikaci s vědci. Potřebujeme vědět, podle čeho budou chtít data vyhledávat, jaké informace jsou pro ně důležité a bez kterých funkcí se naopak obejdou.
Základem je dobrý metadatový model. Michal Med, autor Českého základního metadatového modelu pro výzkumná data (CCMM), ho přirovnává k láhvi piva: samotná data jsou pivo a metadata etiketa, která říká, co je uvnitř. Bez etikety vlastně nevíte, co v láhvi máte.
Pak je tu technická a právní stránka. Repozitář stavíme na platformě Invenio a připravujeme pravidla pro jeho fungování i propojení s dalšími službami. Všechno se snažíme nastavit tak, aby bylo ukládání a vyhledávání dat pro vědce co nejjednodušší.
Jakou v tom všem máte roli vy?