1 of 23

Jak implementace propojených dat ovlivňuje katalogizační praxi v zahraničí

Barbora Drobíková

2 of 23

Quiz, gosocrative.com/room: LINKED2024

3 of 23

Implementace propojených dat

  • Změny směrem k LOD v zahraničních knihovnách probíhají již postupně cca 10/15 let
    • RDF v rámci W3C již počátek 21. století, T.B.Lee, 2006, TED Talk 2009
  • 2008 - zpráva LoC - On the record
    • MARC - postaven na starých technikách programování z 60. let 20. století
    • používán výhradně v prostředí knihoven, často nekompatibilní s dalšími systémy
  • 2011 - Bibframe - vyhlášena iniciativa (LoC)
    • rozvoj nových formátů bibliografických dat na bázi modelu RDF - ontologie BIBRAME
  • 2012 - RDA, original, implementace modelů FRBR/FRAD
    • RDA Official - IFLA-LRM, scénáře implementace
  • aktivity OCLC - SchemaBibEx, VIAF, FAST a další projekty

4 of 23

Trochu teorie

  • 1998 FRBR
    • FRAD a další - rodina modelů FRBR
    • RDA - verze Original - dodnes používaná v rámci českých interpretací
  • 2017 - konsolidovaný model IFLA-LRM
    • RDA Official
    • WEMI entity, změna v definování atributů, kardinality vztahů, nové entity
      • atribut reprezentativního vyjádření
      • zkušenosti konsolidace FRBRoo - extenze CIDOC CRM
      • zkušenosti a kritika původních modelů FRBR rodiny
    • Work, Expression, Manifestation, Item - zůstávají
      • dílo, vyjádření, provedení, jednotka

5 of 23

IFLA LRM

  • nejde jen o model
  • důležité - definice uživatelských úloh, (user-centered design)

​

  • najít, identifikovat, vybrat, získat, prozkoumat
    • find, identify, select, obtain, explore

​

  • Explore - to discover resources using the relationships between them and thus place the resources in a context
  • ​
  • Prozkoumat - zdroje pomocí vztahů mezi nimi a tím prozkoumat zdroje v kontextu

6 of 23

pokr.

  • naplnění uživatelských potřeb

​

    • síťové prostředí
    • propojení instancí entit (různými “směry” - hierarchické vazby, paralelní vazby, asociativní vazby, kontext)
    • obohacení dat z různých zdrojů

​

​

  • spíše systémy implementující propojená data

​

7 of 23

8 of 23

RDA

  • katalogizační pravidla jsou postavena na principech
  • zkušenost již od pravidel z roku 1941 (LoC) - do té doby pravidla stavěna na případech, bujela, mnoho set stránek paragrafů, které se mohou začít vzájemně vylučovat
    • AACR(1) - již stavěna na principech
  • bohužel praxe vždy začne vyžadovat jisté přesné popisy konkrétních situací => bujení pravidel a interpretací
    • mechanizmus, s nímž je nutné počítat, zřejmě se tomu nelze úplně vyhnout, nicm. principy mít na paměti je mnohem zásadnější při aplikaci pravidel než konkrétní ustanovení či paragrafy

9 of 23

(Nová) RDA

  • (možná právě proto) nová RDA neukazují konkrétní paragrafy, rady, jak co zapsat, přepsat, opsat
  • spíše struktura, jak postupovat při identifikaci konkrétních entit
  • jak je propojit
  • co je nutné identifikovat, propojovat, zaznamenat; jak o tom rozhodnout
  • respektují model IFLA-LRM, postupuje se ve struktuře modelu (entit, atributů, vztahů)
  • nově definované koncepty
    • agregáty, diachronní díla
    • mnoho dalšího

10 of 23

11 of 23

RDA principy a propojená data

  • vstřícnost k potřebám uživatelů
    • podpora uživatelských úkolů - viz find, identify, select, obtain, explore
  • efektivnost nákladů
    • standardizovaná data, která umožňují širokou výměnu dat
  • flexibilita
    • metadata by měla fungovat nezávisle na formátu, médiu nebo systémech používaných k ukládání nebo komunikaci metadat. Měla by být vhodná pro použití v různých prostředích
  • kontinuita
    • integrovatelnost do stávajících databází

​

12 of 23

pokr.

  • mezinárodnost
    • Wikidata

​

  • Z dalších principů vybírám:
  • vztahy (mezi entitami), běžné užívání a praxe (odkaz na mezinárodnost, různá písma, různé uživatelské komunity)

13 of 23

Bibframe

  • paralelní iniciativa k RDA
  • často kritizováno

​

  • model Bibframe
  • v základu jednodušší než IFLA-LRM
  • ​
  • entity - Work, Instance, Item
    • dílo, instance, jednotka
  • https://www.loc.gov/bibframe/
  • nově entita Hub

​

  • šířeji adoptováno
  • hlavní těžiště - fondy LoC
  • nutno dodefinovat vlastní “prvky”, jedinečné např. pro české prostředí

14 of 23

Praktické projekty a iniciativy

  • Share VDE

​

  • https://www.svde.org/
  • https://www.svde.org/about/about-share-vde
  • https://www.share-family.org/

​

  • vývoj editoru JCricket (používán různými knihovnami, s různými systémy, centrální správa metadat, ekosystém propojených dat, správa identit)

​

  • Bibframe workshop in Europe (Casalini Libri)

​

  • Bibframe - entita Opus => Hub

​

15 of 23

Další projekty

  • editor Sinopia
  • LD4P3 - projekt Linked data for production (Mellonova nadace)
  • https://docs.google.com/presentation/d/1GFNXBZj-YTyxr8An-590kbieHzI8jvPoZp-I_gBR_iY/edit#slide=id.g8697bb5346_0_144
  • používán více univerzitami v USA (zejména)
  • přes API data online vkládána do lokálních knihovních systémů
    • správa holdingů a jednotek v lokálním systému
    • správa společných metadat centrálně

​

  • PCC - ISNI projekty - management identit x autoritní kontrola

16 of 23

Projekty OCLC

  • Projekt Passage - sandbox ve Wikibase, využití wikidat
  • Důraz se přesouvá od správy textových řetězců k jednoznačné identifikaci a popisu entit v reálném světě, zahrnujících nejen lidi a organizace, ale také díla, místa a události.
  • Trvalé identifikátory, jako jsou DOI, ORCID a URI z Wikidat, hrají zásadní roli v tomto přechodu tím, že poskytují stabilní a jednoznačné odkazy na entity napříč různými systémy a platformami.
  • Wikidata jako nástroj pro správu identit, nabízející kolaborativní platformu pro shromažďování identifikátorů, popisů a vztahů z různých zdrojů, včetně knihoven.

17 of 23

pokr.

  • Stírají se hranice mezi záznamy bibliografickými a autoritními
  • Posun směrem k propojeným datům a správě identit má zásadní důsledky pro tradiční rozlišování mezi bibliografickými a autoritními záznamy.
  • V prostředí propojených dat se oba typy záznamů stávají vyjádřením propojených entit a jejich vztahů, čímž mizí potřeba samostatných databází.

18 of 23

Budoucnost

Kolaborativní, data obohacená a zaměřená na uživatele

  • uživatelsky orientovaný ekosystém, řízený principy propojených dat a podporovaný platformami jako Wikidata;
  • crowdsourcing a zapojení komunity budou hrát stále důležitější roli při obohacování a zlepšování knihovních dat, čerpající z kolektivních znalostí různorodých zainteresovaných stran;
  • knihovny budou muset vyvinout strategie pro správu tohoto kolaborativního prostředí, zajistit kvalitu dat a současně přijmout dynamiku prostředí;
  • cílem je vytvořit interoperabilnější, přístupnější a uživatelsky přívětivější web knihovních dat

19 of 23

Ukázky dalších projektů

​

​

20 of 23

OCLC

​

Blog OCLC

21 of 23

Editory

  • ukázky

​

  • Sinopia

https://stage.sinopia.io

https://github.com/LD4P/sinopia/wiki/Latest-Release

​

  • Marva

https://bibframe.org/marva/editor/

https://guides.loc.gov/c.php?g=1170551&p=8550706&preview=003264c97f504caf990125066b248e24

​

22 of 23

LOD dnes

  • Propojená data lze využívat do jisté míry již dnes – projekty entifikace - $0 a $1
    • využití $0 a $1 v ČR
  • Rozhraní Discovery systémů

Znalostní karty v Discovery rozhraních – např. knihovny.cz, Alma – Primo VE

  • Propojování na externí systémy – GeoNames, Wikidata
  • Komunikace záznamů je omezena strukturou formátu MARC, je zde i omezení počtu znaků v polích, např. 520, 505
  • Výsledný efekt vždy v konkrétní instalaci systému, nelze šíři a obohacené záznamy tolik komunikovat vzájemně

​

23 of 23

Co dál

https://www.w3.org/DesignIssues/LinkedData

27.7. 2006

4 pravidla pro propojená data

​

27.7. 2026? :-)

​