Werkwijze

CopyClear verbetert en verbindt bestaande collectiegegevens. Makers, organisaties, werken en andere entiteiten worden geïdentificeerd, gecontroleerd en waar mogelijk gekoppeld aan externe kennisbronnen.

Belangrijk is niet alleen dát gegevens worden aangevuld, maar ook dat duidelijk blijft wie of wat wordt bedoeld, waarop een identificatie berust en waar de informatie vandaan komt.

Van collectierecord naar verbonden kennis

Een traject begint meestal bij de bestaande collectieregistratie. Personen en organisaties worden vergeleken met bronnen en authority-bestanden zoals Wikidata, RKDartists, GTAA en VIAF.

Een overeenkomstige naam is niet genoeg. Ook beroep, opleiding, werkgever, woonplaats, werkperiode en andere context tellen mee bij de identificatie. Als voldoende zeker is om wie het gaat, wordt gekoppeld aan een bestaand Wikidata-item. Ontbrekende personen en organisaties kunnen op basis van bronnen worden toegevoegd.

Bronnen en kwaliteit

Herkomst is een vast onderdeel van het werk. Gegevens worden waar mogelijk onderbouwd met collectiecatalogi, archieven, naslagwerken, wetenschappelijke publicaties en andere betrouwbare bronnen.

Onzekerheid wordt niet weggewerkt. Een gedocumenteerde geboortedatum is iets anders dan een geboortejaar dat uit een leeftijd is afgeleid. Ook tegenstrijdige bronnen kunnen naast elkaar worden vastgelegd.

Automatisering helpt om grote bestanden te onderzoeken en mogelijke koppelingen te vinden, maar identificaties worden niet uitsluitend op naam of door een algoritme gemaakt.

Community, revisies en monitoring

Wikidata wordt wereldwijd gezamenlijk onderhouden. Elke wijziging heeft een revisiegeschiedenis en kan worden gecontroleerd of teruggedraaid. Datamodellen en kwaliteitsvragen worden besproken binnen gespecialiseerde WikiProjects, werkgroepen en communities.

CopyClear gebruikt daarnaast queries en dynamische overzichten om te volgen waar bijvoorbeeld identifiers, levensdata of auteursrechteninformatie ontbreken. Daardoor kunnen gegevens ook na afloop van een project verder verbeteren.

De internationale community is daarbij van belang. Kennis over bijvoorbeeld Indonesische makers of historische plaatsen hoeft niet uitsluitend uit Nederlandse bronnen te komen, maar kan worden aangevuld door onderzoekers en erfgoedprofessionals met lokale taal- en cultuurkennis.

Aansluiting op NDE en internationale kennisinfrastructuren

De werkwijze sluit aan bij de uitgangspunten van het Netwerk Digitaal Erfgoed (NDE): duurzame identifiers, linked data, open standaarden en verbinding met andere kennisbronnen.

Wikidata vervangt de collectiedatabase niet, maar kan als verbindende kennislaag functioneren. Personen, organisaties en werken krijgen een duurzame URI en kunnen worden gekoppeld aan identifiers uit onder meer VIAF, RKDartists, GTAA, GND en ULAN.

Wereldwijd publiceren musea, archieven en bibliotheken inmiddels zelf Wikidata-identifiers in hun catalogi. Daardoor kunnen lokale collectiegegevens rechtstreeks worden verbonden met kennis uit andere landen en instellingen.

Die internationale uitwisseling is niet alleen technisch interessant. Ze maakt het ook mogelijk dat kennis vanuit verschillende talen en perspectieven aan dezelfde entiteiten wordt toegevoegd en opnieuw wordt gebruikt.

Gedeelde kennis

Een identificatie die voor één museum wordt uitgezocht, kan later ook bruikbaar zijn voor een andere collectie. Hetzelfde geldt voor een verbeterde levensdatum, een authority-koppeling of een bron.

Zo kan onderzoek voor één instelling bijdragen aan een bredere, gedeelde kennisinfrastructuur.