Over CopyClear

CopyClear richt zich op de verbetering van erfgoeddata op het snijvlak van collectie-informatie, persoonsidentificatie, auteursrechten en linked open data.

Museale collecties bevatten vaak gegevens die in de loop van tientallen jaren zijn opgebouwd. Namen van makers zijn op verschillende manieren geregistreerd, biografische gegevens ontbreken of spreken elkaar tegen en koppelingen met externe bronnen zijn niet altijd aanwezig.

CopyClear onderzoekt en verbetert deze gegevens systematisch. Daarbij worden institutionele bronnen gecombineerd met externe kennisbanken en authority files. Wikidata speelt vaak een centrale rol, omdat het gegevens uit verschillende domeinen met elkaar kan verbinden.

De werkwijze is brongebaseerd. Een naamovereenkomst alleen is niet voldoende om een persoon of organisatie te identificeren. Ook beroep, opleiding, instelling, locatie, werkperiode en andere context worden meegenomen.

Het uitgangspunt is niet zoveel mogelijk gegevens toevoegen, maar gegevens controleerbaar, traceerbaar en duurzaam bruikbaar maken.

Ontstaan

CopyClear is opgericht door Hanno Lans, samen met Michelle van Lanschot. De ontwikkeling van CopyClear werd ondersteund door het SIDN fonds en het Stimuleringsfonds Creatieve Industrie.

Michelle van Lanschot was betrokken bij de beginfase en ging later werken bij Wikimedia Nederland. Hanno Lans zette CopyClear voort.

Hanno Lans

Hanno Lans werkt voor musea, archieven en erfgoednetwerken aan het identificeren, verrijken en verbinden van collectiedata.

Daarbij combineert hij bronnenonderzoek met onder meer Wikidata, SPARQL, OpenRefine en geautomatiseerde dataverwerking. Een belangrijk deel van het werk bestaat uit het ontwikkelen van methoden waarmee grote hoeveelheden gegevens onderzocht kunnen worden zonder broncontext, onzekerheid en datakwaliteit uit het oog te verliezen.

Naast afzonderlijke musea werkt hij aan grotere kennisnetwerken, waaronder het Nederlands Instituut voor Beeld & Geluid en NADD — Netwerk Archieven Design en Digitale Cultuur.