Digitizarea explicată

Metadate și înregistrări de articole: ce câmpuri sunt utile?

Metadatele descriu o publicație prin câmpuri precum titlul, autorul, anul apariției sau limba. Înregistrările articolelor leagă contribuțiile de intervalele de pagini și de fișiere. Câmpurile necesare depind de colecție și sistemul de destinație.

Ce informații sunt prelucrate?

Setul de câmpuri depinde de colecție și de sistemul de destinație. Nu fiecare original conține toate datele bibliografice. Informațiile lipsă sau neclare sunt marcate corespunzător; nu inventăm date de publicare sau identificatori.

Grup de câmpuriInformații posibileUtilitate
Descriere bibliograficăTitlu, autor, editură, an de aparițieDescrierea și diferențierea publicațiilor
Descrierea conținutuluiLimbă, domeniu existent, tip de documentFiltrarea și organizarea colecției
AsociereIdentificator de inventar, nume de fișier, interval de paginiLegarea înregistrării de documentul-sursă
Stadiul prelucrăriiValori lipsă, asocieri neclareIdentificarea aspectelor care trebuie verificate

Ce presupune curățarea datelor?

Structurăm informațiile existente și uniformizăm variantele de scriere și formatele după reguli convenite. Modificările permise se stabilesc înainte de lucru. O valoare goală, o indicație ilizibilă și un câmp neverificat ar trebui să rămână diferențiabile.

Prelucrarea poate porni de la tabele și fișiere digitale existente. Un fișier de exemplu și structura țintă dorită ajută la stabilirea câmpurilor care se păstrează, se redenumesc sau se verifică suplimentar.

Cum sunt identificate articolele individuale?

Un volum de revistă poate conține multe articole independente. Segmentarea identifică limitele fiecărei contribuții și leagă titlurile, intervalele de pagini și fișierele asociate. Numerotarea paginilor din scanare poate diferi de numerotarea tipărită.

Legăturile clare dintre text, articol și publicația-sursă sunt utile pentru biblioteci, edituri și companii AI. Câmpurile exportate și eventualele prelucrări suplimentare se stabilesc pentru fiecare proiect.

Cum ajung datele în sistemul dumneavoastră?

Printre formatele posibile se numără CSV și JSON, împreună cu documentele corespunzătoare. Extensia fișierului nu este suficientă: numele câmpurilor, codificarea caracterelor, valorile obligatorii și asocierile trebuie să corespundă sistemului de destinație. O livrare demonstrativă permite testarea importului înaintea unor volume mai mari.

Întrebări frecvente

O publicație trebuie să aibă ISBN pentru a fi înregistrată?

Nu. Lucrările fără ISBN pot fi descrise folosind datele bibliografice disponibile și un identificator de inventar convenit.

Un export CSV funcționează cu orice catalog?

Nu. Structura exportului trebuie adaptată sistemului care primește datele. Formatul fișierului, singur, nu garantează un import reușit.

Puteți curăța datele fără să scanați cărțile?

Da. Curățarea datelor, pregătirea metadatelor și asocierea articolelor pot porni și de la fișiere existente.

Surse tehnice suplimentare

Să discutăm proiectul

Trimiteți-ne informații despre material, volum și rezultatul dorit. Pe această bază stabilim serviciile și pregătim oferta.

info@donauconnect.com