Ce informații sunt prelucrate?
Setul de câmpuri depinde de colecție și de sistemul de destinație. Nu fiecare original conține toate datele bibliografice. Informațiile lipsă sau neclare sunt marcate corespunzător; nu inventăm date de publicare sau identificatori.
| Grup de câmpuri | Informații posibile | Utilitate |
|---|---|---|
| Descriere bibliografică | Titlu, autor, editură, an de apariție | Descrierea și diferențierea publicațiilor |
| Descrierea conținutului | Limbă, domeniu existent, tip de document | Filtrarea și organizarea colecției |
| Asociere | Identificator de inventar, nume de fișier, interval de pagini | Legarea înregistrării de documentul-sursă |
| Stadiul prelucrării | Valori lipsă, asocieri neclare | Identificarea aspectelor care trebuie verificate |
Ce presupune curățarea datelor?
Structurăm informațiile existente și uniformizăm variantele de scriere și formatele după reguli convenite. Modificările permise se stabilesc înainte de lucru. O valoare goală, o indicație ilizibilă și un câmp neverificat ar trebui să rămână diferențiabile.
Prelucrarea poate porni de la tabele și fișiere digitale existente. Un fișier de exemplu și structura țintă dorită ajută la stabilirea câmpurilor care se păstrează, se redenumesc sau se verifică suplimentar.
Cum sunt identificate articolele individuale?
Un volum de revistă poate conține multe articole independente. Segmentarea identifică limitele fiecărei contribuții și leagă titlurile, intervalele de pagini și fișierele asociate. Numerotarea paginilor din scanare poate diferi de numerotarea tipărită.
Legăturile clare dintre text, articol și publicația-sursă sunt utile pentru biblioteci, edituri și companii AI. Câmpurile exportate și eventualele prelucrări suplimentare se stabilesc pentru fiecare proiect.
Cum ajung datele în sistemul dumneavoastră?
Printre formatele posibile se numără CSV și JSON, împreună cu documentele corespunzătoare. Extensia fișierului nu este suficientă: numele câmpurilor, codificarea caracterelor, valorile obligatorii și asocierile trebuie să corespundă sistemului de destinație. O livrare demonstrativă permite testarea importului înaintea unor volume mai mari.
Întrebări frecvente
O publicație trebuie să aibă ISBN pentru a fi înregistrată?
Nu. Lucrările fără ISBN pot fi descrise folosind datele bibliografice disponibile și un identificator de inventar convenit.
Un export CSV funcționează cu orice catalog?
Nu. Structura exportului trebuie adaptată sistemului care primește datele. Formatul fișierului, singur, nu garantează un import reușit.
Puteți curăța datele fără să scanați cărțile?
Da. Curățarea datelor, pregătirea metadatelor și asocierea articolelor pot porni și de la fișiere existente.