<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>Optikai karakterfelismerés on File Format Blog</title>
    <link>https://blog.fileformat.com/hu/tag/optikai-karakterfelismer%C3%A9s/</link>
    <description>Recent content in Optikai karakterfelismerés on File Format Blog</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>hu</language>
    <lastBuildDate>Wed, 07 Oct 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://blog.fileformat.com/hu/tag/optikai-karakterfelismer%C3%A9s/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Hogyan válasszuk ki a megfelelő fájlformátumot a kézírásos szövegfelismeréshez (HTR)</title>
      <link>https://blog.fileformat.com/hu/ocr/ocr-file-formats-for-historical-and-handwritten-documents/</link>
      <pubDate>Wed, 07 Oct 2026 00:00:00 +0000</pubDate>
      
      <guid>https://blog.fileformat.com/hu/ocr/ocr-file-formats-for-historical-and-handwritten-documents/</guid>
      <description>Fedezze fel a legjobb OCR és HTR fájlformátumokat történelmi kéziratokhoz és kézírásos archívumokhoz, összehasonlítva az ALTO, PAGE XML, hOCR és TEI-XML formátumokat.</description>
      <content:encoded><![CDATA[<p><strong>Legutóbb frissítve</strong>: 2026. aug. 20.</p>
<figure class="align-center ">
    <img loading="lazy" src="images/ocr-file-formats-for-historical-and-handwritten-documents.png#center"
         alt="OCR File Formats for Historical and Handwritten Documents"/> 
</figure>

<h2 id="ocr-fájlformátumok-történelmi-és-kézírásos-dokumentumokhoz">OCR fájlformátumok történelmi és kézírásos dokumentumokhoz</h2>
<p>A kulturális örökség digitalizálással történő megőrzése reneszánszba lépett. Míg a korai optikai karakterfelismerő (OCR) rendszerek tiszta, géppel nyomtatott, a huszadik századi papírok feldolgozására lettek tervezve, a modern kulturális örökségi intézmények sokkal zavarosabb, gazdagabb kihívással néznek szembe: középkori kéziratok, a tizenkilencedik századi kézírásos levelezés, törékeny, illusztrált füzetek és évszázados nyilvántartások.</p>
<p>A történelmi dokumentumok átírása már nem csak egyszerű ASCII szöveg kinyeréséről szól. <strong>kontextus</strong> rögzítését igényli – a lap fizikai geometriáját, az alapvonal görbéit, a átszivárgások korrekcióját, a marginaliákat, a rövidítéseket és a paleográfiai bizonytalanságot. Ez a specializált terület, amelyet gyakran a kézírásfelismerés (HTR) kategóriájába sorolják, erősen függ a képadatok és a szövegrétegek tárolására és cseréjére használt fájlformátumtól.</p>
<p>A rossz séma kiválasztása eltávolíthatja a létfontosságú alapvonal adatokat, megszakíthatja az IIIF (International Image Interoperability Framework) manifesztumokkal való összehangolást, vagy megakadályozhatja a hosszú távú digitális megőrzést. Íme egy végleges útmutató a történelmi dokumentumok vezető OCR és HTR fájlformátumairól, azok szerkezeti erősségeiről, valamint arról, hogyan határozhatja meg a megfelelő választást az archiválási folyamatához.</p>
<h2 id="a-történelmi-dilemma-miért-nem-működnek-az-egyszerű-szöveg15-és-a-szabványos-pdf-ek1">A történelmi dilemma: Miért nem működnek az <a href="https//docs.fileformat.com/word-processing/txt/">Egyszerű szöveg</a> és a szabványos <a href="https://docs.fileformat.com/pdf/">PDF-ek</a></h2>
<p>A géppel nyomtatott OCR gyakran egyszerű <code>.txt</code> fájlokat vagy &quot;szendvics&quot; PDF-eket állít elő, amelyek a szkennelés alatt rejtett szövegrétegeket tartalmaznak. Történelmi kéziratok és folyókézírás esetén ezek a kimenetek három fő okból hibásak:</p>
<ol>
<li><strong>Nemlineáris szöveg és összetett elrendezések:</strong> A történelmi írók nem tartották be a rendezett téglalap alakú rácsokat. A szöveg a margókba folyik, körbefut a díszített kezdőbetűk körül, átszövi a beillesztett interlineáris javításokat, vagy függőlegesen fut a gerinc mentén.</li>
<li><strong>Ívelt és ferde alapvonalak:</strong> A kézírás ritkán követ egy merev vízszintes tengelyt. Az olyan HTR motorok, mint a Transkribus, a Kraken és az eScriptorium, polilinés alapvonalakat használnak a kerethelyek helyett, hogy értelmezzék a ligatúrákkal teli írásokat.</li>
<li><strong>Paleográfiai komplexitás és metaadatok:</strong> Az archivális kutatás megköveteli a rövidítések, a történelmi helyesírási változatok, a sérült olvasatok és a soronkénti megbízhatósági pontszámok nyomon követését. A szabványos dokumentumformátumok elhagyják ezt a részletességet.</li>
</ol>
<p>Az eredeti lelet hűségének megőrzése érdekében az archiválási közösség strukturált XML sémákat használ, amelyek a layout topológiát a leírt szöveggel együtt őrzik.</p>
<h2 id="1-page-xml-az-aranyszabvány-a-kézírásos-szövegfelismeréshez-htr">1. PAGE XML: Az aranyszabvány a kézírásos szövegfelismeréshez (HTR)</h2>
<p>A PRImA (Pattern Recognition &amp; Image Analysis) Kutató Laboratórium által fejlesztett <strong>PAGE XML</strong> (Page Analysis and Groundtruth Elements) széles körben a kézírásos szövegfelismerés és a fejlett elrendezéselemzés csúcsformátumának tekintett.</p>
<h3 id="alapvető-architektúra">Alapvető architektúra</h3>
<p>A PAGE XML a fizikai dokumentumot hierarchikus struktúraként kezeli:</p>
<ul>
<li><code>PcGts</code> (Gyökér)
<ul>
<li><code>Page</code> (Kép méretei és az általános olvasási sorrend)
<ul>
<li><code>TextRegion</code> (Bekezdések, címsorok, margó jegyzetek, kulcsszavak)
<ul>
<li><code>TextLine</code>
<ul>
<li><code>Coords</code> (Poligon koordináták a vonal körül)</li>
<li><code>Baseline</code> (Pontok sorozata, amely a szöveg valódi alapvonalát követi)</li>
<li><code>TextEquiv</code> (A felismert szöveg, opcionális bizonyossági mutatókkal)</li>
</ul>
</li>
</ul>
</li>
</ul>
</li>
</ul>
</li>
</ul>
<h3 id="miért-kiemelkedő-a-történelmi-kéziratoknál">Miért kiemelkedő a történelmi kéziratoknál</h3>
<ul>
<li><strong>Poligon és Polivonal Pontosság:</strong> A karakterek téglalap alakú keretekbe kényszerítése helyett a PAGE XML többpontos poligon határokat és folyamatos alapvonalakat használ. Ez megakadályozza, hogy a átfedő kézírási felső- és alsó szárnyak beavatkozzanak a szegmentálásba.</li>
<li><strong>Részletes Strukturális Típusok:</strong> A régiók pontosan osztályozhatók (pl. <code>marginalia</code>, <code>drop-capital</code>, <code>signature-mark</code>, <code>header</code>, <code>editorial-note</code>).</li>
<li><strong>Széles szoftverkörnyezet:</strong> Elsődleges belső és export séma a zászlóshajó HTR platformokhoz, mint a <strong>Transkribus</strong>, <strong>eScriptorium</strong> és a <strong>Kraken</strong>.</li>
</ul>
<h2 id="2-alto-xml-a-könyvtárak-és-archívumok-erőműve">2. ALTO XML: A könyvtárak és archívumok erőműve</h2>
<p><strong>ALTO (Analyzed Layout and Text Object)</strong> egy nyílt XML szabvány, amelyet a Kongresszusi Könyvtár tart karban, és amelyet széles körben alkalmaznak a nemzeti könyvtárak, köztük a Bibliothèque nationale de France (BnF) és a British Library.</p>
<h3 id="alapvető-architektúra-1">Alapvető architektúra</h3>
<p>Az ALTO hierarchikusan strukturálja az elrendezést a <code>Page</code>-től a <code>PrintSpace</code>-ig, lejjebb a <code>TextBlock</code>, <code>TextLine</code> és <code>String</code> (egyes szavak vagy tokenek) elemekig. Gyakran egy <strong>METS</strong> (Metadata Encoding and Transmission Standard) burkolóba csomagolják, hogy a strukturális metaadatokat magas felbontású mesterképekkel társítsa.</p>
<h3 id="fő-erősségek-és-felhasználási-esetek">Fő erősségek és felhasználási esetek</h3>
<ul>
<li><strong>Tömeges digitalizálási munkafolyamatok:</strong> Az ALTO-t ipari méretű újság- és könyvdigitalizálásra tervezték. Tiszta módon kódolja a betűtípus attribútumokat, a szavak szintű koordinátákat, a karakterek megbízhatóságát és a szóközöket.</li>
<li><strong>Modern HTR támogatás (ALTO 4):</strong> Az ALTO korábbi verziói erősen támaszkodtak a téglalap koordinátákra (<code>HPOS</code>, <code>VPOS</code>, <code>WIDTH</code>, <code>HEIGHT</code>). Azonban a <strong>ALTO 4-es verzióval</strong> a séma bevezette a <code>&lt;Shape&gt;</code> sokszögeket és a vonallánc alapvonalakat, ezzel lezárva a funkcionális szakadékot a PAGE XML-lel a kézírásos anyagok esetében.</li>
<li><strong>Hosszú távú megőrzés:</strong> Mivel egy nemzetközi könyvtári konzorciumok által támogatott hivatalos szabvány, az ALTO garantálja a hosszú távú stabilitást és az archív szintű visszafelé kompatibilitást.</li>
</ul>
<h2 id="3-hocr-a-webelső-könnyűsúlyú-szabvány">3. hOCR: A web‑első, könnyűsúlyú szabvány</h2>
<p>Thomas Breuel által létrehozott <strong>hOCR</strong> pragmatikus megközelítést alkalmaz: ahelyett, hogy teljesen új XML sémát hozna létre, a layout és a transzkripció metaadatait közvetlenül a szemantikus HTML/XHTML-be ágyazza be mikroformátumok és osztályattribútumok használatával.</p>
<h3 id="tipikus-szintaxis-példa">Tipikus szintaxis példa</h3>
<div class="highlight"><pre tabindex="0" style="color:#f8f8f2;background-color:#272822;-moz-tab-size:4;-o-tab-size:4;tab-size:4;"><code class="language-html" data-lang="html"><span style="display:flex;"><span>&lt;<span style="color:#f92672">div</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_page&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;page_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 0 0 2480 3508&#34;</span>&gt;
</span></span><span style="display:flex;"><span>  &lt;<span style="color:#f92672">div</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_carea&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;block_1_1&#34;</span>&gt;
</span></span><span style="display:flex;"><span>    &lt;<span style="color:#f92672">p</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_par&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;par_1_1&#34;</span>&gt;
</span></span><span style="display:flex;"><span>      &lt;<span style="color:#f92672">span</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_line&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;line_1_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 150 320 2200 410; baseline 0 -5&#34;</span>&gt;
</span></span><span style="display:flex;"><span>        &lt;<span style="color:#f92672">span</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocrx_word&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;word_1_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 150 325 380 405; x_wconf 92&#34;</span>&gt;Kezdet&lt;/<span style="color:#f92672">span</span>&gt;
</span></span><span style="display:flex;"><span>      &lt;/<span style="color:#f92672">span</span>&gt;
</span></span><span style="display:flex;"><span>    &lt;/<span style="color:#f92672">p</span>&gt;
</span></span><span style="display:flex;"><span>  &lt;/<span style="color:#f92672">div</span>&gt;
</span></span><span style="display:flex;"><span>&lt;/<span style="color:#f92672">div</span>&gt;
</span></span></code></pre></div><h3 id="előnyök-és-hátrányok-a-történelmi-anyagok-esetében">Előnyök és hátrányok a történelmi anyagok esetében</h3>
<ul>
<li><strong>Előnyök:</strong> A böngészők natívan megjeleníthetik. Könnyen átalakítható vanilla CSS és JavaScript segítségével, és ez az alapértelmezett strukturált exportformátum olyan motorok számára, mint a <strong>Tesseract</strong>.</li>
<li><strong>Hátrányok:</strong> A komplex, szabad formájú többpontos alapvonal görbék natív támogatása korlátozott. Bár a korai nyomtatott művek (incunabula vagy tiszta plakátok) esetén praktikus, a hOCR nehezen birkózik meg a változatos kézirati elrendezésekkel és a több rétegű marginaliákkal.</li>
</ul>
<h2 id="4-tei-xml-az-akadémiai-és-digitális-bölcsészet-benchmarkja">4. TEI-XML: Az akadémiai és digitális bölcsészet benchmarkja</h2>
<p>A <strong>Text Encoding Initiative (TEI)</strong> formátum nem kifejezetten OCR motor kimeneti formátum; inkább a kritikus digitális kiadások és a irodalmi és történelmi szövegek tudományos ábrázolásának vezető szabványa.</p>
<h3 id="ocrhtr-csatlakoztatása-a-tei-hez">OCR/HTR csatlakoztatása a TEI-hez</h3>
<p>A modern feldolgozási láncok ritkán állnak meg a nyers karakterfelismerésnél. A tudósok olyan eszközöket használnak, mint a <strong>Transkribus TEI Exporter</strong>, vagy automatizált XSLT csővezetékek a PAGE XML vagy ALTO fájlok TEI-megfelelő XML-re történő átalakításához:</p>
<ul>
<li>A rövidítéseket kibontják (<code>&lt;choice&gt;&lt;abbr&gt;...&lt;/abbr&gt;&lt;expan&gt;...&lt;/expan&gt;&lt;/choice&gt;</code>).</li>
<li>A törléseket, hozzáadásokat és a kézírási kézjeleket formálisan osztályozzák (<code>&lt;add&gt;</code>, <code>&lt;del&gt;</code>, <code>&lt;handShift&gt;</code>).</li>
<li>Az elrendezési adatokat a <code>&lt;facsimile&gt;</code> és <code>&lt;surface&gt;</code> elemek segítségével a irodalmi elemzéssel együtt őrzik meg.</li>
</ul>
<p>Ha a történelmi projektje interaktív kritikai kiadást vagy szemantikai kereshető tudományos archívumot kíván létrehozni, az OCR/HTR adatok TEI-XML-re konvertálása gyakran a szükséges végső lépés.</p>
<h2 id="összehasonlító-mátrix-ocrhtr-formátumok-áttekintése">Összehasonlító mátrix: OCR/HTR formátumok áttekintése</h2>
<table>
<thead>
<tr>
<th style="text-align:left">Jellemző / Kritérium</th>
<th style="text-align:left">PAGE XML</th>
<th style="text-align:left">ALTO XML (v4+)</th>
<th style="text-align:left">hOCR</th>
<th style="text-align:left">TEI-XML</th>
</tr>
</thead>
<tbody>
<tr>
<td style="text-align:left"><strong>Elsődleges tartomány</strong></td>
<td style="text-align:left">Kézírás HTR és kéziratok</td>
<td style="text-align:left">Tömeges könyvtári digitalizáció</td>
<td style="text-align:left">Webes OCR és könnyű keresés</td>
<td style="text-align:left">Tudományos kritikai kiadások</td>
</tr>
<tr>
<td style="text-align:left"><strong>Alapvető támogatás</strong></td>
<td style="text-align:left">Natív, többpontos vonalláncok</td>
<td style="text-align:left">Támogatott (v4.0 óta)</td>
<td style="text-align:left">Alap (Meredekség/Eltolás)</td>
<td style="text-align:left">Fakszimile leképezésen keresztül</td>
</tr>
<tr>
<td style="text-align:left"><strong>Rendellenes sokszögek</strong></td>
<td style="text-align:left">Teljes</td>
<td style="text-align:left">Teljes</td>
<td style="text-align:left">Korlátozott</td>
<td style="text-align:left">Koordinátaelemeken keresztül</td>
</tr>
<tr>
<td style="text-align:left"><strong>Eszközök ökoszisztémája</strong></td>
<td style="text-align:left">Transkribus, eScriptorium</td>
<td style="text-align:left">METS, Goobi, Kitodo</td>
<td style="text-align:left">Tesseract, Web megjelenítők</td>
<td style="text-align:left">Oxygen, TEI Publisher</td>
</tr>
<tr>
<td style="text-align:left"><strong>Szabványosító testület</strong></td>
<td style="text-align:left">PRImA Group / Open</td>
<td style="text-align:left">Kongresszusi Könyvtár</td>
<td style="text-align:left">Közösségi specifikáció</td>
<td style="text-align:left">TEI Konzorcium</td>
</tr>
</tbody>
</table>
<h2 id="gyakorlati-ajánlások-az-archiválási-folyamat-kiválasztása">Gyakorlati ajánlások: Az archiválási folyamat kiválasztása</h2>
<p>Egy hatékony, jövőbiztos digitalizációs folyamat kiépítéséhez:</p>
<ol>
<li><strong>Tiszta kézírásos kéziratok és archívumok esetén:</strong>
Standardizálja a transzkripciót és az elrendezés kinyerését a <strong>PAGE XML</strong> segítségével. Ennek alapvonal-számítása és poligon-kontúrozása a nem szabványos kézírásokat minimális adatveszteséggel kezeli.</li>
<li><strong>Nagy léptékű könyvtárak és vegyes gyűjtemények esetén:</strong>
Válassza a <strong>ALTO XML (v4.2 vagy újabb)</strong>-t <strong>METS</strong>-szel párosítva. Ez garantálja a zökkenőmentes integrációt a szabványos digitális tároló architektúrákba és digitális eszközkezelő rendszerekbe (DAMS).</li>
<li><strong>Webes megjelenítés és teljes szöveges keresési indexek esetén:</strong>
Használja a <strong>hOCR</strong>-t, vagy származtasson könnyű GeoJSON/Web Annotation struktúrákat a PAGE XML-ből, hogy interaktív IIIF nézőket (például Mirador vagy Universal Viewer) működtessen élő, böngészőben megjelenő szövegátfedésekkel.</li>
<li><strong>Tudományos kiadásokhoz és paleográfiai kutatáshoz:</strong>
Generálja a ground truth adatot PAGE XML-ben, végezzen felismerést, és a kimenetet egy automatizált konverteren keresztül alakítsa <strong>TEI-XML</strong>-re a szerkesztői jelöléshez.</li>
</ol>
<p>Azáltal, hogy ezeknek a formátumoknak a szerkezeti képességeit a forrásanyag paleográfiai igényeihez igazítja, biztosítja, hogy minden vonás, rövidítés és történelmi árnyalat évszázadokig értelmezhető maradjon.</p>
<h2 id="gyakran-ismételt-kérdések-gyik">Gyakran Ismételt Kérdések (GYIK)</h2>
<p><strong>Q1. Mi a alapvető különbség a standard OCR és a HTR között?</strong> Az OCR a konzisztens géppel nyomtatott tipográfiát ismeri fel, míg a HTR (Handwritten Text Recognition) mély neurális hálózatokat használ a folyamatos, változó kézírás és ívelt alapvonalak dekódolására.</p>
<p><strong>Q2. Tud-e a Tesseract OCR PAGE XML vagy ALTO kimenetet előállítani történelmi dokumentumokhoz?</strong> Igen, a Tesseract képes natív ALTO XML és hOCR kimenetet generálni, és harmadik féltől származó csomagolók átalakíthatják ezeket az eredményeket PAGE XML-re.</p>
<p><strong>Q3. Miért fontosabbak az alapvonalak, mint a körülhatároló dobozok a kézírásos szöveg átírásában?</strong> Az alapvonalak nyomon követik az emberi kézírás természetes, hullámzó vonalát, lehetővé téve a szoftver számára, hogy szétválassza a átfedő felső- és alsó karaktereket, amelyek egy szilárd körülhatároló dobozban ütköznek.</p>
<p><strong>Q4. Hogyan lép kölcsönhatásba az IIIF szabvány ezekkel az OCR fájlformátumokkal?</strong> Az IIIF nagy felbontású képeket szolgáltat nyílt web API-ken keresztül, míg az ALTO vagy a PAGE XML formátumok koordináta adatokat biztosítanak, amelyeket IIIF Content Search annotációkká lehet konvertálni.</p>
<p><strong>Q5. Melyik fájlformátum a legegyszerűbb közvetlenül kereshető PDF‑vé konvertálni?</strong> Mind a hOCR, mind az ALTO XML párosítható az eredeti oldalképekkel, hogy kereshető kétszintű PDF‑fájlokat hozzanak létre olyan eszközökkel, mint az OCRmyPDF.</p>
<h2 id="lásd-még">Lásd még</h2>
<ul>
<li><a href="https://blog.fileformat.com/en/pdf/pdfa-3-the-hybrid-monster-embedding-original-data-inside-your-ocr/">PDF/A-3 – A Hibrid Szörnyeteg? Eredeti Adatok Beágyazása az OCR-be</a></li>
<li><a href="https://blog.fileformat.com/ocr/understanding-ocr-file-formats-hocr-vs-alto-vs-pdfa-explained/">Az OCR fájlformátumok megértése – HOCR vs ALTO vs PDF/A magyarázata</a></li>
<li><a href="https://blog.fileformat.com/pdf/what-is-the-difference-between-pdf-and-fdf/">Mi a különbség a PDF és az FDF között?</a></li>
<li><a href="https://blog.fileformat.com/pdf/what-is-fdf-used-for/">Mire használják az FDF-et? A Formák Adatformátumának céljának megértése</a></li>
<li><a href="https://blog.fileformat.com/file-formats/pdf-vs-word-which-one-should-you-use-and-when/">PDF vs Word: Melyiket kellene használnod és mikor?</a></li>
</ul>
<!-- raw HTML omitted -->
]]></content:encoded>
    </item>
    
  </channel>
</rss>
