<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>OCR vs HTR on File Format Blog</title>
    <link>https://blog.fileformat.com/vi/tag/ocr-vs-htr/</link>
    <description>Recent content in OCR vs HTR on File Format Blog</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>vi</language>
    <lastBuildDate>Wed, 07 Oct 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://blog.fileformat.com/vi/tag/ocr-vs-htr/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Cách Chọn Định Dạng Tệp Phù Hợp cho Nhận Dạng Văn Bản Viết Tay (HTR)</title>
      <link>https://blog.fileformat.com/vi/ocr/ocr-file-formats-for-historical-and-handwritten-documents/</link>
      <pubDate>Wed, 07 Oct 2026 00:00:00 +0000</pubDate>
      
      <guid>https://blog.fileformat.com/vi/ocr/ocr-file-formats-for-historical-and-handwritten-documents/</guid>
      <description>Khám phá các định dạng tệp OCR và HTR tốt nhất cho bản thảo lịch sử và kho lưu trữ viết tay, so sánh ALTO, PAGE XML, hOCR và TEI-XML.</description>
      <content:encoded><![CDATA[<p><strong>Cập nhật lần cuối</strong>: 20 Tháng 8, 2026</p>
<figure class="align-center ">
    <img loading="lazy" src="images/ocr-file-formats-for-historical-and-handwritten-documents.png#center"
         alt="OCR File Formats for Historical and Handwritten Documents"/> 
</figure>

<h2 id="định-dạng-tệp-ocr-cho-tài-liệu-lịch-sử-và-viết-tay">Định dạng tệp OCR cho tài liệu lịch sử và viết tay</h2>
<p>Bảo tồn di sản văn hoá thông qua số hoá đã bước vào một thời kỳ phục hưng. Trong khi các hệ thống nhận dạng ký tự quang học (OCR) ban đầu được thiết kế để xử lý các tài liệu in máy sạch sẽ, không tì vết của thế kỷ XX, các tổ chức di sản văn hoá hiện đại đang đối mặt với một thách thức phức tạp và phong phú hơn: bản thảo trung cổ, thư từ viết tay cursive của thế kỷ XIX, các cuốn sách minh hoạ dễ gãy, và các sổ đăng ký có tuổi đời hàng thế kỷ.</p>
<p>Việc chép lại các tài liệu lịch sử không còn chỉ là trích xuất văn bản ASCII đơn giản. Nó đòi hỏi việc nắm bắt <strong>ngữ cảnh</strong>—địa hình vật lý của trang, các đường cong baseline, sửa chữa hiện tượng thấm mực, ghi chú lề, viết tắt và sự không chắc chắn trong paleography. Lĩnh vực chuyên môn này, thường được xếp vào Nhận dạng Văn bản Thủ viết (HTR), phụ thuộc mạnh mẽ vào định dạng tệp được sử dụng để lưu trữ và trao đổi cả tọa độ hình ảnh và lớp văn bản.</p>
<p>Việc chọn sai lược đồ có thể làm mất dữ liệu baseline quan trọng, phá vỡ sự đồng bộ với các manifest của IIIF (International Image Interoperability Framework), hoặc ngăn cản việc bảo tồn kỹ thuật số lâu dài. Dưới đây là hướng dẫn chi tiết về các định dạng tệp OCR và HTR hàng đầu cho tài liệu lịch sử, những điểm mạnh cấu trúc của chúng, và cách xác định lựa chọn phù hợp cho quy trình lưu trữ của bạn.</p>
<h2 id="nghịch-lý-lịch-sử-tại-sao-văn-bản-thuần15-và-pdf1-tiêu-chuẩn-không-hiệu-quả">Nghịch lý lịch sử: Tại sao <a href="https//docs.fileformat.com/word-processing/txt/">Văn bản thuần</a> và <a href="https://docs.fileformat.com/pdf/">PDF</a> tiêu chuẩn không hiệu quả</h2>
<p>OCR in máy thường xuất ra các tệp <code>.txt</code> đơn giản hoặc PDF &ldquo;sandwich&rdquo; với các lớp văn bản ẩn phía dưới bản quét. Đối với bản thảo lịch sử và chữ viết tay cursive, các đầu ra này thất bại vì ba lý do cốt lõi:</p>
<ol>
<li><strong>Văn bản phi tuyến và bố cục phức tạp:</strong> Các nhà viết tay lịch sử không tuân theo các lưới hình chữ nhật gọn gàng. Văn bản chảy vào lề, quấn quanh các chữ cái đầu được trang trí, dệt xen kẽ giữa các sửa chữa nội dòng được chèn vào, hoặc chạy dọc theo gáy sách.</li>
<li><strong>Đường cơ sở cong và nghiêng:</strong> Văn viết tay thường không tuân theo trục ngang cứng nhắc. Các công cụ HTR như Transkribus, Kraken và eScriptorium dựa vào các đường cơ sở dạng polyline thay vì các hộp bao để giải thích các chữ viết có nhiều ligature.</li>
<li><strong>Độ phức tạp cổ văn và siêu dữ liệu:</strong> Nghiên cứu lưu trữ đòi hỏi việc theo dõi các từ viết tắt, biến thể chính tả lịch sử, các đoạn đọc bị hư hỏng và điểm tin cậy ở mức dòng. Các định dạng tài liệu tiêu chuẩn loại bỏ độ chi tiết này.</li>
</ol>
<p>Để duy trì độ trung thực với hiện vật gốc, cộng đồng lưu trữ dựa vào các sơ đồ XML có cấu trúc được thiết kế để bảo tồn cấu trúc bố cục cùng với văn bản đã sao chép.</p>
<h2 id="1-page-xml-tiêu-chuẩn-vàng-cho-nhận-dạng-văn-bản-viết-tay-htr">1. PAGE XML: Tiêu chuẩn vàng cho Nhận dạng Văn bản viết tay (HTR)</h2>
<p>Được phát triển bởi Phòng thí nghiệm Nghiên cứu PRImA (Pattern Recognition &amp; Image Analysis), <strong>PAGE XML</strong> (Page Analysis and Groundtruth Elements) được xem rộng rãi là định dạng tiên tiến nhất cho nhận dạng văn bản viết tay và phân tích bố cục nâng cao.</p>
<h3 id="kiến-trúc-cốt-lõi">Kiến trúc cốt lõi</h3>
<p>PAGE XML coi tài liệu vật lý như một cấu trúc phân cấp:</p>
<ul>
<li><code>PcGts</code> (Gốc)
<ul>
<li><code>Page</code> (Kích thước hình ảnh và thứ tự đọc tổng thể)
<ul>
<li><code>TextRegion</code> (Đoạn văn, tiêu đề, ghi chú lề, từ khóa)
<ul>
<li><code>TextLine</code>
<ul>
<li><code>Coords</code> (Tọa độ đa giác quanh dòng)</li>
<li><code>Baseline</code> (Một chuỗi các điểm theo đường cơ sở thực của văn bản)</li>
<li><code>TextEquiv</code> (Văn bản đã nhận dạng, kèm các chỉ số độ tin cậy tùy chọn)</li>
</ul>
</li>
</ul>
</li>
</ul>
</li>
</ul>
</li>
</ul>
<h3 id="lý-do-nó-xuất-sắc-cho-bản-thảo-lịch-sử">Lý do nó xuất sắc cho bản thảo lịch sử</h3>
<ul>
<li><strong>Độ chính xác Đa giác và Đa đường:</strong> Thay vì ép các ký tự vào các hộp bao hình chữ nhật, PAGE XML sử dụng ranh giới đa điểm đa giác và các đường cơ sở liên tục. Điều này ngăn các phần trên và dưới của chữ viết tay chồng lấn gây cản trở việc phân đoạn.</li>
<li><strong>Các loại cấu trúc chi tiết:</strong> Các vùng có thể được phân loại một cách chính xác (ví dụ, <code>marginalia</code>, <code>drop-capital</code>, <code>signature-mark</code>, <code>header</code>, <code>editorial-note</code>).</li>
<li><strong>Hệ sinh thái phần mềm rộng lớn:</strong> Nó phục vụ như lược đồ nội bộ và xuất khẩu chính cho các nền tảng HTR hàng đầu như <strong>Transkribus</strong>, <strong>eScriptorium</strong>, và <strong>Kraken</strong>.</li>
</ul>
<h2 id="2-alto-xml-trụ-cột-mạnh-mẽ-cho-thư-viện-và-lưu-trữ">2. ALTO XML: Trụ cột mạnh mẽ cho Thư viện và Lưu trữ</h2>
<p><strong>ALTO (Analyzed Layout and Text Object)</strong> là một tiêu chuẩn XML mở do Thư viện Quốc hội Hoa Kỳ duy trì và được nhiều thư viện quốc gia áp dụng rộng rãi, bao gồm Thư viện Quốc gia Pháp (BnF) và Thư viện Anh.</p>
<h3 id="kiến-trúc-cốt-lõi-1">Kiến trúc cốt lõi</h3>
<p>ALTO cấu trúc bố cục theo cấp bậc từ <code>Page</code> đến <code>PrintSpace</code>, sau đó đến <code>TextBlock</code>, <code>TextLine</code>, và <code>String</code> (các từ hoặc token riêng lẻ). Nó thường được đóng gói trong một lớp bao <strong>METS</strong> (Metadata Encoding and Transmission Standard) để liên kết siêu dữ liệu cấu trúc với các hình ảnh gốc độ phân giải cao.</p>
<h3 id="các-điểm-mạnh-chính-và-trường-hợp-sử-dụng">Các điểm mạnh chính và trường hợp sử dụng</h3>
<ul>
<li><strong>Quy trình số hoá hàng loạt:</strong> ALTO được thiết kế với mục tiêu số hoá báo chí và sách ở quy mô công nghiệp. Nó mã hoá một cách sạch sẽ các thuộc tính phông chữ, tọa độ mức từ, độ tin cậy của ký tự, và khoảng trắng.</li>
<li><strong>Hỗ trợ HTR hiện đại (ALTO 4):</strong> Các phiên bản trước của ALTO dựa mạnh vào các tọa độ hình chữ nhật (<code>HPOS</code>, <code>VPOS</code>, <code>WIDTH</code>, <code>HEIGHT</code>). Tuy nhiên, bắt đầu với <strong>phiên bản ALTO 4</strong>, lược đồ đã giới thiệu các đa giác <code>&lt;Shape&gt;</code> và đường cơ sở polyline, lấp đầy khoảng trống chức năng so với PAGE XML cho tài liệu viết tay.</li>
<li><strong>Bảo tồn lâu dài:</strong> Vì đây là tiêu chuẩn chính thức được hỗ trợ bởi các liên minh thư viện quốc tế, ALTO đảm bảo tính ổn định lâu dài và khả năng tương thích ngược cấp lưu trữ.</li>
</ul>
<h2 id="3-hocr-tiêu-chuẩn-nhẹ-ưu-tiên-web">3. hOCR: Tiêu chuẩn nhẹ, ưu tiên web</h2>
<p>Được tạo ra bởi Thomas Breuel, <strong>hOCR</strong> áp dụng cách tiếp cận thực dụng: thay vì tạo một lược đồ XML hoàn toàn mới, nó nhúng siêu dữ liệu bố cục và phiên âm trực tiếp vào HTML/XHTML ngữ nghĩa bằng cách sử dụng microformat và thuộc tính lớp.</p>
<h3 id="ví-dụ-cú-pháp-điển-hình">Ví dụ cú pháp điển hình</h3>
<div class="highlight"><pre tabindex="0" style="color:#f8f8f2;background-color:#272822;-moz-tab-size:4;-o-tab-size:4;tab-size:4;"><code class="language-html" data-lang="html"><span style="display:flex;"><span>&lt;<span style="color:#f92672">div</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_page&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;page_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 0 0 2480 3508&#34;</span>&gt;
</span></span><span style="display:flex;"><span>  &lt;<span style="color:#f92672">div</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_carea&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;block_1_1&#34;</span>&gt;
</span></span><span style="display:flex;"><span>    &lt;<span style="color:#f92672">p</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_par&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;par_1_1&#34;</span>&gt;
</span></span><span style="display:flex;"><span>      &lt;<span style="color:#f92672">span</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocr_line&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;line_1_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 150 320 2200 410; baseline 0 -5&#34;</span>&gt;
</span></span><span style="display:flex;"><span>        &lt;<span style="color:#f92672">span</span> <span style="color:#a6e22e">class</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;ocrx_word&#34;</span> <span style="color:#a6e22e">id</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;word_1_1&#34;</span> <span style="color:#a6e22e">title</span><span style="color:#f92672">=</span><span style="color:#e6db74">&#34;bbox 150 325 380 405; x_wconf 92&#34;</span>&gt;Mở đầu&lt;/<span style="color:#f92672">span</span>&gt;
</span></span><span style="display:flex;"><span>      &lt;/<span style="color:#f92672">span</span>&gt;
</span></span><span style="display:flex;"><span>    &lt;/<span style="color:#f92672">p</span>&gt;
</span></span><span style="display:flex;"><span>  &lt;/<span style="color:#f92672">div</span>&gt;
</span></span><span style="display:flex;"><span>&lt;/<span style="color:#f92672">div</span>&gt;
</span></span></code></pre></div><h3 id="ưu-và-nhược-điểm-cho-tài-liệu-lịch-sử">Ưu và nhược điểm cho tài liệu lịch sử</h3>
<ul>
<li><strong>Ưu điểm:</strong> Trình duyệt có thể hiển thị nó một cách tự nhiên. Nó dễ dàng được chuyển đổi bằng CSS và JavaScript thuần, và là định dạng xuất có cấu trúc mặc định cho các công cụ như <strong>Tesseract</strong>.</li>
<li><strong>Nhược điểm:</strong> Hỗ trợ gốc cho các đường cơ sở cong đa điểm phức tạp, tự do là hạn chế. Mặc dù thực tế cho các tác phẩm in sớm (incunabula hoặc bản in sạch), hOCR gặp khó khăn với bố cục bản thảo hỗn loạn và các ghi chú lề đa lớp.</li>
</ul>
<h2 id="4-tei-xml-tiêu-chuẩn-cho-học-thuật-và-nhân-văn-số">4. TEI-XML: Tiêu chuẩn cho học thuật và nhân văn số</h2>
<p>Định dạng <strong>Text Encoding Initiative (TEI)</strong> không phải là định dạng đầu ra của công cụ OCR một cách nghiêm ngặt; thay vào đó, nó là tiêu chuẩn hàng đầu cho các ấn bản kỹ thuật số phê bình và việc biểu diễn học thuật các văn bản văn học và lịch sử.</p>
<h3 id="kết-nối-ocrhtr-với-tei">Kết nối OCR/HTR với TEI</h3>
<p>Các quy trình hiện đại hiếm khi dừng lại ở việc nhận dạng ký tự thô. Các học giả sử dụng các công cụ như <strong>Transkribus TEI Exporter</strong> hoặc các quy trình XSLT tự động để chuyển đổi PAGE XML hoặc tệp ALTO thành XML tuân theo TEI:</p>
<ul>
<li>Các từ viết tắt được mở rộng (<code>&lt;choice&gt;&lt;abbr&gt;...&lt;/abbr&gt;&lt;expan&gt;...&lt;/expan&gt;&lt;/choice&gt;</code>).</li>
<li>Các phần xóa, thêm và tay viết được phân loại chính thức (<code>&lt;add&gt;</code>, <code>&lt;del&gt;</code>, <code>&lt;handShift&gt;</code>).</li>
<li>Dữ liệu bố cục được bảo tồn cùng với phân tích văn học thông qua các phần tử <code>&lt;facsimile&gt;</code> và <code>&lt;surface&gt;</code>.</li>
</ul>
<p>Nếu dự án lịch sử của bạn nhằm tạo ra một ấn bản phê bình tương tác hoặc một kho lưu trữ học thuật có khả năng tìm kiếm ngữ nghĩa, việc chuyển đổi dữ liệu OCR/HTR của bạn sang TEI-XML thường là bước cuối cùng cần thiết.</p>
<h2 id="ma-trận-so-sánh-định-dạng-ocrhtr-trong-một-cái-nhìn">Ma trận so sánh: Định dạng OCR/HTR trong một cái nhìn</h2>
<table>
<thead>
<tr>
<th style="text-align:left">Tính năng / Tiêu chí</th>
<th style="text-align:left">PAGE XML</th>
<th style="text-align:left">ALTO XML (v4+)</th>
<th style="text-align:left">hOCR</th>
<th style="text-align:left">TEI-XML</th>
</tr>
</thead>
<tbody>
<tr>
<td style="text-align:left"><strong>Miền chính</strong></td>
<td style="text-align:left">HTR viết tay &amp; Bản thảo</td>
<td style="text-align:left">Số hoá Thư viện Đại chúng</td>
<td style="text-align:left">OCR Web &amp; Tìm kiếm Nhẹ</td>
<td style="text-align:left">Bản phê bình học thuật</td>
</tr>
<tr>
<td style="text-align:left"><strong>Hỗ trợ Cơ bản</strong></td>
<td style="text-align:left">Gốc, Polyline đa điểm</td>
<td style="text-align:left">Được hỗ trợ (từ v4.0)</td>
<td style="text-align:left">Cơ bản (Độ dốc/Độ dịch)</td>
<td style="text-align:left">Thông qua ánh xạ sao chép</td>
</tr>
<tr>
<td style="text-align:left"><strong>Đa giác bất thường</strong></td>
<td style="text-align:left">Đầy đủ</td>
<td style="text-align:left">Đầy đủ</td>
<td style="text-align:left">Giới hạn</td>
<td style="text-align:left">Thông qua các phần tử tọa độ</td>
</tr>
<tr>
<td style="text-align:left"><strong>Hệ sinh thái công cụ</strong></td>
<td style="text-align:left">Transkribus, eScriptorium</td>
<td style="text-align:left">METS, Goobi, Kitodo</td>
<td style="text-align:left">Tesseract, Trình xem web</td>
<td style="text-align:left">Oxygen, TEI Publisher</td>
</tr>
<tr>
<td style="text-align:left"><strong>Cơ quan tiêu chuẩn hoá</strong></td>
<td style="text-align:left">PRImA Group / Open</td>
<td style="text-align:left">Thư viện Quốc hội</td>
<td style="text-align:left">Đặc tả cộng đồng</td>
<td style="text-align:left">Liên minh TEI</td>
</tr>
</tbody>
</table>
<h2 id="khuyến-nghị-thực-tiễn-lựa-chọn-quy-trình-lưu-trữ-của-bạn">Khuyến nghị thực tiễn: Lựa chọn quy trình lưu trữ của bạn</h2>
<p>Để thiết lập một quy trình số hóa hiệu quả, bền vững cho tương lai:</p>
<ol>
<li><strong>Đối với Bản thảo và Lưu trữ Viết tay Thuần túy:</strong>
Chuẩn hoá việc sao chép và trích xuất bố cục của bạn trên <strong>PAGE XML</strong>. Việc tính toán đường cơ sở và vẽ đa giác của nó xử lý các nét viết không chuẩn với mức mất dữ liệu tối thiểu.</li>
<li><strong>Đối với Thư viện Quy mô Lớn và Bộ sưu tập Hỗn hợp:</strong>
Chọn <strong>ALTO XML (v4.2 hoặc cao hơn)</strong> kết hợp với <strong>METS</strong>. Điều này đảm bảo tích hợp liền mạch vào kiến trúc kho lưu trữ kỹ thuật số tiêu chuẩn và hệ thống quản lý tài sản kỹ thuật số (DAMS).</li>
<li><strong>Đối với Trình bày Web &amp; Chỉ mục Tìm kiếm Toàn văn:</strong>
Sử dụng <strong>hOCR</strong> hoặc tạo ra các cấu trúc GeoJSON/Annotation Web nhẹ từ PAGE XML để điều khiển các trình xem IIIF tương tác (như Mirador hoặc Universal Viewer) với các lớp phủ văn bản trực tiếp trong trình duyệt.</li>
<li><strong>Cho các ấn bản học thuật &amp; Nghiên cứu cổ văn bản:</strong>
Tạo dữ liệu ground truth của bạn ở định dạng PAGE XML, thực hiện nhận dạng, và truyền đầu ra qua một bộ chuyển đổi tự động để tạo <strong>TEI-XML</strong> cho việc đánh dấu biên tập.</li>
</ol>
<p>Bằng cách ghép nối khả năng cấu trúc của các định dạng này với yêu cầu cổ văn bản của tài liệu nguồn, bạn đảm bảo rằng mọi nét viết, viết tắt và sắc thái lịch sử đều được giải mã được trong nhiều thế kỷ tới.</p>
<h2 id="câu-hỏi-thường-gặp-faq">Câu hỏi thường gặp (FAQ)</h2>
<p><strong>Q1. Sự khác biệt cơ bản giữa OCR tiêu chuẩn và HTR là gì?</strong> OCR nhận dạng kiểu chữ máy in đồng nhất, trong khi HTR (Nhận dạng Văn bản viết tay) sử dụng mạng nơ-ron sâu để giải mã chữ viết tay liên tục, biến đổi của con người và các đường cơ sở cong.</p>
<p><strong>Q2. Tesseract OCR có thể tạo ra PAGE XML hoặc đầu ra ALTO cho tài liệu lịch sử không?</strong> Có, Tesseract có thể tạo XML ALTO gốc và đầu ra hOCR, và các wrapper của bên thứ ba có thể chuyển đổi các kết quả này sang PAGE XML.</p>
<p><strong>Q3. Tại sao các đường cơ sở lại quan trọng hơn các hộp bao quanh trong việc chuyển đổi văn bản viết tay?</strong> Các đường cơ sở theo dõi đường nét tự nhiên, gợn sóng của chữ viết tay con người, cho phép phần mềm tách các phần lên và xuống chồng chéo mà va chạm trong các hộp bao quanh cứng nhắc.</p>
<p><strong>Câu 4. Tiêu chuẩn IIIF tương tác như thế nào với các định dạng tệp OCR này?</strong> IIIF cung cấp hình ảnh độ phân giải cao thông qua các API web mở, trong khi các định dạng như ALTO hoặc PAGE XML cung cấp dữ liệu tọa độ có thể được chuyển đổi thành các chú thích Tìm kiếm Nội dung IIIF.</p>
<p><strong>Câu 5. Định dạng tệp nào dễ dàng chuyển đổi trực tiếp thành PDF có thể tìm kiếm?</strong> Cả hOCR và ALTO XML đều có thể kết hợp với hình ảnh trang gốc để tạo ra các tệp PDF hai lớp có thể tìm kiếm bằng các công cụ như OCRmyPDF.</p>
<h2 id="xem-thêm">Xem Thêm</h2>
<ul>
<li><a href="https://blog.fileformat.com/en/pdf/pdfa-3-the-hybrid-monster-embedding-original-data-inside-your-ocr/">PDF/A-3 - Quái vật lai? Nhúng dữ liệu gốc vào OCR của bạn</a></li>
<li><a href="https://blog.fileformat.com/ocr/understanding-ocr-file-formats-hocr-vs-alto-vs-pdfa-explained/">Hiểu về các Định dạng Tệp OCR - Giải thích HOCR vs ALTO vs PDF/A</a></li>
<li><a href="https://blog.fileformat.com/pdf/what-is-the-difference-between-pdf-and-fdf/">Sự khác nhau giữa PDF và FDF là gì?</a></li>
<li><a href="https://blog.fileformat.com/pdf/what-is-fdf-used-for/">FDF được dùng để làm gì? Hiểu mục đích của Định dạng Dữ liệu Biểu mẫu</a></li>
<li><a href="https://blog.fileformat.com/file-formats/pdf-vs-word-which-one-should-you-use-and-when/">PDF vs Word: Nên dùng cái nào và khi nào?</a></li>
</ul>
<!-- raw HTML omitted -->
]]></content:encoded>
    </item>
    
  </channel>
</rss>
