<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>Komprimering i PPTX on File Format Blog</title>
    <link>https://blog.fileformat.com/da/tag/komprimering-i-pptx/</link>
    <description>Recent content in Komprimering i PPTX on File Format Blog</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>da</language>
    <lastBuildDate>Thu, 10 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://blog.fileformat.com/da/tag/komprimering-i-pptx/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Hvordan fungerer komprimering inde i EPUB, DOCX, XLSX og PPTX?</title>
      <link>https://blog.fileformat.com/da/compression/how-compression-works-inside-epub-docx-xlsx-and-pptx/</link>
      <pubDate>Thu, 10 Sep 2026 00:00:00 +0000</pubDate>
      
      <guid>https://blog.fileformat.com/da/compression/how-compression-works-inside-epub-docx-xlsx-and-pptx/</guid>
      <description>Har du nogensinde spekuleret på, hvad der gemmer sig under motorhjelmen på en .docx- eller .epub-fil? Udforsk hvordan ZIP-pakning og DEFLATE-komprimering holder moderne kontordokumenter og e-bøger lette og organiserede.</description>
      <content:encoded><![CDATA[<p><strong>Senest opdateret</strong>: 10 september, 2026</p>
<figure class="align-center ">
    <img loading="lazy" src="images/how-compression-works-inside-epub-docx-xlsx-and-pptx.png#center"
         alt="How Compression Works Inside EPUB, DOCX, XLSX, &amp; PPTX: The Hidden ZIP Architecture"/> 
</figure>

<h2 id="hvordan-fungerer-komprimering-inde-i-epub-docx-xlsx-og-pptx">Hvordan fungerer komprimering inde i EPUB, DOCX, XLSX og PPTX</h2>
<p>Hvis du omdøber en <code>.docx</code>, <code>.xlsx</code>, <code>.pptx</code> eller <code>.epub</code> fil til <code>.zip</code> og dobbeltklikker på den, sker der noget overraskende: den giver ikke en fejl. Dit operativsystem åbner den som en mappe fyldt med undermapper, XML-konfigurationsfiler, stilark, skrifttyper og indlejrede billeder.</p>
<p>Moderne dokumentarkitekturer opgav monolitiske binære klumper for årtier siden. I deres sted har industristandarder—nemlig <strong>Open Packaging Conventions (OPC)</strong> for Microsoft Office og <strong>Open Container Format (OCF)</strong> for EPUB—adopteret en overraskende elegant grundlag: det ydmyge <strong>ZIP-arkiv</strong>.</p>
<p>At forstå, hvordan komprimering fungerer inden i disse formater, afslører, hvorfor moderne dokumenter er så robuste, letvægtige og udvidelige—og hvorfor nogle filer komprimeres med 90 %, mens andre knap nok krymper overhovedet.</p>
<h2 id="1-containerarkitekturen-forklædte-zip9-pakker">1. Containerarkitekturen: Forklædte <a href="https://docs.fileformat.com/compression/zip/">ZIP</a> Pakker</h2>
<p>Før man forstår selve komprimeringsalgoritmen, er det nyttigt at forstå, hvorfor moderne dokumentformater er struktureret som pakker i stedet for selvstændige rå filer.</p>
<h3 id="problemet-med-ældre-binære-formater">Problemet med ældre binære formater</h3>
<p>I løbet af 1990&rsquo;erne og begyndelsen af 2000&rsquo;erne brugte Microsoft Office proprietære binære formater (<code>.doc</code>, <code>.xls</code>, <code>.ppt</code>). Disse filer var i bund og grund hukommelsesdump struktureret omkring Compound File Binary Format (CFBF). De var berygtet skrøbelige:</p>
<ul>
<li>Et enkelt bit‑flip kunne korrumpere hele filstrukturen.</li>
<li>Indlejring af billeder fik filstørrelserne til at vokse uforudsigeligt.</li>
<li>Parsing krævede reverse engineering af tætte binære specifikationer.</li>
<li>Cross‑platform interoperabilitet var et mareridt.</li>
</ul>
<h3 id="skiftet-til-åbne-modulære-containere">Skiftet til åbne, modulære containere</h3>
<p>I midten af 2000&rsquo;erne fandt to parallelle evolutioner sted:</p>
<ol>
<li><strong>Office Open XML (OOXML / ISO/IEC 29500):</strong> Microsoft introducerede de XML-baserede formater, der ender med et <code>x</code> (<a href="https://docs.fileformat.com/word-processing/docx/">DOCX</a>, <a href="https://docs.fileformat.com/spreadsheet/xlsx/">XLSX</a>, <a href="https://docs.fileformat.com/presentation/pptx/">PPTX</a>). Under overfladen følger disse filer <strong>Open Packaging Conventions (OPC)</strong>.</li>
<li><strong><a href="https://docs.fileformat.com/ebook/epub/">EPUB</a> (IDPF / W3C):</strong> Digital udgivelse bevægede sig væk fra proprietære læserformater mod standard webteknologier (HTML, CSS, SVG) pakket ind i <strong>EPUB Open Container Format (OCF)</strong>.</li>
</ol>
<p>Begge arkitekturer er afhængige af standard <strong>PKZIP 2.0 / ZIP-specifikation</strong>. Filtypenavnet bestemmer blot det forventede skema, standardvisningsprogrammet og mime-type deklarationer.</p>
<pre tabindex="0"><code>Sample DOCX File (Unzipped):
├── [Content_Types].xml        &lt;-- Registry of MIME types for parts
├── _rels/                     &lt;-- Package-level relationships
│   └── .rels
├── docProps/                  &lt;-- Core and extended metadata
│   ├── app.xml
│   └── core.xml
└── word/                      &lt;-- Main content payload
    ├── document.xml           &lt;-- Text, paragraphs, and tags
    ├── styles.xml             &lt;-- Typography and presets
    ├── numbering.xml          &lt;-- Lists and counters
    ├── media/                 &lt;-- Embedded images (PNG, JPG)
    └── _rels/
        └── document.xml.rels  &lt;-- Internal hyperlinks &amp; resource pointers
</code></pre><h2 id="2-motoren-under-motorhjelmen-deflate-algoritmen">2. Motoren under motorhjelmen: DEFLATE-algoritmen</h2>
<p>Når et softwareprogram gemmer en DOCX- eller EPUB-fil, gemmer det ikke blot filer i et ukomprimeret arkiv. Det komprimerer de interne aktiver ved hjælp af <strong>DEFLATE</strong> (specificeret i RFC 1951).</p>
<p>DEFLATE er et to-trins tabsfri komprimeringssystem, der kombinerer to grundlæggende datalogi-algoritmer:</p>
<h3 id="trin-1-lz77-lempel-ziv-1977--fjernelse-af-redundans-med-glidende-vindue">Trin 1: LZ77 (Lempel-Ziv 1977) — Fjernelse af redundans med glidende vindue</h3>
<p>XML og HTML er ekstremt omstændelige. Overvej, hvor ofte tags forekommer i en standard <code>document.xml</code> eller <code>chapter1.xhtml</code> fil:</p>
<ul>
<li><code>&lt;w:p&gt;&lt;w:r&gt;&lt;w:rPr&gt;&lt;w:sz w:val=\&quot;24\&quot;/&gt;&lt;/w:rPr&gt;&lt;w:t&gt;</code> gentages tusindvis af gange i Word.</li>
<li><code>row r=&quot;1&quot; spans=&quot;1:15&quot;&gt;&lt;c r=&quot;A1&quot; t=&quot;s&quot;&gt;&lt;v&gt;</code> gentages i Excel på tværs af titusindvis af celler.</li>
<li><code>&lt;p class=&quot;calibre1&quot;&gt;&lt;span class=&quot;body-text&quot;&gt;</code> gentages på tværs af EPUB-bogkapitler.</li>
</ul>
<p>LZ77 scanner datastrømmen ved hjælp af et glidende ordbogs‑vindue (typisk 32 KB). Når den støder på en streng af tegn, den har set for nylig, erstatter den den duplikerede tekst med en lille bagud‑peger:</p>
<ul>
<li><code>(distance, length)</code> — f.eks. &ldquo;gå tilbage 142 bytes, kopier 28 bytes&rdquo;.</li>
</ul>
<p>I stedet for at gemme omstændelig markup igen og igen, komprimerer LZ77 tusindvis af gentagne XML‑tags til kompakte koordinatreferencer.</p>
<h3 id="trin-2-huffman-kodning--variabel-længde-frekvenskodning">Trin 2: Huffman-kodning — Variabel-længde frekvenskodning</h3>
<p>Efter LZ77 har erstattet overflødige sekvenser med længde‑afstand‑tokens, analyserer <strong>Huffman‑kodning</strong> hyppigheden af hvert symbol i strømmen:</p>
<ul>
<li>Hyppigt forekommende symboler (såsom almindelige tegn <code>e</code>, <code>t</code>, mellemrum eller almindelige afstandsmarkører) tildeles korte binære bit‑koder (f.eks. 2 til 4 bits).</li>
<li>Sjældent brugte symboler får længere binære bit‑koder (f.eks. 12 til 16 bits).</li>
</ul>
<p>Resultatet er en strøm af variabel‑længde bitkoder, der komprimerer ren tekst‑XML ned med <strong>75% til 88%</strong>.</p>
<h2 id="3-format-for-format-analyse-hvordan-hver-håndterer-kompression">3. Format-for-format analyse: Hvordan hver håndterer kompression</h2>
<p>Selvom DOCX, XLSX, PPTX og EPUB alle bruger den samme ZIP‑indpakning, varierer deres interne datakarakteristika kraftigt.</p>
<h3 id="a-docx-tekst--og-stilbalancering">A. DOCX: Tekst- og stilbalancering</h3>
<ul>
<li><strong>Hvad der er inde:</strong> Ren XML (<code>word/document.xml</code>), skrifttabeller, stilarter, relationskataloger og en <code>word/media/</code> mappe.</li>
<li><strong>Hvordan komprimering fungerer:</strong>
<ul>
<li>Den rå tekst og XML‑markup oplever massive komprimeringsforhold (ofte falder fra 5 MB rå XML ned til 500 KB).</li>
<li>Moderne dokumenter indeholder dog ofte skærmbilleder, illustrationer og fotos. Da JPEG‑ og PNG‑filer er <strong>allerede komprimerede</strong>, kan DEFLATE ikke reducere dem yderligere. Faktisk giver kørsel af DEFLATE på et allerede komprimeret billede næsten 0 % besparelse (og kan endda let øge størrelsen på grund af komprimerings‑headere).</li>
<li>Derfor er DOCX‑filer uden billeder usædvanligt små, mens billedtunge rapporter næsten svarer til den nøjagtige størrelse af de indeholdte billedfiler.</li>
</ul>
</li>
</ul>
<h3 id="b-xlsx-højvolumen-numeriske-data--delte-strenge">B. XLSX: Højvolumen numeriske data &amp; delte strenge</h3>
<p>Regneark udgør en unik udfordring: et ark kan indeholde hundredtusinder af rækker, hvilket kan føre til astronomiske XML‑filstørrelser, hvis det ikke håndteres smart.</p>
<ul>
<li><strong>Strategi for delte strenge (<code>xl/sharedStrings.xml</code>):</strong>
<ul>
<li>Hvis en tekstetiket som &ldquo;United States&rdquo; eller &ldquo;In Progress&rdquo; forekommer 50.000 gange i et regneark, vil lagring af <code>&lt;c t=\&quot;inlineStr\&quot;&gt;&lt;is&gt;&lt;t&gt;United States&lt;/t&gt;&lt;/is&gt;&lt;/c&gt;</code> i 50.000 celler oppuste den ukomprimerede XML til gigabytes.</li>
<li>Excel fjerner dubletter i tekst før komprimering ved at gemme hver unik streng én gang i en delt strengtabel og referere til den via numerisk indeks (f.eks. <code>&lt;v&gt;0&lt;/v&gt;</code>, <code>&lt;v&gt;1&lt;/v&gt;</code>).</li>
</ul>
</li>
<li><strong>Hvorfor XLSX komprimeres dramatisk:</strong>
<ul>
<li>Numeriske rækkeposter (<code>sheet1.xml</code>) følger gentagende, forudsigelig syntaks.</li>
<li>DEFLATE opdager let gentagne mønstre i tabel-XML. Det er almindeligt, at en rå <code>sheet1.xml</code>-fil på 120 MB krymper til mindre end 6 MB i et XLSX-arkiv.</li>
</ul>
</li>
</ul>
<h3 id="c-pptx-medietunge-slide-decks">C. PPTX: Medietunge slide-decks</h3>
<p>Præsentationer er grundlæggende forskellige fra dokumenter og regneark:</p>
<ul>
<li><strong>Billeddilemmaet:</strong> PPTX-filer domineres typisk af vektorformer, baggrundsgrafik, videoklip og højopløsningsslides.</li>
<li><strong>Komprimeringsprofil:</strong> Mens <code>ppt/slides/slide1.xml</code> til <code>slideN.xml</code> komprimeres effektivt, udgør mediepayloaden (<code>ppt/media/</code>) 85% til 95% af den samlede arkivvægt.</li>
<li><strong>Hvorfor gen-zipning af en PPTX ikke ændrer noget:</strong> Hvis du forsøger at komprimere en allerede gemt PPTX-fil med 7-Zip eller WinRAR, vil du bemærke næsten ingen størrelsesreduktion. Fordi indholdet allerede er et DEFLATE-komprimeret ZIP-arkiv, der indeholder forkomprimerede JPEG&rsquo;er og MP4&rsquo;er, er entropien allerede næsten maksimal.</li>
</ul>
<h3 id="d-epub-webteknologier-med-et-obligatorisk-ukomprimeret-header">D. EPUB: Webteknologier med et obligatorisk ukomprimeret header</h3>
<p>En EPUB-fil er i bund og grund et responsivt, pakket mikro‑website, der indeholder XHTML‑kapitler, CSS‑stilark, TTF/WOFF‑skrifttyper og metadata. EPUB har dog én streng pakkeregulering, der adskiller den fra Microsoft Office-filer:</p>
<pre tabindex="0"><code>EPUB Internal Structure:
├── mimetype                    &lt;-- MUST be uncompressed (Stored) &amp; at byte offset 38
├── META-INF/
│   └── container.xml           &lt;-- Tells reader where the OPF manifest lives
└── OEBPS/ (or EPUB/)
    ├── content.opf             &lt;-- Manifest of all book assets
    ├── toc.ncx / nav.xhtml     &lt;-- Table of contents navigation
    ├── styles/style.css        &lt;-- CSS formatting
    ├── images/                 &lt;-- Book cover &amp; illustrations
    └── text/                   &lt;-- chapter1.xhtml, chapter2.xhtml
</code></pre><ul>
<li><strong>Den magiske <code>mimetype</code>-fil:</strong>
<ul>
<li>E‑læsere skal kunne identificere en EPUB med det samme uden at udtrække hele arkivet eller køre dekomprimeringsprocesser.</li>
<li>Open Container Format (OCF) pålægger, at <code>mimetype</code>-filen:
<ol>
<li>Skal være den allerførste fil i ZIP-arkivet.</li>
<li>Skal indeholde præcis strengen <code>application/epub+zip</code>.</li>
<li><strong>Må ikke komprimeres</strong> (ZIP-komprimeringsmetode <code>0</code> / &ldquo;Stored&rdquo;).</li>
<li>Må ikke have ekstra feltd data, så MIME-strengen altid begynder ved byte 38 i den fysiske fil.</li>
</ol>
</li>
</ul>
</li>
<li><strong>Tekstkomprimering:</strong> Alle resterende filer (<code>.xhtml</code>, <code>.css</code>, <code>.opf</code>) komprimeres ved hjælp af standard DEFLATE (ZIP-metode <code>8</code>), hvilket gør det muligt for fuldlængde romaner at krympe til nogle få hundrede kilobyte.</li>
</ul>
<h2 id="4-sammenligning-af-kompression-på-tværs-af-formater">4. Sammenligning af kompression på tværs af formater</h2>
<table>
<thead>
<tr>
<th style="text-align:left">Format</th>
<th style="text-align:left">Kernepayload</th>
<th style="text-align:left">Primær redundanskilde</th>
<th style="text-align:left">Typisk komprimeringsforhold (tekst/markup)</th>
<th style="text-align:left">Mediehåndtering</th>
</tr>
</thead>
<tbody>
<tr>
<td style="text-align:left"><strong>DOCX</strong></td>
<td style="text-align:left">WordprocessingML (<code>document.xml</code>)</td>
<td style="text-align:left">Gentagne XML afsnit/kørsel-tags</td>
<td style="text-align:left">75% – 85%</td>
<td style="text-align:left">Gemmes i <code>word/media/</code> (mest forkomprimeret)</td>
</tr>
<tr>
<td style="text-align:left"><strong>XLSX</strong></td>
<td style="text-align:left">SpreadsheetML (<code>sheet*.xml</code>)</td>
<td style="text-align:left">Gentagne celle/række-tags; Delte strenge</td>
<td style="text-align:left">80% – 92%</td>
<td style="text-align:left">Sparsomme; billeder/diagrammer i <code>xl/media/</code></td>
</tr>
<tr>
<td style="text-align:left"><strong>PPTX</strong></td>
<td style="text-align:left">PresentationML (<code>slide*.xml</code>)</td>
<td style="text-align:left">Diaslayout-metadata, formkoordinater</td>
<td style="text-align:left">70% – 80%</td>
<td style="text-align:left">Tung <code>ppt/media/</code> payload begrænser den samlede besparelse</td>
</tr>
<tr>
<td style="text-align:left"><strong>EPUB</strong></td>
<td style="text-align:left">XHTML, CSS, OPF, NCX</td>
<td style="text-align:left">HTML-tags, gentagne CSS-selektorer</td>
<td style="text-align:left">65% – 80%</td>
<td style="text-align:left"><code>mimetype</code> ukomprimeret; medier i undermapper</td>
</tr>
</tbody>
</table>
<h2 id="5-praktiske-konklusioner-sådan-optimerer-du-dine-dokumenter">5. Praktiske konklusioner: Sådan optimerer du dine dokumenter</h2>
<p>Fordi du nu ved, hvordan intern pakning fungerer, kan du udnytte komprimeringsmekanismer til at løse virkelige problemer:</p>
<ol>
<li><strong>Reparerer korrupte dokumenter:</strong>
Hvis et dokument nægter at åbne, gør ændring af filendelsen til <code>.zip</code> det muligt at udtrække indholdet og gendanne den rå tekst fra <code>document.xml</code> eller individuelle kapitler fra EPUB&rsquo;ens <code>text/</code>-mappe.</li>
<li><strong>Formindskelse af store Office-filer:</strong>
Da XML-komprimering allerede er optimeret, skyldes store filer næsten altid uoptimerede billeder i <code>media/</code>. I stedet for at bruge tredjeparts PDF- eller DOCX-kompressorer, skal du åbne ZIP-beholderen, udtrække billederne, køre dem gennem en billedoptimerer (som WebP, TinyPNG eller MozJPEG) og erstatte dem i arkivet.</li>
<li><strong>Automatisering af dokumentgenerering:</strong>
Udviklere behøver ikke tunge kontorpakker for at opbygge rapporter. Du kan generere rå XML-skabeloner, pakke dem sammen ved hjælp af standard zlib/ZIP-biblioteker og programmatiskt udgive gyldige DOCX- eller XLSX-filer på millisekunder.</li>
</ol>
<h2 id="6-ofte-stillede-spørgsmål-faq">6. Ofte stillede spørgsmål (FAQ)</h2>
<p><strong>Kan jeg konvertere en DOCX eller EPUB til en ZIP-fil blot ved at omdøbe filendelsen?</strong> Ja; omdøbning af endelsen til <code>.zip</code> gør det muligt for ethvert standardarkiveringsværktøj (som 7-Zip, macOS Archive Utility eller Windows Explorer) at åbne og inspicere de interne filer direkte.</p>
<p><strong>Hvorfor gør komprimering af en DOCX eller PPTX med 7-Zip den ikke mærkbart mindre?</strong> Fordi filen allerede er et internt komprimeret ZIP-arkiv, der indeholder DEFLATE-kodet XML og forkomprimerede billeder, hvilket efterlader minimal redundans for et eksternt værktøj at fjerne.</p>
<p><strong>Hvorfor kræver EPUB-specifikationen, at <code>mimetype</code>-filen er ukomprimeret?</strong> Det gør det muligt for e‑læser‑software at verificere, at filen er en ægte EPUB ved at tjekke MIME‑strengen på en fast byte‑offset uden at skulle initialisere en dekomprimeringsmotor.</p>
<p><strong>Øger ændring af celleformatering i Excel den komprimerede XLSX‑filstørrelse?</strong> Ja; omfattende brugerdefineret formatering bryder ensartet mønstergentagelse på tværs af celler, hvilket skaber længere XML‑definitioner, der reducerer DEFLATE&rsquo;s komprimeringseffektivitet.</p>
<p><strong>Er det muligt at udtrække højopløselige originale billeder fra en Word‑ eller PowerPoint‑fil uden kvalitetstab?</strong> Ja; omdøb filen til <code>.zip</code>, åbn <code>word/media</code>‑ eller <code>ppt/media</code>‑mappen, og du vil finde de originale, ukomprimerede kildebilleder præcis som de blev indsat.</p>
<h2 id="se-også">Se også</h2>
<ul>
<li><a href="https://blog.fileformat.com/compression/compression-file-formats-at-fileformat-com/">Komprimeringsfilformater på FileFormat.com</a></li>
<li><a href="https://blog.fileformat.com/compression/zip-bombs-exploding-your-storage/">ZIP-bomber – Sprænger din lagerplads</a></li>
<li><a href="https://blog.fileformat.com/compression/what-is-7z-file-format-comprehensive-guide-and-faqs/">Forståelse af 7z-filformatet – Omfattende guide og FAQ</a></li>
<li><a href="https://blog.fileformat.com/compression/how-to-open-rar-files-with-best-rar-openers/">De 7 bedste værktøjer til at åbne eller udtrække RAR-filer</a></li>
</ul>
<!-- raw HTML omitted -->
]]></content:encoded>
    </item>
    
  </channel>
</rss>
