ODT-Dokumenten-Prüfer und Text-Extraktor

ODT-Dokumenten-Prüfer und Text-Extraktor: Entpackt das ODT-Archiv, analysiert die Absatzknoten „content.xml“ „<text:p>“ und extrahiert eingebettete „Pictures/“-Dateien.

Tool wird geladen...

Über odt-dokumenten-prüfer und text-extraktor

ODT-Dokumenten-Prüfer und Text-ExtraktorODT-Dokumenten-Prüfer und Text-Extraktor: Entpackt das ODT-Archiv, analysiert die Absatzknoten „content.xml“ „<text:p>“ und extrahiert eingebettete „Pictures/“-Dateien.

Funktionsweise dieses Tools

Dokument-Tools bearbeiten PDF-DOM-Strukturen direkt im Speicher (ISO 32000) und entpacken OpenXML-Dateien (DOCX, XLSX) gemäß ECMA-376.

Verarbeitungs-Pipeline und technische Systemarchitektur

  1. Lexikalische Datenerfassung und Normalisierung im lokalen Arbeitsspeicher-Puffer.
  2. Strukturelle Syntaxvalidierung und Verifikation von Domänen-Invarianten und Grenzwerten.
  3. Deterministische algorithmische Transformation und mathematische Präzisionsberechnung.
  4. Serialisierung der geprüften Ausgabe, Integritätsvalidierung und Bereitstellung von Diagnose-Badges.

Beispiel und praktische Anwendung

Praxisnahes Anwendungsszenario: Ein ODT-ZIP mit drei Einträgen prüfen.

Beispieleingabe:

content.xml mit zwei table:table sowie mimetype und meta.xml

Algorithmische Verarbeitung: Namen zählen, content.xml dekodieren und Tabellen per Regex zählen.

Beispielausgabe:

files 3; contentBytes ist Länge; tables 2.

Grenzen und Sonderfälle

contentBytes ist decodierte Zeichenlänge, nicht Bytezahl. Tabellen werden per Regex, nicht XML, gezählt; Text, Formeln, Stile, Bilder, Metadaten, Namespaces, Gültigkeit, Escapes, Verschlüsselung und Wiederherstellung werden nicht geprüft.

Browser-Verarbeitung und Datenschutz

Die Tool-Funktion ist dafür ausgelegt, Eingaben im Browser zu verarbeiten, ohne sie absichtlich an einen CZOA-Verarbeitungsserver zu senden. Anfragen für Website-Ressourcen, Analyse oder Werbung sind davon getrennt. Browser, Erweiterungen und verwaltete Gerätesoftware liegen außerhalb dieser Grenze.

Lokale Ausführung und Verifizierungsmethodik

Die Verarbeitung der Tool-Nutzlast ist so konzipiert, dass sie lokal im Browser über JavaScript oder Web Workers erfolgt. Anfragen für Website-Ressourcen, Analyse oder Werbung sind davon getrennt. Vertraulichkeit, Wiederholbarkeit und Latenz hängen von der Browser-Umgebung ab und werden nicht absolut garantiert.

Technische Normen und Referenzspezifikationen

Inhaltlich verantwortlich: CZOA Tools · Zuletzt geprüft: 2026-09-15 · Prüfmethodik

Anwendung

  1. Geben Sie Daten ein oder wählen Sie im Arbeitsbereich eine unterstützte Datei.
  2. Prüfen Sie die Bedienelemente und wählen Sie verfügbare Parameter, Einheiten, Formate oder Bereiche.
  3. Klicken Sie auf die Aktionsschaltfläche oder lesen Sie die sofortige Berechnung ab.
  4. Prüfen Sie Hinweise und Ergebnis, bevor Sie es kopieren oder exportieren.

Häufig gestellte Fragen

Wie prüft ODT-Inspektor ein Archiv?+

Er entpackt das Archiv, zählt Einträge, dekodiert content.xml oder leere Bytes, gibt die Zeichenkettenlänge als contentBytes zurück und zählt wörtliches <table:table gefolgt von Leerraum oder >.

Welche Bedienung und Ausgabe gibt es?+

Es gibt nur lokale Dateiauswahl und Lokal verarbeiten. JSON enthält files, contentBytes, tables und note; Textextraktion, Zählung, Bilder, Stile, Metadaten, XML-Baum, Namespaces, Verschlüsselung, Reparatur und Validierung fehlen.

Welche Deutungsgrenzen gelten?+

contentBytes ist decodierte Zeichenlänge, nicht Bytezahl. Tabellen werden per Regex, nicht XML, gezählt; Text, Formeln, Stile, Bilder, Metadaten, Namespaces, Gültigkeit, Escapes, Verschlüsselung und Wiederherstellung werden nicht geprüft.

Was bestätigte der isolierte Browser?+

Ein lokaler Browserlauf prüfte ein unabhängiges ZIP mit drei Einträgen und zwei table:table-Starts in content.xml; es gab files 3, unabhängige Länge und tables 2 zurück. Anfragen enthielten keine Datei.