ODT-Dokumenten-Prüfer und Text-Extraktor
ODT-Dokumenten-Prüfer und Text-Extraktor: Entpackt das ODT-Archiv, analysiert die Absatzknoten „content.xml“ „<text:p>“ und extrahiert eingebettete „Pictures/“-Dateien.
Über odt-dokumenten-prüfer und text-extraktor
ODT-Dokumenten-Prüfer und Text-Extraktor:ODT-Dokumenten-Prüfer und Text-Extraktor: Entpackt das ODT-Archiv, analysiert die Absatzknoten „content.xml“ „<text:p>“ und extrahiert eingebettete „Pictures/“-Dateien.
Funktionsweise dieses Tools
Dokument-Tools bearbeiten PDF-DOM-Strukturen direkt im Speicher (ISO 32000) und entpacken OpenXML-Dateien (DOCX, XLSX) gemäß ECMA-376.
Verarbeitungs-Pipeline und technische Systemarchitektur:
- Lexikalische Datenerfassung und Normalisierung im lokalen Arbeitsspeicher-Puffer.
- Strukturelle Syntaxvalidierung und Verifikation von Domänen-Invarianten und Grenzwerten.
- Deterministische algorithmische Transformation und mathematische Präzisionsberechnung.
- Serialisierung der geprüften Ausgabe, Integritätsvalidierung und Bereitstellung von Diagnose-Badges.
Beispiel und praktische Anwendung
Praxisnahes Anwendungsszenario: Ein ODT-ZIP mit drei Einträgen prüfen.
Beispieleingabe:
Algorithmische Verarbeitung: Namen zählen, content.xml dekodieren und Tabellen per Regex zählen.
Beispielausgabe:
Grenzen und Sonderfälle
contentBytes ist decodierte Zeichenlänge, nicht Bytezahl. Tabellen werden per Regex, nicht XML, gezählt; Text, Formeln, Stile, Bilder, Metadaten, Namespaces, Gültigkeit, Escapes, Verschlüsselung und Wiederherstellung werden nicht geprüft.
Browser-Verarbeitung und Datenschutz
Die Tool-Funktion ist dafür ausgelegt, Eingaben im Browser zu verarbeiten, ohne sie absichtlich an einen CZOA-Verarbeitungsserver zu senden. Anfragen für Website-Ressourcen, Analyse oder Werbung sind davon getrennt. Browser, Erweiterungen und verwaltete Gerätesoftware liegen außerhalb dieser Grenze.
Lokale Ausführung und Verifizierungsmethodik
Die Verarbeitung der Tool-Nutzlast ist so konzipiert, dass sie lokal im Browser über JavaScript oder Web Workers erfolgt. Anfragen für Website-Ressourcen, Analyse oder Werbung sind davon getrennt. Vertraulichkeit, Wiederholbarkeit und Latenz hängen von der Browser-Umgebung ab und werden nicht absolut garantiert.
Technische Normen und Referenzspezifikationen
Inhaltlich verantwortlich: CZOA Tools · Zuletzt geprüft: 2026-09-15 · Prüfmethodik
Anwendung
- Geben Sie Daten ein oder wählen Sie im Arbeitsbereich eine unterstützte Datei.
- Prüfen Sie die Bedienelemente und wählen Sie verfügbare Parameter, Einheiten, Formate oder Bereiche.
- Klicken Sie auf die Aktionsschaltfläche oder lesen Sie die sofortige Berechnung ab.
- Prüfen Sie Hinweise und Ergebnis, bevor Sie es kopieren oder exportieren.
Häufig gestellte Fragen
Wie prüft ODT-Inspektor ein Archiv?+
Er entpackt das Archiv, zählt Einträge, dekodiert content.xml oder leere Bytes, gibt die Zeichenkettenlänge als contentBytes zurück und zählt wörtliches <table:table gefolgt von Leerraum oder >.
Welche Bedienung und Ausgabe gibt es?+
Es gibt nur lokale Dateiauswahl und Lokal verarbeiten. JSON enthält files, contentBytes, tables und note; Textextraktion, Zählung, Bilder, Stile, Metadaten, XML-Baum, Namespaces, Verschlüsselung, Reparatur und Validierung fehlen.
Welche Deutungsgrenzen gelten?+
contentBytes ist decodierte Zeichenlänge, nicht Bytezahl. Tabellen werden per Regex, nicht XML, gezählt; Text, Formeln, Stile, Bilder, Metadaten, Namespaces, Gültigkeit, Escapes, Verschlüsselung und Wiederherstellung werden nicht geprüft.
Was bestätigte der isolierte Browser?+
Ein lokaler Browserlauf prüfte ein unabhängiges ZIP mit drei Einträgen und zwei table:table-Starts in content.xml; es gab files 3, unabhängige Länge und tables 2 zurück. Anfragen enthielten keine Datei.
