Kurz gesagt: AnyMD speichert, liest oder protokolliert keine Dokumentinhalte. Dateien werden im Arbeitsspeicher umgewandelt und sofort verworfen. Das Einzige, was wir erfassen, ist die Seitenzahl — für die Abrechnung. Punkt.
Was wir tatsächlich speichern
Wenn du ein Dokument an die AnyMD-API hochlädst, erfassen wir alles Folgende:
- Seitenzahl — wie viele Seiten dein Dokument hat. Sie wird von deinem monatlichen Kontingent abgezogen.
- Zeitstempel — wann die Konvertierung stattfand.
- HTTP-Statuscode — 200 bei Erfolg, 4xx/5xx bei Fehlern.
- Bytes ein/aus — grobe Größenmetriken.
- Latenz — wie lange die Konvertierung dauerte.
Das ist alles. Keine Dateinamen außer denen in der Antwort. Kein Dokumenttext. Keine extrahierten Inhalte. Keine Metadaten.
Was wir niemals tun
- Wir speichern keine hochgeladenen Dateien. Dateien werden in den Arbeitsspeicher gelesen, umgewandelt und der Speicher wird wieder freigegeben. Es gibt keinen Schreibvorgang auf Festplatte, keinen Datenbank-Blob und kein Archiv.
- Wir untersuchen keine Dokumentinhalte. Wir lesen, analysieren, fassen oder klassifizieren deine Dokumente nicht. Die Rust-Konvertierungsengine verarbeitet Bytes — sie weiß nicht, was im Dokument steht.
- Wir trainieren nicht mit deinen Daten. Deine Dokumente gelangen nie in einen Trainingsdatensatz, eine Fine-Tuning-Pipeline oder einen Prozess zur Modellverbesserung.
- Wir protokollieren keine Inhalte. Server-Logs enthalten IP-Adressen, Zeitstempel, Seitenzahlen und HTTP-Codes — nichts, womit sich ein Dokument rekonstruieren oder sein Inhalt offenlegen ließe.
- Wir teilen keine Daten. Es gibt nichts zu teilen. Seitenzahlen sind keine personenbezogenen Daten.
Konvertierungspipeline im Arbeitsspeicher
Jede Konvertierung folgt genau diesem Ablauf:
- Deine Datei wird per HTTPS (TLS 1.3) hochgeladen.
- Der Rust-Server liest die gesamte Datei in einen Speicherpuffer — keine temporären Dateien, keine Schreibvorgänge auf Festplatte.
- Der Dokumentparser verarbeitet den Puffer und erzeugt Markdown.
- Das Markdown wird in der HTTP-Antwort zurückgesendet.
- Der Puffer wird verworfen. Der Inhalt ist weg. Keine Garbage-Collector-Bereinigung nötig — Rusts
Drop-Trait garantiert die unmittelbare Freigabe.
Die gesamte Pipeline ist synchron und läuft im Prozess. Es gibt keine Warteschlangen, keine Worker, keine Sidecars und keine Datenbanken, die deine Dokumentinhalte berühren. Die Datei kommt herein, wird umgewandelt, verlässt den Server und verschwindet — alles innerhalb eines HTTP-Request-Lebenszyklus.
Warum das wichtig ist
Die meisten Dienste zur Dokumentverarbeitung cachen hochgeladene Dateien zur „Leistungsoptimierung“, speichern sie für KI-Trainingsdaten oder protokollieren genug Metadaten, um Dokumentinhalte zu rekonstruieren. Für manche Anwendungsfälle ist das ein Feature — aber wenn du Folgendes verarbeitest:
- Rechtsdokumente unter Mandatsgeheimnis
- Medizinische Unterlagen (DSGVO-/HIPAA-sensibel)
- Geschäftsdaten, die nirgendwo zwischengespeichert werden sollen
- Personenbezogene Daten, die du lieber nicht gespeichert haben möchtest
… brauchst du eine API, die deine Daten standardmäßig als flüchtig behandelt. Das ist AnyMD.
Vergleich mit Alternativen
| Merkmal | AnyMD | PyMuPDF4LLM | docling | marker |
|---|---|---|---|---|
| Nur Arbeitsspeicher | ✅ | ⚠️ (lokale Bibliothek) | ⚠️ (lokale Bibliothek) | ⚠️ (lokale Bibliothek) |
| Keine Inhaltsprotokollierung | ✅ | ⚠️ (abhängig vom Host) | ⚠️ (abhängig vom Host) | ⚠️ (abhängig vom Host) |
| Kein KI-Training mit Daten | ✅ Garantiert | ⚠️ (lokale Bibliothek) | ⚠️ (lokale Bibliothek) | ⚠️ (lokale Bibliothek) |
| Nur EU-Server | ✅ | ⚠️ | ⚠️ | ⚠️ |
| Richtlinie zur Datenspeicherung | Null (dokumentiert) | N/A (lokales Werkzeug) | N/A (lokales Werkzeug) | N/A (lokales Werkzeug) |
Hinweis: PyMuPDF4LLM, docling und marker sind lokale Python-Bibliotheken, keine gehosteten APIs. Der Datenschutz hängt vollständig davon ab, wo und wie du sie ausführst. AnyMD ist eine gehostete API mit einer ausdrücklichen, dokumentierten Garantie ohne Datenspeicherung.
Hosting in der EU
AnyMD läuft vollständig auf Servern in der Europäischen Union (Hetzner, Finnland). Daten verlassen nie die EU-Rechtsordnung. Das ist für die DSGVO-Compliance relevant — Artikel 28 (Auftragsverarbeiter) und Artikel 32 (Sicherheit) sind grundsätzlich erfüllt, wenn Daten nie den Arbeitsspeicher deiner eigenen Infrastruktur oder unserer EU-Server verlassen.
Seitenzahl — die einzige Kennzahl
Warum erfassen wir überhaupt die Seitenzahl? Weil sie die fairste Abrechnungsmetrik für Dokumentkonvertierung ist. Eine einseitige Textdatei kostet nicht dasselbe in der Verarbeitung wie ein gescanntes PDF mit 200 Seiten, und Pauschalpreise würden kleine Nutzer über- oder große Nutzer unterbelasten. Die Seitenzahl ist:
- objektiv messbar
- nicht in Dokumentinhalte zurückführbar
- mit den tatsächlichen Verarbeitungskosten korreliert
Wenn die Seitenzahl ausreichen würde, um ein Dokument zu rekonstruieren, gäbe es keine Kompressionsalgorithmen.
Unterm Strich
AnyMD ist für datenschutzbewusste Entwickler konzipiert. Wenn deine Dokumente geschäftlich, rechtlich oder persönlich sensibel sind, musst du uns nicht vertrauen. Du musst prüfen können, dass die technische Architektur es unmöglich macht, etwas anderes zu tun als umzuwandeln und zu vergessen. Die Pipeline im Arbeitsspeicher, Rusts unmittelbare Speicherfreigabe und unsere Null-Speicherungs-Logs bedeuten, dass es buchstäblich nichts gibt, das leaken könnte.
Mit der Konvertierung beginnen — kostenloser Tarif, 100 Seiten/Monat, keine Karte erforderlich.