Blog

Aucune conservation des données — comment AnyMD traite vos documents

10 août 2026 · 4 min de lecture


En bref : AnyMD ne stocke, ne lit et ne journalise pas le contenu de vos documents. Les fichiers sont convertis en mémoire et supprimés instantanément. La seule donnée suivie est le nombre de pages, pour la facturation. C’est tout.

Ce que nous stockons réellement

Lorsque vous envoyez un document à l’API AnyMD, voici tout ce que nous enregistrons :

  • Nombre de pages — le nombre de pages de votre document. Il est déduit de votre quota mensuel.
  • Horodatages — le moment où la conversion a eu lieu.
  • Code d’état HTTP — 200 en cas de succès, 4xx/5xx en cas d’erreur.
  • Octets entrants/sortants — des mesures de taille approximatives.
  • Latence — le temps pris par la conversion.

Et c’est tout. Aucun nom de fichier au-delà de ce qui apparaît dans la réponse. Aucun texte de document. Aucun contenu extrait. Aucune métadonnée.

Ce que nous ne faisons jamais

  • Nous ne stockons pas les fichiers envoyés. Les fichiers sont lus en mémoire, convertis, puis la mémoire est libérée. Aucun écriture disque, aucun blob en base de données, aucune archive.
  • Nous n’inspectons pas le contenu des documents. Nous ne lisons, n’analysons, ne résumons ni ne classifions vos documents. Le moteur de conversion Rust traite des octets ; il ne sait pas ce que contient le document.
  • Nous n’entraînons pas nos modèles avec vos données. Vos documents n’entrent jamais dans un jeu d’entraînement, un pipeline de fine-tuning ou une boucle d’amélioration de modèle.
  • Nous ne journalisons pas le contenu. Les journaux serveur contiennent adresses IP, horodatages, nombres de pages et codes HTTP — rien qui puisse reconstruire un document ou révéler son contenu.
  • Nous ne partageons pas les données. Il n’y a rien à partager. Les nombres de pages ne permettent pas d’identifier une personne.

Pipeline de conversion en mémoire

Chaque conversion suit exactement ce chemin :

  1. Votre fichier est envoyé via HTTPS (TLS 1.3).
  2. Le serveur Rust lit le fichier entier dans un tampon mémoire — pas de fichier temporaire, pas d’écriture disque.
  3. L’analyseur de documents traite le tampon et produit la sortie Markdown.
  4. Le Markdown est renvoyé dans la réponse HTTP.
  5. Le tampon est libéré. Le contenu disparaît. Aucun passage de ramasse-miettes n’est nécessaire : le trait Drop de Rust garantit une désallocation immédiate.

Tout le pipeline est synchrone et dans le même processus. Il n’y a ni files d’attente, ni workers, ni sidecars, ni bases de données qui touchent le contenu de votre document. Le fichier entre, est converti, ressort et disparaît — au sein d’un seul cycle de requête HTTP.

Pourquoi c’est important

La plupart des services de traitement de documents mettent les fichiers en cache pour « optimiser les performances », les conservent pour des données d’entraînement IA ou journalisent assez de métadonnées pour reconstruire leur contenu. C’est une fonctionnalité pour certains usages — mais si vous traitez :

  • Des documents juridiques soumis à la confidentialité client
  • Des dossiers médicaux sensibles au regard du RGPD / HIPAA
  • Des données commerciales propriétaires que vous ne voulez mettre en cache nulle part
  • Des informations personnelles que vous préférez ne pas voir stockées

…vous avez besoin d’une API qui traite vos données comme éphémères par défaut. C’est AnyMD.

Comparaison avec les alternatives

FonctionnalitéAnyMDPyMuPDF4LLMdoclingmarker
Mémoire uniquement⚠️ (bibliothèque locale)⚠️ (bibliothèque locale)⚠️ (bibliothèque locale)
Pas de journalisation du contenu⚠️ (dépend de l’hôte)⚠️ (dépend de l’hôte)⚠️ (dépend de l’hôte)
Pas d’entraînement IA sur les données✅ Garanti⚠️ (bibliothèque locale)⚠️ (bibliothèque locale)⚠️ (bibliothèque locale)
Serveurs UE uniquement⚠️⚠️⚠️
Politique de conservationZéro (documentée)N/A (outil local)N/A (outil local)N/A (outil local)

Remarque : PyMuPDF4LLM, docling et marker sont des bibliothèques Python locales, et non des API hébergées. La confidentialité dépend entièrement du lieu et de la manière dont vous les exécutez. AnyMD est une API hébergée avec une garantie explicite et documentée d’absence de conservation.

Hébergement dans l’UE

AnyMD s’exécute entièrement sur des serveurs situés dans l’Union européenne (Hetzner, Finlande). Les données ne sortent jamais de la juridiction européenne. C’est important pour la conformité au RGPD : les articles 28 (sous-traitants) et 32 (sécurité) sont intrinsèquement respectés lorsque les données ne quittent jamais la mémoire de votre infrastructure ou de nos serveurs européens.

Le nombre de pages — la seule mesure

Pourquoi suivons-nous le nombre de pages ? Parce que c’est la mesure de facturation la plus juste pour la conversion de documents. Un fichier texte d’une page n’a pas le même coût de traitement qu’un PDF numérisé de 200 pages, et un tarif fixe surchargerait les petits utilisateurs ou sous-facturerait les gros. Le nombre de pages est :

  • Objectivement mesurable
  • Impossible à réutiliser pour retrouver le contenu d’un document
  • Corrélé au coût réel de traitement

Si le nombre de pages suffisait à reconstruire un document, les algorithmes de compression n’existeraient pas.

En conclusion

AnyMD est conçu pour les développeurs sensibles à la confidentialité. Si vos documents sont sensibles — commercialement, juridiquement ou personnellement — vous n’avez pas besoin de nous faire confiance. Vous devez vérifier que l’architecture technique nous empêche de faire autre chose que convertir puis oublier. Le pipeline en mémoire, la désallocation immédiate de Rust et notre politique de journalisation sans conservation signifient qu’il n’y a littéralement rien à divulguer.

Commencez à convertir — offre gratuite, 100 pages/mois, sans carte bancaire.


← Lire la suite →