AI/ML-data indeholder ofte PDF, DOCX, PPTX, XLSX og EPUB. Før træning, fine-tuning eller RAG skal de normaliseres til ren struktureret tekst.
Fra kommandolinjen
curl https://anymd.net/api/convert \
-H "Authorization: Bearer your-key" \
-F "file=@paper.pdf"AnyMD registrerer formatet ud fra filendelsen. Samme kommando virker for DOCX, PPTX, XLSX, RTF, EPUB, ODT, HTML og CSV.
Fra Python
import requests
with open("report.pdf", "rb") as f:
resp = requests.post("https://anymd.net/api/convert", headers={"Authorization": "Bearer your-key"}, files={"file": ("report.pdf", f)})
markdown = resp.textBrug samme kald i en løkke for batchkonvertering. Ét API, ét outputformat (GFM Markdown) og én nøgle erstatter formatspecifikke biblioteker og deres vedligeholdelse.
Hent gratis API-nøgle — 100 sider/måned.