Extraire Texte et Tableaux de Fichiers PDF
Extrayez du texte propre et des données de tableaux structurés de n'importe quel PDF. Idéal pour les pipelines de données, l'indexation de recherche, l'analyse de contenu et les modèles IA/LLM.
# JSON with tables — /v2/pdf/extract-text (recommended)
curl -X POST \
https://api.convertfilefast.com/v2/pdf/extract-text \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "file=@report.pdf" \
-F "pages=1-5" \
-F "extract_tables=true"
# Plain text file — /v2/convert/pdf-to-txt
curl -X POST \
https://api.convertfilefast.com/v2/convert/pdf-to-txt \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "file=@report.pdf" \
--output extracted.txtimport requests
# Option 1: JSON with tables (extract-text) — rich structured output
response = requests.post(
"https://api.convertfilefast.com/v2/pdf/extract-text",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("report.pdf", "rb")},
data={"pages": "1-5", "extract_tables": "true"}
)
data = response.json()
for page in data["pages"]:
print(f"Page {page['page_number']}: {page['text'][:100]}...")
# Option 2: Plain text file (pdf-to-txt) — simple .txt output
response = requests.post(
"https://api.convertfilefast.com/v2/convert/pdf-to-txt",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("report.pdf", "rb")}
)
with open("extracted.txt", "wb") as f:
f.write(response.content)const formData = new FormData();
formData.append("file", fs.createReadStream("report.pdf"));
formData.append("pages", "1-5");
formData.append("extract_tables", "true");
const response = await fetch(
"https://api.convertfilefast.com/v2/pdf/extract-text",
{
method: "POST",
headers: { "Authorization": "Bearer YOUR_API_KEY" },
body: formData,
}
);
const data = await response.json();
console.log(`Extracted ${data.total_pages} pages`);// n8n HTTP Request Node
{
"method": "POST",
"url": "https://api.convertfilefast.com/v2/pdf/extract-text",
"contentType": "multipart-form-data",
"bodyParameters": {
"parameters": [
{ "name": "file", "parameterType": "formBinaryData", "inputDataFieldName": "data" },
{ "name": "extract_tables", "value": "true" }
]
},
"options": { "response": { "responseFormat": "json" } }
}Avantages
Pourquoi utiliser notre API?
Solution complète et fiable pour l'intégration dans n'importe quelle stack technologique.
Extraction de Texte
Extrayez du texte propre et structuré de n'importe quel PDF avec détection correcte des paragraphes.
Détection de Tableaux
Détecte et extrait automatiquement les tableaux comme arrays de données structurés.
Sélection de Pages
Extrayez de pages spécifiques (ex: "1,3,5-7") ou de toutes les pages en une requête.
Accès aux Métadonnées
Obtenez les métadonnées PDF (titre, auteur, date de création) avec le texte extrait.
Prêt pour IA/LLM
Idéal pour alimenter le contenu extrait vers ChatGPT, Claude ou des pipelines IA personnalisés.
Intégration aux Pipelines
Intégrez facilement dans des pipelines ETL avec n8n, Airflow ou scripts de traitement.
Ou appelez-le depuis Claude, Cursor ou tout client MCP
Convert File Fast fournit un serveur Model Context Protocol natif. Confiez cette conversion à un agent IA en un seul appel d’outil — sans client HTTP, sans gestion de binaire, avec une clé API par utilisateur.
npx -y convertfilefast-mcpconvert_file({ target_format: "txt", source_url: "https://example.com/file.pdf" })Commencez à Extraire du Texte des PDFs
Obtenez votre clé API et extrayez du texte de documents PDF en quelques secondes. Le plan gratuit inclut 10 conversions par mois.
Sans carte de crédit. 10 conversions gratuites sur le plan Free.