Convertir un PDF en Excel
Cette capacité repère le tableau d’une page que vous envoyez en image et le reconstruit dans un fichier Excel. Un modèle de vision analyse la disposition, aligne chaque valeur dans sa cellule et rétablit lignes et colonnes, pour que vous puissiez trier, filtrer et calculer au lieu de recopier des chiffres à la main.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Des chiffres prisonniers d’un PDF
Relevés bancaires, factures fournisseurs, catalogues tarifaires, exports figés : une masse de données utiles arrive en PDF, où elles ne sont bonnes qu’à être lues. Dès qu’il faut additionner, trier ou rapprocher deux colonnes, on se retrouve à retaper les lignes une à une — long, fastidieux, et propice aux fautes de frappe sur un montant. L’extraction vers Excel libère ces chiffres : ils reviennent dans une grille où chaque calcul redevient possible d’un clic.
Une lecture par modèle de vision
La reconnaissance s’appuie sur un modèle de vision qui interprète la disposition réelle du tableau, y compris quand les traits de bordure manquent ou que les colonnes sont seulement suggérées par l’alignement. Elle sépare les en-têtes des données, respecte les lignes et rend un fichier prêt à l’emploi. Cette approche, plus fine qu’une simple extraction de texte, a un coût plus élevé par page — ce qui explique le tarif à l’unité, plus marqué que sur les conversions classiques.
Fonctionnement et tarif
Vous soumettez la page en image, une tâche est créée, vous récupérez le fichier tableur. Le prix est de $0.010 par requête, plus $0.0575 par page, en dollars US : une page revient donc à $0.0675, le gros du coût tenant à l’analyse visuelle. Chaque appel traite une seule page ; le découpage automatique d’un PDF de plusieurs pages, qui suppose un rendu par page, est prévu. Cette capacité est en version bêta et déjà utilisable ; nous en affinons le rendu sur les tableaux les plus denses.
Cas d’usage
Relevé bancaire à analyser
Julien Lefèvre récupère les écritures d’une page de relevé, envoyée en image, dans Excel pour les catégoriser et pointer ses dépenses. Fini le recopiage ligne à ligne d’un tableau qu’il ne pouvait qu’imprimer.
Catalogue fournisseur à comparer
Atelier Garnier SARL extrait la grille tarifaire d’un fournisseur reçue en image. Dans Excel, elle compare les prix, applique ses marges et bâtit son propre devis sans ressaisie.
Factures à consolider
Studio Lumen SAS convertit ses factures en tableaux Excel, page par page, pour additionner la TVA du trimestre. Les montants tombent dans les bonnes cellules, prêts à sommer.
Questions fréquentes
L’outil retrouve-t-il les colonnes même sans bordures visibles ?
Oui : le modèle de vision se fonde sur l’alignement et l’espacement, pas seulement sur les traits. Un tableau sans quadrillage apparent est généralement reconstruit correctement, colonnes séparées.
Pourquoi le prix à la page est-il plus élevé qu’ailleurs ?
Parce que l’analyse repose sur un modèle de vision, plus coûteux qu’une extraction de texte simple. Le tarif, $0.0575 par page, reflète ce traitement ; il reste modeste face au temps d’une ressaisie manuelle.
Un tableau scanné fonctionne-t-il ?
Oui, c’est même un point fort de l’approche par vision : un tableau issu d’un scan ou d’une photo est interprété directement, sans étape d’OCR préalable, tant que l’image est nette.
Dois-je vérifier le résultat ?
Un contrôle rapide est recommandé sur les tableaux très denses ou ambigus, où une cellule peut être mal découpée. Sur des tableaux nets, le résultat est directement exploitable.
Quel est le coût pour une page, et pour un document de plusieurs pages ?
$0.010 par requête plus $0.0575 par page, soit $0.0675 la page, en dollars US. Un appel traite une seule page : pour un document de plusieurs pages, envoyez chaque page en image (le découpage automatique est prévu). Paiement par PayPal, sans abonnement, facture sur demande.
Mes données financières restent-elles confidentielles ?
Oui. L’extraction est automatisée, sans lecture humaine ; la page transite chiffrée et n’est conservée que le temps de produire le fichier Excel que vous téléchargez.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/doc/pdf-to-excel \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"image":"https://ejemplo.com/libro.xlsx"}'const res = await fetch("https://api.kit.forhosting.com/doc/pdf-to-excel", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"image": "https://ejemplo.com/libro.xlsx"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/doc/pdf-to-excel",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"image": "https://ejemplo.com/libro.xlsx"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/doc/pdf-to-excel", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"image":"https://ejemplo.com/libro.xlsx"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"image":"https://ejemplo.com/libro.xlsx"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/doc/pdf-to-excel", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"image": "https://ejemplo.com/libro.xlsx"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "doc.pdf_to_excel",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_mb | 25 |
max_pages | 200 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |
413 | input_too_large | Entrée trop volumineuse : consultez la limite de taille de cette capacité. |
422 | task_failed | La tâche a échoué : elle ne vous est pas facturée. |