ForHosting KIT · Documents et PDF

Convertir un PDF en Excel

Cette capacité repère le tableau d’une page que vous envoyez en image et le reconstruit dans un fichier Excel. Un modèle de vision analyse la disposition, aligne chaque valeur dans sa cellule et rétablit lignes et colonnes, pour que vous puissiez trier, filtrer et calculer au lieu de recopier des chiffres à la main.

● Betapar requête + par page$0.010
Utilisez-le depuis WebAPIE-mailTelegramApp bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Des chiffres prisonniers d’un PDF

Relevés bancaires, factures fournisseurs, catalogues tarifaires, exports figés : une masse de données utiles arrive en PDF, où elles ne sont bonnes qu’à être lues. Dès qu’il faut additionner, trier ou rapprocher deux colonnes, on se retrouve à retaper les lignes une à une — long, fastidieux, et propice aux fautes de frappe sur un montant. L’extraction vers Excel libère ces chiffres : ils reviennent dans une grille où chaque calcul redevient possible d’un clic.

Une lecture par modèle de vision

La reconnaissance s’appuie sur un modèle de vision qui interprète la disposition réelle du tableau, y compris quand les traits de bordure manquent ou que les colonnes sont seulement suggérées par l’alignement. Elle sépare les en-têtes des données, respecte les lignes et rend un fichier prêt à l’emploi. Cette approche, plus fine qu’une simple extraction de texte, a un coût plus élevé par page — ce qui explique le tarif à l’unité, plus marqué que sur les conversions classiques.

Fonctionnement et tarif

Vous soumettez la page en image, une tâche est créée, vous récupérez le fichier tableur. Le prix est de $0.010 par requête, plus $0.0575 par page, en dollars US : une page revient donc à $0.0675, le gros du coût tenant à l’analyse visuelle. Chaque appel traite une seule page ; le découpage automatique d’un PDF de plusieurs pages, qui suppose un rendu par page, est prévu. Cette capacité est en version bêta et déjà utilisable ; nous en affinons le rendu sur les tableaux les plus denses.

Relevé bancaire à analyser

Julien Lefèvre récupère les écritures d’une page de relevé, envoyée en image, dans Excel pour les catégoriser et pointer ses dépenses. Fini le recopiage ligne à ligne d’un tableau qu’il ne pouvait qu’imprimer.

Catalogue fournisseur à comparer

Atelier Garnier SARL extrait la grille tarifaire d’un fournisseur reçue en image. Dans Excel, elle compare les prix, applique ses marges et bâtit son propre devis sans ressaisie.

Factures à consolider

Studio Lumen SAS convertit ses factures en tableaux Excel, page par page, pour additionner la TVA du trimestre. Les montants tombent dans les bonnes cellules, prêts à sommer.

L’outil retrouve-t-il les colonnes même sans bordures visibles ?

Oui : le modèle de vision se fonde sur l’alignement et l’espacement, pas seulement sur les traits. Un tableau sans quadrillage apparent est généralement reconstruit correctement, colonnes séparées.

Pourquoi le prix à la page est-il plus élevé qu’ailleurs ?

Parce que l’analyse repose sur un modèle de vision, plus coûteux qu’une extraction de texte simple. Le tarif, $0.0575 par page, reflète ce traitement ; il reste modeste face au temps d’une ressaisie manuelle.

Un tableau scanné fonctionne-t-il ?

Oui, c’est même un point fort de l’approche par vision : un tableau issu d’un scan ou d’une photo est interprété directement, sans étape d’OCR préalable, tant que l’image est nette.

Dois-je vérifier le résultat ?

Un contrôle rapide est recommandé sur les tableaux très denses ou ambigus, où une cellule peut être mal découpée. Sur des tableaux nets, le résultat est directement exploitable.

Quel est le coût pour une page, et pour un document de plusieurs pages ?

$0.010 par requête plus $0.0575 par page, soit $0.0675 la page, en dollars US. Un appel traite une seule page : pour un document de plusieurs pages, envoyez chaque page en image (le découpage automatique est prévu). Paiement par PayPal, sans abonnement, facture sur demande.

Mes données financières restent-elles confidentielles ?

Oui. L’extraction est automatisée, sans lecture humaine ; la page transite chiffrée et n’est conservée que le temps de produire le fichier Excel que vous téléchargez.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/doc/pdf-to-excel

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/doc/pdf-to-excel \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"image":"https://ejemplo.com/libro.xlsx"}'
{
  "image": "https://ejemplo.com/libro.xlsx"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "doc.pdf_to_excel",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.010
par page$0.0575

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_mb25
max_pages200
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.
413input_too_largeEntrée trop volumineuse : consultez la limite de taille de cette capacité.
422task_failedLa tâche a échoué : elle ne vous est pas facturée.

Consulter la documentation complète du KIT →