ForHosting KIT · Recherche sémantique

Discuter avec un PDF

Discuter avec un PDF, c’est poser vos questions en langage naturel à un document — contrat, rapport, notice, bail — et obtenir une réponse tirée de son contenu, sans le lire de bout en bout. L’outil indexe le fichier, retrouve les passages utiles et rédige la réponse pour vous.

● Stablepar requête + par recherche$0.003
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Ce que l’outil fait de votre fichier

Vous importez votre PDF, puis l’outil le découpe en passages et en construit un index sémantique. Quand vous posez une question, il ne relit pas les cent pages : il retrouve les quelques extraits qui traitent votre sujet, même si vous n’employez pas les mots exacts du texte. La réponse s’appuie sur ces extraits. Un rapport annuel, un bail de trois pages ou une notice technique de deux cents pages passent par le même chemin, avec le même confort de lecture.

Des réponses ancrées dans le document, pas inventées

La réponse est rédigée à partir des passages retrouvés dans votre document, et non de connaissances générales glanées ailleurs. Si l’information ne figure pas dans le fichier, l’outil le dit plutôt que d’inventer. Vous pouvez lui demander de citer la page ou de reproduire la phrase d’origine, ce qui reste précieux pour un contrat ou une clause : vous vérifiez la source avant d’agir, sans reparcourir tout le texte.

Les documents où il fait gagner le plus de temps

Un contrat de prestation dont vous cherchez la durée de préavis, des conditions générales de vente à confronter à un litige, une notice d’installation où trouver le bon réglage, un rapport dont vous voulez le chiffre clé : autant de cas où la question directe remplace une demi-heure de lecture en diagonale. L’outil brille sur les documents longs et structurés, ceux que personne n’a envie de relire entièrement pour une seule ligne.

Ce qui reste hors de portée

Un PDF n’est pas toujours lisible tel quel. Un document scanné sans couche de texte doit d’abord passer par la reconnaissance optique de caractères, sinon il n’y a rien à indexer. Les tableaux très denses ou les schémas se résument mal en une phrase. Enfin, l’outil répond sur ce qu’il lit : un contrat ambigu restera ambigu. Pour une décision juridique ou fiscale, sa réponse éclaire votre lecture, elle ne remplace pas l’avis d’un professionnel.

Un bail à décortiquer

Camille Moreau reçoit un bail commercial de vingt-deux pages avant de signer. Plutôt que de tout éplucher, elle demande la durée du bail, le montant de la révision annuelle et les conditions de résiliation. Chaque réponse renvoie à la page correspondante, qu’elle relit avant de s’engager.

Des conditions générales sous la main

L’Atelier Garnier SARL doit répondre à un client mécontent qui invoque une clause de garantie. Depuis les CGV en PDF, l’outil retrouve l’article exact et sa formulation, ce qui permet de répondre en citant le texte plutôt que de mémoire.

Une notice technique interrogée

Sur un chantier, la Menuiserie Rousseau & Fils cherche le couple de serrage recommandé dans une notice de deux cents pages. La question posée depuis un téléphone renvoie le passage utile en quelques secondes, sans faire défiler le document.

Un rapport résumé à la demande

Le Studio Lumen SAS reçoit un rapport d’audit dense. Avant la réunion, l’équipe lui demande les trois recommandations principales et le budget estimé, de quoi préparer les questions sans avoir lu les cinquante pages.

Mes fichiers sont-ils conservés après mes questions ?

Votre PDF est envoyé sur nos serveurs pour être indexé, le temps de votre session de questions. Il n’est pas conservé au-delà du traitement ni réutilisé pour autre chose. Comme l’analyse ne se fait pas dans le navigateur, disons-le clairement : le fichier transite par nos serveurs, où il est traité puis supprimé.

Les réponses peuvent-elles être fausses ?

L’outil s’appuie sur les passages de votre document, ce qui réduit fortement les réponses inventées, mais aucune synthèse automatique n’est infaillible. Sur un point qui engage — une clause, un montant, une échéance — demandez la citation de la source et vérifiez la page indiquée avant de décider.

Combien coûte une question ?

Le prix est affiché, sans abonnement: $0.003 par requête, plus $0.015 par question traitée. Vous ne payez que ce que vous utilisez, et il n’y a ni forfait mensuel. L’achat est direct, en une fois.

Faut-il un document déjà lisible ?

Oui. Un PDF natif, avec du texte sélectionnable, est indexé directement. Un simple scan, lui, est une image : il faut d’abord lui ajouter une couche de texte par reconnaissance optique de caractères, sinon il n’y a rien à interroger.

Y a-t-il une taille maximale ?

Les documents volumineux passent sans souci ; un fichier de plusieurs centaines de pages reste dans les limites de traitement. Pour un ouvrage entier ou une archive complète, mieux vaut le découper au préalable, ce qui accélère aussi les réponses.

Depuis où puis-je l’utiliser ?

Cette page exécute l’outil en ligne, sans rien installer. La même fonction est accessible via l’API pour l’intégrer à vos propres traitements, et arrivera bientôt sur mobile, par e-mail et sur Telegram. À vous de choisir le canal.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/rag/chat-pdf

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/rag/chat-pdf \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "rag.chat_pdf",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.003
par recherche$0.015

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_chunks10000
max_tokens20000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.
422task_failedLa tâche a échoué : elle ne vous est pas facturée.

Consulter la documentation complète du KIT →