Estrai il testo da una pagina HTML
Estrarre il testo da una pagina HTML significa buttar via tag, script e stili e tenere solo le parole leggibili. Il KIT lo fa nel browser: incolli l'HTML e ottieni il testo puro, senza codice, pronto da copiare in un documento, da contare o da rileggere. Niente formattazione, niente markup: solo il contenuto in chiaro.
Esegui gratis nel browser
Funziona nel tuo browser: gratis, senza registrazione, i file non escono dal tuo dispositivo.
Solo le parole, niente codice
A differenza della conversione in Markdown, qui non resta nessuna formattazione: né titoli, né elenchi, né link segnati con simboli. Il risultato è testo semplice e basta, come se avessi tolto tutto tranne le frasi. È quello che ti serve quando devi incollare un contenuto in un campo che accetta solo testo, contarne le parole, darlo a un altro strumento o semplicemente leggerlo senza distrazioni.
Cosa viene rimosso
Spariscono i tag HTML, gli script, i fogli di stile, i menu, i pulsanti e ogni pezzo di codice. Il KIT prova a mantenere una struttura minima leggibile — gli a capo tra i paragrafi restano, così il testo non diventa un unico blocco — ma nessun elemento grafico sopravvive. Se una pagina è piena di codice pubblicitario e navigazione, ti ritrovi in mano solo il contenuto che conta davvero.
Gratis nel browser
L'estrazione avviene sul tuo dispositivo: l'HTML non viene inviato da nessuna parte. Nessun account, nessun limite di utilizzo, fino a 25 MB per documento. Se ti serve estrarre il testo da tante pagine in modo automatico — per esempio per analizzarne il contenuto o alimentare un archivio — la stessa funzione è disponibile via API a $0.002 a richiesta.
Casi d'uso
Copiare il testo di una pagina
Devi riportare il contenuto di una pagina in un documento Word: estrai il testo pulito e lo incolli senza portarti dietro tag, colori o pulsanti.
Contare le parole di un contenuto
Vuoi sapere quante parole ha davvero un articolo online, al netto del codice: estrai il testo puro e lo conti, senza che i tag falsino il totale.
Preparare un testo per l'analisi
Devi dare il contenuto di una pagina a uno strumento che lavora solo con testo semplice: lo ripulisci dall'HTML e ottieni un input pulito.
Domande frequenti
Che differenza c'è con la conversione in Markdown?
Qui non resta alcuna formattazione: solo testo puro. Il Markdown, invece, conserva titoli, elenchi e link con simboli. Scegli in base a cosa ti serve dopo.
Mantiene gli a capo tra i paragrafi?
Sì, il KIT tiene una struttura minima leggibile con gli a capo, così il testo non diventa un blocco unico difficile da rileggere.
L'HTML viene inviato a un server?
No, l'estrazione avviene nel browser e il contenuto resta sul tuo dispositivo. Adatto anche a pagine con dati riservati.
Devo registrarmi o pagare?
No, nel browser è gratis e senza limiti. Il costo riguarda solo l'uso via API, a $0.002 a richiesta, per estrarre testo in serie.
Funziona dal telefono?
Sì, gira nel browser del telefono. Incolli l'HTML e ottieni il testo pulito, comodo da riusare al volo.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/data/html-to-text \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/data/html-to-text", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/data/html-to-text",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/data/html-to-text", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/data/html-to-text", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"input": "…"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "data.html_to_text",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
max_mb | 25 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |