Embedding del testo
L’embedding trasforma un testo in una serie di numeri — un vettore — che ne rappresenta il significato. Frasi che parlano della stessa cosa ottengono vettori vicini. È il primo mattone di ogni ricerca semantica, sistema di consigli o confronto tra documenti fatto sul senso, non sulle parole.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Che cos’è un vettore, in pratica
Immagina di dare a ogni frase una posizione in uno spazio a molte dimensioni: testi su argomenti vicini finiscono vicini, testi lontani restano lontani. Con quei numeri puoi misurare quanto due frasi si somigliano, ordinare risultati per pertinenza o raggruppare contenuti. Da soli i vettori non si leggono a occhio: sono la materia prima che alimenta ricerca, consigli e confronti. Il KIT ti restituisce l’embedding già pronto, senza installare librerie né addestrare modelli.
Funziona bene con l’italiano
Il modello è multilingue e gestisce l’italiano con accenti, termini tecnici e burocratese, senza doverlo tradurre prima. Una clausola di contratto, la scheda di un prodotto o la email di un cliente producono vettori coerenti fra loro. Puoi anche mescolare lingue nello stesso insieme, utile se lavori con documenti in italiano e allegati in inglese. Il limite è di 20.000 token per richiesta: un testo più lungo va spezzato in parti prima di essere vettorizzato.
Dalla web e via API
Generi gli embedding dalla pagina del KIT, incollando il testo, oppure via API quando li integri in un tuo sistema; presto anche da app e altri canali. Non è “una API” e basta: è uno strumento che usi da dove ti serve. Se devi elaborare migliaia di frasi in una volta sola, esiste la versione in blocco, pensata proprio per le liste lunghe.
Prezzo chiaro, paghi a consumo
Paghi solo quello che vettorizzi: $0.002 a richiesta più $0.0015 ogni 1.000 token, in dollari. Niente abbonamento, niente minimo mensile. Un paragrafo breve costa una frazione di centesimo; una relazione di venti pagine resta sotto pochi centesimi. Il prezzo è pubblicato accanto allo strumento, così sai quanto spendi prima di lanciare l’elaborazione.
Casi d'uso
Base di conoscenza dello Studio Bianchi
Lo Studio Commercialista Bianchi di Bologna vettorizza circolari e prassi interne per ritrovarle poi per significato: chi cerca “aliquota forfettari” trova la nota giusta anche se il testo diceva “regime agevolato”.
Catalogo di Rossi & Figli S.r.l.
Rossi & Figli S.r.l. trasforma in vettori le descrizioni degli articoli per collegare prodotti affini e proporre alternative quando un modello è esaurito.
Email di assistenza
Un team di supporto vettorizza i messaggi in arrivo per raggrupparli per tema e recuperare in fretta risposte già scritte per casi simili.
Domande frequenti
Che differenza c’è tra embedding e ricerca?
L’embedding è solo il primo passo: trasforma il testo in numeri. Per cercare davvero ti servono poi un indice e una query, funzioni distinte del KIT che partono proprio da questi vettori.
Quanti token entrano in una richiesta?
Fino a 20.000 token per richiesta e 10.000 blocchi complessivi. Un testo più lungo va diviso in parti: ogni parte diventa un vettore a sé.
I miei testi restano privati?
Il testo viene elaborato per produrre il vettore e poi eliminato: non lo conserviamo né lo usiamo per addestrare modelli. Il calcolo avviene sul server, non nel browser.
Come pago e devo registrarmi?
Si acquista direttamente, senza account: PayPal o carta. Il prezzo è a consumo e in dollari, senza abbonamenti nascosti.
Posso avere fattura?
Sì. Scrivi a [email protected] o su WhatsApp con i dati della tua partita IVA e ti mandiamo il documento di acquisto.
Serve per una sola lingua?
No: il modello è multilingue. Puoi vettorizzare testi in italiano, inglese e altre lingue e confrontarli anche tra loro nello stesso insieme.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/search/embed \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/embed", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/embed",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/embed", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/embed", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"text": "…"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.embed",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
max_chunks | 10000 |
max_tokens | 20000 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |