Doppioni scritti in modo diverso?
Uno strumento che trova i doppioni scritti in modo diverso: stesso significato, testo differente. Riconosce ordine invertito, abbreviazioni e punteggiatura — “Rossi & Figli S.r.l.” e “Rossi e Figli Srl” — dove una deduplica normale fallisce. Usa l’intelligenza artificiale, gira via server e si paga a consumo, con prezzo pubblicato.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Perché i doppioni sfuggono
Un confronto tradizionale guarda i caratteri: se due righe non sono identiche, le tiene entrambe. Ma nella realtà lo stesso cliente compare come “Mario Rossi”, “Rossi Mario” e “M. Rossi”, e la stessa azienda come “Rossi & Figli S.r.l.” e “Rossi e Figli Srl”. Per l’occhio umano sono la stessa voce; per un normale deduplicatore no. Qui interviene un confronto che ragiona sul significato, non sulla forma.
Come funziona il confronto semantico
Il KIT calcola una rappresentazione del contenuto di ogni riga e misura quanto sono vicine tra loro, raggruppando quelle che dicono la stessa cosa in modo diverso. Puoi regolare la soglia di somiglianza: più stretta per unire solo i casi quasi certi, più larga per catturare anche le varianti lontane. Alla fine ottieni un elenco senza doppioni e la lista dei gruppi individuati, per controllare le scelte.
A pagamento, con i dati protetti
Questo confronto usa un modello di intelligenza artificiale e gira sui nostri server, quindi si paga a consumo: $0.002 a richiesta più $0.0015 ogni mille righe, prezzo pubblicato, senza abbonamento. Il file viene elaborato per trovare i duplicati e poi eliminato: non lo conserviamo. Ci lavora un sistema automatico, non una persona.
Casi d'uso
Anagrafica con nomi disallineati
Rossi & Figli S.r.l. ha un elenco dove lo stesso fornitore appare come “Tecnoedil Verona Snc” e “Tecnoedil Verona S.n.c.”. Il confronto semantico li unisce in un’unica voce.
Fusione di liste da fonti diverse
Due reparti tengono elenchi clienti con stili di scrittura diversi. Unendoli restano molti doppioni non identici: l’IA li individua dove un confronto testuale fallirebbe.
Catalogo con nomi simili
Un catalogo prodotti ha varianti dello stesso articolo scritte in modo diverso. Il raggruppamento semantico aiuta a ripulirlo prima di pubblicarlo.
Domande frequenti
Riconosce “Rossi & Figli S.r.l.” e “Rossi e Figli Srl” come la stessa azienda?
Sì: è proprio il suo scopo. Il confronto ragiona sul significato, quindi unisce ordine invertito, abbreviazioni e differenze di punteggiatura che un deduplicatore normale terrebbe separati.
Posso regolare quanto devono essere simili le righe?
Sì: imposti la soglia di somiglianza. Più stretta unisce solo i casi quasi certi, più larga cattura anche le varianti lontane. Ottieni anche l’elenco dei gruppi trovati per verificare.
Perché non è gratis nel browser?
Perché usa un modello di IA che gira sui nostri server. Si paga a consumo: $0.002 a richiesta più $0.0015 ogni mille righe, prezzo pubblicato, senza abbonamento.
Come pago?
Con PayPal, direttamente e senza registrazione. Paghi solo quello che usi, in base alle righe elaborate.
Che fine fa il mio file?
Viene elaborato per individuare i duplicati e poi eliminato: non lo conserviamo. L’operazione è automatica, senza intervento umano.
E se unisse per sbaglio due voci diverse?
Abbassa la soglia e ricontrolla i gruppi proposti prima di applicare. Se qualcosa non torna, scrivici a [email protected]: ti risponde una persona vera.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/data/dedupe-semantic \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/data/dedupe-semantic", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/data/dedupe-semantic",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/data/dedupe-semantic", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/data/dedupe-semantic", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"text": "…"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "data.dedupe_semantic",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
max_mb | 25 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |