Type-Token-Verhältnis für lexikalische Vielfalt berechnen
Der Rechner für das Type-Token-Verhältnis misst die Vielfalt des Wortschatzes in einem Text, indem er die Zahl verschiedener Worttypen durch die Gesamtzahl der Worttokens teilt.
Im Browser ausführen – kostenlos
Fügen Sie Prosa, ein Transkript, einen Aufsatz oder einen anderen Text ein, um die zugrunde liegenden Zählwerte und ein reproduzierbares Verhältnis zwischen null und eins zu erhalten. Die Berechnung ist deterministisch, erkennt Unicode-Wörter und Zahlen, bewahrt Apostrophe innerhalb von Wörtern und kann Wörter, die sich nur in der Groß- und Kleinschreibung unterscheiden, zusammenfassen oder trennen.
Verstehen Sie die Aussage des Verhältnisses
Das Type-Token-Verhältnis, häufig als TTR abgekürzt, setzt die Vielfalt des Wortschatzes zur Textlänge in Beziehung. Ein Token ist jedes einzelne Vorkommen eines Wortes im Text, ein Typ dagegen eine unterschiedliche Wortform. Im Satz „Vögel singen und Vögel fliegen“ gibt es fünf Tokens, aber vier Typen, weil „Vögel“ zweimal vorkommt. Die Zahl der Typen geteilt durch die Zahl der Tokens ergibt einen Wert über null bis einschließlich eins. Eins bedeutet, dass jedes Token einmalig ist; ein niedrigerer Wert weist auf mehr Wiederholungen hin. Diese einfache Deutung eignet sich als erster Überblick über Texte, Transkripte, Lernersprache und Inhaltsbestände. Das Verhältnis beschreibt jedoch nur und bewertet nicht die Qualität. Wiederholungen können beabsichtigt, notwendig oder erwünscht sein, besonders in technischen Anleitungen und konzentrierten Erläuterungen. Betrachten Sie daher neben dem Verhältnis auch die ausgegebenen Token- und Typenzahlen. So bleibt nachvollziehbar, wie der Wert zustande kam, und eine einzelne Dezimalzahl wird nicht fälschlich als vollständiges Urteil über Stil oder Sprachvermögen verwendet.
Vergleichen Sie Texte auf fairer Grundlage
Die Textlänge wirkt sich stark auf ein einfaches Type-Token-Verhältnis aus. Kurze Abschnitte bieten weniger Gelegenheiten für Wortwiederholungen und erzielen deshalb oft höhere Werte als längere Texte, selbst wenn Autor oder Thema gleich sind. Wählen Sie für einen aussagekräftigen Vergleich Proben mit ähnlicher Länge, Textsorte, Sprache und Aufbereitung. Vergleichen Sie beispielsweise zwei Aufsätze mit je fünfhundert Wörtern statt einer kurzen Nachricht mit einem vollständigen Bericht. Dieser Rechner erkennt Folgen aus Unicode-Buchstaben oder Ziffern als Tokens und lässt gerade oder typografische Apostrophe innerhalb eines Wortes bestehen. Satzzeichen um ein Wort erzeugen keinen zusätzlichen Typ. Standardmäßig wird die Groß- und Kleinschreibung vereinheitlicht: „Buch“ und „buch“ gelten als derselbe Typ. Aktivieren Sie die Beachtung der Schreibweise nur, wenn sie für Ihre Fragestellung wichtig ist. Verwenden Sie für alle Proben dieselben Einstellungen, erfassen Sie die Gesamtzahl der Tokens und beurteilen Sie kleine Unterschiede vorsichtig, vor allem bei kurzen Texten oder verschiedenen Themen.
Nutzen Sie das Ergebnis reproduzierbar
Ein verlässlicher Ablauf beginnt mit einer klar abgegrenzten Probe. Entscheiden Sie vor der Analyse, ob Überschriften, Zitate, Sprecherbezeichnungen, Zahlen und wiederkehrende Standardtexte einbezogen werden sollen. Wenn Sie solche Bestandteile in einer Probe entfernen und in einer anderen behalten, verändern Sie Zähler und Nenner. Verarbeiten Sie jeden vorbereiteten Text mit derselben Einstellung zur Groß- und Kleinschreibung und speichern Sie alle vier Ausgabefelder: Gesamtzahl der Tokens, verschiedene Typen, Type-Token-Verhältnis und angewandte Schreibweisenregel. Damit ist das Ergebnis prüfbar und wiederholbar. Die Browserversion eignet sich für einzelne Kontrollen; die API unterstützt Stapelverarbeitung, redaktionelle Übersichten, Lernwerkzeuge und Forschungsvorbereitung. Die Berechnung ist deterministisch und sendet den Text nicht an ein KI-Modell, sodass gleiche Eingaben und Optionen gleiche Ausgaben erzeugen. Falls sich die Probenlängen nicht angleichen lassen, dokumentieren Sie diese Einschränkung oder ergänzen Sie ein längenkorrigiertes Maß. Deuten Sie den Wert vor allem im Kontext: Ein niedrigeres Verhältnis kann notwendige Fachbegriffe, einen klaren Themenfokus, Zitate oder wiederholte Dialoge widerspiegeln und muss keinen schwachen Wortschatz bedeuten.
Anwendungsfälle
Schreibproben vergleichen
Messen Sie gleich lange Fassungen mit einheitlichen Einstellungen, um Veränderungen bei Wortwiederholungen zu erkennen.
Transkripte untersuchen
Ergänzen Sie Interviews, Unterricht, Besprechungen oder Forschungstranskripte um ein transparentes Maß der Wortschatzvielfalt.
Inhaltsbestände prüfen
Verarbeiten Sie Artikel oder Produkttexte stapelweise und markieren Sie ungewöhnlich repetitive Inhalte für die manuelle Prüfung.
Häufige Fragen
Wie wird das Type-Token-Verhältnis berechnet?
Die Zahl der verschiedenen Worttypen wird durch die Gesamtzahl der Worttokens geteilt; das Ergebnis wird auf sechs Dezimalstellen gerundet.
Was bedeutet ein hohes Type-Token-Verhältnis?
Ein größerer Anteil der Tokens kommt in dieser Probe nur einmal vor. Allein beweist das weder bessere Texte noch einen fortgeschritteneren Wortschatz.
Warum sollten Texte ähnlich lang sein?
Längere Texte bieten mehr Möglichkeiten für Wiederholungen, wodurch die einfache TTR meist sinkt. Ähnliche Längen machen Vergleiche aussagekräftiger.
Beeinflusst die Großschreibung das Ergebnis?
Standardmäßig nicht. Setzen Sie case_sensitive auf true, wenn Formen wie „Haus“ und „haus“ als getrennte Typen zählen sollen.
Wie werden Wörter erkannt?
Folgen aus Unicode-Buchstaben und Ziffern sind Tokens. Ein gerades oder typografisches Apostroph im Wort bleibt erhalten; äußere Satzzeichen trennen Tokens.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/str/type-token-ratio \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"The quick brown fox jumps over the lazy dog. The fox rests."}'const res = await fetch("https://api.kit.forhosting.com/str/type-token-ratio", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "The quick brown fox jumps over the lazy dog. The fox rests."
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/str/type-token-ratio",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "The quick brown fox jumps over the lazy dog. The fox rests."
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/str/type-token-ratio", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"The quick brown fox jumps over the lazy dog. The fox rests."}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"The quick brown fox jumps over the lazy dog. The fox rests."}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/str/type-token-ratio", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"text": "The quick brown fox jumps over the lazy dog. The fox rests."
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "str.type_token_ratio",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_chars | 1000000 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |