Stille aus einer Aufnahme entfernen
KIT erkennt stille Abschnitte in einer Audiodatei automatisch und schneidet sie heraus, sodass eine Aufnahme ohne lange Pausen und Denkgeräusche übrig bleibt. Gedacht für Diktate, Interviews oder Sprachnachrichten, in denen Pausen die Aufnahme unnötig in die Länge ziehen, ohne dass jede Stelle manuell gesucht werden muss.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
So wird Stille erkannt und entfernt
KIT analysiert die Lautstärke der Aufnahme fortlaufend und schneidet Abschnitte heraus, die länger als ein festgelegter Schwellenwert unterhalb der Hörbarkeitsgrenze liegen. Kurze natürliche Sprechpausen bleiben erhalten, damit die Aufnahme nicht abgehackt klingt; nur auffällig lange Stille zwischen Sätzen oder am Anfang und Ende der Datei wird entfernt. Das Ergebnis behält denselben Inhalt wie das Original, nur ohne die überflüssigen stillen Abschnitte dazwischen.
Aktueller Stand: in Bereitstellung
Diese Funktion akzeptiert derzeit noch keine Ausführungen, befindet sich aber bereits in der Bereitstellung. Geplant sind $0.077 pro Anfrage plus $0.0045 pro Minute – für eine achtminütige Aufnahme wären das rund $0.113. Die Grenze liegt bei 200 MB und 180 Minuten. Diese Zahlen gelten unverändert, sobald die Funktion startet, sowohl über diese Seite als auch über die API, ohne dass Bestandskunden nachträglich einen höheren Preis zahlen.
Wofür sich die Funktion eignet
Ein Diktat mit langen Denkpausen wird für die Weiterverarbeitung kompakter; ein Interview mit wiederholten Gesprächspausen wirkt beim Anhören flüssiger; eine Sprachnachricht, die mit zehn Sekunden Stille beginnt, startet direkt beim ersten gesprochenen Wort. In allen Fällen wird die Aufnahme kürzer, ohne dass Inhalt verloren geht, was sich besonders bei der anschließenden Transkription oder Zusammenfassung auf die Verarbeitungszeit und damit auch auf die Kosten auswirkt.
Was nicht entfernt wird
Kurze, natürliche Sprechpausen zwischen Sätzen bleiben bewusst erhalten, damit das Ergebnis flüssig klingt statt abgehackt zu wirken. Wer zusätzlich Hintergrundgeräusche loswerden will, kombiniert diese Funktion am besten mit der separaten Rauschunterdrückung, die auf ein anderes Problem als reine Stille zielt. Beide Funktionen lassen sich nacheinander auf dieselbe Datei anwenden, ohne sich gegenseitig zu beeinträchtigen, unabhängig davon, in welcher Reihenfolge sie angewendet werden.
Anwendungsfälle
Diktat ohne Denkpausen
Sabine Schneider spricht ihre Notizen für die Buchhaltung mit häufigen Denkpausen ein und lässt die Aufnahme vor der Transkription automatisch von langen Stillen befreien.
Interview kompakter machen
Eine Podcast-Produktion entfernt aus einem Interview wiederkehrende Gesprächspausen, damit die Episode flüssiger wirkt, ohne dass ein einziges Wort des Inhalts fehlt.
Sprachnachricht ohne Anlaufzeit
Ein Vertriebsteam entfernt die stille Anlaufzeit am Anfang eingehender Kunden-Sprachnachrichten, damit die Aufnahme beim Abspielen sofort mit dem gesprochenen Inhalt beginnt.
Häufige Fragen
Werden auch kurze Sprechpausen entfernt?
Nein, nur auffällig lange stille Abschnitte oberhalb eines Schwellenwerts; normale Pausen zwischen Sätzen bleiben erhalten, damit das Ergebnis natürlich klingt.
Ist diese Funktion schon nutzbar?
Noch nicht, sie befindet sich in der Bereitstellung und nimmt derzeit keine Ausführungen an. Preis und Grenzen sind bereits veröffentlicht.
Was wird das Entfernen von Stille kosten?
$0.077 pro Anfrage plus $0.0045 pro Minute der Ausgangsdatei.
Entfernt die Funktion auch Hintergrundgeräusche?
Nein, dafür ist die separate Rauschunterdrückung vorgesehen; diese Funktion erkennt ausschließlich stille Abschnitte.
Wie groß darf die Datei sein?
Geplant sind bis zu 200 MB und bis zu 180 Minuten Laufzeit.
Was passiert mit meiner Aufnahme nach der Verarbeitung?
Sie wird ausschließlich zur Erstellung des Ergebnisses verwendet und nicht veröffentlicht oder an Dritte weitergegeben.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/audio/remove-silence \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"audio":"https://ejemplo.com/audio.mp3"}'const res = await fetch("https://api.kit.forhosting.com/audio/remove-silence", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"audio": "https://ejemplo.com/audio.mp3"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/audio/remove-silence",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"audio": "https://ejemplo.com/audio.mp3"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/audio/remove-silence", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"audio":"https://ejemplo.com/audio.mp3"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"audio":"https://ejemplo.com/audio.mp3"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/audio/remove-silence", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"audio": "https://ejemplo.com/audio.mp3"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "audio.remove_silence",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_mb | 200 |
max_minutes | 180 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |