ForHosting KIT · Audio y voz

Quitar silencios

Toda grabación tiene pausas que tenían sentido para quien hablaba y no aportan nada a quien escucha después: un momento para pensar, un micrófono que quedó abierto, un tramo largo antes de que alguien por fin diga lo importante. Este endpoint encuentra esos huecos y los corta para que la grabación avance al ritmo de lo que realmente se está diciendo.

● EstablePor solicitud + por minuto$0.077
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

De dónde viene el aire muerto

Las grabaciones sin guion están llenas de esto: un narrador solo que organiza sus ideas a mitad de frase, una entrevista remota con una conexión lenta, una nota de voz que alguien dejó corriendo mientras se alejaba. Ese silencio no es exactamente un error, es solo un subproducto de cómo habla y graba la gente de verdad, pero deja una experiencia de escucha peor y un archivo más largo de lo que merece el contenido. audio.remove_silence apunta justo a ese desperdicio sin tocar el habla que lo rodea.

Cómo se decide el corte

Haga POST a /audio/remove-silence con su archivo, y la tarea corre de forma asíncrona, devolviendo un task_id de inmediato. El resultado —una versión del archivo sin los tramos silenciosos— llega por webhook firmado o mediante un enlace firmado válido por 24 horas. La detección trabaja sobre tramos silenciosos por debajo de un umbral, no sobre una duración fija de pausa, así que una respiración natural de medio segundo entre frases se deja intacta mientras que un hueco muerto de noventa segundos se recorta.

Más ajustado no siempre es mejor

Quitar toda pausa de forma demasiado agresiva puede hacer que el habla suene apurada o artificial, algo que todo editor de audio aprende a respetar; un poco de aire entre frases es parte de cómo el habla natural se lee para quien escucha. El objetivo aquí no es cero silencio, es eliminar el aire muerto que no cumple ninguna función, un blanco bastante distinto y hacia el cual está ajustado este endpoint.

Lo que ahorra más adelante en la cadena

Los archivos más cortos se transcriben más rápido y más barato, se resumen con más precisión porque hay menos vacío que un modelo tenga que atravesar, y simplemente le quitan menos tiempo a quien escucha: tres ganancias reales de un solo paso. Los editores de podcast lo aplican antes del masterizado final para ajustar entrevistas sin revisar manualmente una forma de onda buscando huecos silenciosos, y las aplicaciones de notas de voz lo corren automáticamente en cada grabación para que el usuario nunca note que el aire muerto estuvo ahí. Con precio por solicitud más por minuto del archivo de origen, es lo bastante económico como para correrlo por defecto en cada grabación, en lugar de reservarlo solo para las que alguien se acuerda de limpiar.

Ajustar una entrevista sin guion

Un productor de podcast quita las pausas largas de pensamiento de una entrevista sin editar antes de enviarla al editor para el masterizado final.

Limpiar notas de voz remotas

Una aplicación de notas elimina el aire muerto de las notas de voz automáticamente para que la reproducción se mantenga ajustada aunque la grabación haya seguido corriendo mientras el usuario se distraía.

Transcripciones más cortas y más baratas

Un flujo de transcripción quita los silencios antes de enviar el audio a los siguientes pasos, reduciendo tanto el tiempo de procesamiento como el costo por minuto de transcripción.

Revisión más rápida de grabaciones largas

Un equipo legal quita los huecos silenciosos de una declaración grabada para que los revisores pierdan menos tiempo esperando pausas sin contenido.

¿Cómo quito los silencios de un audio con la API?

Envíe el archivo por POST a /audio/remove-silence, guarde el task_id devuelto y reciba el archivo limpio por webhook o mediante un enlace firmado válido por 24 horas.

¿Es gratis la API para quitar silencios de audio?

No, no hay plan gratuito ni prueba; cuesta $0.077 por solicitud más $0.0045 por minuto de audio de origen, y una tarea fallida nunca se cobra.

¿Va a cortar las pausas naturales del habla?

Apunta a tramos de aire muerto por debajo de un umbral de volumen, no a cualquier pausa corta, así que el respiro normal entre frases generalmente se conserva.

¿Qué formatos acepta?

Los más comunes: MP3, WAV, OGG, M4A y FLAC; consulte la referencia del endpoint para la lista completa vigente.

¿Puedo ajustar qué tan agresiva es la eliminación de silencios?

Consulte la referencia del endpoint para ver los parámetros de sensibilidad disponibles si necesita una detección más o menos estricta que la que viene por defecto.

¿Quitar silencios también reduce el costo de transcripción?

Sí, un archivo más corto después de eliminar silencios generalmente implica menos tiempo de procesamiento y menor costo en cualquier servicio posterior que cobre por minuto, como la transcripción.

¿Ya está disponible este endpoint?

Está en despliegue en este momento y todavía no acepta trabajos; revise el estado del endpoint antes de enviarle tráfico de producción.

¿Se conserva mi audio después de procesarlo?

No, los archivos de origen y los resultados se eliminan después del período de retención y nunca se usan para entrenamiento.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/audio/remove-silence

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/audio/remove-silence \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"audio":"https://ejemplo.com/audio.mp3"}'
{
  "audio": "https://ejemplo.com/audio.mp3"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "audio.remove_silence",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.077
Por minuto$0.0045

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb200
max_minutes180
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →