ForHosting KIT · Datos y archivos

Detectar delimitador CSV: coma, punto y coma, tabulador o barra

Los archivos CSV no siempre emplean comas. Las exportaciones regionales suelen usar puntos y coma, los procesos de datos pueden preferir tabuladores y las herramientas de línea de comandos generan a menudo texto separado por barras.

● BetaGratis · en su navegador
Úselo desde WebAPIEmailTelegramApp pronto

Este detector examina una muestra representativa e identifica el delimitador más probable entre coma, punto y coma, tabulador y barra. Exige un patrón estable en todas las líneas no vacías, por lo que no adivina cuando la estructura es irregular. El resultado incluye el carácter, su nombre, el número de columnas inferido y las líneas analizadas.

Elija una muestra CSV representativa

Pegue al menos dos líneas no vacías del mismo archivo CSV, preferiblemente la cabecera y varias filas de datos normales. Una muestra útil conserva los separadores y saltos de línea originales; no hace falta cargar un archivo grande completo solo para identificar su formato. El detector considera cuatro candidatos habituales: coma, punto y coma, tabulador y barra vertical. Ignora las líneas vacías, incluida la última línea que dejan muchos editores, porque no contienen estructura de campos. Cada línea relevante debe presentar el mismo número de apariciones del separador real. Por ejemplo, una cabecera de tres campos y dos filas de tres campos producen dos separadores por línea. Si la muestra incluye explicaciones antes de la cabecera, registros repartidos en varias líneas o filas cortadas, límpiela o seleccione una sección más representativa. Una entrada uniforme aporta pruebas de estructura en lugar de exigir una inferencia basada en un carácter aislado. El texto no se modifica: la herramienta informa del resultado, pero no reformatea, analiza, almacena ni corrige el CSV proporcionado.

Comprenda la decisión basada en frecuencia

El detector cuenta las apariciones literales de cada carácter candidato en todas las líneas no vacías. Un candidato solo sigue siendo válido si aparece al menos una vez en cada línea y mantiene exactamente el mismo recuento. Entre los candidatos válidos se elige el de mayor frecuencia por línea. El método es determinista y fácil de auditar: el mismo texto siempre produce el mismo resultado, sin modelos, solicitudes de red, ajustes regionales ni elecciones aleatorias. El número de columnas devuelto es el recuento ganador más uno, mientras que el total de líneas indica cuánta evidencia se examinó. Este análisis es deliberadamente más limitado que un analizador CSV completo. En particular, también cuenta los candidatos incluidos dentro de valores entre comillas. Si un texto entre comillas contiene cantidades variables de comas y los puntos y coma separan los campos de forma constante, estos aún pueden resultar correctos; sin embargo, las comillas complejas o los registros multilínea pueden volver incoherentes todos los candidatos. En ese caso se devuelve un error en vez de una conjetura poco fiable. Para gestionar escapes y comillas por completo, use después un analizador CSV específico.

Resuelva muestras incoherentes o ambiguas

Un error resulta útil cuando la muestra no permite sostener una respuesta fiable. Si ninguna coma, punto y coma, tabulador o barra presenta el mismo recuento positivo en todas las líneas no vacías, la herramienta indica que ningún candidato aparece de forma uniforme. Esto suele revelar filas dañadas, exportaciones mezcladas, notas pegadas o texto que no es realmente tabular. Otro error cubre la ambigüedad: dos o más candidatos pueden compartir la frecuencia uniforme más alta. Elegir uno por una prioridad arbitraria haría imprevisible el análisis posterior, así que el detector solicita una muestra más clara. Añada filas representativas, quite comentarios externos o revise la configuración de exportación del sistema de origen. También se rechaza una sola línea, porque la estructura repetida entre líneas constituye la evidencia esencial del método. Tras un resultado correcto, pase el carácter devuelto a su lector CSV y, si lo desea, compruebe que las filas analizadas coincidan con el número de columnas indicado. Puede usarlo gratis en el navegador; las llamadas automatizadas a la API cuestan $0.002 por solicitud. Ambos canales ejecutan la misma lógica pura.

Configure una importación automáticamente

Examine una muestra del proveedor antes de seleccionar el delimitador para un analizador CSV o una importación a base de datos.

Diagnostique una carga de hoja de cálculo

Confirme si una exportación usa el formato regional con punto y coma en vez de la coma esperada por el formulario.

Valide supuestos del proceso

Compruebe que el texto delimitado entrante mantenga una estructura estable antes de transformarlo o asignar su esquema.

¿Qué delimitadores puede detectar?

Los candidatos son coma, punto y coma, tabulador y barra vertical.

¿Cuándo se considera uniforme un delimitador?

Debe aparecer al menos una vez y tener exactamente el mismo recuento en cada línea no vacía.

¿Se incluyen las líneas vacías?

No. Se ignoran las líneas vacías o compuestas solo por espacios, incluida una línea final vacía.

¿La detección interpreta campos CSV entre comillas?

No. Realiza un análisis de frecuencia literal, por lo que cuenta los caracteres candidatos dentro de valores entre comillas.

¿Por qué una muestra ambigua devuelve un error?

Si varios candidatos empatan con la frecuencia uniforme más alta, elegir uno por prioridad sería una conjetura sin fundamento.

¿Cuánto cuesta una solicitud API?

Cada solicitud API cuesta $0.002; la versión del navegador se ejecuta localmente de forma gratuita.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/data/detect-csv-delimiter

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.

curl -X POST https://api.kit.forhosting.com/data/detect-csv-delimiter \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"name,city,score\nAda,London,92\nLinus,Helsinki,88"}'
{
  "text": "name,city,score\nAda,London,92\nLinus,Helsinki,88"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "data.detect_csv_delimiter",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb25
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →