ForHosting KIT · Datos y archivos

Calcular estadísticas de una columna CSV

Convierta una columna numérica de un CSV en un resumen estadístico compacto sin abrir una hoja de cálculo ni escribir un script desechable.

● BetaGratis · en su navegador
Úselo desde WebAPIEmailTelegramApp pronto

Proporcione el texto CSV y el nombre exacto de la columna numérica para obtener su mínimo, máximo, media aritmética, mediana y desviación estándar poblacional. Cada celda seleccionada se valida antes del cálculo: las columnas ausentes, celdas vacías, etiquetas, infinitos y demás valores no numéricos generan un error claro en vez de un resultado parcial engañoso. Los campos entre comillas, las comillas escapadas, los delimitadores configurables y los finales de línea habituales se procesan de forma determinista.

Proporcione el texto CSV y elija una columna

Comience con un texto CSV cuyo primer registro sea la cabecera y cuyos registros restantes contengan las observaciones. Defina column con la cabecera exacta que desea analizar. Los espacios alrededor de la cabecera se ignoran, pero la ortografía y las mayúsculas sí importan; así se evita seleccionar silenciosamente otro campo. La coma es el separador predeterminado. Si su archivo usa punto y coma, tabulación, barra vertical u otro separador de un carácter, indíquelo en el campo de delimitador. Se admiten valores CSV entre comillas, incluidos delimitadores y saltos de línea internos, además de comillas duplicadas. El analizador considera datos todos los registros posteriores a la cabecera, por lo que conviene retirar notas de pie ajenas antes de enviar el archivo. Debe existir al menos un registro de datos. La respuesta identifica la columna elegida y muestra el número de observaciones junto a las cinco estadísticas, para que usted confirme qué valores se incluyeron antes de emplear el resultado en un informe, una regla de validación o una decisión de importación automatizada.

Interprete las cinco estadísticas devueltas

El mínimo y el máximo describen el intervalo observado. La media es el promedio aritmético: se suman todos los valores seleccionados y se divide el total por su cantidad. La mediana es el valor central después de ordenar numéricamente; si hay un número par de observaciones, corresponde al promedio de los dos valores centrales. La desviación estándar se calcula como poblacional: las distancias al cuadrado respecto de la media se dividen por el número completo de observaciones antes de extraer la raíz cuadrada. Esta definición resulta apropiada cuando la columna CSV constituye toda la población que usted quiere describir. Si las filas son una muestra para estimar una población mayor, aplique después la corrección muestral. Los resultados emplean números de JavaScript normalizados a quince cifras significativas para evitar artefactos molestos de coma flotante sin perder precisión útil. La capacidad no infiere unidades, elimina valores atípicos, pondera observaciones ni reinterpreta monedas formateadas. Resume exactamente los valores numéricos finitos proporcionados en la columna elegida.

Proteja el proceso posterior con validación estricta

Las estadísticas fiables exigen una columna numérica coherente, por eso la validación es deliberadamente estricta. La solicitud falla si la cabecera indicada no existe o si cualquier celda seleccionada está vacía, ausente, contiene infinito o no representa un número finito. Las filas defectuosas no se omiten en silencio, porque calcular con un conjunto reducido puede dar una respuesta verosímil pero incorrecta. Antes de llamar a esta capacidad, normalice símbolos monetarios, separadores de miles, porcentajes y marcadores textuales de valores nulos. El error señala la columna y, cuando una celda es inválida, la posición de la fila de datos empezando por uno, lo que facilita localizar y reparar el registro original. Este comportamiento permite usar la capacidad como control de calidad previo a la ingesta: un resultado correcto confirma que la columna esperada existe y que todas las filas participan en el cálculo. El proceso es determinista, no accede a la red ni conserva el archivo. El navegador sirve para una comprobación inmediata; cada solicitud automatizada a la API cuesta $0.002.

Revisar una exportación de mediciones

Resuma una columna de sensores o laboratorio y compare su intervalo y dispersión con los límites operativos previstos.

Validar una fuente entrante

Compruebe que una columna numérica obligatoria existe y solo contiene valores utilizables antes de importar el CSV.

Describir resultados de una encuesta

Calcule la tendencia central y la dispersión poblacional de una respuesta numérica sin fórmulas de hoja de cálculo.

¿Qué tipo de desviación estándar se devuelve?

Se devuelve la desviación estándar poblacional: la varianza se divide por todas las observaciones antes de extraer su raíz cuadrada.

¿Se ignoran las celdas vacías?

No. Una celda vacía o ausente en la columna seleccionada provoca un error de entrada no válida para evitar subconjuntos ocultos.

¿Puede el CSV usar un separador distinto de la coma?

Sí. Indique cualquier delimitador válido de un carácter, como punto y coma, tabulación o barra vertical.

¿Admite campos CSV entre comillas?

Sí. Interpreta delimitadores entre comillas, saltos de línea internos y comillas dobles escapadas según las convenciones de CSV.

¿Cuánto cuesta una solicitud a la API?

Cada solicitud a la API cuesta $0.002. La versión del navegador puede ejecutarse localmente para comprobaciones interactivas.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/data/csv-column-stats

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.

curl -X POST https://api.kit.forhosting.com/data/csv-column-stats \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"csv":"name,score\nAda,10\nGrace,20\nLinus,30","column":"score"}'
{
  "csv": "name,score\nAda,10\nGrace,20\nLinus,30",
  "column": "score"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "data.csv_column_stats",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb25
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →