ForHosting KIT · Datos y archivos

Filtrar filas de un CSV

Una exportación de diez millones de filas rara vez es lo que realmente necesita; casi siempre quiere el subconjunto donde status es activo y región coincide con un valor específico, y encontrar ese subconjunto a mano es justo donde las hojas de cálculo se atascan. Este endpoint aplica reglas condicionales a un CSV y devuelve solo las filas que cumplen, sin importar el tamaño del archivo.

● EstableGratis · en su navegador
Úselo desde WebAPIEmailApp prontoTelegram pronto

Corre en su navegador. Gratis y sin límite: sus datos no salen de esta página.

El problema del subconjunto detrás de cada exportación grande

Las exportaciones completas existen porque generar una filtrada para cada caso de uso posible es poco práctico del lado del sistema origen, así que la carga de filtrar recae en quien consume el archivo. Un analista financiero recibe todas las transacciones registradas cuando solo necesita los reembolsos de este trimestre; un equipo de soporte recibe todos los tickets cuando solo necesita los que siguen abiertos y sin asignar. El autofiltro de una hoja de cálculo funciona bien para unos miles de filas y empieza a fallar mucho antes de que un archivo llegue a los tamaños que los sistemas reales exportan de verdad.

Cómo se construyen y combinan las condiciones

Llame a POST /data/filter-csv con su archivo y un conjunto de condiciones —una columna, un operador como igual, mayor que, contiene o está vacío, y un valor de comparación— y combine varias condiciones con lógica AND, donde todas deben cumplirse, o lógica OR, donde basta con que se cumpla una sola. Esto refleja exactamente cómo funciona una cláusula WHERE en SQL, así que cualquiera que haya escrito status = 'activo' AND region = 'LATAM' ya entiende el modelo mental, solo que expresado como reglas estructuradas en vez de sintaxis de consulta.

Acertar en las comparaciones sobre datos reales

Filtrar solo es útil si maneja los datos tal como aparecen en la realidad: las comparaciones numéricas necesitan que la columna se reconozca como número y no se compare como texto, los rangos de fecha necesitan una interpretación real de fechas y no un ordenamiento de cadenas que coloque "2026-1-5" después de "2026-10-1", y las condiciones de texto necesitan tolerar diferencias de mayúsculas que una persona ni siquiera notaría. Acertar en estas comparaciones es lo que separa un filtro que devuelve el subconjunto equivocado en silencio de uno en el que puede confiar sin revisarlo dos veces.

Filtrar como paso propio, no como último recurso

Es tentador tratar el filtrado como algo que se hace al final, después de todo lo demás, pero hacerlo temprano en un flujo suele ahorrar costo real de procesamiento más adelante: no tiene sentido transformar, unir o deduplicar filas que de todos modos va a descartar. Tratar el filtro como un paso propio y componible significa que decide en qué punto del flujo tiene sentido reducir el conjunto de datos, en lugar de filtrar siempre al final por costumbre.

Su lugar dentro de la automatización

La tarea corre de forma asíncrona y devuelve un task_id de inmediato, así que encaja de forma natural antes de una unión, después de una transformación, o como paso independiente dentro de un trabajo programado que extrae las filas relevantes del día de una exportación en constante crecimiento. Los resultados regresan por webhook firmado o por un enlace firmado válido por 24 horas, listos para alimentar directamente un reporte, una alerta o la siguiente etapa del flujo.

Aislar tickets de soporte abiertos

Filtre una exportación completa de tickets hasta quedarse solo con status = abierto y prioridad = alta, para que un tablero de equipo muestre exactamente lo que necesita atención hoy.

Reportes por región o segmento

Extraiga solo las filas de una región o segmento de clientes específico de una exportación de toda la empresa antes de construir un reporte localizado.

Revisión previa de calidad de datos

Filtre las filas donde un campo obligatorio está vacío o un valor cae fuera de un rango esperado, para aislar los registros que necesitan limpieza antes de importarlos.

Extractos acotados por fecha

Extraiga solo las transacciones o eventos dentro de un rango de fechas de una exportación histórica completa, sin cargar antes todo el archivo en una base de datos.

¿Puedo combinar varias condiciones al filtrar un CSV?

Sí, esta api para filtrar filas de un csv soporta lógica AND, donde todas las condiciones deben cumplirse, y lógica OR, donde basta con que se cumpla una sola.

¿Qué operadores de comparación soporta?

Igual, distinto, mayor que, menor que, contiene, empieza con y está vacío, todos aplicados con el manejo correcto de números y fechas, no como simple comparación de texto.

¿El filtrado maneja fechas y números correctamente, no solo texto?

Sí, las columnas reconocidas como números o fechas se comparan como tales, así que un filtro de rango sobre fechas o montos funciona correctamente en lugar de ordenarlos como cadenas de texto.

¿Hay un plan gratuito para probar el endpoint de filtrado?

La herramienta de arriba es gratis en su navegador. La API es de pago: cada llamada se descuenta de su saldo prepago de ForHosting KIT — se recarga desde $10.00 (no caduca), se paga el precio publicado de cada solicitud, y una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens, y una tarea fallida no se cobra.

¿Qué tan grande puede ser el archivo CSV que filtro?

Envíe los archivos grandes como solicitudes asíncronas; cada una devuelve su propio task_id, así que el filtrado corre en segundo plano sin importar el tamaño del archivo y sin bloquear su flujo.

¿Qué pasa con las filas que no cumplen mis condiciones?

Se excluyen por completo del resultado; la respuesta contiene únicamente las filas que satisfacen sus condiciones de filtro.

¿Cómo recibo el CSV filtrado?

A través de un webhook firmado, recomendado para flujos automatizados, o un enlace firmado válido por 24 horas si prefiere obtenerlo manualmente.

¿Cuánto cuesta la API para filtrar filas de un CSV?

$0.002 por solicitud, cobrado únicamente cuando la tarea de filtrado se completa con éxito.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/data/filter-csv

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/data/filter-csv \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "data.filter_csv",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb25
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →