ForHosting KIT · OCR y extracción de datos

Sacar las citas de un artículo

Una bibliografía es una lista que solo un gestor de citas puede aprovechar de verdad, y transcribir cincuenta referencias a mano es donde una investigación cuidadosa se vuelve tediosa. Este endpoint lee la lista de referencias de un artículo y devuelve cada cita como JSON estructurado —autores, título, año, publicación e identificadores cuando existen— lista para importar en lugar de retipear.

● BetaPor solicitud + por página$0.003
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

La distancia entre una lista impresa y datos utilizables

Una lista de referencias formateada para la vista del lector —sangría francesa, nombres de revista en cursiva, una mezcla inconsistente de comas y puntos según el estilo de citación— no lleva ninguna estructura legible por máquina. Copiarla a mano en un gestor de referencias, entrada por entrada, es lento y propenso a errores, sobre todo cuando una sola revisión de literatura combina varios estilos: APA en un artículo, numeración Vancouver en otro, una variante autor-fecha en un tercero.

Quién realmente trabaja con listas de referencias a gran volumen

Investigadores que arman una revisión sistemática y necesitan cada fuente citada de docenas de artículos cargada en una sola biblioteca, personal de producción editorial que verifica que las citas dentro del texto coincidan con la bibliografía antes de la maquetación, bibliotecarios académicos que construyen bases de citas a partir de revistas antiguas digitalizadas, y desarrolladores de herramientas de gestión de referencias que necesitan una forma confiable de importar la bibliografía que un usuario pega como página escaneada o exportada.

Cómo fluye la solicitud y el resultado

Envía el artículo o las páginas de la lista de referencias a POST /ocr/citation y recibe un task_id de inmediato, porque el proceso corre de forma asíncrona en lugar de mantener una conexión abierta. Al completarse la extracción, la lista de citas analizadas —cada entrada dividida en autor, título, año, fuente y cualquier identificador que incluyera el original— llega por webhook firmado o queda disponible en un enlace firmado durante 24 horas.

Los estilos de citación son una convención joven sobre un hábito antiguo

Los académicos citan trabajos previos desde hace siglos, pero el estilo de citación estandarizado —APA, MLA, Chicago, Vancouver y el resto— es una invención del siglo veinte pensada para hacer las referencias comparables mucho antes de que existieran máquinas capaces de leerlas. Este endpoint cierra ese ciclo: lee el estilo que use el artículo y normaliza el resultado en un esquema consistente, sin importar la convención que haya seguido el autor original.

Dónde encaja en un flujo de revisión

A $0.003 por solicitud más $0.0135 por página, y con cobro únicamente sobre extracciones exitosas, una herramienta de revisión sistemática puede pasar la bibliografía de cada artículo incluido por este endpoint apenas se agrega a la revisión, construyendo una biblioteca de citas deduplicada de forma automática en lugar de pedirle a un asistente que transcriba listas de referencias entre rondas de selección. Las tareas fallidas se reintentan automáticamente hasta tres veces sin costo, y el endpoint requiere saldo prepago —sin capa gratuita, por diseño, para mantenerlo rápido.

Bibliotecas de citas para revisiones sistemáticas

Un equipo de investigación extrae cada referencia de decenas de artículos incluidos para construir una biblioteca de citas deduplicada en lugar de transcribir cada bibliografía.

Control de calidad en producción editorial

El personal de producción usa la lista de referencias analizada para verificar que cada cita en el texto tenga su entrada correspondiente en la bibliografía antes de maquetar.

Importación a gestores de referencias

Una aplicación de gestión bibliográfica permite pegar una bibliografía escaneada o copiada e importa cada cita como un registro estructurado automáticamente.

Digitalización de archivos de revistas antiguas

Una biblioteca extrae citas de números atrasados escaneados para poblar una base de citas consultable que nunca existió en formato digital.

¿Qué devuelve la api extraer citas bibliograficas?

Una lista en JSON estructurada de las referencias del artículo, cada una dividida en autor, título, año, publicación de origen y cualquier identificador presente en la entrada original.

¿Cómo se usa la api de extracción de citas?

Envíe el archivo a POST /ocr/citation, reciba un task_id de inmediato, y obtenga las citas analizadas por webhook o enlace firmado cuando termine la tarea asíncrona.

¿Soporta estilos APA, MLA, Vancouver y otros?

Sí, lee el estilo que realmente use el artículo y normaliza cada entrada al mismo esquema estructurado sin importar la convención de formato.

¿Existe una capa gratuita para extraer citas bibliográficas?

No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.

¿Cuánto cuesta extraer citas?

$0.003 por solicitud más $0.0135 por página, precio publicado y plano, y se cobra solo cuando la extracción tiene éxito.

¿Puede procesar una bibliografía escaneada de una revista antigua?

Sí, extrae texto de páginas escaneadas y de PDF nativos digitales antes de analizar la lista de referencias.

¿Se cobra si la extracción falla?

No. Las tareas fallidas se reintentan automáticamente hasta tres veces y nunca se cobran; recibe un error claro si fallan todos los reintentos.

¿Puedo extraer citas de muchos artículos en lote?

Envíe una solicitud por artículo; cada una devuelve su propio task_id, así que toda una revisión de literatura puede procesarse en paralelo.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/ocr/citation

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/ocr/citation \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "ocr.citation",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.003
Por página$0.0135

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb25
max_pages10
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.
413input_too_largeEl archivo supera el límite de tamaño.
422task_failedLa tarea falló tras 3 reintentos. No se cobra.

Ver la documentación completa del KIT →