Generar texto
La API para generar texto recibe un prompt y devuelve texto redactado, encolado en un sistema de tareas en vez de transmitido en vivo, lo que significa que puede calcular su factura de antemano en lugar de descubrirla después. No hay un medidor de tokens que vigilar: se cobra por solicitud más una tarifa fija por cada 1.000 palabras generadas.
Ejecútela online
Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.
Por qué poner un LLM tras una cola
La mayoría de las integraciones de generación de texto están pensadas para una ventana de chat, donde alguien mira la pantalla esperando que las palabras vayan apareciendo. Buena parte del trabajo real de generación —copy de producto a escala, redacción de informes, contenido por lotes para un CMS— no tiene a nadie observando en tiempo real, y forzar ese trabajo a través de una API síncrona y en streaming solo añade código frágil de manejo de conexiones sin ningún beneficio. Este endpoint está construido para el caso por lotes: envía el prompt, se aleja, recibe el texto cuando está listo.
Cómo es enviar una solicitud en la práctica
Una llamada a POST /text/generate con su prompt devuelve un task_id de inmediato y encola el trabajo de generación. El texto terminado se entrega después mediante un webhook firmado, la ruta recomendada para cualquier flujo automatizado, o mediante un enlace firmado que permanece válido por 24 horas si prefiere consultarlo o compartirlo con alguien. Ninguno de los dos métodos de entrega requiere mantener un socket abierto.
Sobre un precio que realmente puede predecir
El precio basado en tokens de la mayoría de proveedores de modelos de lenguaje es notoriamente difícil de estimar antes de que termine una llamada, porque la tokenización varía según el contenido y el idioma. Este endpoint cobra por número de solicitudes y palabras en su lugar: $0.003 por solicitud más $0.0135 por cada 1.000 palabras generadas, de modo que un lote de 500 prompts con unas 300 palabras cada uno tiene un costo que puede calcular en una hoja de cálculo antes de llamar siquiera a la API.
Dónde encaja dentro de un sistema más grande
Como la interfaz es una cola y no un flujo en vivo, la generación de texto aquí se combina de forma limpia con otros endpoints asíncronos: alimentar una respuesta de preguntas sobre documentos hacia un prompt de generación, o encadenar el texto generado hacia una tarea de formato o traducción, sin necesidad de mantener nunca una solicitud abierta a través de varias llamadas al modelo. Los reintentos y fallos se manejan igual en todos los endpoints, así que su manejo de errores se mantiene uniforme.
Qué esperar en resultados y límites
Los prompts más largos y las salidas solicitadas más extensas tardan proporcionalmente más en salir de la cola; no hay un tope artificial disfrazado de característica, solo el compromiso honesto entre longitud y tiempo de espera. El acceso requiere saldo prepago en lugar de un plan gratuito, lo que mantiene la cola libre de tráfico de abuso desechable, y una tarea que falla tras tres reintentos devuelve un error claro y nunca se cobra.
Qué puede hacer con ella
Lotes de contenido nocturnos
Un CMS encola los borradores del boletín de toda una semana antes de terminar el día y deja que los webhooks llenen el calendario editorial para la mañana siguiente.
Redacción de informes desde datos estructurados
Una herramienta de reportes convierte un resumen JSON de métricas mensuales en una sección narrativa escrita, ejecutada automáticamente al inicio de cada ciclo de reporte.
Encadenamiento de prompts en un flujo
Un flujo de trabajo genera un esquema, espera el webhook y luego pasa cada sección de vuelta por el endpoint para expandirla, todo sin una persona en el proceso.
Escalamiento de contenido con costo predecible
Un equipo de marketing proyecta el gasto mensual de una campaña de contenido multiplicando el conteo de palabras planeado por la tarifa publicada por palabra, antes de escribir un solo prompt.
Preguntas frecuentes
¿Cómo funciona la API para generar texto?
Envía un prompt a POST /text/generate, se encola como tarea asíncrona y el texto generado se entrega por webhook firmado o por un enlace firmado válido por 24 horas.
¿Hay una prueba gratuita para la API de generar texto?
No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.
¿Cómo se calcula el precio, es por token?
No hay tokens: el precio es $0.003 por solicitud más $0.0135 por cada 1.000 palabras de texto generado, una tarifa que puede calcular de antemano.
¿Por qué la API es asíncrona en vez de transmitir en vivo?
El streaming asume que alguien está mirando en tiempo real; este endpoint apunta a uso por lotes y flujos automatizados, así que encola el trabajo y entrega el resultado terminado por webhook.
¿Qué pasa si una tarea de generación falla?
La tarea se reintenta automáticamente hasta tres veces; si aun así falla, recibe un error claro y nunca se le cobra.
¿Puedo usar esto para generar contenido en volumen?
Sí: puede encolar tantas solicitudes en paralelo como necesite; cada una devuelve su propio task_id, que es justamente para lo que está diseñado el endpoint.
¿Por cuánto tiempo está disponible el texto generado?
El enlace firmado permanece válido durante 24 horas; después, el resultado se elimina y nunca se usa para entrenamiento.
¿En qué se diferencia esto de una API de chat con streaming?
Una API de chat está pensada para un intercambio en vivo; esta está pensada para generación por lotes sin supervisión, con precio predecible y sin tokens.
Para desarrolladores — acceso por API
Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.
Endpoint de API
¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.
Llámela desde su stack
curl -X POST https://api.kit.forhosting.com/text/generate \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/text/generate", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/generate",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/generate", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/generate", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Ejemplo de solicitud
{
"text": "…"
}Ejemplo de respuesta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.generate",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.
Precio
Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.
Límites
max_tokens | 20000 |
Errores
| HTTP | Código | Significado |
|---|---|---|
401 | unauthorized | API key ausente o inválida. |
402 | insufficient_balance | El saldo no cubre el precio de la tarea. |
404 | unknown_type | El tipo de tarea no existe. |
429 | rate_limited | Demasiadas peticiones. Use el webhook en vez de sondear. |
422 | task_failed | La tarea falló tras 3 reintentos. No se cobra. |