Lanza IA en tu producto sin operar la capa compleja
Conecta tu aplicación a endpoints Nulu 4.8 con claves API, saldo prepago, medición por token y soporte técnico para pasar de prueba a producción con menos fricción.
La capa de desarrollo para integrar Nulu 4.8
Todo lo que un equipo necesita entre una idea con IA y una integración mantenible: autenticación, documentación, medición y controles operativos.
Interfaz compatible
Conecta clientes modernos con rutas conocidas para listar endpoints y crear respuestas de chat.
Observabilidad de uso
Revisa tokens de entrada, caché, salida, cargos y estado de cada solicitud desde el panel.
Gestión de acceso
Crea claves API, revoca credenciales, separa entornos y mantiene trazabilidad por usuario o aplicación.
La meta no es solo responder prompts: es dar a tu equipo una forma ordenada de operar IA en producción.
Acceso a 20 modelos por API
Tarifas simples por 1M tokens, saldo prepago y cargos calculados por uso real para que puedas estimar, lanzar y ajustar sin contratos confusos.
Nulu 4.8 Flash
Opción ágil para asistentes, clasificación, resúmenes, extracción y flujos de alto volumen.
- Contexto: 1M tokens
- Salida máxima: 384K tokens
- Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
- Entrada
- $0.336
- Entrada cacheada
- $0.00672
- Salida
- $0.672
por 1M tokens
por 1M tokens
por 1M tokens
Nulu 4.8
Opción para tareas que requieren más profundidad: análisis, planificación y respuestas estructuradas.
- Contexto: 1M tokens
- Salida máxima: 384K tokens
- Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
- Entrada
- $1.044
- Entrada cacheada
- $0.0087
- Salida
- $2.088
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Sol
Modelo flagship de GPT para tareas complejas, razonamiento profundo y agentes con herramientas.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls.
- Entrada
- $1.1325
- Entrada cacheada
- $0.11325
- Salida
- $6.795
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Luna
Variante económica de GPT 5.6 para tareas de uso general con buen rendimiento.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.2265
- Entrada cacheada
- $0.02265
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Terra
Equilibrio entre costo y capacidad en la familia GPT 5.6.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls.
- Entrada
- $0.56625
- Entrada cacheada
- $0.056625
- Salida
- $3.3975
por 1M tokens
por 1M tokens
por 1M tokens
Claude Sonnet 5
Claude equilibrado con contexto de 1M y hasta 128K tokens de salida.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $0.453
- Entrada cacheada
- $0.0906
- Salida
- $2.265
por 1M tokens
por 1M tokens
por 1M tokens
Opus 4.8
Claude de máxima profundidad para análisis complejos y trabajos de investigación.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $1.1325
- Entrada cacheada
- $0.11325
- Salida
- $5.6625
por 1M tokens
por 1M tokens
por 1M tokens
Fable 5
Modelo enterprise para cargas de trabajo críticas con máxima capacidad.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $2.265
- Entrada cacheada
- $0.2265
- Salida
- $11.325
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.6 Flash
Flash de última generación con velocidad y rendimiento mejorados.
- Contexto: 1M tokens
- Varía según variante
- Multimodal, tool calls.
- Entrada
- $0.8154
- Entrada cacheada
- $0.08154
- Salida
- $4.077
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.5 Flash
Flash confiable para producción con balance velocidad-rendimiento.
- Contexto: 1M tokens
- Varía según variante
- Multimodal, tool calls.
- Entrada
- $0.8154
- Entrada cacheada
- $0.08154
- Salida
- $4.8924
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.5 Flash-Lite
Variante ligera de Flash para tareas de menor complejidad y alto volumen.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.16308
- Entrada cacheada
- $0.016308
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.1 Flash-Lite
La opción más ligera y económica de la familia Gemini Flash.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.1359
- Entrada cacheada
- $0.01359
- Salida
- $0.8154
por 1M tokens
por 1M tokens
por 1M tokens
Grok 4.3
Modelo flagship de Grok para tareas de alto rendimiento general.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.283125
- Entrada cacheada
- $0.283125
- Salida
- $0.56625
por 1M tokens
por 1M tokens
por 1M tokens
Grok 4.5
Optimizado para código y agentes autónomos con razonamiento avanzado.
- Contexto: 1M tokens
- Varía según variante
- Tool calls, código, agentes.
- Entrada
- $0.453
- Entrada cacheada
- $0.11325
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
Grok Build 0.1
Modelo orientado a desarrollo y construcción de aplicaciones.
- Contexto: 1M tokens
- Varía según variante
- Tool calls, código.
- Entrada
- $0.2265
- Entrada cacheada
- $0.2265
- Salida
- $0.453
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K2.7 Code
Optimizado para código con contexto de 1M y thinking mode.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls, código.
- Entrada
- $0.907888
- Entrada cacheada
- $0.181577
- Salida
- $3.771225
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K2.7 Code HighSpeed
Variante rápida de Kimi K2.7 Code para codificación de baja latencia.
- Contexto: 1M tokens
- Varía según variante
- Código, tool calls.
- Entrada
- $1.840313
- Entrada cacheada
- $1.840313
- Salida
- $7.644375
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K3
Disponible como proveedor independiente con precios dedicados. Consultar en la plataforma.
- Proveedor separado
- Varía según variante
- Acceso por proveedor independiente.
- Entrada
- $3.93
- Entrada cacheada
- N/D
- Salida
- $19.65
por 1M tokens
por 1M tokens
por 1M tokens
Aviso: precios en horas pico
El consumo durante las horas pico se factura al doble de la tarifa regular. Horas pico (UTC): 1:00–4:00 AM y 6:00–10:00 AM. Esta variación se refleja en tus cargos por consumo.
- El costo se calcula por tokens medidos, no por asientos ni paquetes cerrados.
- El saldo prepago ayuda a limitar exposición antes de escalar tráfico.
- Ambos endpoints soportan contexto de 1M tokens y salidas de hasta 384K tokens.
Los precios se muestran en USD y pueden actualizarse cuando cambien costos de acceso, infraestructura o condiciones comerciales.
De cuenta nueva a primera respuesta
El onboarding está diseñado para que puedas probar, medir y decidir antes de escalar tráfico.
- Step 01
Abre tu workspace
Regístrate, entra al panel y revisa documentación, precios y endpoints disponibles.
- Step 02
Define presupuesto inicial
Agrega saldo prepago para limitar el gasto mientras pruebas prompts, latencia y calidad.
- Step 03
Conecta tu backend
Genera una clave API, llama el endpoint compatible y valida la respuesta en tu entorno.
- Step 04
Itera con datos
Usa el historial de tokens, cargos y estados para ajustar prompts, límites y presupuesto.
Proveedor de acceso a IA por API para equipos modernos
World App Technologies ofrece acceso administrado a IA por API, claves API, medición de uso y soporte para organizaciones que necesitan acceso confiable a endpoints Nulu 4.8 en producción.
Combinamos infraestructura API, facturación segura, documentación para desarrolladores y soporte práctico para compañías que usan IA mediante endpoints administrados.
Documentación práctica
Guías directas para autenticar, probar requests, entender respuestas y diagnosticar errores comunes.
Control financiero
Saldo, historial, top-ups y reportes ayudan a mantener el gasto visible para producto y administración.
Operación continua
Cuidamos la experiencia de acceso, disponibilidad del panel, facturación y trazabilidad de solicitudes.
Acompañamiento comercial
Ayudamos con compras, recargas, dudas de implementación y necesidades de equipos que ya están en producción.
Lo que defendemos
Convertir acceso técnico a IA en una experiencia clara para equipos reales.
- Reducir fricción entre prototipo, primera integración y despliegue.
- Mantener precios, consumo y recargas visibles para todos los usuarios autorizados.
- Mejorar continuamente la experiencia de desarrolladores, soporte y operación de la plataforma.
24/7
Acceso API
1M
Unidad de precio por tokens
USD
Facturación clara
Casos donde la IA por API aporta rápido
Desde prototipos internos hasta productos con clientes, la plataforma cubre casos donde velocidad, costo y control importan.
Aplicaciones con IA
Agrega asistentes, generación de contenido, análisis de texto y respuestas inteligentes sin rediseñar tu stack.
Operaciones con presupuesto
Define límites de gasto con saldo prepago y revisa consumo por usuario, clave o integración.
Equipos que necesitan salida a producción
Recibe acompañamiento para pasar de prueba técnica a un flujo estable con documentación y trazabilidad.
Guías para operar IA con criterio
Contenido para equipos que quieren entender tokens, arquitectura, seguridad, costos y adopción de IA sin humo.