Acceso a 20 modelos por API
Tarifas simples por 1M tokens, saldo prepago y cargos calculados por uso real para que puedas estimar, lanzar y ajustar sin contratos confusos.
Nulu 4.8 Flash
Opción ágil para asistentes, clasificación, resúmenes, extracción y flujos de alto volumen.
- Contexto: 1M tokens
- Salida máxima: 384K tokens
- Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
- Entrada
- $0.336
- Entrada cacheada
- $0.00672
- Salida
- $0.672
por 1M tokens
por 1M tokens
por 1M tokens
Nulu 4.8
Opción para tareas que requieren más profundidad: análisis, planificación y respuestas estructuradas.
- Contexto: 1M tokens
- Salida máxima: 384K tokens
- Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
- Entrada
- $1.044
- Entrada cacheada
- $0.0087
- Salida
- $2.088
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Sol
Modelo flagship de GPT para tareas complejas, razonamiento profundo y agentes con herramientas.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls.
- Entrada
- $1.1325
- Entrada cacheada
- $0.11325
- Salida
- $6.795
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Luna
Variante económica de GPT 5.6 para tareas de uso general con buen rendimiento.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.2265
- Entrada cacheada
- $0.02265
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
GPT 5.6 Terra
Equilibrio entre costo y capacidad en la familia GPT 5.6.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls.
- Entrada
- $0.56625
- Entrada cacheada
- $0.056625
- Salida
- $3.3975
por 1M tokens
por 1M tokens
por 1M tokens
Claude Sonnet 5
Claude equilibrado con contexto de 1M y hasta 128K tokens de salida.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $0.453
- Entrada cacheada
- $0.0906
- Salida
- $2.265
por 1M tokens
por 1M tokens
por 1M tokens
Opus 4.8
Claude de máxima profundidad para análisis complejos y trabajos de investigación.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $1.1325
- Entrada cacheada
- $0.11325
- Salida
- $5.6625
por 1M tokens
por 1M tokens
por 1M tokens
Fable 5
Modelo enterprise para cargas de trabajo críticas con máxima capacidad.
- Contexto: 1M tokens
- Salida máxima: 128K tokens
- Tool calls, JSON output.
- Entrada
- $2.265
- Entrada cacheada
- $0.2265
- Salida
- $11.325
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.6 Flash
Flash de última generación con velocidad y rendimiento mejorados.
- Contexto: 1M tokens
- Varía según variante
- Multimodal, tool calls.
- Entrada
- $0.8154
- Entrada cacheada
- $0.08154
- Salida
- $4.077
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.5 Flash
Flash confiable para producción con balance velocidad-rendimiento.
- Contexto: 1M tokens
- Varía según variante
- Multimodal, tool calls.
- Entrada
- $0.8154
- Entrada cacheada
- $0.08154
- Salida
- $4.8924
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.5 Flash-Lite
Variante ligera de Flash para tareas de menor complejidad y alto volumen.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.16308
- Entrada cacheada
- $0.016308
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
Gemini 3.1 Flash-Lite
La opción más ligera y económica de la familia Gemini Flash.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.1359
- Entrada cacheada
- $0.01359
- Salida
- $0.8154
por 1M tokens
por 1M tokens
por 1M tokens
Grok 4.3
Modelo flagship de Grok para tareas de alto rendimiento general.
- Contexto: 1M tokens
- Varía según variante
- Tool calls.
- Entrada
- $0.283125
- Entrada cacheada
- $0.283125
- Salida
- $0.56625
por 1M tokens
por 1M tokens
por 1M tokens
Grok 4.5
Optimizado para código y agentes autónomos con razonamiento avanzado.
- Contexto: 1M tokens
- Varía según variante
- Tool calls, código, agentes.
- Entrada
- $0.453
- Entrada cacheada
- $0.11325
- Salida
- $1.359
por 1M tokens
por 1M tokens
por 1M tokens
Grok Build 0.1
Modelo orientado a desarrollo y construcción de aplicaciones.
- Contexto: 1M tokens
- Varía según variante
- Tool calls, código.
- Entrada
- $0.2265
- Entrada cacheada
- $0.2265
- Salida
- $0.453
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K2.7 Code
Optimizado para código con contexto de 1M y thinking mode.
- Contexto: 1M tokens
- Varía según variante
- Thinking mode, tool calls, código.
- Entrada
- $0.907888
- Entrada cacheada
- $0.181577
- Salida
- $3.771225
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K2.7 Code HighSpeed
Variante rápida de Kimi K2.7 Code para codificación de baja latencia.
- Contexto: 1M tokens
- Varía según variante
- Código, tool calls.
- Entrada
- $1.840313
- Entrada cacheada
- $1.840313
- Salida
- $7.644375
por 1M tokens
por 1M tokens
por 1M tokens
Kimi K3
Disponible como proveedor independiente con precios dedicados. Consultar en la plataforma.
- Proveedor separado
- Varía según variante
- Acceso por proveedor independiente.
- Entrada
- $3.93
- Entrada cacheada
- N/D
- Salida
- $19.65
por 1M tokens
por 1M tokens
por 1M tokens
Aviso: precios en horas pico
El consumo durante las horas pico se factura al doble de la tarifa regular. Horas pico (UTC): 1:00–4:00 AM y 6:00–10:00 AM. Esta variación se refleja en tus cargos por consumo.
- El costo se calcula por tokens medidos, no por asientos ni paquetes cerrados.
- El saldo prepago ayuda a limitar exposición antes de escalar tráfico.
- Ambos endpoints soportan contexto de 1M tokens y salidas de hasta 384K tokens.
Los precios se muestran en USD y pueden actualizarse cuando cambien costos de acceso, infraestructura o condiciones comerciales.