Precios API

Acceso a 20 modelos por API

Tarifas simples por 1M tokens, saldo prepago y cargos calculados por uso real para que puedas estimar, lanzar y ajustar sin contratos confusos.

Uso general

Nulu 4.8 Flash

Opción ágil para asistentes, clasificación, resúmenes, extracción y flujos de alto volumen.

  • Contexto: 1M tokens
  • Salida máxima: 384K tokens
  • Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
Entrada
$0.336

por 1M tokens

Entrada cacheada
$0.00672

por 1M tokens

Salida
$0.672

por 1M tokens

Razonamiento

Nulu 4.8

Opción para tareas que requieren más profundidad: análisis, planificación y respuestas estructuradas.

  • Contexto: 1M tokens
  • Salida máxima: 384K tokens
  • Thinking mode, JSON, tool calls, prefix completion y FIM en modo sin razonamiento.
Entrada
$1.044

por 1M tokens

Entrada cacheada
$0.0087

por 1M tokens

Salida
$2.088

por 1M tokens

Flagship

GPT 5.6 Sol

Modelo flagship de GPT para tareas complejas, razonamiento profundo y agentes con herramientas.

  • Contexto: 1M tokens
  • Varía según variante
  • Thinking mode, tool calls.
Entrada
$1.1325

por 1M tokens

Entrada cacheada
$0.11325

por 1M tokens

Salida
$6.795

por 1M tokens

Económico

GPT 5.6 Luna

Variante económica de GPT 5.6 para tareas de uso general con buen rendimiento.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls.
Entrada
$0.2265

por 1M tokens

Entrada cacheada
$0.02265

por 1M tokens

Salida
$1.359

por 1M tokens

Balanceado

GPT 5.6 Terra

Equilibrio entre costo y capacidad en la familia GPT 5.6.

  • Contexto: 1M tokens
  • Varía según variante
  • Thinking mode, tool calls.
Entrada
$0.56625

por 1M tokens

Entrada cacheada
$0.056625

por 1M tokens

Salida
$3.3975

por 1M tokens

Balanceado

Claude Sonnet 5

Claude equilibrado con contexto de 1M y hasta 128K tokens de salida.

  • Contexto: 1M tokens
  • Salida máxima: 128K tokens
  • Tool calls, JSON output.
Entrada
$0.453

por 1M tokens

Entrada cacheada
$0.0906

por 1M tokens

Salida
$2.265

por 1M tokens

Máxima profundidad

Opus 4.8

Claude de máxima profundidad para análisis complejos y trabajos de investigación.

  • Contexto: 1M tokens
  • Salida máxima: 128K tokens
  • Tool calls, JSON output.
Entrada
$1.1325

por 1M tokens

Entrada cacheada
$0.11325

por 1M tokens

Salida
$5.6625

por 1M tokens

Enterprise

Fable 5

Modelo enterprise para cargas de trabajo críticas con máxima capacidad.

  • Contexto: 1M tokens
  • Salida máxima: 128K tokens
  • Tool calls, JSON output.
Entrada
$2.265

por 1M tokens

Entrada cacheada
$0.2265

por 1M tokens

Salida
$11.325

por 1M tokens

Frontier Flash

Gemini 3.6 Flash

Flash de última generación con velocidad y rendimiento mejorados.

  • Contexto: 1M tokens
  • Varía según variante
  • Multimodal, tool calls.
Entrada
$0.8154

por 1M tokens

Entrada cacheada
$0.08154

por 1M tokens

Salida
$4.077

por 1M tokens

Production

Gemini 3.5 Flash

Flash confiable para producción con balance velocidad-rendimiento.

  • Contexto: 1M tokens
  • Varía según variante
  • Multimodal, tool calls.
Entrada
$0.8154

por 1M tokens

Entrada cacheada
$0.08154

por 1M tokens

Salida
$4.8924

por 1M tokens

Económico

Gemini 3.5 Flash-Lite

Variante ligera de Flash para tareas de menor complejidad y alto volumen.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls.
Entrada
$0.16308

por 1M tokens

Entrada cacheada
$0.016308

por 1M tokens

Salida
$1.359

por 1M tokens

Ultra-ligero

Gemini 3.1 Flash-Lite

La opción más ligera y económica de la familia Gemini Flash.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls.
Entrada
$0.1359

por 1M tokens

Entrada cacheada
$0.01359

por 1M tokens

Salida
$0.8154

por 1M tokens

Flagship

Grok 4.3

Modelo flagship de Grok para tareas de alto rendimiento general.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls.
Entrada
$0.283125

por 1M tokens

Entrada cacheada
$0.283125

por 1M tokens

Salida
$0.56625

por 1M tokens

Code & Agents

Grok 4.5

Optimizado para código y agentes autónomos con razonamiento avanzado.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls, código, agentes.
Entrada
$0.453

por 1M tokens

Entrada cacheada
$0.11325

por 1M tokens

Salida
$1.359

por 1M tokens

Dev

Grok Build 0.1

Modelo orientado a desarrollo y construcción de aplicaciones.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls, código.
Entrada
$0.2265

por 1M tokens

Entrada cacheada
$0.2265

por 1M tokens

Salida
$0.453

por 1M tokens

Code

Kimi K2.7 Code

Optimizado para código con contexto de 1M y thinking mode.

  • Contexto: 1M tokens
  • Varía según variante
  • Thinking mode, tool calls, código.
Entrada
$0.907888

por 1M tokens

Entrada cacheada
$0.181577

por 1M tokens

Salida
$3.771225

por 1M tokens

Code rápido

Kimi K2.7 Code HighSpeed

Variante rápida de Kimi K2.7 Code para codificación de baja latencia.

  • Contexto: 1M tokens
  • Varía según variante
  • Código, tool calls.
Entrada
$1.840313

por 1M tokens

Entrada cacheada
$1.840313

por 1M tokens

Salida
$7.644375

por 1M tokens

Proveedor

Kimi K3

Disponible como proveedor independiente con precios dedicados. Consultar en la plataforma.

  • Proveedor separado
  • Varía según variante
  • Acceso por proveedor independiente.
Entrada
$3.93

por 1M tokens

Entrada cacheada
N/D

por 1M tokens

Salida
$19.65

por 1M tokens

1M Contexto

GLM 5.2

Modelo con contexto de 1M tokens para tareas de análisis y generación.

  • Contexto: 1M tokens
  • Varía según variante
  • Tool calls, JSON output.
Entrada
$1.208

por 1M tokens

Entrada cacheada
$0.302

por 1M tokens

Salida
$4.228

por 1M tokens

ChatGPT

GPT Chat Latest

Acceso directo al modelo que impulsa ChatGPT con la experiencia conversacional de OpenAI.

  • Contexto: 1M tokens
  • Varía según variante
  • Thinking mode, tool calls, conversacional.
Entrada
$1.1325

por 1M tokens

Entrada cacheada
$1.1325

por 1M tokens

Salida
$6.795

por 1M tokens

Aviso: precios en horas pico

El consumo durante las horas pico se factura al doble de la tarifa regular. Horas pico (UTC): 1:00–4:00 AM y 6:00–10:00 AM. Esta variación se refleja en tus cargos por consumo.

  • El costo se calcula por tokens medidos, no por asientos ni paquetes cerrados.
  • El saldo prepago ayuda a limitar exposición antes de escalar tráfico.
  • Ambos endpoints soportan contexto de 1M tokens y salidas de hasta 384K tokens.
Abrir plataforma API

Los precios se muestran en USD y pueden actualizarse cuando cambien costos de acceso, infraestructura o condiciones comerciales.