Modelos disponibles
29 modelos · 8 proveedores · Precios finales por millón de tokens
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
Claude Haiku
Rápido / económico
Claude Haiku 4.5 es nuestro modelo más rápido y rentable, igualando el rendimiento de Sonnet 4 en codificación, uso de recursos informáticos y tareas de agentes. Claude Haiku 4.5 obtiene una puntuación del 73,3 % en SWE-bench Verified, lo que lo convierte en uno de los mejores modelos de codificación del mundo.
Chat generalAlto volumen / económicoBaja latencia
claude-haiku
|
stream tools vision web docs cache | 200K | $1.0000 | $5.0000 |
|
Claude Sonnet 5
Balanceado
Claude Sonnet 5 es el modelo Sonnet más agentic de Anthropic. Puede planificar, usar navegadores y terminales, ejecutar tareas autónomamente, y ofrece mejoras significativas en razonamiento, codificación y trabajo profesional comparado con Sonnet 4.6. Rendimiento cercano a Opus 4.8 con precios más accesibles
RazonamientoCódigoAgentic / Tools
claude-sonnet-5
|
stream tools vision web docs cache | 1M | $3.0000 | $15.0000 |
|
Claude Opus 4.8
Flagship
Claude Opus 4.8 es el modelo más capaz de Anthropic para uso general. Optimizado para codificación, agentes inteligentes y razonamiento profundo. Ofrece mejor juicio, confiabilidad en tareas complejas, y rendimiento superior en proyectos de ingeniería de software. Soporta 1M tokens contexto y procesamiento multimodal.
RazonamientoCódigoMatemáticasAgentic / Tools
claude-opus-4-8
|
stream tools vision web docs cache | 1M | $5.0000 | $25.0000 |
|
Claude Opus 5
Flagship
es una mejora radical con respecto a Claude Opus 4.8, con las mayores ganancias en razonamiento profundo, tareas agénticas y de largo horizonte, y escalado de cómputo en tiempo de prueba.
RazonamientoCódigoMatemáticasAgentic / Tools
claude-opus-5
|
stream tools vision web docs cache | 1M | $5.0000 | $25.0000 |
|
Claude Fable 5
Flagship
el modelo más avanzado de Anthropic para razonamiento complejo, programación, análisis y creación de contenido. Destaca por su comprensión profunda del contexto, respuestas precisas, planificación de tareas extensas y excelente capacidad para colaborar en proyectos técnicos, investigación, documentación y desarrollo de software de alta calidad
RazonamientoCódigoMatemáticasAgentic / Tools
claude-fable-5
|
stream tools vision web docs cache | 1M | $10.0000 | $50.0000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
gpt-5.4-nano
Rápido / económico
GPT-5.4 nano es el modelo más ligero y barato de la familia GPT-5.4, optimizado para tareas de alto volumen y baja latencia como clasificación, extracción de datos y subagentes. Soporta texto e imágenes, con contexto muy amplio y buen control de costos.
Chat generalAlto volumen / económicoBaja latencia
gpt-5.4-nano
|
stream tools vision web docs cache | 1M | $0.2000 | $1.2500 |
|
gpt-5.4-mini
Rápido / económico
GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad, capacidad y costo para tareas técnicas exigentes.
CódigoChat general
gpt-5.4-mini
|
stream tools vision web docs cache | 1M | $0.7500 | $4.5000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
gemini-2.5-flash-lite
Rápido / económico
Gemini 2.5 Flash Lite es un modelo ultraligero diseñado para máxima velocidad y eficiencia. Ideal para tareas sencillas, respuestas instantáneas y entornos de alta demanda, ofrece un rendimiento ágil y económico, optimizando al máximo tus recursos sin comprometer la precisión necesaria en interacciones críticas.
Chat generalAlto volumen / económicoBaja latencia
gemini-2.5-flash-lite
|
stream tools vision web docs cache | 1M | $0.1000 | $0.4000 |
|
Gemini-3.1-lite
Rápido / económico
Gemini 3.1 Flash Lite es el modelo más eficiente y ágil de nuestra arquitectura. Optimizado para ofrecer respuestas ultrarrápidas y un consumo mínimo de recursos, es la solución ideal para aplicaciones en tiempo real, tareas de baja latencia y procesamiento de alto volumen, manteniendo una calidad excepcional en cada interacción.
Chat generalAlto volumen / económicoBaja latencia
gemini-3.1-flash-lite
|
stream tools vision web docs cache | 1M | $0.2500 | $1.5000 |
|
Nano Banana 2 Lite
Gemini 3.1 Flash Lite Image es un modelo optimizado para velocidad y eficiencia en el procesamiento de contenido visual. Diseñado para tareas ligeras, ofrece respuestas rápidas en el análisis e interpretación de imágenes, siendo ideal para aplicaciones que requieren alto rendimiento y baja latencia. gemini-3.1-flash-lite-image
|
vision img i2i | 50K | $0.0336 / imagen | |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
CogView-4
CogView-4 es el primer modelo de código abierto de Z.AI para texto a imagen. Destaca por su superior comprensión semántica y calidad visual, permitiendo generar texto bilingüe (inglés/chino) de cualquier longitud y crear imágenes en resoluciones flexibles dentro de un rango determinado. CogView-4
|
stream img | 0K | $0.0100 / imagen | |
|
GLM-Image
GLM-Image es el modelo insignia de Z.AI que utiliza una arquitectura híbrida única. Combina decodificadores autorregresivos y difusión para integrar comprensión global con precisión local. Es ideal para crear pósteres y diagramas complejos, marcando un avance clave en la tecnología generativa cognitiva moderna. GLM-Image
|
stream img | 0K | $0.0150 / imagen | |
|
glm-5
Flagship
GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.
RazonamientoCódigoAgentic / Tools
glm-5
|
stream tools web docs cache | 200K | $1.0000 | $3.2000 |
|
glm-5.2
Flagship
GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.
RazonamientoCódigoAgentic / ToolsDocumentos largos
glm-5.2
|
stream tools web docs cache | 1M | $1.4000 | $4.4000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
kimi-k2.5
Balanceado
Kimi K2.5 es un modelo de lenguaje grande desarrollado por Moonshot AI. Destaca por su capacidad de procesar contextos extensos (hasta 2 millones de caracteres en chino), razonamiento avanzado, generación de código y multimodalidad (texto, imágenes y video), con un enfoque especial en tareas complejas de larga duración.
RazonamientoCódigoChat generalMatemáticas
kimi-k2.5
|
stream tools vision web docs cache | 262K | $0.6000 | $3.0000 |
|
kimi-k2.6
Flagship
Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos de razonamiento, contexto de 256k, caché automática, ToolCalls, JSON Mode, Partial Mode y búsqueda en internet.
RazonamientoCódigoAgentic / Tools
kimi-k2.6
|
stream tools vision web docs cache | 262K | $0.9500 | $4.0000 |
|
kimi-k2.7-code
Flagship
Kimi K2.7 Code es el modelo de programación más inteligente de Kimi, con alta tasa de éxito en contextos largos, arquitectura multimodal nativa que soporta texto, imagen, video y modos de razonamiento, además de diálogo y tareas de agente.
RazonamientoCódigoAgentic / Tools
kimi-k2.7-code
|
stream tools vision web docs cache | 262K | $0.9500 | $4.0000 |
|
kimi-k2.7-code-highspeed
Flagship
Kimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y eficiente.
RazonamientoCódigoAgentic / ToolsBaja latencia
kimi-k2.7-code-highspeed
|
stream tools vision web docs cache | 262K | $1.9000 | $8.0000 |
|
kimi-k3
Balanceado
Kimi K3 es el modelo de lenguaje avanzado de Moonshot AI, diseñado para razonamiento profundo, contexto extenso y precisión en tareas complejas. Destaca en matemáticas, programación, análisis de documentos largos y conversaciones naturales en múltiples idiomas.
RazonamientoCódigoMatemáticasAgentic / Tools
kimi-k3
|
stream tools vision web docs cache | 1M | $3.0000 | $15.0000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
Minimax image-01
es un modelo de generación de imágenes basado en inteligencia artificial capaz de crear visuales de alta calidad a partir de descripciones textuales. Soporta la edición de imágenes existentes, la síntesis de múltiples referencias visuales, y ofrece opciones de relación de aspecto y resolución configurables para adaptarse a diversas necesidades creativas. minimax-image-01
|
img i2i | 0K | $0.0035 / imagen | |
|
MiniMax-M2.7
Balanceado
MiniMax-M2.7 representa una versión actualizada del modelo de lenguaje de MiniMax. Esta iteración incorpora mejoras en el procesamiento del lenguaje natural, ofreciendo respuestas más coherentes y contextualmente relevantes. El modelo optimiza el consumo de recursos computacionales mientras mantiene un equilibrio entre velocidad y calidad. Su arquitectura permite manejar conversaciones complejas con mayor precisión, siendo adecuado para aplicaciones que van desde la asistencia virtual hasta la generación de contenido especializado
RazonamientoCódigoChat generalRedacción creativa
MiniMax-M2.7
|
stream tools web docs cache | 204K | $0.3000 | $1.2000 |
|
MiniMax-M3
Flagship
MiniMax-M3 es un modelo de inteligencia artificial desarrollado por la empresa china MiniMax. Se trata de una avanzada arquitectura de lenguaje multilingüe diseñada para ofrecer alto rendimiento en comprensión y generación de texto. El modelo incorpora técnicas de entrenamiento optimizadas que permiten procesar múltiples idiomas con fluidez. MiniMax-M3 destaca por su capacidad de adaptación a diversas tareas, desde conversación general hasta aplicaciones especializadas en negocios y educación. Precio por tamaño del prompt
desdeinout
0
$0.30
$1.20
512.001
$0.60
$2.40
El tramo lo fija el tamaño del prompt de entrada y rige todo el request.
RazonamientoCódigoRedacción creativaAgentic / Tools
MiniMax-M3
|
stream tools vision web docs cache long ctx | 1M | $0.3000 $0.60 desde 512K | $1.2000 $2.40 desde 512K |
|
MiniMax-M2.7-highspeed
Balanceado
MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) . Sobresale en tareas de ingeniería, codificación y flujos de trabajo de agentes
RazonamientoCódigoDocumentos largosBaja latencia
MiniMax-M2.7-highspeed
|
stream tools web docs cache | 204K | $0.6000 | $2.4000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
Deepseek Flash
Rápido / económico
El modelo más ágil de la familia DeepSeek, diseñado para respuestas en milisegundos sin perder calidad. Ideal para atención al cliente, asistentes en tiempo real y automatización inteligente. Flash Thinking: razonamiento ultrarrápido. Contexto ampliado: hasta 1M de tokens. Bajo costo por inferencia: máximo rendimiento, mínimo gasto. Lleva la inteligencia artificial instantánea a tu negocio. ¡Potencia tu flujo de trabajo con DeepSeek-V4-Flash!
Chat generalAlto volumen / económicoBaja latencia
deepseek-v4-flash
|
stream tools web cache | 1M | $0.1800 | $0.3000 |
|
Deepseek Pro
Flagship
Precisión profesional y razonamiento profundo. Diseñado para tareas complejas como análisis de datos, investigación académica y planificación estratégica. Ofrece contexto extendido, alta coherencia lógica y fiabilidad empresarial. Máximo rendimiento para quienes exigen lo mejor en cada respuesta. DeepSeek-V4-Pro: tu socio inteligente para decisiones críticas.
RazonamientoChat generalMatemáticasAlto volumen / económico
deepseek-v4-pro
|
stream tools web cache | 1M | $0.5000 | $0.9000 |
| Modelo | Capacidades | Context | IN /1M tok | OUT /1M tok |
|---|---|---|---|---|
|
grok-imagine-image
Grok-Imagine-Image es el modelo especializado de xAI en generación y edición de imágenes . Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona grok-imagine-image
|
vision img i2i | 0K | $0.0200 / imagen | |
|
grok-imagine-image-quality
Grok-Imagine-Image-Quality es el modelo especializado de xAI en generación y edición de imágenes de alta calidad. Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona grok-imagine-image-quality
|
vision img i2i | 0K | $0.0500 / imagen | |
|
grok-build-0.1
Balanceado
Grok-build-0.1 Modelo de codificación inteligente de SpaceXAI para software automatizado, ingeniería y tareas de flujo de trabajo. Integra un razonamiento profundo, humor inteligente y una búsqueda incansable de la verdad. Diseñado para ser útil, directo y curioso, ayuda a los usuarios a comprender el universo sin censuras ni sesgos innecesarios, manteniendo siempre máxima honestidad y capacidad Precio por tamaño del prompt
desdeinout
0
$1.00
$2.00
200.000
$2.00
$4.00
El tramo lo fija el tamaño del prompt de entrada y rige todo el request.
CódigoAgentic / Tools
grok-build-0.1
|
stream tools vision web docs cache long ctx | 256K | $1.0000 $2.00 desde 200K | $2.0000 $4.00 desde 200K |
|
grok-4.5
Flagship
Grok-4.5 es la versión avanzada del modelo insignia de xAI. Ofrece razonamiento superior, comprensión multimodal profunda, generación de código experto, creatividad ilimitada y respuestas más precisas y contextuales. Más rápido, eficiente y capaz de manejar tareas complejas con mayor coherencia, conocimiento actualizado y menor alucinación. Precio por tamaño del prompt
desdeinout
0
$2.00
$6.00
200.000
$4.00
$12.00
El tramo lo fija el tamaño del prompt de entrada y rige todo el request.
RazonamientoCódigoRedacción creativaAgentic / Tools
grok-4.5
|
stream tools vision web docs cache long ctx | 500K | $2.0000 $4.00 desde 200K | $6.0000 $12.00 desde 200K |
Precio de proveedor, sin recargo por token — TokenGate cobra un 6% al recargar saldo. Los badges cache y peak indican modelos con prompt caching y franjas de precio pico/valle — pasá el mouse sobre el ícono ⓘ de cada modelo para el detalle. ¿Cómo funciona el billing?