TokenGate

Modelos disponibles

29 modelos · 8 proveedores · Precios finales por millón de tokens

Anthropic 5 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Claude Haiku Rápido / económico

Claude Haiku 4.5 es nuestro modelo más rápido y rentable, igualando el rendimiento de Sonnet 4 en codificación, uso de recursos informáticos y tareas de agentes. Claude Haiku 4.5 obtiene una puntuación del 73,3 % en SWE-bench Verified, lo que lo convierte en uno de los mejores modelos de codificación del mundo.

Máx. salida
64K tok
Velocidad
Rápido
Cache read /1M
$0.1000
Cache write /1M
$1.2500
Chat generalAlto volumen / económicoBaja latencia
claude-haiku
stream tools vision web docs cache 200K $1.0000 $5.0000
Claude Sonnet 5 Balanceado

Claude Sonnet 5 es el modelo Sonnet más agentic de Anthropic. Puede planificar, usar navegadores y terminales, ejecutar tareas autónomamente, y ofrece mejoras significativas en razonamiento, codificación y trabajo profesional comparado con Sonnet 4.6. Rendimiento cercano a Opus 4.8 con precios más accesibles

Máx. salida
128K tok
Velocidad
Rápido
Cache read /1M
$0.3000
Cache write /1M
$3.7500
RazonamientoCódigoAgentic / Tools
claude-sonnet-5
stream tools vision web docs cache 1M $3.0000 $15.0000
Claude Opus 4.8 Flagship

Claude Opus 4.8 es el modelo más capaz de Anthropic para uso general. Optimizado para codificación, agentes inteligentes y razonamiento profundo. Ofrece mejor juicio, confiabilidad en tareas complejas, y rendimiento superior en proyectos de ingeniería de software. Soporta 1M tokens contexto y procesamiento multimodal.

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$0.5000
Cache write /1M
$6.2500
RazonamientoCódigoMatemáticasAgentic / Tools
claude-opus-4-8
stream tools vision web docs cache 1M $5.0000 $25.0000
Claude Opus 5 Flagship

es una mejora radical con respecto a Claude Opus 4.8, con las mayores ganancias en razonamiento profundo, tareas agénticas y de largo horizonte, y escalado de cómputo en tiempo de prueba.

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$0.5000
Cache write /1M
$6.2500
RazonamientoCódigoMatemáticasAgentic / Tools
claude-opus-5
stream tools vision web docs cache 1M $5.0000 $25.0000
Claude Fable 5 Flagship

el modelo más avanzado de Anthropic para razonamiento complejo, programación, análisis y creación de contenido. Destaca por su comprensión profunda del contexto, respuestas precisas, planificación de tareas extensas y excelente capacidad para colaborar en proyectos técnicos, investigación, documentación y desarrollo de software de alta calidad

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$1.0000
Cache write /1M
$12.5000
RazonamientoCódigoMatemáticasAgentic / Tools
claude-fable-5
stream tools vision web docs cache 1M $10.0000 $50.0000
OpenAI 2 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
gpt-5.4-nano Rápido / económico

GPT-5.4 nano es el modelo más ligero y barato de la familia GPT-5.4, optimizado para tareas de alto volumen y baja latencia como clasificación, extracción de datos y subagentes. Soporta texto e imágenes, con contexto muy amplio y buen control de costos.

Máx. salida
128K tok
Velocidad
Rápido
Cache read /1M
$0.0200
Chat generalAlto volumen / económicoBaja latencia
gpt-5.4-nano
stream tools vision web docs cache 1M $0.2000 $1.2500
gpt-5.4-mini Rápido / económico

GPT-5.4 mini es una versión más pequeña y rápida de GPT-5.4, diseñada para programación, uso de herramientas, razonamiento multimodal y cargas de trabajo en API o subagentes de alto volumen. Busca equilibrar velocidad, capacidad y costo para tareas técnicas exigentes.

Máx. salida
128K tok
Velocidad
Rápido
Cache read /1M
$0.0750
CódigoChat general
gpt-5.4-mini
stream tools vision web docs cache 1M $0.7500 $4.5000
Google 3 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
gemini-2.5-flash-lite Rápido / económico

Gemini 2.5 Flash Lite es un modelo ultraligero diseñado para máxima velocidad y eficiencia. Ideal para tareas sencillas, respuestas instantáneas y entornos de alta demanda, ofrece un rendimiento ágil y económico, optimizando al máximo tus recursos sin comprometer la precisión necesaria en interacciones críticas.

Máx. salida
64K tok
Velocidad
Rápido
Cache read /1M
$0.0150
Chat generalAlto volumen / económicoBaja latencia
gemini-2.5-flash-lite
stream tools vision web docs cache 1M $0.1000 $0.4000
Gemini-3.1-lite Rápido / económico

Gemini 3.1 Flash Lite es el modelo más eficiente y ágil de nuestra arquitectura. Optimizado para ofrecer respuestas ultrarrápidas y un consumo mínimo de recursos, es la solución ideal para aplicaciones en tiempo real, tareas de baja latencia y procesamiento de alto volumen, manteniendo una calidad excepcional en cada interacción.

Máx. salida
64K tok
Velocidad
Rápido
Cache read /1M
$0.0250
Chat generalAlto volumen / económicoBaja latencia
gemini-3.1-flash-lite
stream tools vision web docs cache 1M $0.2500 $1.5000
Nano Banana 2 Lite

Gemini 3.1 Flash Lite Image es un modelo optimizado para velocidad y eficiencia en el procesamiento de contenido visual. Diseñado para tareas ligeras, ofrece respuestas rápidas en el análisis e interpretación de imágenes, siendo ideal para aplicaciones que requieren alto rendimiento y baja latencia.

gemini-3.1-flash-lite-image
vision img i2i 50K $0.0336 / imagen
Z — ZhipuAI 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
CogView-4

CogView-4 es el primer modelo de código abierto de Z.AI para texto a imagen. Destaca por su superior comprensión semántica y calidad visual, permitiendo generar texto bilingüe (inglés/chino) de cualquier longitud y crear imágenes en resoluciones flexibles dentro de un rango determinado.

CogView-4
stream img 0K $0.0100 / imagen
GLM-Image

GLM-Image es el modelo insignia de Z.AI que utiliza una arquitectura híbrida única. Combina decodificadores autorregresivos y difusión para integrar comprensión global con precisión local. Es ideal para crear pósteres y diagramas complejos, marcando un avance clave en la tecnología generativa cognitiva moderna.

GLM-Image
stream img 0K $0.0150 / imagen
glm-5 Flagship

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$0.2000
RazonamientoCódigoAgentic / Tools
glm-5
stream tools web docs cache 200K $1.0000 $3.2000
glm-5.2 Flagship

GLM-5.2 es un avanzado modelo de lenguaje desarrollado por Zhipu AI. Destaca por su excelente capacidad de razonamiento, comprensión multimodal profunda y una ventana de contexto muy extensa. Está diseñado para resolver tareas complejas, ofreciendo respuestas precisas, coherentes y fluidas en entornos profesionales muy exigentes.

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$0.2600
RazonamientoCódigoAgentic / ToolsDocumentos largos
glm-5.2
stream tools web docs cache 1M $1.4000 $4.4000
Kimi 5 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
kimi-k2.5 Balanceado

Kimi K2.5 es un modelo de lenguaje grande desarrollado por Moonshot AI. Destaca por su capacidad de procesar contextos extensos (hasta 2 millones de caracteres en chino), razonamiento avanzado, generación de código y multimodalidad (texto, imágenes y video), con un enfoque especial en tareas complejas de larga duración.

Máx. salida
49K tok
Velocidad
Estándar
Cache read /1M
$0.1000
RazonamientoCódigoChat generalMatemáticas
kimi-k2.5
stream tools vision web docs cache 262K $0.6000 $3.0000
kimi-k2.6 Flagship

Kimi K2.6 es el modelo más avanzado de Kimi, con capacidades superiores de escritura de código a largo plazo, mejor cumplimiento de instrucciones y auto-corrección. Arquitectura multimodal nativa (texto, imagen, video), modos de razonamiento, contexto de 256k, caché automática, ToolCalls, JSON Mode, Partial Mode y búsqueda en internet.

Máx. salida
49K tok
Velocidad
Estándar
Cache read /1M
$0.1600
RazonamientoCódigoAgentic / Tools
kimi-k2.6
stream tools vision web docs cache 262K $0.9500 $4.0000
kimi-k2.7-code Flagship

Kimi K2.7 Code es el modelo de programación más inteligente de Kimi, con alta tasa de éxito en contextos largos, arquitectura multimodal nativa que soporta texto, imagen, video y modos de razonamiento, además de diálogo y tareas de agente.

Máx. salida
49K tok
Velocidad
Estándar
Cache read /1M
$0.1900
RazonamientoCódigoAgentic / Tools
kimi-k2.7-code
stream tools vision web docs cache 262K $0.9500 $4.0000
kimi-k2.7-code-highspeed Flagship

Kimi K2.7 Code HighSpeed es la versión ultrarrápida del modelo K2.7 Code, con velocidades de hasta 260 tokens/s en contextos cortos y 180 tokens/s en general, ofreciendo una experiencia de codificación extremadamente fluida y eficiente.

Máx. salida
49K tok
Velocidad
Estándar
Cache read /1M
$0.3800
RazonamientoCódigoAgentic / ToolsBaja latencia
kimi-k2.7-code-highspeed
stream tools vision web docs cache 262K $1.9000 $8.0000
kimi-k3 Balanceado

Kimi K3 es el modelo de lenguaje avanzado de Moonshot AI, diseñado para razonamiento profundo, contexto extenso y precisión en tareas complejas. Destaca en matemáticas, programación, análisis de documentos largos y conversaciones naturales en múltiples idiomas.

Máx. salida
128K tok
Velocidad
Estándar
Cache read /1M
$0.3000
RazonamientoCódigoMatemáticasAgentic / Tools
kimi-k3
stream tools vision web docs cache 1M $3.0000 $15.0000
MiniMax 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Minimax image-01

es un modelo de generación de imágenes basado en inteligencia artificial capaz de crear visuales de alta calidad a partir de descripciones textuales. Soporta la edición de imágenes existentes, la síntesis de múltiples referencias visuales, y ofrece opciones de relación de aspecto y resolución configurables para adaptarse a diversas necesidades creativas.

minimax-image-01
img i2i 0K $0.0035 / imagen
MiniMax-M2.7 Balanceado

MiniMax-M2.7 representa una versión actualizada del modelo de lenguaje de MiniMax. Esta iteración incorpora mejoras en el procesamiento del lenguaje natural, ofreciendo respuestas más coherentes y contextualmente relevantes. El modelo optimiza el consumo de recursos computacionales mientras mantiene un equilibrio entre velocidad y calidad. Su arquitectura permite manejar conversaciones complejas con mayor precisión, siendo adecuado para aplicaciones que van desde la asistencia virtual hasta la generación de contenido especializado

Máx. salida
131K tok
Velocidad
Estándar
Cache read /1M
$0.0800
RazonamientoCódigoChat generalRedacción creativa
MiniMax-M2.7
stream tools web docs cache 204K $0.3000 $1.2000
MiniMax-M3 Flagship

MiniMax-M3 es un modelo de inteligencia artificial desarrollado por la empresa china MiniMax. Se trata de una avanzada arquitectura de lenguaje multilingüe diseñada para ofrecer alto rendimiento en comprensión y generación de texto. El modelo incorpora técnicas de entrenamiento optimizadas que permiten procesar múltiples idiomas con fluidez. MiniMax-M3 destaca por su capacidad de adaptación a diversas tareas, desde conversación general hasta aplicaciones especializadas en negocios y educación.

Máx. salida
250K tok
Velocidad
Estándar
Cache read /1M
$0.1300

Precio por tamaño del prompt

desdeinout
0 $0.30 $1.20
512.001 $0.60 $2.40

El tramo lo fija el tamaño del prompt de entrada y rige todo el request.

RazonamientoCódigoRedacción creativaAgentic / Tools
MiniMax-M3
stream tools vision web docs cache long ctx 1M $0.3000 $0.60 desde 512K $1.2000 $2.40 desde 512K
MiniMax-M2.7-highspeed Balanceado

MiniMax-M2.7-highspeed es una versión optimizada para baja latencia que ofrece el mismo rendimiento que el modelo M2.7, pero con una velocidad de generación de ~100 tokens por segundo (frente a los ~60 tps del estándar) . Sobresale en tareas de ingeniería, codificación y flujos de trabajo de agentes

Máx. salida
131K tok
Velocidad
Estándar
Cache read /1M
$0.0900
RazonamientoCódigoDocumentos largosBaja latencia
MiniMax-M2.7-highspeed
stream tools web docs cache 204K $0.6000 $2.4000
DeepSeek 2 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
Deepseek Flash Rápido / económico

El modelo más ágil de la familia DeepSeek, diseñado para respuestas en milisegundos sin perder calidad. Ideal para atención al cliente, asistentes en tiempo real y automatización inteligente. Flash Thinking: razonamiento ultrarrápido. Contexto ampliado: hasta 1M de tokens. Bajo costo por inferencia: máximo rendimiento, mínimo gasto. Lleva la inteligencia artificial instantánea a tu negocio. ¡Potencia tu flujo de trabajo con DeepSeek-V4-Flash!

Máx. salida
320K tok
Velocidad
Rápido
Cache read /1M
$0.0030
Chat generalAlto volumen / económicoBaja latencia
deepseek-v4-flash
stream tools web cache 1M $0.1800 $0.3000
Deepseek Pro Flagship

Precisión profesional y razonamiento profundo. Diseñado para tareas complejas como análisis de datos, investigación académica y planificación estratégica. Ofrece contexto extendido, alta coherencia lógica y fiabilidad empresarial. Máximo rendimiento para quienes exigen lo mejor en cada respuesta. DeepSeek-V4-Pro: tu socio inteligente para decisiones críticas.

Máx. salida
320K tok
Velocidad
Lento
Cache read /1M
$0.0040
RazonamientoChat generalMatemáticasAlto volumen / económico
deepseek-v4-pro
stream tools web cache 1M $0.5000 $0.9000
GROK 4 modelos
Modelo Capacidades Context IN /1M tok OUT /1M tok
grok-imagine-image

Grok-Imagine-Image es el modelo especializado de xAI en generación y edición de imágenes . Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona

grok-imagine-image
vision img i2i 0K $0.0200 / imagen
grok-imagine-image-quality

Grok-Imagine-Image-Quality es el modelo especializado de xAI en generación y edición de imágenes de alta calidad. Produce visuals hiperrealistas, artísticos y coherentes con gran detalle, excelente comprensión de prompts complejos, iluminación natural, anatomía precisa y estilos variados, manteniendo consistencia y creatividad excepciona

Edición imagen
$0.0700
grok-imagine-image-quality
vision img i2i 0K $0.0500 / imagen
grok-build-0.1 Balanceado

Grok-build-0.1 Modelo de codificación inteligente de SpaceXAI para software automatizado, ingeniería y tareas de flujo de trabajo. Integra un razonamiento profundo, humor inteligente y una búsqueda incansable de la verdad. Diseñado para ser útil, directo y curioso, ayuda a los usuarios a comprender el universo sin censuras ni sesgos innecesarios, manteniendo siempre máxima honestidad y capacidad

Máx. salida
131K tok
Velocidad
Estándar
Cache read /1M
$0.2000

Precio por tamaño del prompt

desdeinout
0 $1.00 $2.00
200.000 $2.00 $4.00

El tramo lo fija el tamaño del prompt de entrada y rige todo el request.

CódigoAgentic / Tools
grok-build-0.1
stream tools vision web docs cache long ctx 256K $1.0000 $2.00 desde 200K $2.0000 $4.00 desde 200K
grok-4.5 Flagship

Grok-4.5 es la versión avanzada del modelo insignia de xAI. Ofrece razonamiento superior, comprensión multimodal profunda, generación de código experto, creatividad ilimitada y respuestas más precisas y contextuales. Más rápido, eficiente y capaz de manejar tareas complejas con mayor coherencia, conocimiento actualizado y menor alucinación.

Máx. salida
100K tok
Velocidad
Rápido
Cache read /1M
$0.3000

Precio por tamaño del prompt

desdeinout
0 $2.00 $6.00
200.000 $4.00 $12.00

El tramo lo fija el tamaño del prompt de entrada y rige todo el request.

RazonamientoCódigoRedacción creativaAgentic / Tools
grok-4.5
stream tools vision web docs cache long ctx 500K $2.0000 $4.00 desde 200K $6.0000 $12.00 desde 200K

Precio de proveedor, sin recargo por token — TokenGate cobra un 6% al recargar saldo. Los badges cache y peak indican modelos con prompt caching y franjas de precio pico/valle — pasá el mouse sobre el ícono de cada modelo para el detalle. ¿Cómo funciona el billing?