Modelos de IA

28

Encuentra el modelo adecuado para tu tarea. Filtra por fortaleza, compara precios y decide.

Filtrar por proveedor

28modelos
Claude Fable 5 logo

Claude Fable 5

Anthropic

Condicional

El modelo frontera de clase Mythos de Anthropic — el Claude disponible públicamente más potente hasta la fecha, líder en todos los benchmarks principales en su lanzamiento. El veredicto se mantiene CONDICIONAL por dos limitaciones vigentes: precios solo por créditos a $10/$50 por 1M de tokens sin opción de suscripción, y un clasificador de seguridad que se activa en exceso con tareas de código rutinarias, redirigiéndolas silenciosamente a un fallback de Opus 4.8. Conviene recurrir a Fable 5 cuando el salto de capacidad justifica el costo; para el trabajo rutinario, Sonnet 5 es la alternativa más predecible.

Entrada
$10 / 1M tokens
Salida
$50 / 1M tokens
Contexto
1M context, 128K max output
Claude Haiku 4.5 logo

Claude Haiku 4.5

Anthropic

Recomendado

La referencia de valor de Anthropic a $1/$5 por 1M de tokens — el nivel rápido y de bajo costo contra el que se comparan los rivales, con contexto de 200K y salida de 64K. Ideal para trabajo de alto volumen sensible a la latencia: clasificación, extracción, resúmenes y enrutamiento. Conviene recurrir a Opus 4.8 o Sonnet 5 cuando se necesita razonamiento profundo de múltiples pasos.

Entrada
$1 / 1M tokens
Salida
$5 / 1M tokens
Contexto
200K tokens
Claude Opus 4.8 logo

Claude Opus 4.8

Anthropic

Recomendado

El modelo de razonamiento insignia de Anthropic y el referente práctico de la frontera en capacidad desplegable — contexto de 1M tokens a $5/$25 por 1M de tokens, incluido en todos los planes de suscripción. Nuestra elección para el trabajo intensivo en revisión: revisión de código, refactorización con restricciones y tareas de ritmo deliberado. Su sólida programación agéntica, su razonamiento analítico de primer nivel y el acceso estable por suscripción lo convierten en el insignia por defecto para la mayoría de los equipos de producción.

Entrada
$5 / 1M tokens
Salida
$25 / 1M tokens
Contexto
1M tokens
Claude Sonnet 4.6 logo

Claude Sonnet 4.6

Anthropic

Condicional

Superado por Claude Sonnet 5 (lanzado el 30 de junio de 2026) como el caballo de batalla por defecto del nivel medio. El precio de $3/$15 y el contexto de 1M tokens de Sonnet 4.6 los iguala ahora un sucesor con un salto de 13.4 puntos en Terminal-Bench 2.1 con la misma tarifa. Conviene elegir 4.6 solo para despliegues fijados o cuando el ~30% más de tokens de Sonnet 5 y la eliminación de temperature/top_p/top_k resulten descalificantes.

Entrada
$3 / 1M tokens
Salida
$15 / 1M tokens
Contexto
1M tokens
Claude Sonnet 5 logo

Claude Sonnet 5

Anthropic

Recomendado

El Sonnet más agéntico de Anthropic ofrece un rendimiento cercano a Opus 4.8 a aproximadamente la mitad del precio, con +13.4 puntos en Terminal-Bench 2.1 sobre Sonnet 4.6. El nuevo tokenizador infla los conteos ~30%, por lo que el precio de lanzamiento ($2/$10 por MTok hasta el 31 de agosto) mantiene la migración neutral en costos, aunque los equipos deberían recalcular presupuestos antes de cambiar. Sustituye a Sonnet 4.6 como el modelo por defecto en todos los planes de Claude, ideal para programación agéntica, depuración de código heredado y pipelines de producción — no para el razonamiento frontera más exigente ni para tareas de ciberseguridad.

Entrada
$3 / 1M
Salida
$15 / 1M
Contexto
1M tokens
G

GLM-5.2

Z.ai

Condicional

El mejor modelo de código de pesos abiertos con contexto de 1M tokens y licencia MIT — supera a GPT-5.5 en múltiples benchmarks a una fracción del costo, pero aún va por detrás de Claude Opus 4.8 en las tareas más difíciles de largo alcance.

Entrada
$1.40 / 1M tokens
Salida
$4.40 / 1M tokens
Contexto
1M tokens
GPT-4.1 logo

GPT-4.1

OpenAI

Recomendado

El destino de migración por defecto para cargas de trabajo de GPT-4 Turbo: misma estructura de solicitudes, menor costo, contexto de 1M tokens — convierte los payloads heredados de function_call al formato tools y sigue adelante.

Entrada
$2 / 1M tokens
Salida
$8 / 1M tokens
Contexto
1M tokens
GPT-4o (Retired from ChatGPT, API-only) logo

GPT-4o (Retired from ChatGPT, API-only)

OpenAI

Condicional

GPT-4o (May 2024) has been superseded by the GPT-5.x family and delisted from OpenAI's flagship API pricing page. It remains available through the API but is no longer a current-generation model. Use only where migration to GPT-5.x is blocked; otherwise, GPT-5.5 or GPT-5.4 offer better performance at comparable cost.

Entrada
$2.50 / 1M tokens
Salida
$10 / 1M tokens
Contexto
128K tokens
GPT-5.5 logo

GPT-5.5

OpenAI

Recomendado

El modelo frontera comercial de propósito general de OpenAI y el ancla desplegable de OpenAI mientras la familia GPT-5.6 sigue restringida por el gobierno — $5/$30 por 1M de tokens con contexto de 1M+. Su razonamiento sólido, el amplio soporte del ecosistema y la plena disponibilidad pública lo convierten en una opción por defecto fiable para producción, aunque modelos más baratos ya lo igualan en tareas específicas. Para la mayoría de los equipos, sigue siendo la referencia con la que se miden los modelos más nuevos.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
1M+ tokens (922K in / 128K out)
GPT-5.5-Cyber logo

GPT-5.5-Cyber

OpenAI

Condicional

85.6% en CyberGym — la puntuación más alta de un modelo individual — pero con acceso restringido solo para defensores verificados.

Entrada
N/A
Salida
N/A
Contexto
Trusted Access for Cyber; not commercial API
GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI

pending

El nivel económico de GPT-5.6 de OpenAI — TerminalBench 2.1 con 82,5 % por $1/$6 por 1M de tokens, superando a Claude Haiku 4.5 y Gemini Flash en capacidad por dólar. La advertencia: Luna está restringida a ~20 socios de confianza, sin verificación independiente ni fecha de disponibilidad general. Ideal para equipos que construyen arquitecturas de enrutamiento de modelos que pueden escalar fallos baratos a Terra o Sol.

Entrada
$1 / 1M tokens
Salida
$6 / 1M tokens
Contexto
Fastest and most cost-efficient GPT-5.6 tier.
GPT-5.6 Sol logo

GPT-5.6 Sol

OpenAI

Recomendado

GPT-5.6 Sol es el modelo frontera más rentable, líder en benchmarks de código y competitivo en razonamiento difícil a una fracción del costo de sus pares. El veredicto se refuerza con la divulgación del endurecimiento de seguridad GPT-Red — el modelo fue entrenado adversarialmente contra un modelo dedicado de red-teaming por RL de auto-juego a escala frontera, lo que lo hace 6x más robusto frente a inyecciones de prompt.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
Same rate card as GPT-5.5. Ultra mode costs more.
GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI

pending

El caballo de batalla de gama media de GPT-5.6 — capacidad de clase GPT-5.5 a mitad de precio ($2,50/$15 por 1M de tokens), con TerminalBench 2.1 al 84,3 % empatando con Claude Fable 5. La salvedad: todas las afirmaciones provienen del proveedor, Terra está restringida a ~20 socios y no hay fecha de disponibilidad general confirmada. Para la mayoría de las cargas de trabajo de producción, Terra sería la opción pragmática por defecto una vez disponible; GPT-5.5 y Opus 4.8 son las alternativas actuales.

Entrada
$2.50 / 1M tokens
Salida
$15 / 1M tokens
Contexto
Roughly 2x cheaper than GPT-5.5 for similar perf.
GPT-Live-1 logo

GPT-Live-1

OpenAI

Condicional

El primer modelo de voz full-duplex de OpenAI: escucha y habla simultáneamente, un salto más allá del Modo de Voz Avanzado por turnos. Delega el razonamiento complejo a GPT-5.5 en segundo plano mientras mantiene la fluidez conversacional. Veredicto CONDICIONAL: es la mejor experiencia de voz en ChatGPT disponible, pero es un modelo integrado en el producto, sin API y con soporte desigual de idiomas.

Entrada
ChatGPT subscription
Salida
ChatGPT subscription
Contexto
ChatGPT Voice only
GPT-Live-1 mini logo

GPT-Live-1 mini

OpenAI

Condicional

La variante gratuita de GPT-Live-1: misma arquitectura full-duplex en un paquete más pequeño y rápido, que funciona como modelo de voz predeterminado para usuarios de ChatGPT Free. Comparte las innovaciones principales: interacción continua, soporte para palabra de activación y delegación a GPT-5.5. Mismas limitaciones: sin API, calidad de idioma desigual. Una mejora sustancial sobre el antiguo modo de voz por turnos para usuarios gratuitos.

Entrada
Free (ChatGPT)
Salida
Free (ChatGPT)
Contexto
ChatGPT Voice only
Gemini 2.5 Pro logo

Gemini 2.5 Pro

Google

Recomendado

Ahora la opción económica para contexto largo: un recorte del 40% en precios (jun 2026) hizo que procesar corpus completos sea accesible para presupuestos medios — la ventana de contexto más larga disponible, con fuerte integración en el ecosistema de Google.

Entrada
$1.25 / 1M tokens
Salida
$10 / 1M tokens
Contexto
1M tokens
Gemini 3.5 Flash logo

Gemini 3.5 Flash

Google

Recomendado

El destacado de Google en eficiencia de costos para la automatización agéntica de escritorio a $1.50/$9 por 1M de tokens con contexto de ~1M. Su Computer Use nativo obtiene 78.4 en OSWorld-Verified — a 0.3 puntos de GPT-5.5 a aproximadamente un tercio del costo. LA salvedad relevante: la herramienta Computer Use es una vista previa pública que aún no está en la API de producción, así que conviene verificar la disponibilidad del endpoint antes de integrarla.

Entrada
$1.50 / 1M tokens
Salida
$9 / 1M tokens
Contexto
1M tokens
Gemini 3.5 Pro logo

Gemini 3.5 Pro

Google

pending

El modelo frontera de Google previo a la disponibilidad general — ya en su cuarto aplazamiento y «con meses de retraso» según Bloomberg. El contexto de 2M tokens, el pipeline multimodal nativo y el razonamiento Deep Think siguen siendo capacidades reales, pero no existe un calendario de disponibilidad general confirmado. La capacidad de código es la carencia principal.

Entrada
Not yet published
Salida
Not yet published
Contexto
Est. $5-15/$30-60 per 1M. 2M ctx. Not GA.
G

Grok 4.5

SpaceXAI

Condicional

Modelo de programación agéntica con precio competitivo a $2/$6 por 1M tokens y 500K de contexto: los benchmarks publicados por xAI lo sitúan en la zona media, por detrás de Fable 5 y GPT-5.5, aunque supera a Opus 4.8 en DeepSWE y Terminal-Bench 2.1. La verdadera noticia es la eficiencia de coste: 4.2× más eficiente en tokens que Opus 4.8 en SWE-Bench Pro. Ideal para equipos que necesitan programación sólida a una fracción del precio de los modelos punteros. Aún no disponible en la UE.

Entrada
$2 / 1M tokens
Salida
$6 / 1M tokens
Contexto
500K tokens
H

Hy3

Tencent

Condicional

Modelo agéntico MoE de pesos abiertos bajo licencia Apache 2.0 (295B totales, 21B activos) con gran fiabilidad en llamadas a herramientas y comportamiento anti-alucinaciones, aunque en programación queda por detrás de GLM-5.2 y el autoalojamiento exige 8 o más GPUs. Acceso gratuito en OpenRouter hasta el 21 de julio — después, $0,20/$0,80 por 1M de tokens. Ideal para agentes de programación autoalojados y trabajo con documentos de contexto largo, donde la licencia permisiva importa más que las puntuaciones absolutas en benchmarks.

Entrada
$0.20 / 1M
Salida
$0.80 / 1M
Contexto
256K tokens
I

Inkling

Thinking Machines Lab

Condicional

Inkling es la mejor razón hasta ahora para tomarse en serio la IA multimodal de pesos abiertos. Ofrece razonamiento y programación competitivos con la mejor seguridad de su clase en modelos abiertos y esfuerzo de pensamiento controlable, todo bajo Apache 2.0. Pero Thinking Machines es honesta: no es el más potente en conjunto — la factualidad se queda corta (SimpleQA 43.9%) y el autoalojamiento exige hardware serio (2 TB de VRAM). Condicional: una base convincente para organizaciones que necesitan poseer y afinar un modelo multimodal, no para equipos que buscan el máximo rendimiento inmediato.

Entrada
$1.87 / 1M tokens
Salida
$4.68 / 1M tokens
Contexto
Up to 1M tokens native
K

Kimi K3

Moonshot AI

Condicional

El buque insignia MoE de 2.8T de Moonshot AI — el modelo de pesos abiertos más grande jamás publicado — lidera en programación front-end en Arena WebDev y compite con Opus 4.8 en tareas de programación de horizonte largo. Su precio plano de $3/$15 por 1M lo mantiene accesible, pero aún va por detrás de Fable 5 y GPT 5.6 Sol en benchmarks de ejecución precisa, y los pesos seguirán solo en la nube hasta el 27 de julio. Ideal para equipos que hacen programación agéntica de contexto largo, toleran cierta verbosidad y no necesitan autoalojamiento inmediato.

Entrada
$3.00 / 1M
Salida
$15.00 / 1M
Contexto
1M tokens, $0.30/1M cached
Llama 4 Maverick logo

Llama 4 Maverick

Meta

Condicional

El modelo de código abierto líder para equipos que necesitan autoalojamiento, soberanía de datos o quieren evitar la dependencia de un proveedor de API.

Entrada
Free (self-hosted) or $0.20 / 1M tokens (hosted)
Salida
Free (self-hosted) or $0.60 / 1M tokens (hosted)
Contexto
10M tokens
MAI-Code-1-Flash logo

MAI-Code-1-Flash

Microsoft

Condicional

El primer modelo de código propio de Microsoft — un MoE disperso pequeño, rápido y agresivamente optimizado en costos a $0.75/$4.50 por 1M de tokens. Ofrece una ventaja de 16 puntos sobre Claude Haiku 4.5 en SWE-Bench Pro usando hasta un 60% menos de tokens. Está diseñado específicamente para flujos de trabajo de Copilot de alto volumen — autocompletados, refactorizaciones, andamiajes —, no es un modelo frontera. Rinde mejor dentro del ecosistema Copilot; el acceso por API fuera de él aún se está desplegando.

Entrada
$0.75 / 1M tokens
Salida
$4.50 / 1M tokens
Contexto
256K context
Muse Spark 1.1 logo

Muse Spark 1.1

Meta

Condicional

El primer modelo de IA de pago de Meta y su primera ofensiva en el mercado de programación comercial: $1.25/$4.25 por 1M tokens con 1M de contexto, orquestación nativa de subagentes, soporte para MCP/herramientas y capacidad de uso de ordenador a aproximadamente 4× por debajo del precio de Anthropic/OpenAI. Lidera en benchmarks de uso de herramientas pero va 7 puntos por detrás de Opus 4.8 en programación pura en SWE-Bench Pro. Pesos cerrados, vista previa pública solo en EE. UU. Ideal para equipos que priorizan la orquestación de herramientas a bajo coste.

Entrada
$1.25 / 1M tokens
Salida
$4.25 / 1M tokens
Contexto
1M tokens
Mythos 5 (Claude Mythos 5) logo

Mythos 5 (Claude Mythos 5)

Anthropic

Condicional

El modelo de ciberseguridad más potente del mundo (83.8% en CyberGym) — construido sobre los pesos de Fable 5 con los clasificadores de seguridad retirados. El acceso se suspendió tras la directiva de exportación del 12 de junio; se restauró parcialmente el 26 de junio para ~100 organizaciones estadounidenses designadas de infraestructura crítica (Project Glasswing). El veredicto sigue CONDICIONAL: la capacidad es de élite, pero el acceso está sujeto a designación federal. No es una API pública — solo puede usarse si la organización figura en la lista del Departamento de Comercio.

Entrada
$10 / 1M tokens
Salida
$50 / 1M tokens
Contexto
1M tokens (restricted access)
O

Ornith-1.0

DeepReinforce

Condicional

Una sólida familia de modelos de código agentivo de código abierto con licencia MIT que logra benchmarks competitivos con la frontera — supera a Claude Opus 4.7 tanto en Terminal-Bench 2.1 como en SWE-Bench Verified — pero requiere self-hosting con recursos GPU significativos y proviene de un laboratorio nuevo con un historial limitado.

Entrada
Free (MIT license)
Salida
Free (MIT license)
Contexto
256K tokens
S

Sakana Fugu

Sakana AI

Condicional

Orquestador multi-agente que iguala a modelos frontera en benchmarks clave enrutando a través de un pool de agentes expertos — pero el enrutamiento opaco y la dependencia de plataforma limitan la transparencia.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
272K tokens (>272K: $10/$45 per 1M)