Modelos de IA

54

Encuentra el modelo adecuado para tu tarea. Filtra por fortaleza, compara precios y decide.

Filtrar por proveedor

54modelos
Astra logo

Astra

OpenAI

pending

Primer modelo en activar el umbral de ciberseguridad 'Critical' de OpenAI. Resolvió 10 problemas matemáticos abiertos por unos $2,000. Desarrollo pausado activamente desde agosto de 2026 para refuerzo de seguridad.

Entrada
Not yet published
Salida
Not yet published
Contexto
Development slowed Aug 2026. No GA date.
Claude Fable 5 logo

Claude Fable 5

Anthropic

Condicional

El modelo frontera de clase Mythos de Anthropic — el Claude disponible públicamente más potente hasta la fecha, líder en todos los benchmarks principales en su lanzamiento. El veredicto se mantiene CONDICIONAL por dos limitaciones vigentes: precios solo por créditos a $10/$50 por 1M de tokens sin opción de suscripción, y un clasificador de seguridad que se activa en exceso con tareas de código rutinarias, redirigiéndolas silenciosamente a un fallback de Opus 4.8. Conviene recurrir a Fable 5 cuando el salto de capacidad justifica el costo; para el trabajo rutinario, Sonnet 5 es la alternativa más predecible.

Entrada
$10 / 1M tokens
Salida
$50 / 1M tokens
Contexto
1M context, 128K max output
Claude Haiku 4.5 logo

Claude Haiku 4.5

Anthropic

Recomendado

La referencia de valor de Anthropic a $1/$5 por 1M de tokens — el nivel rápido y de bajo costo contra el que se comparan los rivales, con contexto de 200K y salida de 64K. Ideal para trabajo de alto volumen sensible a la latencia: clasificación, extracción, resúmenes y enrutamiento. Conviene recurrir a Opus 4.8 o Sonnet 5 cuando se necesita razonamiento profundo de múltiples pasos.

Entrada
$1 / 1M tokens
Salida
$5 / 1M tokens
Contexto
200K tokens
Claude Opus 4.8 logo

Claude Opus 4.8

Anthropic

Recomendado

El modelo de razonamiento insignia de Anthropic y el referente práctico de la frontera en capacidad desplegable — contexto de 1M tokens a $5/$25 por 1M de tokens, incluido en todos los planes de suscripción. Nuestra elección para el trabajo intensivo en revisión: revisión de código, refactorización con restricciones y tareas de ritmo deliberado. Su sólida programación agéntica, su razonamiento analítico de primer nivel y el acceso estable por suscripción lo convierten en el insignia por defecto para la mayoría de los equipos de producción.

Entrada
$5 / 1M tokens
Salida
$25 / 1M tokens
Contexto
1M tokens
Claude Opus 5 logo

Claude Opus 5

Anthropic

Recomendado

Inteligencia cercana a Fable 5 a la mitad de precio. SOTA en Frontier-Bench y CursorBench. Un 85% menos de salvaguardas cibernéticas que Fable 5. El modelo de frontera de cabecera para el coding diario.

Entrada
$5.00 / 1M tokens
Salida
$25.00 / 1M tokens
Contexto
200K tokens
Claude Sonnet 4.6 logo

Claude Sonnet 4.6

Anthropic

Condicional

Superado por Claude Sonnet 5 (lanzado el 30 de junio de 2026) como el caballo de batalla por defecto del nivel medio. El precio de $3/$15 y el contexto de 1M tokens de Sonnet 4.6 los iguala ahora un sucesor con un salto de 13.4 puntos en Terminal-Bench 2.1 con la misma tarifa. Conviene elegir 4.6 solo para despliegues fijados o cuando el ~30% más de tokens de Sonnet 5 y la eliminación de temperature/top_p/top_k resulten descalificantes.

Entrada
$3 / 1M tokens
Salida
$15 / 1M tokens
Contexto
1M tokens
Claude Sonnet 5 logo

Claude Sonnet 5

Anthropic

Recomendado

El Sonnet más agéntico de Anthropic ofrece un rendimiento cercano a Opus 4.8 a aproximadamente la mitad del precio, con +13.4 puntos en Terminal-Bench 2.1 sobre Sonnet 4.6. El nuevo tokenizador infla los conteos ~30%, por lo que el precio de lanzamiento ($2/$10 por MTok hasta el 31 de agosto) mantiene la migración neutral en costos, aunque los equipos deberían recalcular presupuestos antes de cambiar. Sustituye a Sonnet 4.6 como el modelo por defecto en todos los planes de Claude, ideal para programación agéntica, depuración de código heredado y pipelines de producción — no para el razonamiento frontera más exigente ni para tareas de ciberseguridad.

Entrada
$3 / 1M
Salida
$15 / 1M
Contexto
1M tokens
D

DeepSeek V4 Flash

DeepSeek

Recomendado

DeepSeek's volume-tier open-weight model at 284B parameters (13B active MoE) with a 1M-token context window. SWE-bench Verified 79.0% at $0.22 input and $0.66 output per 1M tokens off-peak, doubling during the seven daily peak hours. The August 2026 price rise ended its run as the cheapest credible API (GPT-5.6 Luna now undercuts it on input at $0.20), but it remains a strong value pick, and the MIT license means self-hosting sidesteps API pricing entirely. Still the default workhorse for high-throughput agent pipelines that can run off-peak.

Entrada
$0.22 / 1M tokens
Salida
$0.66 / 1M tokens
Contexto
1M tokens. Peak 2x: 01-04 + 06-10 UTC
D

DeepSeek V4 Pro

DeepSeek

Recomendado

The strongest open-weight coding model we've tested: SWE-bench Verified 80.6%, LiveCodeBench 93.5% and 3206 Codeforces Elo. At $0.66 input and $1.98 output per 1M tokens off-peak it stays far below Western flagship pricing even after the August 2026 rise, though rates double during the seven daily peak hours. The default for self-hosted agentic coding.

Entrada
$0.66 / 1M tokens
Salida
$1.98 / 1M tokens
Contexto
1M tokens. Peak 2x: 01-04 + 06-10 UTC
F

FLUX 3

Black Forest Labs

Condicional

Modelo fundacional multimodal unificado para imagen, video, audio y predicción de acciones.

Entrada
Not yet published
Salida
Not yet published
Contexto
Gated early access
G

GLM-5.2

Z.ai

Condicional

El mejor modelo de código de pesos abiertos con contexto de 1M tokens y licencia MIT — supera a GPT-5.5 en múltiples benchmarks a una fracción del costo, pero aún va por detrás de Claude Opus 4.8 en las tareas más difíciles de largo alcance.

Entrada
$1.40 / 1M tokens
Salida
$4.40 / 1M tokens
Contexto
1M tokens
G

GLM-5.3

Z.ai

Condicional

GLM-5.3 es el modelo de pesos abiertos de codificación y ciberdefensa más reciente de Z.ai: la misma base que GLM-5.2, con todas las mejoras provenientes del post-entrenamiento. Pero las cifras principales siguen siendo generadas por el proveedor, los pesos abiertos se retienen ~2 semanas por la capacidad de seguridad emergente y el precio por token no está publicado. Recurre a él ahora para seguridad defensiva y automatización agéntica; espera a los pesos y a las auditorías independientes antes de estandarizarte.

Entrada
N/A (rate not yet published)
Salida
N/A (rate not yet published)
Contexto
1M context
GPT-4.1 logo

GPT-4.1

OpenAI

Recomendado

El destino de migración por defecto para cargas de trabajo de GPT-4 Turbo: misma estructura de solicitudes, menor costo, contexto de 1M tokens — convierte los payloads heredados de function_call al formato tools y sigue adelante.

Entrada
$2 / 1M tokens
Salida
$8 / 1M tokens
Contexto
1M tokens
GPT-4o (Retired from ChatGPT, API-only) logo

GPT-4o (Retired from ChatGPT, API-only)

OpenAI

Condicional

GPT-4o (May 2024) has been superseded by the GPT-5.x family and delisted from OpenAI's flagship API pricing page. It remains available through the API but is no longer a current-generation model. Use only where migration to GPT-5.x is blocked; otherwise, GPT-5.5 or GPT-5.4 offer better performance at comparable cost.

Entrada
$2.50 / 1M tokens
Salida
$10 / 1M tokens
Contexto
128K tokens
GPT-5.5 logo

GPT-5.5

OpenAI

Recomendado

El modelo frontera comercial de propósito general de OpenAI y el ancla desplegable de OpenAI mientras la familia GPT-5.6 sigue restringida por el gobierno — $5/$30 por 1M de tokens con contexto de 1M+. Su razonamiento sólido, el amplio soporte del ecosistema y la plena disponibilidad pública lo convierten en una opción por defecto fiable para producción, aunque modelos más baratos ya lo igualan en tareas específicas. Para la mayoría de los equipos, sigue siendo la referencia con la que se miden los modelos más nuevos.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
1M+ tokens (922K in / 128K out)
GPT-5.5-Cyber logo

GPT-5.5-Cyber

OpenAI

Condicional

85.6% en CyberGym — la puntuación más alta de un modelo individual — pero con acceso restringido solo para defensores verificados.

Entrada
N/A
Salida
N/A
Contexto
Trusted Access for Cyber; not commercial API
GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI

Condicional

GPT-5.6 Luna is OpenAI's budget tier — near-GPT-5.5 capability at $1/$6 per 1M tokens, the strongest capability-per-dollar value in the GPT-5.6 family. Now generally available via API and Codex after the July 9 government-gate lift. Remains conditional: all benchmarks are vendor-reported, Luna lacks activation classifiers, and it is not in the standard ChatGPT picker.

Entrada
$0.20 / 1M tokens
Salida
$1.20 / 1M tokens
Contexto
Fastest tier. 80% cut Jul 30 → $0.20/$1.20.
GPT-5.6 Sol logo

GPT-5.6 Sol

OpenAI

Recomendado

GPT-5.6 Sol es el modelo frontera más rentable, líder en benchmarks de código y competitivo en razonamiento difícil a una fracción del costo de sus pares. El veredicto se refuerza con la divulgación del endurecimiento de seguridad GPT-Red — el modelo fue entrenado adversarialmente contra un modelo dedicado de red-teaming por RL de auto-juego a escala frontera, lo que lo hace 6x más robusto frente a inyecciones de prompt.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
Same $5/$30. Fast mode: 2.5× at 2× cost.
GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI

Condicional

GPT-5.6 Terra is OpenAI's mid-tier workhorse — GPT-5.5-class capability at half the cost ($2.50/$15 per 1M tokens). Now generally available via API and Codex after the July 9 government-gate lift. Remains conditional: all benchmarks are vendor-reported without independent reproduction, and Terra is not selectable in the standard ChatGPT model picker.

Entrada
$2.00 / 1M tokens
Salida
$12.00 / 1M tokens
Contexto
Mid-tier. 20% cut Jul 30 → $2.00/$12.00.
GPT-5.6-Cyber logo

GPT-5.6-Cyber

OpenAI

Condicional

GPT-5.6-Cyber es el modelo de ciberseguridad entrenado específicamente por OpenAI, construido sobre GPT-5.6 Sol y disponible exclusivamente a través del programa restringido Daybreak Red. Es el primer modelo en alcanzar el umbral de capacidad cibernética 'High' de OpenAI, con un rendimiento en cadenas de exploits y zero-days que supera ampliamente a los modelos de propósito general.

Entrada
$12.50 / 1M tokens
Salida
$75 / 1M tokens
Contexto
400K tokens
GPT-Live-1 logo

GPT-Live-1

OpenAI

Condicional

El primer modelo de voz full-duplex de OpenAI — escucha y habla simultáneamente, un salto más allá del Modo de Voz Avanzado por turnos.

Entrada
ChatGPT subscription
Salida
ChatGPT subscription
Contexto
ChatGPT Voice only
GPT-Live-1 mini logo

GPT-Live-1 mini

OpenAI

Condicional

La variante del nivel gratuito de GPT-Live-1 — la misma arquitectura dúplex completo en un paquete más pequeño y rápido, sirviendo como el modelo de voz predeterminado para usuarios de ChatGPT Free. Comparte las innovaciones centrales: interacción continua, soporte de palabra de activación y delegación a GPT-5.5. Se aplican las mismas limitaciones: sin API, calidad de idioma desigual. Una mejora sustancial sobre el antiguo modo de voz basado en turnos para usuarios gratuitos.

Entrada
Free (ChatGPT)
Salida
Free (ChatGPT)
Contexto
ChatGPT Voice only
GPT-Live-Transcribe logo

GPT-Live-Transcribe

OpenAI

Recomendado

El modelo de voz a texto en streaming de baja latencia de OpenAI entrega deltas de transcripción en vivo a $0.017/min con latencia ajustable y transcripción consciente del contexto. Mejora la tasa de error de gpt-realtime-whisper y soporta sugerencias de palabras clave en tiempo real, sugerencias de idioma y actualizaciones de configuración a mitad de sesión vía WebSocket o WebRTC. El compromiso: ~3.8× el coste de GPT-Transcribe por lotes, y sin diarización, marcas de tiempo de palabras ni puntuaciones de confianza. Ideal para subtitulado en vivo, asistentes de reuniones y agentes de voz donde la visualización de transcripción en menos de un segundo importa más que el coste por minuto.

Entrada
$0.017 / minute
Salida
N/A
Contexto
Per-minute realtime audio billing
GPT-Transcribe logo

GPT-Transcribe

OpenAI

Recomendado

El último modelo de speech-to-text por lotes de OpenAI alcanza un 3.31% AA-WER a $0.0045/min — un 25% más barato y mediblemente más preciso que su predecesor gpt-4o-transcribe. Soporta indicaciones de contexto, sugerencias de palabras clave y detección de idioma en más de 22 idiomas, lo que lo convierte en la mejor opción predeterminada para transcripción asíncrona de archivos en la plataforma OpenAI. Limitación: sin diarización ni marcas de tiempo a nivel de palabra; usa gpt-4o-transcribe-diarize para etiquetas de hablante o gpt-live-transcribe para necesidades en tiempo real. Ideal para desarrolladores que construyen transcripción de reuniones, procesamiento de medios e interfaces de voz sobre la API de OpenAI.

Entrada
$0.0045 / minute
Salida
N/A
Contexto
Per-minute audio billing
Gemini 2.5 Pro logo

Gemini 2.5 Pro

Google

Recomendado

Ahora la opción económica para contexto largo: un recorte del 40% en precios (jun 2026) hizo que procesar corpus completos sea accesible para presupuestos medios — la ventana de contexto más larga disponible, con fuerte integración en el ecosistema de Google.

Entrada
$1.25 / 1M tokens
Salida
$10 / 1M tokens
Contexto
1M tokens
Gemini 3.1 Pro logo

Gemini 3.1 Pro

Google

Condicional

El modelo Pro más capaz de Google disponible públicamente, con contexto de 1M tokens a precios competitivos. Generación anterior: Gemini 3.6 y 3.5 Flash ya lo superan en benchmarks de codificación y agentes a menor coste. Mantenlo si usas Google Cloud/Vertex AI; si no, la línea Flash o los competidores ofrecen más.

Entrada
$2 / 1M
Salida
$12 / 1M
Contexto
1M tokens
Gemini 3.5 Flash logo

Gemini 3.5 Flash

Google

Recomendado

El destacado de Google en eficiencia de costos para la automatización agéntica de escritorio a $1.50/$9 por 1M de tokens con contexto de ~1M. Su Computer Use nativo obtiene 78.4 en OSWorld-Verified — a 0.3 puntos de GPT-5.5 a aproximadamente un tercio del costo. LA salvedad relevante: la herramienta Computer Use es una vista previa pública que aún no está en la API de producción, así que conviene verificar la disponibilidad del endpoint antes de integrarla.

Entrada
$1.50 / 1M tokens
Salida
$9 / 1M tokens
Contexto
1M tokens
Gemini 3.5 Flash Cyber logo

Gemini 3.5 Flash Cyber

Google

Precaución

Gemini 3.5 Flash Cyber es el primer modelo especializado en ciberseguridad de Google, afinado a partir de 3.5 Flash para encontrar, validar y parchear vulnerabilidades. Dentro de la arquitectura multiagente de CodeMender, alcanza un rendimiento competitivo en CyberGym frente a modelos mucho más grandes como Mythos a una fracción del coste. Pero las restricciones son severas: se ejecuta exclusivamente dentro de CodeMender, disponible solo para gobiernos y socios de confianza mediante un piloto de acceso limitado sin API pública, sin cifras de benchmark publicadas y sin calendario para un lanzamiento más amplio.

Entrada
N/A
Salida
N/A
Contexto
CodeMender-only, government-gated pilot
Gemini 3.5 Flash-Lite logo

Gemini 3.5 Flash-Lite

Google

Recomendado

Gemini 3.5 Flash-Lite es el modelo más rápido y barato de la serie 3.5 de Google, a 350 tok/s y $0,30/$2,50. El salto generacional desde 3.1 Flash-Lite es la verdadera historia — supera con creces a su predecesor en benchmarks agénticos clave y vence al Gemini 3 Flash completo en tareas de programación y uso del ordenador. Para desarrolladores que escalan subagentes agénticos de alto rendimiento, pipelines de búsqueda y procesamiento de documentos, la relación precio-rendimiento de Flash-Lite no tiene rival en la gama de Google.

Entrada
$0.30 / 1M
Salida
$2.50 / 1M
Contexto
1M context, 64K output, 350 tok/s
Gemini 3.5 Pro logo

Gemini 3.5 Pro

Google

pending

El modelo frontera de Google previo a la disponibilidad general — ya en su cuarto aplazamiento y «con meses de retraso» según Bloomberg. El contexto de 2M tokens, el pipeline multimodal nativo y el razonamiento Deep Think siguen siendo capacidades reales, pero no existe un calendario de disponibilidad general confirmado. La capacidad de código es la carencia principal.

Entrada
Not yet published
Salida
Not yet published
Contexto
Est. $5-15/$30-60 per 1M. 2M ctx. Not GA.
Gemini 3.6 Flash logo

Gemini 3.6 Flash

Google

Recomendado

Gemini 3.6 Flash es el nuevo caballo de batalla predeterminado de la gama Flash de Google — es mejor y más barato que 3.5 Flash, con puntuaciones superiores en todos los benchmarks y una reducción del precio de salida de $9.00 a $7.50 por millón de tokens. La ganancia de eficiencia de tokens del 17% implica un menor coste por tarea incluso antes del recorte de precio, y la función integrada de Computer Use a través de la API lo convierte en una opción creíble para programación agéntica. Para desarrolladores del ecosistema Google, esta es la actualización clara — no hay razón para quedarse en 3.5 Flash.

Entrada
$1.50 / 1M
Salida
$7.50 / 1M
Contexto
1M context, 64K output
Gemini 3.7 Flash logo

Gemini 3.7 Flash

Google

Recomendado

Gemini 3.7 Flash es el caballo de batalla Flash más potente de Google hasta la fecha para codificación y agentes: una mejora real frente a 3.6 Flash, a la mitad del precio anterior durante 2026. Sigue por detrás de la frontera en las tareas más difíciles de terminal y uso de computadora. Una actualización clara para quienes construyen agentes sensibles al costo y dentro del ecosistema de Google; no es un reemplazo de la codificación de frontera.

Entrada
$0.75 / 1M
Salida
$3.75 / 1M
Contexto
1M context, 64K output
Gemini 3.8 Flash logo

Gemini 3.8 Flash

Google

Recomendado

Gemini 3.8 Flash is Google's strongest Flash workhorse yet — a genuine capability upgrade over the recommended 3.7 Flash at the same introductory price, with real gains across software engineering, agents and professional domains. The deciding caveat is Google's own: 3.8 "works harder," so per-task token burn runs well above 3.7, which remains the efficiency-first pick. Adopt 3.8 for long-horizon coding, agents and finance or legal work — benchmark your own workload before the intro price expires.

Entrada
$0.75 / 1M
Salida
$3.75 / 1M
Contexto
1M context, 64K output
Gemini 4 logo

Gemini 4

Google

pending

El modelo de próxima generación confirmado de Google DeepMind. El pre-entrenamiento comenzó el 21 de julio de 2026. Sin benchmarks, sin precios, sin especificaciones, sin fecha de GA.

Entrada
Not yet published
Salida
Not yet published
Contexto
Pre-training started Jul 2026. No GA date.
G

Grok 4.5

SpaceXAI

Condicional

Modelo de programación y agéntico con precios competitivos a $2/$6 por 1M tokens con 500K de contexto — los benchmarks publicados por xAI lo sitúan en la zona media, por detrás de Fable 5 y GPT-5.5, aunque lidera frente a Opus 4.8 en DeepSWE y Terminal-Bench 2.1. La verdadera historia es la eficiencia de costes: 4.2× más eficiente en tokens que Opus 4.8 en SWE-Bench Pro. Ideal para equipos que necesitan programación potente a una fracción del precio de frontera. Aún no disponible en la UE.

Entrada
$2 / 1M tokens
Salida
$6 / 1M tokens
Contexto
500K tokens
G

Grok 4.6

SpaceXAI

Condicional

Competitivo en la frontera a $2/$6, con 61 en el AA Intelligence Index (empata con GPT-5.6 Sol) y un GDPVal-AA solo por detrás de Claude Opus 5 — arranca fuerte, pero con un único evaluador y un solo día de vida. Condicional: espera antes de apostar en producción hasta que aterricen más benchmarks.

Entrada
$2.00 / 1M tokens
Salida
$6.00 / 1M tokens
Contexto
Delayed past Aug 7. Now ~Aug 10-14. 500K ctx.
G

Grok Voice Think Fast 2.0

SpaceXAI

Condicional

El modelo speech-to-speech de nueva generación de SpaceXAI con una arquitectura de razonamiento paralelo que lo hace sustancialmente más inteligente que los modelos de voz convencionales.

Entrada
$0.08 / min of audio (speech-to-speech)
Salida
Included in speech-to-speech rate
Contexto
API-only
H

Hy3

Tencent

Condicional

Modelo agéntico MoE de pesos abiertos bajo licencia Apache 2.0 (295B totales, 21B activos) con gran fiabilidad en llamadas a herramientas y comportamiento anti-alucinaciones, aunque en programación queda por detrás de GLM-5.2 y el autoalojamiento exige 8 o más GPUs. Acceso gratuito en OpenRouter hasta el 21 de julio — después, $0,20/$0,80 por 1M de tokens. Ideal para agentes de programación autoalojados y trabajo con documentos de contexto largo, donde la licencia permisiva importa más que las puntuaciones absolutas en benchmarks.

Entrada
$0.20 / 1M
Salida
$0.80 / 1M
Contexto
256K tokens
I

Inkling

Thinking Machines Lab

Condicional

Inkling es la razón más sólida hasta ahora para tomarse en serio la IA multimodal de pesos abiertos. Ofrece razonamiento y programación competitivos con la mejor seguridad de su clase en pesos abiertos y esfuerzo de razonamiento controlable, todo bajo licencia Apache 2.0. Pero Thinking Machines admite abiertamente que no es el más potente en general — la factualidad se queda atrás (SimpleQA 43.9%) y el autoalojamiento exige hardware serio (2 TB de VRAM). conditional: una base convincente para organizaciones que necesitan poseer y afinar un modelo multimodal, no para equipos que buscan el máximo rendimiento sin personalización.

Entrada
$1.87 / 1M tokens
Salida
$4.68 / 1M tokens
Contexto
Up to 1M tokens native
K

Kimi K3

Moonshot AI

Condicional

Potente modelo MoE de 2.8 billones de parámetros, #1 en Arena WebDev y puntuaciones líderes en Terminal-Bench, pero actualmente bajo investigación activa de la Casa Blanca por robo de propiedad intelectual a escala industrial, con el Tesoro de EE. UU. amenazando con sanciones.

Entrada
$3.00 / 1M
Salida
$15.00 / 1M
Contexto
1M ctx, $0.30 cached. Weights live (Jul 27).
L

Laguna S 2.1

poolside

Condicional

Laguna S 2.1 es el primer modelo de programación occidental de pesos abiertos creíble en 11 meses: un MoE de 118B que activa solo 8B de parámetros por token y alcanza un 70.2% en Terminal-Bench 2.1, superando a modelos 10 veces más grandes. Pero no está en la frontera — GPT-5.6 Sol y Kimi K3 van muy por delante — y entre sus limitaciones conocidas figuran el sobreajuste a benchmarks, errores al anidar JSON en argumentos de herramientas y la ausencia de control configurable del esfuerzo de razonamiento. El colapso de la ronda Serie C de $14B de Poolside plantea dudas sobre su sostenibilidad, lo que hace que este modelo sea más adecuado para programación agéntica autoalojada donde la soberanía de datos pesa más que el liderazgo absoluto en benchmarks.

Entrada
$0.10 / 1M
Salida
$0.20 / 1M
Contexto
OpenMDW-1.1 license, 1M context
Llama 4 Maverick logo

Llama 4 Maverick

Meta

Condicional

El modelo de código abierto líder para equipos que necesitan autoalojamiento, soberanía de datos o quieren evitar la dependencia de un proveedor de API.

Entrada
Free (self-hosted) or $0.20 / 1M tokens (hosted)
Salida
Free (self-hosted) or $0.60 / 1M tokens (hosted)
Contexto
10M tokens
MAI-Code-1-Flash logo

MAI-Code-1-Flash

Microsoft

Condicional

El primer modelo de código propio de Microsoft — un MoE disperso pequeño, rápido y agresivamente optimizado en costos a $0.75/$4.50 por 1M de tokens. Ofrece una ventaja de 16 puntos sobre Claude Haiku 4.5 en SWE-Bench Pro usando hasta un 60% menos de tokens. Está diseñado específicamente para flujos de trabajo de Copilot de alto volumen — autocompletados, refactorizaciones, andamiajes —, no es un modelo frontera. Rinde mejor dentro del ecosistema Copilot; el acceso por API fuera de él aún se está desplegando.

Entrada
$0.75 / 1M tokens
Salida
$4.50 / 1M tokens
Contexto
256K context
MAI-Code-1.1-Flash logo

MAI-Code-1.1-Flash

Microsoft

Condicional

MAI-Code-1.1-Flash es el modelo de codificación renovado de Microsoft para el nivel pequeño de Copilot: un cuarto del costo y un 22% mejor en Terminal-Bench 2.1 que su predecesor de junio, ahora con visión nativa. Está pensado para trabajo iterativo de alto volumen más que para razonamiento de frontera, lo que lo convierte en el modelo de codificación serio más barato de Copilot. Recurre a él para autocompletados cotidianos, refactorizaciones y depuración asistida por imágenes; usa un buque insignia para arquitecturas complejas.

Entrada
$0.20 / 1M
Salida
$1.20 / 1M
Contexto
256K context
MAI-Cyber-1-Flash logo

MAI-Cyber-1-Flash

Microsoft

Condicional

El primer modelo de ciberseguridad propio de Microsoft, construido sobre la familia MAI-Thinking-1 e integrado en el sistema multiagente MDASH. MAI-Cyber-1-Flash gestiona ~90% de las cargas de trabajo de seguridad a aproximadamente la mitad del coste de configuraciones anteriores, reservando GPT-5.4 para el 10% más difícil. Alcanza un 95.95% en CyberGym — 12 puntos por encima de Mythos 5 — pero es un benchmark reportado por el proveedor desde una configuración de sistema completo (harness + dos modelos), no una comparación independiente modelo contra modelo. Disponible solo a través de Azure AI Foundry con acceso empresarial verificado; sin precios independientes ni API pública.

Entrada
N/A (MDASH SCU consumption)
Salida
N/A (MDASH SCU consumption)
Contexto
Azure AI Foundry vetted access
Muse Glimmer logo

Muse Glimmer

Meta

Condicional

Muse Glimmer es el modelo agentivo open-weight de 30B de Meta, destilado del modelo frontier cerrado Muse Spark y publicado bajo Apache 2.0. Con cuantización a 4-bit ejecuta llamadas a herramientas multi-paso, razonamiento multimodal y recuperación ante fallos en una sola GPU de consumo de 24 GB sin dependencias de la nube.

Entrada
Free (open weights)
Salida
Free (open weights)
Contexto
131K tokens
Muse Spark 1.1 logo

Muse Spark 1.1

Meta

Condicional

El primer modelo de IA de pago de Meta y su primera incursión en el mercado de programación comercial: $1.25/$4.25 por 1M tokens con 1M de contexto, orquestación nativa de subagentes, soporte MCP/herramientas y capacidad de uso de ordenador, aproximadamente 4 veces por debajo del precio de Anthropic/OpenAI. Lidera en benchmarks de uso de herramientas pero se queda 7 puntos por detrás de Opus 4.8 en programación pura en SWE-Bench Pro. Pesos cerrados, vista previa pública solo en EE. UU. Ideal para equipos que priorizan la orquestación de herramientas a bajo coste.

Entrada
$1.25 / 1M tokens
Salida
$4.25 / 1M tokens
Contexto
1M tokens
Muse Spark 1.2 logo

Muse Spark 1.2

Meta

Condicional

La actualización del modelo de Meta enfocado en codificación, co-entrenado con el harness de Muse Code — 82.9% en Terminal-Bench 2.1 y 59.3% en DeepSWE 1.1, solo superado por Claude Opus 5 en el primero. Precios estándar sin cambios a $1.25 entrada / $4.25 salida por 1M tokens.

Entrada
$1.25 / 1M tokens
Salida
$4.25 / 1M tokens
Contexto
1M tokens
Mythos 5 (Claude Mythos 5) logo

Mythos 5 (Claude Mythos 5)

Anthropic

Condicional

El modelo de ciberseguridad más potente del mundo (83.8% en CyberGym) — construido sobre los pesos de Fable 5 con los clasificadores de seguridad retirados. El acceso se suspendió tras la directiva de exportación del 12 de junio; se restauró parcialmente el 26 de junio para ~100 organizaciones estadounidenses designadas de infraestructura crítica (Project Glasswing). El veredicto sigue CONDICIONAL: la capacidad es de élite, pero el acceso está sujeto a designación federal. No es una API pública — solo puede usarse si la organización figura en la lista del Departamento de Comercio.

Entrada
$10 / 1M tokens
Salida
$50 / 1M tokens
Contexto
1M tokens (restricted access)
O

Ornith-1.0

DeepReinforce

Condicional

Una sólida familia de modelos de código agentivo de código abierto con licencia MIT que logra benchmarks competitivos con la frontera — supera a Claude Opus 4.7 tanto en Terminal-Bench 2.1 como en SWE-Bench Verified — pero requiere self-hosting con recursos GPU significativos y proviene de un laboratorio nuevo con un historial limitado.

Entrada
Free (MIT license)
Salida
Free (MIT license)
Contexto
256K tokens
P

Palmyra X6

Writer

Condicional

Palmyra X6 es el modelo agéntico buque insignia de Writer para flujos de trabajo de marketing e ingresos — post-entrenado sobre el GLM-5.2 de pesos abiertos de Z.ai a $2/$8 por 1M tokens, una fracción de la tarifa de los modelos de frontera. Cada cifra destacada proviene de las evaluaciones internas de Writer, y la procedencia de GLM-5.2 es una auténtica cuestión de aprovisionamiento. Adóptalo dentro de Writer para el trabajo de agentes GTM sensible al costo; busca en otra parte la capacidad general validada con benchmarks independientes.

Entrada
$2 / 1M
Salida
$8 / 1M
Contexto
1M context, 8K max output
Q

Qwen3.8-27B

Alibaba

Condicional

Qwen3.8-27B es el modelo open-weight de 27 000 millones de parámetros de Alibaba, ya disponible bajo Apache 2.0 con 262K de contexto nativo y despliegue en una sola GPU. Es el compañero autoalojable del buque insignia Qwen3.8-Max de 2,4T. Los benchmarks siguen siendo cifras de Alibaba, por lo que queda en 'conditional': un modelo real y ejecutable cuyas ganancias en programación declaradas por el fabricante aún esperan reproducción independiente.

Entrada
Free (open weights — self-hosted)
Salida
Free (open weights — self-hosted)
Contexto
TBD — context window not published
Q

Qwen3.8-Max

Alibaba

pending

Buque insignia MoE multimodal de 2.4 billones de parámetros. Todavía no en GA -- sin precios de API por token, sin tabla de benchmarks, sin pesos abiertos publicados. Entrada desde $6/mes mediante Token Plan Lite.

Entrada
$2.00 / 1M tokens
Salida
$6.00 / 1M tokens
Contexto
984K tokens. Open weights promised week of Aug 10.
S

Sakana Fugu

Sakana AI

Condicional

Orquestador multi-agente que iguala a modelos frontera en benchmarks clave enrutando a través de un pool de agentes expertos — pero el enrutamiento opaco y la dependencia de plataforma limitan la transparencia.

Entrada
$5 / 1M tokens
Salida
$30 / 1M tokens
Contexto
272K tokens (>272K: $10/$45 per 1M)