H

Hy3

Tencent · Lanzado jul 2026

Condicional

Modelo agéntico MoE de pesos abiertos bajo licencia Apache 2.0 (295B totales, 21B activos) con gran fiabilidad en llamadas a herramientas y comportamiento anti-alucinaciones, aunque en programación queda por detrás de GLM-5.2 y el autoalojamiento exige 8 o más GPUs. Acceso gratuito en OpenRouter hasta el 21 de julio — después, $0,20/$0,80 por 1M de tokens. Ideal para agentes de programación autoalojados y trabajo con documentos de contexto largo, donde la licencia permisiva importa más que las puntuaciones absolutas en benchmarks.

¿Es adecuada para ti?

Bueno para

  • Programación agéntica con llamadas a herramientas estables entre distintos scaffolds: precisión en SWE-Bench con una variación inferior al 4% entre CodeBuddy, Cline y KiloCode
  • Despliegues autoalojados bajo Apache 2.0: sin dependencia de API, uso comercial permisivo, variante FP8 disponible para menor consumo de memoria
  • Procesamiento de documentos de contexto largo (256K) con entrenamiento anti-alucinaciones: la tasa de alucinación cayó del 12.5% al 5.4% en evaluaciones internas
  • Supera a GLM-5.1 en pruebas ciegas de expertos (2.67/4 frente a 2.51/4): más fuerte en frontend, CI/CD y flujos de datos/almacenamiento

No recomendado para

  • Benchmarks de programación (SWE-Bench Verified 78.0) por detrás de GLM-5.2 (84.2) y Claude Sonnet 5: no es la opción para excelencia pura en programación
  • Coste de autoalojamiento: 295B parámetros totales requieren 8 GPUs (mínimo H20-3e); el nivel gratuito de OpenRouter finaliza el 21 de julio de 2026

Rendimiento por tarea

Flujos agénticos

Very Good

Estabilidad de llamadas a herramientas entre scaffolds, variación independiente del scaffold inferior al 4%

Razonamiento

Very Good

GPQA Diamond 90.4, USAMO 72.0, IMOAnswerBench 90.0: competitivo con modelos más grandes

Generación de código

Very Good

SWE-Bench Verified 78.0: sólido para un modelo abierto, pero 6.2 puntos por detrás de GLM-5.2

Tareas de contexto largo

Very Good

Contexto de 256K, MRCR diálogo largo 75.1%, mejoras anti-alucinaciones

Precios

Entrada

$0.20 / 1M

Salida

$0.80 / 1M

Contexto

256K tokens

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
SWE-Bench Verified78.0 Fuente
SWE-Bench Multilingual75.8 Fuente
Terminal-Bench 2.171.7 Fuente
GPQA Diamond90.4 Fuente
USAMO 202672.0 Fuente
IMOAnswerBench90.0 Fuente
HLE (with tools)53.2 Fuente

Aún no hay cambios de veredicto

El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos