La carrera por el modelo abierto más rentable para construir agentes no para de acelerarse, y Tencent acaba de poner sobre la mesa una de las apuestas más serias del año. Mientras OpenAI y Anthropic siguen defendiendo sus modelos cerrados de última generación, el gigante chino ha optado por liberar los pesos completos de su tecnología más avanzada para agentes, apostando a que la adopción masiva pesa más que el control exclusivo.
Hy3 no es un lanzamiento improvisado. Llega tras meses de aprendizaje con la versión preview, recogiendo feedback de más de 50 productos internos de Tencent antes de escalar el post-entrenamiento con datos de mayor calidad. El resultado es un modelo que, según sus propios benchmarks, rivaliza con modelos de bandera que tienen entre dos y cinco veces más parámetros activos.
🔍 ¿Qué es Hy3 y qué problema resuelve?
Hy3 es un modelo de lenguaje de tipo Mixture-of-Experts (MoE) desarrollado por el equipo Tencent Hunyuan, publicado el 6 de julio de 2026. Su arquitectura activa solo 21.000 millones de parámetros de un total de 295.000 millones, lo que le permite ofrecer un rendimiento de gama alta sin necesitar la infraestructura masiva que exigen otros modelos de tamaño equivalente.
El problema que resuelve es concreto: los agentes de IA fallan con frecuencia en tareas largas porque pierden el hilo, invocan mal las herramientas o se equivocan en conversaciones de múltiples turnos. Tencent afirma haber reducido estos fallos de conversación multi-turno del 17,4% al 7,9% respecto a la generación anterior, y haber conseguido que el modelo sostenga flujos de trabajo de agentes de hasta 495 pasos sin descarrilar.
⚙️ Características principales
Hy3 se licencia bajo Apache 2.0, lo que permite su uso comercial sin restricciones, y está disponible en GitHub, Hugging Face, ModelScope y AtomGit. Entre sus funciones más relevantes destacan:
- Parsers dedicados para llamadas a herramientas: soporte nativo para vLLM y SGLang, con modos de esfuerzo de razonamiento (no_think, low, high) que permiten controlar cuánto «piensa» el modelo antes de actuar.
- Ventana de contexto de 256K tokens: suficiente para procesar documentos largos, historiales de conversación extensos o múltiples llamadas a herramientas encadenadas.
- Cuantización para hardware modesto: versiones GGUF de 1-bit y 4-bit que permiten ejecutar el modelo en una sola GPU con 128 GB, sin necesitar un clúster de ocho GPUs H20.
- Integración con frameworks de agentes: compatibilidad ya probada con OpenClaw, OpenCode, KiloCode y el protocolo MCP (Model Context Protocol) para orquestar cadenas de herramientas.
- Despliegue en producción real: ya funciona dentro de Yuanbao, CodeBuddy, WorkBuddy, QQ y Tencent Docs, con mejoras medidas del 54% en latencia del primer token y del 47% en tiempo de generación de extremo a extremo.
En benchmarks de navegación web como BrowseComp, Hy3 pasó del 28,7% de su predecesor Hy2 al 67,1%, y en WideSearch alcanzó un 70,2%, superando a GLM-5 y Kimi-K2.5, aunque todavía por debajo del 77,2% de Claude Opus 4.6. Para quien quiera profundizar en cómo funcionan estas arquitecturas, Paris 2.0 — El Primer Modelo Open Source de Vídeo Generativo con Entrenamiento Descentralizado ofrece contexto adicional sobre otros modelos de la misma familia. Según Wikipedia, los modelos de lenguaje grande basados en arquitecturas de mezcla de expertos activan solo una fracción de sus parámetros por consulta, lo que reduce el coste computacional sin sacrificar capacidad.
💰 Precio y planes
Los pesos del modelo son gratuitos y de código abierto bajo licencia Apache 2.0, por lo que cualquier empresa puede descargarlo, modificarlo y desplegarlo sin coste de licencia. Para quienes prefieren no gestionar infraestructura propia, Tencent Cloud ofrece acceso vía API a partir de aproximadamente 0,18 dólares por millón de tokens de entrada y 0,59 dólares por millón de tokens de salida, con paquetes de plan personal desde unos 4,10 dólares al mes. Durante el lanzamiento, Tencent ofreció además dos semanas de acceso gratuito a través de OpenRouter para facilitar las primeras pruebas.
✅ Análisis: Pros y Contras
| ✅ Ventajas | ❌ Desventajas |
|---|---|
| Licencia Apache 2.0 totalmente abierta y apta para uso comercial sin restricciones | La documentación y buena parte del ecosistema de soporte están orientados al mercado chino |
| Ejecuta flujos de agentes de hasta 495 pasos con una tasa de error muy reducida | Todavía queda por detrás de Claude Opus 4.6 en benchmarks de navegación web compleja |
| Cuantizaciones de 1-bit y 4-bit que permiten correrlo en una sola GPU de 128 GB | Requiere conocimientos técnicos para desplegarlo localmente; no hay una app de consumo directa |
| Coste de API muy competitivo frente a modelos cerrados equivalentes | Al ser un lanzamiento reciente, la comunidad de terceros y los tutoriales en español son escasos |
| Ya validado en producción real dentro de productos de Tencent con millones de usuarios | Depende de servidores y APIs alojados en infraestructura china, lo que puede preocupar a empresas con requisitos estrictos de soberanía de datos |
⭐ Puntuación oledir.com: 4,3/5
Puntuación: 4,3/5 — Hy3 destaca por su equilibrio entre coste, apertura y fiabilidad en tareas de agentes largas, aunque su curva de adopción fuera de China y la falta de una interfaz de consumo limitan su puntuación frente a alternativas más pulidas para el usuario final.
- 🎯 Facilidad de uso: 3,5/5
- 💡 Funcionalidades: 4,7/5
- 💰 Relación calidad-precio: 4,8/5
- 🔧 Integraciones: 4,3/5
- 📞 Soporte: 3,2/5
🚀 ¿Para quién es ideal Hy3?
Hy3 está pensado para equipos técnicos, empresas de infraestructura de IA y desarrolladores que construyen agentes propios y necesitan un modelo potente sin pagar las tarifas de los grandes laboratorios occidentales. Es especialmente interesante para quienes ya trabajan con vLLM, SGLang o frameworks como OpenClaw y buscan un motor de razonamiento capaz de sostener workflows largos: procesamiento de documentos, análisis de datos, recuperación de conocimiento y orquestación de herramientas vía MCP. No es la mejor opción para quien busca una app lista para usar sin tocar código.
🔗 Prueba Hy3 gratis
👉 Visita Hy3 — Sitio oficial de Tencent Hunyuan
