El gigante tecnológico Tencent acaba de revolucionar el sector de la inteligencia artificial al anunciar una proeza técnica de gran calado: la compresión de su modelo estrella, Hy4-preview. Con una huella inicial masiva de 1,5 terabytes, el modelo se ha reducido a unos 200 gigabytes gracias a una técnica de cuantización agresiva denominada Sherry, integrada en el conjunto de herramientas de código abierto AngelSlim. Esta drástica reducción, equivalente a una disminución del 87 % en el tamaño del archivo, permitiría teóricamente ejecutar este modelo en hardware menos costoso, como estaciones de trabajo de alta gama, donde antes era indispensable contar con un clúster de servidores.

En el núcleo de esta innovación, el modelo Hy4-preview impresiona por sus dimensiones, al sumar 770 mil millones de parámetros. Su arquitectura, basada en una mezcla de expertos (MoE), explica en parte la viabilidad de esta compresión. Al activar solo una fracción de los parámetros por token, el sistema se beneficia de una redundancia natural que lo hace más resiliente ante la pérdida de precisión derivada de la cuantización. Tencent asegura que la versión comprimida conserva el 98 % de las capacidades del modelo original, una cifra que, sin embargo, suscita dudas dentro de la comunidad científica.

La credibilidad de este rendimiento sigue siendo, de hecho, el centro del debate. Si bien el tamaño reducido del archivo es un hecho técnico verificable, la calidad real de los resultados tras la compresión sigue siendo cuestionable. Los expertos recuerdan que las puntuaciones de referencia publicadas por la empresa corresponden a la versión en precisión completa, no a la versión aligerada. Históricamente, una pérdida del 2 % en pruebas estandarizadas puede traducirse, en la práctica, en capacidades de razonamiento o planificación menos fluidas. No obstante, la transparencia de Tencent, al publicar sus herramientas de compresión en acceso libre, permitirá a los investigadores independientes contrastar rápidamente estos datos con casos de uso reales.

Las implicaciones económicas detrás de este avance son considerables. Al permitir el autoalojamiento de modelos de gran tamaño con costes operativos reducidos, Tencent amenaza directamente el monopolio de la facturación por token que imponen los servicios en la nube actuales. La relación de costes, estimada hasta doce veces inferior a la de las soluciones competidoras más costosas para contextos extensos, podría acelerar la adopción de la IA local en empresas preocupadas por controlar sus gastos. Esta estrategia posiciona a Tencent como un actor fundamental en el panorama de los pesos abiertos (open weights), marcando un paso decisivo en la democratización de la IA soberana y de alto rendimiento.