A Tencent abriu o código do Hunyuan Hy3, um modelo de linguagem de 295 bilhoes de parâmetros, liberando os pesos completos sob a licença Apache 2.0 no Hugging Face, ModelScope e GitCode. O lançamento segue uma versão prévia que a Tencent divulgou em abril, e agora inclui tanto a versão padrão quanto uma variante FP8 que e mais barata de rodar. A Apache 2.0 e uma licença permissiva que permite uso comercial, o que importa tanto quanto a capacidade bruta, porque significa que empresas podem construir sobre o Hy3 sem as restrições de uso que algumas outras licenças de modelo impõem.
O número que define o modelo não e realmente os 295 bilhoes de parâmetros totais, e os cerca de 21 bilhoes que ficam ativos a cada momento. O Hy3 e um modelo de mistura de especialistas, uma arquitetura que armazena um conjunto muito grande de subredes especializadas mas ativa apenas uma pequena fração delas para cada token. O efeito e que o modelo pode carregar o conhecimento de algo muito maior enquanto custa muito menos para rodar, mais próximo de um modelo de 21 bilhoes de parâmetros do que de um de 295 bilhoes. Ele vem com uma janela de contexto de 256K tokens, que e longa o suficiente para conter grandes bases de código ou conjuntos de documentos em uma única passagem, e a versão FP8 reduz ainda mais a memória e a computação necessárias para implantar o modelo.
Em termos de capacidade, a Tencent se apoia em uma avaliação cega em vez do costumeiro ranking de benchmarks automatizados. Ela diz que 270 especialistas pontuaram modelos concorrentes em tarefas tiradas de seu próprio trabalho do dia a dia, e o Hy3 chegou a 2.67 de 4, a frente do GLM-5.1 com 2.51. A empresa relata força particular em raciocínio, fluxos de trabalho como agente, tarefas de contexto longo, programação, produtividade de escritório, modelagem financeira, design de frontend e desenvolvimento de jogos, e afirma que o modelo rivaliza com sistemas abertos de ponta que rodam várias vezes mais parâmetros ativos. O formato cego e baseado em trabalho real e um sinal mais significativo do que um benchmark sintético, embora ainda seja o fornecedor relatando seu próprio resultado.
Vale a pena ser preciso sobre o que a afirmação e, e o que não e. Vencer o GLM-5.1 em um teste cego e liderar sua classe de tamanho e um resultado real e específico. Rivalizar com modelos de ponta que tem de duas a cinco vezes os parâmetros ativos e um forte argumento de eficiência. Nenhuma dessas coisas e o mesmo que superar os modelos de fronteira fechada dos maiores laboratórios, e a Tencent não esta realmente afirmando isso. A leitura honesta e que o Hy3 e um modelo capaz, eficiente e totalmente aberto que e muito bom para o seu tamanho ativo, não uma declaração de que o mundo aberto alcançou o topo absoluto do mundo fechado.
A razão pela qual isso importa além de um único lançamento e que continua estendendo um padrão que se manteve o ano todo, no qual grandes empresas e laboratórios de tecnologia chineses seguem lancando modelos capazes sob licenças genuinamente abertas e amigaveis ao uso comercial. O Hy3 se junta a uma serie constante de lançamentos de pesos abertos em 2026, e reforça de uma so vez duas das tendências mais claras do ano, o movimento em direção a designs de mistura de especialistas que mantem baixa a computação ativa, e o impulso rumo a capacidade de agir como agente, que e aquilo para o que esses modelos são ajustados. Para qualquer um que constroi sobre modelos abertos, um sistema de 295 bilhoes de parâmetros que roda como um de 21 bilhoes, e forte em agentes e contexto longo, e carrega uma licença Apache 2.0, e uma opção nova genuinamente útil em vez de apenas mais uma entrada em uma lista.
