Ir para o conteúdo

H Company lança Holo4, agentes de pesos abertos que operam qualquer interface de software

Resposta curta

A H Company lançou o Holo4, modelos agênticos nos tamanhos 27B denso e 35B-A3B (mixture-of-experts), além de um Holotron4 Nano atualizado, todos disponíveis na H Models API e como pesos abertos. O Holo4 opera GUIs, escreve código e chama ferramentas MCP ou API com o mesmo modelo, atingindo 61,7% (27B) e 30,9% (35B-A3B) no OSWorld 2.0, contra 81,8% do Opus 5.5, a um custo muito menor.

O que isso significa na operação

Para uma empresa B2B de 10 a 200 pessoas, o atrativo prático não é o placar do benchmark, mas a flexibilidade de interface: a maioria das ferramentas internas, CRMs legados e portais de fornecedores não tem API utilizável, o que hoje obriga a cliques manuais. Um modelo capaz de recorrer ao controle via GUI quando falta uma API, e alternar para chamadas de API quando ela existe, se aplica diretamente à automação de entrada de pedidos, triagem de tickets ou reconciliação de dados entre ferramentas que nunca foram construídas para serem automatizadas. Os pesos abertos (BF16, FP8, NVFP4, GGUF) permitem que uma equipe técnica opte por hospedagem própria em vez de pagar preços de ponta por chamada, embora a diferença relatada no OSWorld 2.0 em relação ao Opus 5.5 (61,7% vs 81,8%) indique que se trata de uma troca entre custo e desempenho, não de uma substituição equivalente, e deva ser testada em um fluxo de trabalho específico antes de ser confiada a tarefas de produção.

A H Company publicou detalhes do Holo4, uma nova série de modelos agênticos construídos para operar software por meio de qualquer interface disponível: interfaces gráficas, código escrito, MCP ou chamadas diretas de API. O lançamento inclui dois tamanhos, um modelo denso de 27B e um modelo mixture-of-experts de 35B-A3B, ambos já disponíveis na H Models API e como pesos abertos no Hugging Face nos formatos BF16, FP8, NVFP4 e GGUF de 4 bits. A empresa também lançou o Holotron4 Nano, uma versão atualizada do Holotron 3 construída ao aplicar a mesma receita de treinamento ao modelo Nemotron 3 Nano Omni da NVIDIA, como parte da NVIDIA Nemotron Coalition.

Segundo o post, o Holo4 é treinado para usar um único modelo em desktops, web, Android, sandboxes de código e APIs de negócio, em vez de exigir um modelo diferente por plataforma. A empresa contextualiza isso contra uma limitação comum: modelos agênticos otimizados para cliques em GUI ficam inutilizáveis sem uma tela, enquanto modelos construídos para chamadas de ferramentas falham diante de aplicações que não expõem nenhuma API, e tarefas de negócio reais frequentemente exigem os dois.

No OSWorld 2.0, um benchmark para fluxos de trabalho longos de desktop, o Holo4 27B marcou 61,7% contra 81,8% do Opus 5.5, enquanto o Holo4 35B-A3B alcançou 30,9%. A H Company afirma que isso fica atrás dos modelos fechados mais fortes, mas com um custo por tarefa muito menor, e publicou todas as trajetórias de benchmark publicamente para replay. Os modelos foram treinados usando aprendizado supervisionado e por reforço em ambientes gerados pela Agentic Task Factory interna da empresa, que já produziu aproximadamente 10 mil tarefas abrangendo aplicações web, servidores MCP e ambientes de desktop, incluindo ambientes híbridos que expõem o mesmo estado por GUI e por MCP simultaneamente.

A H Company também reconstruiu seu harness de treinamento, o loop que executa as ações de um agente e gerencia seu contexto ao longo de sequências longas de tarefas, adicionando memória persistente ao longo de centenas de passos e acesso direto ao shell na máquina de desktop. Checkpoints otimizados do drafter DSpark para inferência mais rápida estão previstos para lançamento em breve.

Fonte: Hugging Face

Próximo passo

Visibility Analyzer

É isto que o Visibility Analyzer mede num site real: quais respostas citam você, quais páginas o motor não consegue recuperar e o que corrigir primeiro. Rodar é grátis.

Rodar uma auditoria de visibilidade grátis

Rodar é grátis. Sem cartão.

Preço
Grátis
Duração
Uma rodada, minutos

Plano grátis: duas análises por dia, sem cartão.