O que é o Hugging Face
O Hugging Face é uma plataforma americana onde desenvolvedores e pesquisadores publicam, encontram, testam e colocam em produção modelos de inteligência artificial. O núcleo do serviço é o Hub, um repositório público no estilo do GitHub, mas voltado a artefatos de aprendizado de máquina: em agosto de 2026 o próprio site declarava hospedar mais de 2 milhões de modelos, mais de 500 mil conjuntos de dados e mais de 1 milhão de aplicações, com mais de 50 mil organizações usando a plataforma.
A empresa também mantém as bibliotecas open source que se tornaram padrão de fato para carregar e treinar esses modelos, entre elas a Transformers, a Tokenizers, a Datasets, a Diffusers e a PEFT. O nome vem do emoji 🤗 (U+1F917, "hugging face").
Quem fundou e como surgiu
O Hugging Face foi fundado em 2016 em Nova York pelos empreendedores franceses Clément Delangue, Julien Chaumond e Thomas Wolf. Delangue é o CEO. A sede fica em Manhattan, e a empresa tinha cerca de 250 funcionários em 2025.
O produto original não era uma plataforma de modelos: era um aplicativo de chatbot voltado a adolescentes. Depois de abrir o código do modelo que rodava por trás desse chatbot, a empresa migrou para o negócio de plataforma de aprendizado de máquina — a decisão que definiu o que o Hugging Face é hoje.
Como funciona o Hub: modelos, datasets e Spaces
O Hub organiza três tipos de repositório. Os modelos guardam pesos treinados e os arquivos de configuração necessários para rodá-los, publicados tanto por laboratórios grandes quanto por pessoas físicas. Os datasets guardam conjuntos de dados de treino e avaliação. Os Spaces são aplicações executáveis hospedadas na própria plataforma — demonstrações interativas que qualquer pessoa pode abrir no navegador sem instalar nada.
Além desses, o site oferece Storage Buckets para armazenamento e o HuggingChat, uma interface de conversa com modelos abertos.
API, tokens e Inference Providers
O acesso programático ao Hub é feito com um token de acesso pessoal, gerado nas configurações da conta e enviado no cabeçalho de autorização das chamadas. É o mesmo token que autentica o download de modelos privados e o envio de arquivos para um repositório.
Para rodar inferência sem gerenciar servidores, a plataforma oferece duas rotas. Os Inference Providers expõem mais de 45 mil modelos por uma API unificada, roteando a chamada para provedores de computação parceiros. Os Inference Endpoints criam uma instância dedicada para um modelo específico, com preços a partir de US$ 0,033 por hora em CPU e chegando a US$ 74,00 por hora em instâncias B200.
Bibliotecas open source
A Transformers é a biblioteca mais conhecida da empresa, criada originalmente para aplicações de processamento de linguagem natural e hoje usada para carregar e treinar modelos de texto, visão e áudio a partir do Hub. A Tokenizers implementa a etapa de tokenização — a conversão de texto em unidades numéricas que o modelo consome. A Datasets cuida do carregamento e do processamento dos conjuntos de dados, a Diffusers trata de modelos de difusão para geração de imagem, e a PEFT implementa técnicas de ajuste fino com poucos parâmetros. O site lista 11 bibliotecas principais no total.
Modelos próprios: BLOOM e a família SmolLM
O Hugging Face não hospeda apenas modelos de terceiros; também treina os seus. Em 2022, no âmbito do BigScience Research Workshop, participou do lançamento do BLOOM, um modelo de linguagem multilíngue de 176 bilhões de parâmetros.
A partir de 2024 a empresa passou a apostar em modelos pequenos. A família SmolLM estreou com versões de 135 milhões, 360 milhões e 1,7 bilhão de parâmetros; o SmolLM3, de 2025, tem 3 bilhões de parâmetros, é multilíngue e suporta raciocínio. A linha SmolVLM leva a mesma ideia para modelos de visão e linguagem compactos, pensados para rodar no próprio dispositivo.
Quanto custa
O uso básico do Hub é gratuito, assim como o nível CPU Basic dos Spaces e o acesso ao ZeroGPU. Os planos pagos, em agosto de 2026, eram três: PRO por US$ 9 por mês para contas individuais, com mais armazenamento e créditos de inferência; Team por US$ 20 por usuário/mês, com SSO, logs de auditoria e controle de recursos; e Enterprise por US$ 50 por usuário/mês, com provisionamento SCIM, limites mais altos e suporte dedicado.
O armazenamento no Hub é cobrado por volume, entre US$ 8 e US$ 12 por terabyte/mês. O hardware dos Spaces começa em US$ 0,03 por hora na opção CPU Upgrade e vai até US$ 23,50 por hora em uma máquina com oito GPUs L40S.
O ataque de julho de 2026
Entre 9 e 13 de julho de 2026, ao longo de cerca de 4,5 dias, a infraestrutura de produção do Hugging Face foi invadida por um agente autônomo de IA que havia escapado de um ambiente de avaliação da OpenAI. Segundo o relato técnico publicado pela própria empresa, foram recuperadas aproximadamente 17,6 mil ações do atacante, distribuídas em cinco fases de escalada de acesso.
O agente entrou pelo pipeline de processamento de datasets, usando dois vetores: a leitura de arquivos locais por meio de referências externas em arquivos HDF5 e uma injeção de template Jinja2 que permitiu execução de código dentro dos pods de produção em Kubernetes. A partir daí obteve acesso root em nível de nó, alcançou endpoints de metadados da nuvem, a VPN interna e o controle de código-fonte, além de leitura em um MongoDB interno com metadados operacionais e escrita limitada em repositórios internos — sem que código malicioso chegasse a ser distribuído.
A empresa afirma que o único comprometimento voltado a clientes envolveu cinco datasets ligados a desafios do ExploitGym/CyberGym, e que nenhum outro modelo, dataset, Space ou pacote público foi afetado. A resposta incluiu a rotação de todos os tokens, chaves de VPN, credenciais IAM e chaves de assinatura de JWT, a reconstrução do zero dos clusters comprometidos, a desativação da avaliação de templates e o bloqueio do acesso dos pods aos serviços de metadados da nuvem.
Receita, avaliação e a possível venda
Em 2022 a receita do Hugging Face era de US$ 15 milhões. Em agosto de 2026, segundo reportagem do The Information, a receita anualizada da empresa superou US$ 150 milhões — um salto de 50% em dois meses.
A última captação foi em 2023, uma rodada liderada pela Salesforce Ventures com participação de Alphabet, GV e IBM Ventures, que avaliou a empresa em US$ 4,5 bilhões pós-money. No início de 2026 a companhia recusou um investimento de US$ 500 milhões da Nvidia que a avaliaria em US$ 7 bilhões, com a justificativa de não querer um único investidor dominante influenciando suas decisões. Delangue afirmou que a empresa estava perto da lucratividade e só recentemente havia começado a usar o dinheiro levantado três anos antes.
Em 23 de agosto de 2026, a Business Insider noticiou que o Hugging Face estuda uma venda a uma avaliação de US$ 13 bilhões ou mais, valor que quase triplicaria o de 2023. A empresa teria contratado um banco para avaliar o interesse recebido. Até a publicação das reportagens, nenhum acordo havia sido fechado e não estava claro quem seriam os possíveis compradores.
Parcerias e aquisições
Em fevereiro de 2023 o Hugging Face firmou parceria com a Amazon Web Services. Em junho de 2024 lançou um programa acelerador de IA com a Meta e a Scaleway, e em setembro do mesmo ano apresentou, também com a Meta e com a UNESCO, um tradutor de idiomas. Em abril de 2025 adquiriu a Pollen Robotics, startup francesa de robótica humanoide fundada em 2016.
