A Staffbase é a primeira plataforma de experiência do colaborador nativa em IA. Ela integra comunicações, TI e RH para alcançar todos os colaboradores — incluindo os trabalhadores da linha de frente, que costumam ser os mais difíceis de conectar — por meio de um aplicativo de marca, intranet, e-mail, SMS, sinalização digital, integrações com o Microsoft 365 e novas experiências com agentes, como podcasts personalizados e um assistente conversacional. Mais de 1.500 clientes corporativos, incluindo Adidas, Alaska Airlines, DHL, MAN Truck & Bus e Whataburger, utilizam a Staffbase para se conectar com suas equipes. Nomeada como Líder no Gartner® Magic Quadrant™ de 2025 para Soluções de Intranet Empacotadas pelo terceiro ano consecutivo e reconhecida pelo G2 como Líder em Intranets para Colaboradores, a empresa está sediada em Nova York e em Chemnitz, na Alemanha.
Ser nativa em IA significa que a IA não é um recurso adicional na Staffbase — é a base sobre a qual o produto foi construído. Cada nova experiência, desde a busca semântica na intranet até o assistente conversacional e os podcasts personalizados, depende da execução de inferência de modelos de linguagem e embeddings de forma confiável, global e em escala corporativa. Este estudo de caso analisa como a Staffbase utilizou o TrueFoundry AI Gateway para unificar essa inferência em uma ampla infraestrutura de nuvem multirregional e transformá-la em uma plataforma única e confiável.
À medida que a Staffbase incorporou a IA ao núcleo de sua plataforma, o maior desafio não foi chamar um modelo, mas sim executar a inferência de forma confiável na escala e na abrangência geográfica que uma plataforma de experiência do colaborador exige.
Três pressões se destacaram. Primeiro, escala bruta: uma plataforma nativa em IA que atende a mais de 1.500 clientes corporativos gera um volume contínuo e enorme de inferência, dominado pelas chamadas de embedding que impulsionam a busca e a recuperação de conteúdo de cada cliente. Segundo, uma infraestrutura fragmentada de provedores e regiões: a capacidade estava distribuída entre várias assinaturas e contas cognitivas do Azure — implantações separadas em regiões como Suécia e França, cada uma com suas próprias chaves de API, cotas e limites de taxa — além do AWS Bedrock. Equilibrar o tráfego manualmente entre todas elas, mantendo-se dentro dos limites de taxa de cada conta, seria inviável. Terceiro, residência de dados e confiabilidade: com sede na Europa e clientes globais, a Staffbase precisava que a inferência fosse roteada pelas regiões corretas e — como as comunicações dos colaboradores são essenciais — precisava de um tempo de atividade comprovável.
A Staffbase padronizou o TrueFoundry AI Gateway como o plano de controle único para todo o seu tráfego de IA. Por trás de um único endpoint, o Gateway agora gerencia um backend deliberadamente complexo — e oculta essa complexidade de todas as equipes que desenvolvem sobre ele.
O Gateway oferece à Staffbase uma interface única para um backend que abrange 5 assinaturas do Azure, além do AWS Bedrock, 28 contas cognitivas do Azure e 141 implantações individuais de modelos em 9 regiões. As equipes chamam uma única API e obtêm acesso a 19 modelos — desde os modelos de fronteira mais recentes até modelos especializados de embedding e reranking — sem precisar configurar SDKs, chaves ou endpoints de provedores por conta própria.
Modelos disponíveis (19): gpt-5.6-luna, gpt-5.6-sol, gpt-5.6-terra, gpt-5.5, gpt-5.4, gpt-5.1, gpt-5-mini, gpt-5-nano, gpt-4.1, gpt-4.1-mini, gpt-4.1-nano, gpt-4o, claude-sonnet-5, claude-sonnet-4-6, claude-haiku-4-5, Mistral-Large-3, text-embedding-3-large, text-embedding-3-small, cohere-rerank-v3-5.
É aqui que o Gateway mostra o seu valor. A capacidade do Azure da Staffbase é dividida entre contas cognitivas separadas — Suécia e França, por exemplo, estão na mesma assinatura, mas possuem suas próprias chaves de API, cotas e limites de taxa. O Gateway agrupa todos os 141 destinos de implantação em uma capacidade lógica e roteia cada solicitação para uma implantação com margem disponível, contornando automaticamente os limites de taxa por conta e realizando failover quando um endpoint está saturado. Apenas o gateway de produção de1 faz o balanceamento entre 32 destinos de roteamento; em todos os ambientes, o Gateway gerencia 141. O que costumava ser um problema manual de planejamento de capacidade agora é algo com que os engenheiros nunca precisam se preocupar.
A produção é executada como gateways regionais distintos — prod-de1 (Europa), prod-us1 (EUA) e prod-au1 (Austrália) — para que as solicitações sejam atendidas a partir da geografia correta, tanto para residência de dados quanto para latência. Para uma plataforma com sede na Europa e clientes corporativos em todo o mundo, rotear a inferência por meio de gateways específicos da região mantém os dados onde devem estar, ao mesmo tempo em que oferece a cada região seu próprio pool de capacidade confiável.
O mix de tráfego conta a história de um produto nativo de IA: os embeddings representam mais de 97% de todo o tráfego do Gateway, impulsionando a recuperação e a busca semântica por trás das experiências de IA da Staffbase. Desde o lançamento em fevereiro, o Gateway processou cerca de 108,2 milhões de solicitações para text-embedding-3-small e 29,3 milhões para text-embedding-3-large, além de 2,5 milhões de solicitações de geração para gpt-5-mini, com um volume crescente nos modelos de fronteira.
Como a comunicação com os funcionários não pode sofrer interrupções, a Staffbase monitora o Gateway com base em SLOs formais. Em uma janela móvel de 28 dias, a disponibilidade chega a 99,99998% — superando confortavelmente os cinco noves — em todos os ambientes de produção, e as taxas de sucesso das solicitações de modelo permanecem em 99,99%+ ou mais, uma vez excluídos os erros de configuração esperados (respostas de limite de taxa e autenticação).
Cerca de 22 recursos de produto e equipes distintos roteiam seu tráfego pelo Gateway hoje, e cada um dos 12 recursos que a Staffbase lançou entre fevereiro e maio de 2026 depende dele. Como todo esse tráfego flui por uma superfície governada, a Staffbase obtém uma visão única e atribuível do uso e dos gastos — por uma fração do que o volume sugere.
Adotar uma plataforma tão profundamente só funciona se o fornecedor acompanhar a velocidade da equipe. A Staffbase destacou a capacidade de resposta da TrueFoundry — particularmente a rapidez com que as solicitações de recursos são atendidas — como uma vantagem real à medida que escala sua adoção de IA.
Ao centralizar na TrueFoundry, a Staffbase transformou uma infraestrutura de IA fragmentada, com múltiplas assinaturas e regiões, em uma plataforma única e governada na qual suas equipes podem construir sem atritos.
Desde o lançamento em fevereiro, o Gateway gerenciou mais de 141 milhões de solicitações — atualmente cerca de 97,8 milhões em um mês típico — e processou 29,2 bilhões de tokens (27,3 bilhões de entrada e 1,9 bilhão de saída). Ele manteve a disponibilidade em até 99,99998% e taxas de sucesso acima de 99,99%, equilibrando a carga entre 141 implantações em 9 regiões, tudo por trás de um único endpoint. Cerca de 22 funcionalidades e equipes dependem dele, e todos os recursos de IA que a Staffbase lançou em 2026 rodam sobre ele.
A experiência da Staffbase mostra que ser nativo em IA em escala empresarial não exige a construção de uma infraestrutura de inferência do zero. Ao padronizar o uso do AI Gateway da TrueFoundry para inferência unificada, balanceamento de carga inteligente entre várias regiões e visibilidade de custos — abrangendo 5 assinaturas Azure, AWS Bedrock, 28 contas cognitivas e 141 implantações — a Staffbase escalou para mais de 140 milhões de solicitações gerenciadas com confiabilidade de cinco noves, oferecendo a cada equipe um local confiável para construir a próxima geração de experiências para funcionários.
