Staffbase es la primera plataforma de experiencia del empleado nativa en IA. Integra comunicaciones, TI y RR. HH. para llegar a cada empleado —incluidos los trabajadores de primera línea, a menudo los más difíciles de conectar— a través de una aplicación corporativa, intranet, correo electrónico, SMS, señalización digital, integraciones con Microsoft 365 y nuevas experiencias basadas en agentes, como podcasts personalizados y un asistente conversacional. Más de 1.500 clientes empresariales, entre ellos Adidas, Alaska Airlines, DHL, MAN Truck & Bus y Whataburger, utilizan Staffbase para conectar con su personal. Nombrada líder en el Cuadrante Mágico™ de Gartner® 2025 para soluciones de intranet empaquetadas por tercer año consecutivo y reconocida por G2 como líder en intranets para empleados, la empresa tiene su sede en Nueva York y Chemnitz, Alemania.
Ser nativo en IA significa que la IA no es un complemento en Staffbase, sino el cimiento sobre el que se construye el producto. Cada nueva experiencia, desde la búsqueda semántica en la intranet hasta el asistente conversacional y los podcasts personalizados, depende de ejecutar la inferencia de modelos de lenguaje y embeddings de forma fiable, global y a escala empresarial. Este caso de estudio analiza cómo Staffbase utilizó la pasarela de IA de TrueFoundry para unificar dicha inferencia en una amplia infraestructura en la nube multirregional y convertirla en una plataforma única y fiable.
A medida que Staffbase integraba la IA en el núcleo de su plataforma, el verdadero reto no era invocar un modelo, sino ejecutar la inferencia de forma fiable a la escala y con la cobertura geográfica que exige una plataforma de experiencia del empleado para grandes empresas.
Destacaron tres presiones. Primero, escala bruta: una plataforma nativa en IA que sirve a más de 1.500 clientes empresariales genera un volumen de inferencia enorme y continuo, dominado por las llamadas de embedding que impulsan la búsqueda y recuperación en todo el contenido de los clientes. Segundo, una infraestructura fragmentada de proveedores y regiones: la capacidad estaba repartida entre múltiples suscripciones y cuentas cognitivas de Azure —despliegues independientes en regiones como Suecia y Francia, cada uno con sus propias claves de API, cuotas y límites de tasa— además de AWS Bedrock. Equilibrar el tráfico manualmente entre todos ellos y mantenerse dentro de los límites de tasa de cada cuenta habría sido insostenible. Tercero, residencia de datos y fiabilidad: con sede central en Europa y clientes globales, Staffbase necesitaba que la inferencia se enrutara a través de las regiones adecuadas y, dado que las comunicaciones de los empleados son críticas, necesitaba una disponibilidad demostrable.
Staffbase estandarizó la pasarela de IA de TrueFoundry como el plano de control único para todo su tráfico de IA. Detrás de un punto de conexión, la pasarela gestiona ahora un backend deliberadamente complejo, ocultando dicha complejidad a todos los equipos que desarrollan sobre ella.
La pasarela ofrece a Staffbase una interfaz única para un backend que abarca 5 suscripciones de Azure más AWS Bedrock, 28 cuentas cognitivas de Azure y 141 despliegues de modelos individuales en 9 regiones. Los equipos llaman a una única API y obtienen acceso a 19 modelos —desde los modelos de vanguardia más recientes hasta modelos especializados de embedding y reranking— sin tener que configurar ellos mismos los SDK, claves o puntos de conexión de los proveedores.
Modelos disponibles (19): gpt-5.6-luna, gpt-5.6-sol, gpt-5.6-terra, gpt-5.5, gpt-5.4, gpt-5.1, gpt-5-mini, gpt-5-nano, gpt-4.1, gpt-4.1-mini, gpt-4.1-nano, gpt-4o, claude-sonnet-5, claude-sonnet-4-6, claude-haiku-4-5, Mistral-Large-3, text-embedding-3-large, text-embedding-3-small, cohere-rerank-v3-5.
Aquí es donde el Gateway demuestra su valor. La capacidad de Azure de Staffbase se divide en cuentas cognitivas independientes; por ejemplo, Suecia y Francia están en la misma suscripción, pero tienen sus propias claves de API, cuotas y límites de tasa. El Gateway agrupa los 141 destinos de despliegue en una capacidad lógica única y dirige cada solicitud al despliegue con mayor disponibilidad, sorteando automáticamente los límites de tasa por cuenta y realizando conmutaciones por error cuando un punto de conexión se satura. Solo el gateway de producción de de1 equilibra entre 32 destinos de enrutamiento; en todos los entornos, el Gateway gestiona 141. Lo que antes era un problema de planificación de capacidad manual, ahora es algo en lo que los ingenieros nunca tienen que pensar.
La producción se ejecuta como gateways regionales distintos (prod-de1 para Europa, prod-us1 para EE. UU. y prod-au1 para Australia), por lo que las solicitudes se atienden desde la ubicación geográfica adecuada tanto por motivos de residencia de datos como de latencia. Para una plataforma con sede en Europa y clientes empresariales en todo el mundo, dirigir la inferencia a través de gateways específicos por región mantiene los datos donde deben estar, al tiempo que proporciona a cada región su propio grupo de capacidad fiable.
La combinación de tráfico cuenta la historia de un producto nativo de IA: los embeddings representan más del 97% de todo el tráfico del Gateway, impulsando la recuperación y la búsqueda semántica detrás de las experiencias de IA de Staffbase. Desde su lanzamiento en febrero, el Gateway ha procesado aproximadamente 108,2 millones de solicitudes a text-embedding-3-small y 29,3 millones a text-embedding-3-large, además de 2,5 millones de solicitudes de generación a gpt-5-mini, con un volumen creciente en los modelos de vanguardia.
Dado que las comunicaciones de los empleados no pueden permitirse tiempos de inactividad, Staffbase supervisa el Gateway mediante SLO formales. En una ventana móvil de 28 días, la disponibilidad se sitúa en hasta un 99,99998% (superando cómodamente los cinco nueves) en todos los entornos de producción, y las tasas de éxito de las solicitudes de modelos se mantienen en un 99,99% o más una vez que se excluyen los errores de configuración esperados (respuestas de límite de tasa y autenticación).
Alrededor de 22 funciones de producto y equipos distintos dirigen su tráfico a través del Gateway hoy en día, y cada una de las 12 funciones que Staffbase lanzó entre febrero y mayo de 2026 depende de él. Debido a que todo ese tráfico fluye a través de una superficie gobernada, Staffbase obtiene una visión única y atribuible del uso y el gasto, por una fracción de lo que sugiere el volumen.
Adoptar una plataforma tan profundamente solo funciona si el proveedor se mueve a la velocidad del equipo. Staffbase destacó la capacidad de respuesta de TrueFoundry, especialmente la rapidez con la que se atienden las solicitudes de nuevas funciones, como una ventaja real a medida que escala su adopción de IA.
Al centralizarse en TrueFoundry, Staffbase convirtió una infraestructura de IA fragmentada, multisuscripción y multirregional en una plataforma única y gobernada sobre la que sus equipos pueden construir sin fricciones.
Desde su lanzamiento en febrero, el Gateway ha gestionado más de 141 millones de solicitudes — actualmente alrededor de 97,8 millones al mes — y ha procesado 29 200 millones de tokens (27 300 millones de entrada y 1900 millones de salida). Ha mantenido una disponibilidad de hasta el 99,99998 % y tasas de éxito superiores al 99,99 %, equilibrando la carga entre 141 implementaciones en 9 regiones, todo bajo un único punto de acceso. Aproximadamente 22 funciones y equipos dependen de él, y todas las funciones de IA que Staffbase lanzó en 2026 se ejecutan sobre esta plataforma.
La experiencia de Staffbase demuestra que ser nativo de IA a escala empresarial no requiere construir una infraestructura de inferencia desde cero. Al estandarizar el uso del AI Gateway de TrueFoundry para la inferencia unificada, el equilibrio de carga inteligente entre regiones y la visibilidad de costes —a través de 5 suscripciones de Azure, AWS Bedrock, 28 cuentas cognitivas y 141 implementaciones—, Staffbase escaló a más de 140 millones de solicitudes gestionadas con una fiabilidad de cinco nueves, ofreciendo a cada equipo un lugar fiable donde construir la próxima generación de experiencias para empleados.
