Blank white background with no objects or features visible.

نقدم لكم وصولاً مجانياً إلى تقرير Gartner Hype Cycle الكامل حول حوكمة الذكاء الاصطناعي لعام 2026. احصل على نسختك →

97.8M
AI requests routed through the Gateway in July 2026
99.995%
model request success rate in production

Staffbase هي أول منصة لتجربة الموظفين تعتمد على الذكاء الاصطناعي بشكل أصيل. فهي تجمع بين الاتصالات وتكنولوجيا المعلومات والموارد البشرية للوصول إلى كل موظف — بما في ذلك العاملون في الخطوط الأمامية الذين غالباً ما يصعب التواصل معهم — من خلال تطبيق موظفين يحمل العلامة التجارية، وشبكة إنترانت، والبريد الإلكتروني، والرسائل النصية القصيرة، واللافتات الرقمية، وتكاملات Microsoft 365، وتجارب وكلاء جديدة مثل البودكاست المخصص والمساعد التفاعلي. يستخدم أكثر من 1,500 عميل من المؤسسات، بما في ذلك Adidas وAlaska Airlines وDHL وMAN Truck & Bus وWhataburger، منصة Staffbase للوصول إلى موظفيهم. تم تصنيف الشركة كشركة رائدة في تقرير Gartner® Magic Quadrant™ لعام 2025 لحلول الإنترانت المعبأة للعام الثالث على التوالي، كما اعترفت بها G2 كشركة رائدة في مجال إنترانت الموظفين، ويقع مقرها الرئيسي في مدينة نيويورك وكيمنتس بألمانيا.

أن تكون المنصة "أصلية في الذكاء الاصطناعي" يعني أن الذكاء الاصطناعي ليس مجرد ميزة إضافية في Staffbase، بل هو الأساس الذي بُني عليه المنتج. فكل تجربة جديدة، بدءاً من البحث الدلالي عبر الإنترانت وصولاً إلى المساعد التفاعلي والبودكاست المخصص، تعتمد على تشغيل نماذج اللغة والاستدلال التضميني (embedding inference) بشكل موثوق وعالمي وعلى نطاق مؤسسي. تستعرض دراسة الحالة هذه كيف استخدمت Staffbase بوابة TrueFoundry للذكاء الاصطناعي لتوحيد عمليات الاستدلال هذه عبر بنية تحتية سحابية واسعة ومتعددة المناطق، وتحويلها إلى منصة واحدة يمكن الاعتماد عليها.

التحدي: ذكاء اصطناعي على مستوى المؤسسات عبر بنية سحابية واسعة

بينما كانت Staffbase تدمج الذكاء الاصطناعي في صميم منصتها، لم تكن المشكلة الصعبة في استدعاء النموذج، بل في تشغيل الاستدلال بشكل موثوق على النطاق وعبر النطاق الجغرافي الذي تتطلبه منصة تجربة الموظفين في المؤسسات الكبرى.

برزت ثلاثة ضغوط رئيسية. أولاً، النطاق الهائل: تولد المنصة التي تعتمد على الذكاء الاصطناعي وتخدم أكثر من 1,500 عميل من المؤسسات حجماً هائلاً ومستمراً من طلبات الاستدلال، تهيمن عليها استدعاءات التضمين (embedding calls) التي تشغل عمليات البحث والاسترجاع عبر محتوى كل عميل. ثانياً، تشتت مزودي الخدمة والمناطق الجغرافية: كانت السعة موزعة عبر اشتراكات Azure متعددة وحسابات معرفية — عمليات نشر منفصلة في مناطق مثل السويد وفرنسا، ولكل منها مفاتيح API وحصص وحدود معدل خاصة بها — بالإضافة إلى AWS Bedrock. كان موازنة حركة المرور بين كل هذه الموارد يدوياً، والبقاء ضمن حدود المعدل لكل حساب، أمراً غير ممكن. ثالثاً، سيادة البيانات والموثوقية: مع وجود مقر رئيسي في أوروبا وعملاء عالميين، احتاجت Staffbase إلى توجيه الاستدلال عبر المناطق الصحيحة، ولأن اتصالات الموظفين بالغة الأهمية، فقد احتاجت إلى وقت تشغيل يمكن إثباته.

"Managing AI resources across multiple regions and subscriptions had become too complex to handle manually. We didn't want our engineers thinking about which cognitive account had quota left, or which region a request should land in — we needed one endpoint that just handled it. We were able to manage that with TrueFoundry."

Stefan Staude, Senior Site Reliability Engineer

الحل: بوابة واحدة عبر كل اشتراك ومنطقة ونموذج

اعتمدت Staffbase على بوابة TrueFoundry للذكاء الاصطناعي كلوحة تحكم موحدة لكل حركة مرور الذكاء الاصطناعي الخاصة بها. ومن خلال نقطة نهاية واحدة، أصبحت البوابة الآن واجهة لخلفية معقدة عمداً، وتخفي هذا التعقيد عن كل فريق يعمل على بنائها. 

1. وكيل موحد عبر 141 عملية نشر و19 نموذجاً

تمنح البوابة Staffbase واجهة واحدة لخلفية تمتد عبر 5 اشتراكات Azure بالإضافة إلى AWS Bedrock، و28 حساباً معرفياً على Azure، و141 عملية نشر فردية للنماذج عبر 9 مناطق. تستدعي الفرق واجهة برمجة تطبيقات (API) واحدة وتحصل على إمكانية الوصول إلى 19 نموذجاً — من أحدث النماذج الرائدة إلى نماذج التضمين وإعادة الترتيب المتخصصة — دون الحاجة إلى ربط حزم تطوير البرمجيات (SDKs) الخاصة بالمزودين أو المفاتيح أو نقاط النهاية بأنفسهم. 

Gateway Azure subs Cognitive accounts Regions Routing targets Models
de1 / prod 1 6 4 32 18
us1 / prod 1 5 3 27 18
au1 / prod 1 6 5 23 17
de1 / stage 1 6 4 31 18
de1 / dev 1 + AWS 5 + Bedrock 3 + 1 28 19
Total 5 Azure + 1 AWS 28 Azure accounts 9 regions 141 —

النماذج المتاحة (19): gpt-5.6-luna, gpt-5.6-sol, gpt-5.6-terra, gpt-5.5, gpt-5.4, gpt-5.1, gpt-5-mini, gpt-5-nano, gpt-4.1, gpt-4.1-mini, gpt-4.1-nano, gpt-4o, claude-sonnet-5, claude-sonnet-4-6, claude-haiku-4-5, Mistral-Large-3, text-embedding-3-large, text-embedding-3-small, cohere-rerank-v3-5.

2. موازنة ذكية للأحمال عبر الاشتراكات والمناطق الجغرافية

هنا تكمن القيمة الحقيقية للبوابة (Gateway). يتم توزيع سعة Azure الخاصة بـ Staffbase عبر حسابات معرفية منفصلة؛ فالسويد وفرنسا، على سبيل المثال، تقعان ضمن نفس الاشتراك ولكن لكل منهما مفاتيح API وحصص وحدود معدل خاصة بها. تقوم البوابة بتجميع كافة أهداف النشر البالغ عددها 141 هدفاً في سعة منطقية واحدة، وتوجيه كل طلب إلى وجهة نشر تتوفر لديها السعة اللازمة، مما يتجاوز تلقائياً حدود المعدل لكل حساب ويوفر خاصية التبديل عند تعطل أو تشبع إحدى نقاط النهاية. بوابة الإنتاج de1 وحدها توازن بين 32 وجهة توجيه؛ وعبر جميع البيئات، تدير البوابة 141 وجهة. ما كان في السابق مشكلة تتطلب تخطيطاً يدوياً للسعة، أصبح الآن أمراً لا يحتاج المهندسون للتفكير فيه مطلقاً.

“The routing and load balancing across our Azure accounts is the single biggest thing the Gateway does for us. Sweden, France, every deployment gets pooled into one endpoint, and traffic just flows to wherever there’s quota. We prevented hitting rate limits and stopped babysitting capacity.”

Stefan Staude, Senior Site Reliability Engineer

3. التوجيه متعدد المناطق لضمان سيادة البيانات وزمن الاستجابة

تعمل بيئة الإنتاج كبوابات إقليمية متميزة — prod-de1 (أوروبا)، وprod-us1 (الولايات المتحدة)، وprod-au1 (أستراليا) — بحيث يتم تقديم الطلبات من المنطقة الجغرافية المناسبة لضمان سيادة البيانات وتقليل زمن الاستجابة. بالنسبة لمنصة ذات مقر رئيسي في أوروبا وعملاء من المؤسسات حول العالم، فإن توجيه الاستدلال عبر بوابات مخصصة لكل منطقة يحافظ على بقاء البيانات في مكانها الصحيح مع منح كل منطقة مجمع سعة خاصاً وموثوقاً بها.

4. تضمينات (Embeddings) على نطاق واسع

يعكس مزيج حركة المرور طبيعة المنتج المعتمد على الذكاء الاصطناعي: حيث تشكل التضمينات أكثر من 97% من إجمالي حركة مرور البوابة، مما يدعم عمليات الاسترجاع والبحث الدلالي خلف تجارب الذكاء الاصطناعي في Staffbase. منذ الإطلاق في فبراير، عالجت البوابة حوالي 108.2 مليون طلب لنموذج text-embedding-3-small و29.3 مليون طلب لنموذج text-embedding-3-large، إلى جانب 2.5 مليون طلب توليد لنموذج gpt-5-mini، مع تزايد حجم الطلبات عبر النماذج المتطورة.

Model (since Feb, ~177 days) Total requests
text-embedding-3-small ~108.2M
text-embedding-3-large ~29.3M
gpt-5-mini ~2.5M

5. موثوقية يمكنك قياسها

نظراً لأن اتصالات الموظفين لا تحتمل أي توقف، تتابع Staffbase أداء البوابة وفقاً لأهداف مستوى الخدمة (SLOs) الرسمية. على مدار نافذة زمنية متجددة مدتها 28 يوماً، تصل نسبة التوفر إلى 99.99998% — متجاوزةً بسهولة معيار "الخمس تسعات" — عبر كل بيئة إنتاج، وتستقر معدلات نجاح طلبات النماذج عند 99.99% فأكثر بمجرد استبعاد أخطاء الإعداد المتوقعة (مثل استجابات حدود المعدل والمصادقة).

Environment Availability (28d) Success rate (30d)
prod-de1 99.99998% 99.995%
prod-us1 99.99987% 99.995%
prod-au1 99.99674% 99.990%
dev 99.99981% 99.990%
stage-de1 99.99976% 99.984%

6. رؤية واضحة للتكاليف لكل ميزة وفريق

حوالي 22 ميزة وفريقاً مختلفاً في المنتج يوجهون حركة مرورهم عبر البوابة اليوم، وتعتمد عليها كل ميزة من الميزات الـ 12 التي أطلقتها Staffbase بين فبراير ومايو 2026. ولأن كل هذه الحركة تمر عبر واجهة واحدة خاضعة للحوكمة، تحصل Staffbase على رؤية موحدة وقابلة للتتبع للاستخدام والإنفاق — بجزء بسيط من التكلفة التي قد يوحي بها حجم العمل. 

دعم يواكب خارطة طريق سريعة التطور

إن تبني منصة بهذا العمق لا ينجح إلا إذا كان المورد يعمل بنفس سرعة الفريق. وقد أشادت Staffbase باستجابة TrueFoundry — لا سيما سرعة معالجة طلبات الميزات — باعتبارها ميزة حقيقية في ظل توسعها في تبني الذكاء الاصطناعي.

النتائج: أكثر من 140 مليون طلب خاضع للحوكمة بموثوقية تتجاوز 99.99%

من خلال المركزية على TrueFoundry، حولت Staffbase بصمتها المشتتة في الذكاء الاصطناعي، عبر اشتراكات ومناطق متعددة، إلى منصة واحدة خاضعة للحوكمة يمكن لفرقها البناء عليها دون أي عوائق.

منذ إطلاقه في فبراير، تولت البوابة إدارة أكثر من 141 مليون طلب — أي حوالي 97.8 مليون طلب في الشهر الواحد — ومعالجة 29.2 مليار رمز (token) (27.3 مليار للمدخلات و1.9 مليار للمخرجات). وقد حافظت البوابة على توافرية تصل إلى 99.99998% ومعدلات نجاح تتجاوز 99.99%، مع موازنة الأحمال عبر 141 عملية نشر في 9 مناطق، وكل ذلك من خلال نقطة نهاية واحدة. يعتمد عليها حالياً حوالي 22 ميزة وفريقاً، وتعمل جميع ميزات الذكاء الاصطناعي التي أطلقتها Staffbase في عام 2026 من خلالها.

“The Gateway became the layer every AI feature is built on. It gave us one place to run inference at scale, across every region and provider, with the reliability our customers expect — and it did it without our teams having to become infrastructure experts.”

Luca Ghersi, Director of Engineering @ Staffbase

أبرز الدروس المستفادة للفرق التي تعتمد بوابة ذكاء اصطناعي

  • وحّد سعتك التشغيلية، ولا تدرها يدوياً. عندما يتم توزيع الاستدلال (inference) عبر العديد من الاشتراكات والحسابات والمناطق، فإن استخدام بوابة تجمع هذه الموارد في سعة منطقية واحدة وتتجاوز حدود المعدلات (rate limits) يزيل عبئاً تشغيلياً كبيراً.
  • صمم نظامك بناءً على حجم العمل الفعلي. بالنسبة للمنتجات القائمة على الذكاء الاصطناعي، يمكن أن تشكل عمليات التضمين (embeddings) الجزء الأكبر من حركة المرور — حيث تجاوزت 97% في حالتنا. إن البوابة التي توجه الطلبات ذات الحجم الكبير والتكلفة المنخفضة بكفاءة تحافظ على النفقات أقل بكثير مما قد توحي به أعداد الطلبات الخام.
  • اجعل الموثوقية قابلة للقياس. إن تتبع أداء البوابة مقابل أهداف مستوى الخدمة (SLOs) الرسمية حول مفهوم وقت التشغيل من مجرد أمنية إلى رقم ملموس يمكن لـ Staffbase الاعتماد عليه في الاتصالات الحيوية.
  • ركز الإدارة أولاً، ثم وزع التكاليف. منحت نقطة النهاية الموحدة لـ 22 ميزة تقريباً شركة Staffbase رؤية شاملة للاستخدام والتكلفة، مع إمكانية نسبها لكل ميزة وفريق، بدلاً من محاولة مطابقة الإنفاق عبر مزودين مختلفين.

الخلاصة

تثبت تجربة Staffbase أن كونك شركة تعتمد على الذكاء الاصطناعي على مستوى المؤسسات لا يتطلب بناء بنية تحتية للاستدلال من الصفر. فمن خلال توحيد المعايير باستخدام بوابة الذكاء الاصطناعي من TrueFoundry لتحقيق استدلال موحد، وموازنة ذكية للأحمال عبر مناطق متعددة، وشفافية في التكاليف — عبر 5 اشتراكات في Azure، وAWS Bedrock، و28 حساباً معرفياً، و141 عملية نشر — تمكنت Staffbase من توسيع نطاق عملياتها لتصل إلى أكثر من 140 مليون طلب مُدار بموثوقية عالية جداً، مع توفير منصة واحدة موثوقة لكل فريق لبناء الجيل القادم من تجارب الموظفين.

The fastest way to build, govern and scale your AI

شغّل مسار تعلم الآلة الخاص بك من اليوم الأول

مسار