

سحابة SambaNova هي واجهة برمجة تطبيقات (API) لاستدلال الذكاء الاصطناعي تُشغّل النماذج الكبيرة مفتوحة المصدر بسرعات لا يمكن لمزودي الخدمات المعتمدين على وحدات معالجة الرسومات (GPU) مجاراتها، وذلك باستخدام بنية رقائق RDU الخاصة بشركة SambaNova. صُممت لأعباء عمل المؤسسات والمطورين التي تتطلب استدلالاً سريعاً وفعالاً من حيث التكلفة على نماذج تصل إلى 671B معلمة.
شركة SambaNova Systems هي شركة متخصصة في أجهزة وحوسبة الذكاء الاصطناعي السحابية مقرها وادي السيليكون، وتقوم بتصنيع رقائقها الخاصة المصممة خصيصًا لاستدلال الذكاء الاصطناعي. تأسست الشركة في عام 2017 على يد أساتذة جامعة ستانفورد السابقين Kunle Olukotun و Chris Re إلى جانب الرئيس التنفيذي Rodrigo Liang، وقد طورت وحدة تدفق البيانات القابلة لإعادة التكوين (RDU)، والتي وصلت الآن إلى جيلها الرابع (SN40L) مع الإعلان عن الجيل الخامس SN50 في فبراير 2026. على عكس مزودي خدمات الاستدلال المعتمدين على وحدات معالجة الرسومات (GPU)، تستخدم وحدة RDU من SambaNova بنية ذاكرة ثلاثية المستويات تجمع بين HBM3 و DDR DRAM و on-die SRAM، مما يتيح لخزانة خوادم (rack) واحدة مكونة من 16 شريحة تشغيل نماذج مثل DeepSeek-R1 671B أو GPT-OSS 120B بشكل مستمر، دون مواجهة حاجز الذاكرة الذي يحد من إنتاجية وحدات معالجة الرسومات.
تمثل سحابة SambaNova واجهة برمجة التطبيقات (API) العامة: وهي خدمة الدفع مقابل الرمز (pay-per-token) تتيح الوصول إلى DeepSeek V3 و Llama 4 Maverick و GPT-OSS 120B و Gemma 3 و MiniMax M2.5 وغيرها من النماذج مفتوحة المصدر. تبدأ أسعار الإدخال من $0.15 لكل مليون رمز على DeepSeek-V3.1-cb، مع توفر باقة مجانية (200K رمز/يوم، بدون الحاجة لبطاقة ائتمان) لأغراض التقييم. تضيف باقة المطورين (Developer Tier)، التي أُطلقت في 8 فبراير 2025، حدودًا أعلى للطلبات وفواتير مبنية على الاستهلاك. بالنسبة للمؤسسات التي تحتاج إلى نشر محلي (on-premises)، توفر خدمة SambaManaged خزائن SN40L فعلية لضمان عدم خروج البيانات من بيئة العميل. أما منتج Samba-1 الخاص بالشركة، والذي أُعلن عنه في 28 فبراير 2024، فهو نموذج "تكوين الخبراء" (Composition of Experts) يضم تريليون معلمة، ومصمم للنشر المحلي في المؤسسات الخاضعة للوائح التنظيمية.
ما الذي تقدمه SambaNova فعليًا في أبريل 2026
تعمل SambaNova كشركة لتصنيع الرقائق ومزود سحابي للاستدلال في آنٍ واحد، مما يميزها عن مزودي واجهات برمجة التطبيقات (API) البحتة. يضع تصميم ذاكرة SN40L RDU سعة 64GB من HBM3، و 1.5TB من DDR DRAM، و 520MB من on-die SRAM على كل شريحة، مع 16 شريحة في خزانة خوادم قياسية مقاس 19 بوصة مبردة بالهواء. تعني هذه البنية أن المنصة لا تحتاج إلى تقسيم النماذج الكبيرة عبر عشرات المسرعات كما تفعل مجموعات وحدات معالجة الرسومات (GPU clusters).
تُظهر معايير Artificial Analysis (مارس 2026) أن SambaNova تقدم مخرجات تبلغ 711 رمزًا/ثانية على gpt-oss-120B و 250 رمزًا/ثانية على DeepSeek R1 671B، مقارنة بمتوسط يبلغ حوالي 19 رمزًا/ثانية عبر مزودي الخدمات المعتمدين على وحدات معالجة الرسومات لنفس نموذج 671B. يبلغ زمن الوصول للرمز الأول (Latency to first token) على gpt-oss-120B حوالي 1.25 ثانية.
على واجهة برمجة التطبيقات السحابية، يغطي كتالوج النماذج حوالي 8-10 نماذج يتم تتبعها بنشاط اعتبارًا من أبريل 2026: متغيرات متعددة من DeepSeek، و Llama 3.3 70B، و Llama 4 Maverick، و GPT-OSS 120B، و Gemma 3 12B، و MiniMax M2.5. تتوافق واجهة برمجة التطبيقات مع OpenAI، مما يعني أنه يمكن توجيه معظم التعليمات البرمجية الحالية التي تستخدم حزمة تطوير البرمجيات (SDK) الخاصة بـ OpenAI إلى نقطة نهاية SambaNova بمجرد تبديل عنوان URL الأساسي.
في 26 فبراير 2026، أعلنت SambaNova عن SN50، وهو الجيل الخامس من وحدة RDU. تدعي الشركة أن SN50 يوفر 5 أضعاف السرعة القصوى وأكثر من 3 أضعاف إنتاجية وحدات معالجة الرسومات Nvidia Blackwell B200 للاستدلال الوكيلي (agentic inference)، بمتوسط طاقة للخزانة يبلغ 20kW (مما يتيح النشر في مراكز البيانات المبردة بالهواء دون الحاجة لترقيات التبريد السائل). تُعد شركة SoftBank Corp. أول عميل مُعلن لـ SN50، حيث ستقوم بنشره لخدمات الذكاء الاصطناعي السيادية في جميع أنحاء منطقة آسيا والمحيط الهادئ. سيتم شحن SN50 في النصف الثاني من عام 2026.
"يتحدث قطاع الذكاء الاصطناعي بأكمله عن بناء هاتف ذكي للذكاء الاصطناعي، وهو نظام متكامل من الأجهزة والبرمجيات، واليوم، تُعد SambaNova أول من يقدم نسخة من ذلك للمؤسسات.". Rodrigo Liang، الرئيس التنفيذي لشركة SambaNova Systems، بيان صحفي عبر BusinessWire، 28 فبراير 2024
موقع SambaNova مقارنة بـ Cerebras و Groq
تقوم الشركات الثلاث ببناء رقائق مخصصة لاستدلال الذكاء الاصطناعي بدلاً من تكييف بنيات وحدات معالجة الرسومات (GPU) ذات الأغراض العامة. الاختلافات بينها معمارية وليست شكلية.
تستخدم Cerebras (WSE-3) محركًا بحجم الرقاقة (wafer-scale engine): شريحة واحدة تمتد عبر رقاقة أشباه موصلات كاملة، مع 4 تريليون ترانزستور، و 900,000 نواة حوسبة، و 44GB من on-chip SRAM بنطاق ترددي للذاكرة يبلغ 21 PB/s. يحقق هذا التصميم أسرع معدل رموز في الثانية للمستخدم الواحد مقارنة بأي منصة أخرى. المقايضة هنا: سعة 44GB من on-chip SRAM تحد من حجم النموذج الأصلي. يتطلب تشغيل نماذج أكبر من هذه السعة تقسيمها عبر أنظمة رقائق متعددة. يتطلب WSE-3 أيضًا تبريدًا سائلًا متخصصًا بطاقة 23kW لكل نظام، مقارنة بالتبريد القياسي بالهواء في SambaNova الذي يستهلك حوالي 10kW. تُقدم Cerebras خدماتها بشكل أساسي عبر السحابة؛ وتتوفر خيارات النشر المحلي ولكنها نادرة.
تستخدم Groq (LPU) وحدة معالجة لغة (Language Processing Unit) مبنية كمعالج تدفق موتر (tensor streaming processor) مع بنية ذاكرة تعتمد على SRAM فقط. تحتوي كل شريحة LPU على 230 MiB فقط من الذاكرة. يوفر هذا التصميم استدلالًا سريعًا جدًا على النماذج الصغيرة والمتوسطة (Llama 3.3 70B بسرعة تقارب 350 رمزًا/ثانية)، ولكن الاعتماد على SRAM فقط يعني أن تشغيل نموذج 70B يتطلب توزيع عبء العمل عبر مئات الرقائق: حوالي 576 شريحة LPU موزعة على 9 خزائن لنفس عبء عمل 70B الذي تشغله SambaNova على 16 شريحة SN40L في خزانة واحدة. على نطاق 671B معلمة، لا يمكن لـ Groq المنافسة بكفاءة. ولا يتوفر خيار النشر المحلي.
يتعامل تصميم الذاكرة ثلاثي المستويات من SambaNova مع أكبر النماذج باستخدام الحد الأدنى من الأجهزة، ويدعم حركة مرور المؤسسات متعددة المستخدمين في وقت واحد عبر العديد من النماذج. المقايضة مقابل Cerebras هي سرعة الذروة للمستخدم الواحد؛ والمقايضة مقابل Groq هي نضج النظام البيئي للمطورين وشفافية التسعير.
"لو تمكنت وحدات معالجة الرسومات (GPUs) من الاستفادة حقًا من النطاق الترددي لذاكرتها، لكانت أسرع بكثير، لكنها لا تستطيع ذلك.". Anton McGonnell، رئيس المنتجات البرمجية في SambaNova Systems، The Register، سبتمبر 2024
واقع واجهة برمجة تطبيقات المطورين
توفر الباقة المجانية من سحابة SambaNova حوالي 200,000 رمز يوميًا، وهو ما يكفي لتقييم النماذج ولكنه غير كافٍ لتشغيل تطبيق في بيئة الإنتاج. تتيح باقة المطورين التي أُطلقت في 8 فبراير 2025 فواتير الاستهلاك بنظام الدفع مقابل الرمز وحدود طلبات أعلى، مع رصيد مجاني بقيمة $5 عند التسجيل. تتوافق واجهة برمجة التطبيقات مع OpenAI، لذا فإن التكامل يُعد مباشرًا وسهلاً للمطورين الذين يعملون بالفعل مع واجهات برمجة تطبيقات النماذج اللغوية الكبيرة (LLM APIs).
تتراكم التحديات عند حدود الطلبات (Rate limits). حتى في باقة المطورين، يقتصر الحد الأقصى لبعض النماذج على 20 طلبًا في الدقيقة على الرغم من أن الوثائق تدعي حدودًا أعلى. تسبب انتقال نظام الفوترة الذي استمر لعدة أسابيع في أوائل عام 2026 في بقاء العديد من المطورين عالقين في حدود الباقة المجانية حتى بعد إضافة طرق الدفع. أبلغ المستخدمون في منتدى المجتمع عن أخطاء 429 أدت إلى تعطل تطبيقات الإنتاج، حيث أظهر سجل أحد المطورين استخدام 3.3 مليون رمز مقابل حد يومي يبلغ 200K فشل في الترقية على الرغم من ربط بطاقة ائتمان. أقرت SambaNova بأن المشكلة كانت عبارة عن خطأ برمجي في انتقال نظام الفوترة وحلت معظم الحالات عبر تعديلات يدوية للباقات، لكنها لم تقدم جدولًا زمنيًا مؤكدًا للانتهاء.
كتالوج النماذج أضيق مقارنة بـ OpenAI أو Anthropic. لا توجد نماذج أساسية مملوكة لشركة SambaNova متاحة عبر واجهة برمجة التطبيقات السحابية؛ حيث يقتصر Samba-1 على النشر المحلي للمؤسسات فقط. لا يوجد GPT-4، ولا Claude، ولا Gemini. إذا كانت حالة الاستخدام الخاصة بك تتطلب أي شيء خارج مجموعة النماذج مفتوحة المصدر التي تستضيفها SambaNova، فلن تتمكن من تغطيتها داخل المنصة.
بالنسبة لفرق المؤسسات التي تمضي قدمًا في النشر المحلي عبر SambaManaged، يمتد نطاق التكامل إلى ما هو أبعد من مجرد الوصول إلى واجهة برمجة التطبيقات: حيث تتطلب منطق الأعمال، وأتمتة سير العمل، والمراقبة، واسترجاع السياق هندسة مخصصة بالكامل. وصف أحد التحليلات الخارجية التجربة بأنها "أشبه بشراء محرك فورمولا 1 بينما ما تحتاجه حقًا هو سيارة كاملة"، مشيرًا إلى الفجوة بين قدرات الأجهزة الخام ونظام الإنتاج القابل للنشر.
الفئة المستهدفة من SambaNova
تناسب سحابة SambaNova ملفًا شخصيًا محددًا للمطورين: الفرق التي تُشغّل استدلالًا عالي الإنتاجية على نماذج كبيرة مفتوحة المصدر حيث تُترجم الرموز في الثانية إلى وفورات حقيقية في التكلفة أو اختلافات ملموسة في تجربة المستخدم. تمثل فرق الخدمات المالية التي تبني تحليلات تداول في الوقت الفعلي، ومهندسو تعلم الآلة في المختبرات الوطنية أو الصناعات الخاضعة للوائح التنظيمية التي تحتاج إلى خصوصية النشر المحلي، والمطورون الذين يبنون وكلاء بحث عميق يعالجون ملايين الرموز في الجلسة الواحدة، حالات استخدام واقعية. يقلل التسعير لكل رمز من تكلفة مزودي الخدمات المعتمدين على وحدات معالجة الرسومات بشكل كبير عند التوسع: $0.22 للإدخال / $0.59 للإخراج لكل مليون رمز لنموذج gpt-oss-120B مقابل معدلات أعلى بكثير على نقاط نهاية GPU المماثلة.
نشر مختبر أرجون الوطني التابع لوزارة الطاقة الأمريكية مجموعة استدلال SN40L كاملة في نوفمبر 2024، واستخدمها لتشغيل AuroraGPT والبحث العلمي القائم على الذكاء الاصطناعي عبر علم الأحياء والكيمياء وعلوم المواد. وصفت Accenture نموذج Samba-1 بأنه مناسب لعملاء المؤسسات الذين يحتاجون إلى ذكاء اصطناعي محلي متكامل (full-stack on-premises AI). هذه هي النماذج الأصلية للعملاء التي تخدمها SambaNova بشكل ممتاز حقًا.
ما لا تقدمه SambaNova
تجاوز سحابة SambaNova إذا كنت بحاجة إلى نماذج رائدة مملوكة لشركات. لا يوجد GPT-4، ولا Claude، ولا Gemini، ولا وصول عبر واجهة برمجة التطبيقات إلى نموذج Samba-1 الخاص بشركة SambaNova. إذا كانت حالة الاستخدام الخاصة بك تتطلب الوصول إلى كتالوج نماذج واسع يتضمن نماذج مغلقة، فأنت بحاجة إلى مزود مختلف.
تجاوزها إذا كنت تقوم ببناء نماذج أولية بمفردك أو في فريق صغير بدون موارد هندسية. يتم الوصول إلى حدود الباقة المجانية بسرعة. واجه نظام الفوترة إخفاقات موثقة في الترقية. الوثائق، على الرغم من تحسنها، إلا أنها أقل شمولاً من وثائق OpenAI. يتطلب منتج المؤسسات المحلي شهورًا من أعمال التنفيذ ومشاركة كاملة من فريق المبيعات.
تجاوزها إذا كنت بحاجة إلى سياق كامل بحجم 128K على النماذج الكبيرة. عند الإطلاق في سبتمبر 2024، اقتصر نموذج 405B على سياق 8K لأسباب تتعلق بإدارة حركة المرور. تظل حدود نافذة السياق على أكبر النماذج قيدًا معروفًا.
تتجلى أقوى قيمة لـ SambaNova عندما تقوم بتشغيل نماذج كبيرة مفتوحة المصدر على نطاق واسع، وعندما يكون زمن الوصول (latency) مهمًا، وتكون مستعدًا للقيام بعمل هندسي حقيقي للبناء فوق قدرة الاستدلال الخام التي توفرها.
تقييمات المستخدمين
لا توجد تقييمات بعد. كن أول من يشارك تجربته!
سجّل الدخول لكتابة تقييم.
مقالات ذات صلة
أدلة ومقالات ذات صلة بـ SambaNova.

Grok 4.3 API for Agents (May 2026): Pricing, Benchmarks, Migration

Does API Cost More Than a Subscription for Claude Opus 4.8, GPT-5.5, and Grok?

OpenAI GPT-Realtime-2 (May 2026): Pricing, Latency & 30-Min Voice Agent

Claude Code New Limits (May 2026): Per-Plan Changes & SpaceX Deal

Google Vision AI Explained (2026): Pricing Per 1,000 Units, Free Tier, and Alternatives
