

Sakana Fugu هو نموذج تنسيق صدر في يونيو 2026 من شركة Sakana AI اليابانية: واجهة برمجة تطبيقات واحدة متوافقة مع OpenAI تقوم بتوجيه المهام عبر GPT-5.5 و Gemini و Claude Opus 4.8. يحقق النموذج درجات رائدة في البرمجة، ولكنه يعمل كموجه مهام وليس كنموذج منفرد، ويتأخر عن Fable 5 في أصعب الاختبارات المعيارية.
لا يُعد Sakana Fugu نموذجاً لغوياً كبيراً منفرداً، على الرغم من أنه يُقيّم كنموذج واحد ويُطرح كمنافس لنموذج Fable 5 من Anthropic. بل هو نموذج تنسيق: منسق مُدرَّب يتلقى طلبك عبر واجهة برمجة تطبيقات واحدة متوافقة مع OpenAI ويوجهه عبر مجموعة من النماذج الرائدة الحالية، وهي حالياً GPT-5.5 و Gemini 3.5 Flash و Claude Opus 4.8، ثم يدمج عملها في إجابة واحدة. تم إطلاقه في 22 يونيو 2026 من قبل Sakana AI، وهو مختبر في طوكيو شارك في تأسيسه David Ha و Llion Jones، أحد مؤلفي ورقة Transformer الأصلية.
يعتمد Fugu على ورقتين بحثيتين لشركة Sakana في مؤتمر ICLR 2026: الأولى Trinity، وهو منسق مُطوَّر صغير بحوالي 0.6B معلمة، والثانية Conductor، وهو نموذج تعلم معزز بحوالي 7B معلمة يكتشف استراتيجيات التنسيق ويمكنه استدعاء نسخ من نفسه بشكل متكرر. يتوفر النموذج في إصدارين خلف نقطة نهاية واحدة: Fugu، المُحسَّن للسرعة والقادر على استبعاد مزودين محددين للامتثال، و Fugu Ultra، المُحسَّن لتحقيق أقصى درجات الدقة في المهام الصعبة متعددة الخطوات. جاء الإطلاق بعد عشرة أيام من ضوابط التصدير الأمريكية التي قطعت معظم العالم عن Fable 5 و Mythos Preview، وكان توجه Sakana واضحاً: نتائج بمستوى ريادي دون الاعتماد على مورد واحد أو ولاية قضائية واحدة. تفصل هذه المراجعة بين ما يفعله Fugu بشكل جيد حقاً وبين الأجزاء التي لا تصمد من هذا الطرح.
نظرة سريعة على Sakana Fugu، يونيو 2026
يُعد Fugu، بكلمات Sakana نفسها، "نموذجاً لغوياً كبيراً بحد ذاته، مُدرَّباً على استدعاء نماذج لغوية كبيرة مختلفة في مجموعة وكلاء، بما في ذلك استدعاء نسخ من نفسه بشكل متكرر." تقوم بإرسال مطالبة إلى نقطة نهاية متوافقة مع OpenAI على console.sakana.ai، ويقرر المنسق أي متخصص في المجموعة يجب أن يتولى كل خطوة، مع تعيين أدوار Thinker أو Worker أو Verifier عبر الأدوار، قبل إرجاع استجابة واحدة مدمجة. يوجد تقرير فني منشور على arXiv (2606.21228) يدعمه، مما يوفر شفافية أكبر مما تقدمه معظم إطلاقات المنتجات.
يتوفر إصداران. Fugu هو الخيار الافتراضي للسرعة والتكلفة ويتيح لك استبعاد مزودين محددين، وهو مفيد إذا كانت قواعد الامتثال لديك تمنع مورداً معيناً. يستخدم Fugu Ultra (معرف النموذج fugu-ultra-20260615) مجموعة ثابتة مُحسَّنة للدقة. تدرج Sakana دراسات حالة تشمل البحث الآلي، والتنبؤ بترتيب القراءة اليابانية الكلاسيكية، وحل مكعب روبيك، وتصميم قزحية ميكانيكية باستخدام CAD، وشطرنج المكفوفين، وقرارات تداول الأسهم. أحد القيود العملية عند الإطلاق: يتوفر Fugu عالمياً باستثناء الاتحاد الأوروبي والمنطقة الاقتصادية الأوروبية، حيث كان الامتثال للائحة العامة لحماية البيانات (GDPR) لا يزال معلقاً اعتباراً من 22 يونيو 2026.
ما يبرع فيه Sakana Fugu حقاً
أقوى فكرة هنا هي الاستقلالية عن المزود من خلال واجهة واحدة. بدلاً من برمجة حزمتك التقنية على نموذج واحد وإعادة كتابة المطالبات عندما يتغير ذلك النموذج أو يصبح غير متاح، يمكنك استدعاء Fugu وترك المنسق يختار. بالنسبة لمؤسسة اهتزت بسبب ضوابط التصدير في 12 يونيو والتي جعلت Fable 5 و Mythos غير متاحين بين عشية وضحاها، فإن طرح المرونة هذا حقيقي وجاء في وقته. صاغ الرئيس التنفيذي David Ha ذلك مباشرة:
"الاعتماد على واجهات برمجة التطبيقات لشركة واحدة في البنية التحتية الحيوية أو التمويل أو الحوكمة يمثل نقطة ضعف جوهرية. لم يعد هذا الخطر احتمالاً افتراضياً، بل أصبح حقيقة واقعة." (David Ha، الرئيس التنفيذي لشركة Sakana AI، يونيو 2026)
بالنظر إلى الأرقام المجردة، يسجل Fugu Ultra بالفعل درجات بمستوى ريادي في أجزاء من حزمة الاختبارات. فهو يتصدر في LiveCodeBench (93.2) ويتقدم قليلاً في GPQA-Diamond (95.5)، وتفيد Sakana بأنه يتفوق على Opus 4.8 و GPT-5.5 و Gemini 3.1 Pro في العديد من الاختبارات المعيارية للبرمجة. يُعد التنسيق المتكرر القائم على الأدوار عملاً مبتكراً حقاً من مختبر موثوق، ويجعل تقرير arXiv الطريقة قابلة للفحص بدلاً من كونها صندوقاً أسود.
مقارنة Fable 5: ما تظهره الاختبارات المعيارية حقاً
تنص Sakana على أن "Fugu Ultra يقف جنباً إلى جنب مع النماذج الرائدة مثل Fable 5 و Mythos Preview عبر أكثر الاختبارات المعيارية الهندسية والعلمية والمنطقية صرامة في الصناعة." هذا الادعاء حقيقي، ولكن هناك ثلاثة أمور تقوضه، وهي أمور مهمة.
أولاً، لا يتواجد Fable 5 و Mythos في مجموعة Fugu. فهما يخضعان لضوابط التصدير، لذا لا يمكن لـ Fugu الوصول إليهما، وتستخدم المقارنة الأرقام المنشورة الخاصة بشركة Anthropic بدلاً من إجراء اختبار مباشر ومضبوط. ثانياً، لم يقم أي طرف ثالث مستقل بإعادة إنتاج النتائج حتى الآن. ثالثاً، الأرقام متباينة بمجرد النظر إلى ما هو أبعد من الانتصارات في مجال البرمجة.
| الاختبار المعياري | Fugu Ultra | Fable 5 / Mythos | الأفضلية |
|---|---|---|---|
| LiveCodeBench | 93.2 | 89.8 (Fable 5) | Fugu بفارق 3.4 |
| GPQA-Diamond | 95.5 | 94.1 (Mythos) | Fugu بفارق 1.4 |
| SWE-Bench Pro | 73.7 | 80.0 (Fable 5) | Anthropic بفارق 6.3 |
| TerminalBench 2.1 | 82.1 | 88.0 (Mythos) | Anthropic بفارق 5.9 |
| Humanity's Last Exam | 50.0 | 53.3 (Fable 5) | Anthropic بفارق 3.3 |
القراءة الصادقة: يفوز Fugu Ultra في LiveCodeBench و GPQA-Diamond ويتأخر في الاختبارات الأكثر أهمية، وهي SWE-Bench Pro و TerminalBench و Humanity's Last Exam. عبارة "مقارن بـ Fable 5" تعني تكافؤاً انتقائياً في عدد قليل من الاختبارات المعيارية، وليس تكافؤاً شاملاً، وهي نتائج مُبلغ عنها من قبل المزود بدلاً من التحقق منها بشكل مستقل. تعامل مع العنوان الرئيسي على أنه تسويق، ومع الجدول على أنه الواقع.
أين يخفق Sakana Fugu: أنماط الفشل التي أبلغ عنها المستخدمون
كانت ردود الفعل العملية المبكرة متشككة في الغالب، وتتركز حول ثلاث قضايا: السرعة، والتكلفة، ومسألة ما إذا كان التنسيق يضيف قيمة كافية لتبرير هذه الطبقة. على Hacker News:
"مقابل $200/شهر تحصل على أقل من 3 ساعات من الاستخدام في الأسبوع، وواجهة برمجة التطبيقات بطيئة للغاية، وجودة المخرجات في اختباراتي لا تقترب بأي حال من Fable." (cortesi، Hacker News، يونيو 2026)
الانتقاد الهيكلي الأكثر شيوعاً هو أن Fugu عبارة عن موجه مدفوع فوق نماذج تدفع مقابلها بالفعل، مما قد يعني الدفع لثلاثة مزودين بالإضافة إلى Sakana لتنسيقها. لخص أحد المراجعين المزاج العام بصراحة:
"حتى يثبت العكس، هذا مجرد موجه أو غلاف متقدم للغاية، وليس قفزة جوهرية في الذكاء كما كان الحال مع Mythos أو Fable." (GreedyWorking1499، Reddit، يونيو 2026)
هناك محذوران آخران يستحقان التفكير. إن طرح الاستقلالية عن الموردين أجوف جزئياً، لأن Fugu لا يزال يوجه عبر نماذج رائدة خاضعة للسيطرة الأمريكية (Opus و GPT و Gemini)، لذا فهو يقلل من الاعتماد على مورد واحد بدلاً من القضاء على التعرض الجيوسياسي. كما أن Sakana تحمل سحابة من الشكوك حول مصداقيتها: فقد ادعى "AI CUDA Engineer" الخاص بها في عام 2025 تحقيق تسريعات كبيرة في النواة والتي تم تتبعها بسرعة إلى ثغرة في بيئة التقييم المعزولة، ولهذا السبب ترغب أجزاء من المجتمع في التحقق المستقل قبل الوثوق بالأرقام الرئيسية لـ Fugu. أضف إلى ذلك عدم التوفر في الاتحاد الأوروبي وبطء واجهة برمجة التطبيقات، وهذا يجعل منه إطلاقاً يجب تقييمه بعناية، وليس اعتماده بثقة عمياء.
Sakana Fugu مقابل نموذج ريادي منفرد
أوضح طريقة للتفكير في Fugu هي أنه نظام لتحديد كيفية استخدام خيارات النماذج المتعددة، بينما تُعد Claude (Opus و Fable) و ChatGPT (GPT-5.5) و Google Gemini خيارات نماذج فردية بهوية واضحة. هذا الاختلاف سلاح ذو حدين. يمكن للتوجيه أن يرفع النتائج في العمل المعقد متعدد الخطوات حيث تتمتع النماذج المختلفة بنقاط قوة مختلفة، ويمنحك نقطة نهاية واحدة للحفاظ عليها بدلاً من ثلاثة تكاملات. ولكنه يضيف أيضاً زمن انتقال، ويضيف طبقة من التكلفة، ويقلل من الرؤية حول النموذج الذي أنتج مخرجاتك بالفعل، وهو أمر مهم لقابلية إعادة الإنتاج وتصحيح الأخطاء والامتثال.
لذا فإن Fugu ليس بديلاً مطابقاً لـ Fable 5. إذا كنت بحاجة إلى نموذج متميز ومعروف بهوية مستقرة وأفضل درجة في أصعب الاختبارات المعيارية للبرمجة الوكيلة، فإن النموذج الريادي المنفرد لا يزال هو الفائز. إذا كنت تريد وصولاً مستقلاً عن المزود وكنت على استعداد للتخلي عن بعض التحكم والسرعة مقابل ذلك، فإن Fugu هو الخيار الأكثر إثارة للاهتمام. كلاهما يحلان مشاكل مختلفة، على الرغم من إطار الاختبارات المعيارية الذي يضعهما وجهاً لوجه.
أسعار Sakana Fugu
يتم الوصول من خلال الاشتراكات أو الرموز المميزة بنظام الدفع حسب الاستخدام. الاشتراكات هي Standard بسعر $20 شهرياً، و Pro بسعر $100 شهرياً (حوالي عشرة أضعاف مخصصات Standard)، و Max بسعر $200 شهرياً (حوالي ثلاثين ضعف Standard). يبلغ سعر الدفع حسب الاستخدام لـ Fugu Ultra $5 لكل مليون رمز إدخال و $30 لكل مليون رمز إخراج، ويرتفع إلى $10 و $45 للسياق الذي يزيد عن 272K، مع إدخال مخزن مؤقتاً بسعر $0.50 لكل مليون. تقدم Sakana شهراً ثانياً مجانياً للاشتراكات التي تبدأ قبل 31 يوليو 2026. لاحظ أن تكاليف الرموز تعكس النفقات العامة للتنسيق، نظراً لأن طلباً واحداً يمكن أن يتفرع عبر العديد من النماذج الأساسية، لذا يمكن أن يكون الإنفاق في العالم الحقيقي أعلى مما يشير إليه السعر المعلن في المهام متعددة الخطوات.
من يجب عليه استخدام Sakana Fugu، ومن يجب عليه الانتظار
يستحق Fugu نظرة جادة إذا كنت مطوراً أو فريق منصة يريد واجهة برمجة تطبيقات واحدة مستقلة عن المزود عبر النماذج الرائدة، أو مؤسسة قلقة بشأن تقييد الموردين أو التعرض لضوابط التصدير بعد قيود 12 يونيو، أو فريقاً يقوم بعمل برمجي وبحثي معقد متعدد الخطوات حيث يمكن أن يساعد التوجيه عبر المتخصصين. تجعل نقطة النهاية المتوافقة مع OpenAI التجربة سهلة إذا كنت تبني بالفعل على تلك الواجهة.
انتظر أو ابحث في مكان آخر إذا كنت بحاجة إلى نموذج منفرد مُثبت بهوية مستقرة وأعلى الدرجات في الاختبارات المعيارية للبرمجة الوكيلة، حيث لا يزال Fable 5 أو Opus 4.8 في الصدارة، أو إذا كنت حساساً للتكلفة أو زمن الانتقال، أو إذا كنت في الاتحاد الأوروبي حيث لم يتوفر بعد، أو إذا كنت تريد تفكيراً ريادياً تم التحقق منه بشكل مستقل بدلاً من الادعاءات المُبلغ عنها من قبل المزود من منتج جديد تماماً. يُعد Fugu أحد أكثر الإطلاقات ابتكاراً حقاً في منتصف عام 2026، ولكنه أيضاً غير مُثبت في الميدان، والخطوة الذكية اليوم هي اختباره على عبء العمل الخاص بك بدلاً من الوثوق بالعنوان الرئيسي لـ Fable 5.
تقييمات المستخدمين
لا توجد تقييمات بعد. كن أول من يشارك تجربته!
سجّل الدخول لكتابة تقييم.
مقالات ذات صلة
أدلة ومقالات ذات صلة بـ Sakana Fugu.

Grok 4.3 API for Agents (May 2026): Pricing, Benchmarks, Migration

The Personal AI Productivity Stack (2026): One Tool Per Job, Nothing Extra

DeepSeek V4 Pro vs Claude Opus 4.7: 5-PR Refactor Test (2026)

What People Are Building With Claude Fable 5 (And Which Viral Demos Are Fake)

Claude Code vs Cursor vs Codex vs Devin vs Replit Agent 3: 2026 Scorecard
