Sakana Fugu: מתזמר במקום ענק. השקה ב-22 ביוני מיפן.

מחבר: Alex Khohlov

Sakana Fugu: מתזמר במקום ענק. השקה ב-22 ביוני מיפן.-1
Sakana Fugu - השוואה במשימות שונות עם מערכות בינה מלאכותית מובילות

ב-22 ביוני 2026 פתחה המעבדה מטוקיו Sakana AI גישה ציבורית ל-Fugu ולגרסתו הבכירה Fugu Ultra. אין מדובר בעוד מודל שפה גדול, אלא במתזמר: מודל מאומן המקבל שאילתה לנקודת קצה (endpoint) אחת התואמת ל-OpenAI, ואז מחליט בעצמו — האם להתמודד לבד או להרכיב צוות של מודלי frontier חיצוניים (GPT-5.5, Claude, Gemini ואחרים, עד כדי קריאה רקורסיבית לעצמו). חלוקת התפקידים, בדיקת תוצאות הביניים והרכבת התשובה הסופית מתבצעות בפנים, מבלי להגיע לקוד המשתמש.

הקונספט לא נולד בחלל ריק. המחצית הראשונה של 2026 חשפה את השבריריות שבהסתמכות על ספק יחיד: ב-12 ביוני, תחת צו ייצוא אמריקאי, חסמה Anthropic את הגישה הציבורית למודלים החזקים ביותר שלה — Claude Fable 5 ו-Mythos. עבור חברות ומדינות שהטמיעו API זר בתשתית קריטית, החלטה כזו של "לילה אחד" אינה עוד סיכון היפותטי. המענה של Sakana הוא פרגמטי: לא לרדוף אחר מספר הפרמטרים, אלא ללמוד להרכיב את הצוות הטוב ביותר ממה שכבר קיים ולעקוף חוליות חסרות. מאגר המודלים הוא בר-החלפה, ולכן במקרה של חוסר זמינות של Fable או Mythos, המערכת פשוט מנתבת את הבקשה סביבם.

בבסיס עומדות שתי עבודות שהתקבלו ל-ICLR 2026. TRINITY מתאר מתאם (coordinator) מפותח המחלק תפקידי Thinker, Worker ו-Verifier ובונה אינטראקציה רב-שלבית (arXiv:2512.04695). Conductor הוא מודל שאומן באמצעות למידת חיזוק (reinforcement learning) לייצר תוכניות תיאום בשפה טבעית (arXiv:2512.04388). במקום תהליכי עבודה (workflow) קשיחים, Fugu לומד את דפוסי שיתוף הפעולה עצמם — ומכאן נובעות הגמישות והיכולת לאמץ מודלים חדשים עם צאתם.

ישנן שתי גרסאות. Fugu שומר על איזון בין איכות לשיהוי — סוס עבודה לקוד, סקירה ובוטים של צ'אט, כולל בתוך Codex; כאן ניתן גם להחריג מודלים או ספקים מסוימים מהמאגר בהתאם לדרישות פרטיות וציות (compliance). Fugu Ultra מיועד למשימות ארוכות ורב-שלביות שבהן מודלים מונוליטיים מאבדים את ההקשר וצוברים שגיאות: שחזור עבודות מדעיות, ניתוח קוד מעמיק, cybersecurity, ומחקרים פטנטיים וספרותיים.

באשר למספרים: Sakana משווה את Fugu לאותם מודלים שהוא עצמו מתזמר, וברוב המסלולים המתזמר עוקף כל אחד מהמשתתפים בנפרד. Fugu Ultra מוביל במבחני הביצועים (benchmarks) העיקריים של כתיבת קוד ובשורה של מבחנים מדעיים, ולפי הצהרת המעבדה הוא משתווה ל-Fable 5 ול-Mythos Preview — וזאת למרות ששניהם אינם נמצאים במאגר, שכן גישה ציבורית אליהם כבר אינה קיימת. כל התוצאות החיצוניות נלקחו מהדוחות של הספקים עצמם, כך שיש להתייחס אליהן כאל נתונים מוצהרים ולא כאל כאלה שנבדקו באופן עצמאי.

התועלת האסטרטגית מורכבת משלושה דברים. פוחתת התלות בספק יחיד: ניתן לשלב מודלים של חברות שונות לפי מחיר, מהירות וציות. נוצרת יתירות מובנית — המערכת עוקפת תקלה או מגבלה חדשה אצל ספק אחד. והחיוב בנוי בצורה הוגנת יותר מאשר במערכות רב-סוכנים קלאסיות: בעבודה של מספר סוכנים, התשלום אינו "מצטבר", אלא מחושב לפי התעריף של המודל היקר ביותר בשרשרת.

הגישה היא דרך API אחיד. המנוי מגיע בשלוש רמות: Standard ב-$20 לחודש, Pro ב-$100 (מכסה פי עשרה יותר) ו-Max ב-$200 (פי עשרים); עד סוף יולי החודש השני ניתן בחינם. לעומסים כבדים קיים מודל pay-as-you-go: Fugu Ultra עולה $5 למיליון טוקנים של קלט ו-$30 לטוקנים של פלט, והמחיר עולה בהקשרים שמעל 272K. הדוח הטכני זמין ב-GitHub של המעבדה, והמוצר והקונסולה בכתובות sakana.ai/fugu ו-console.sakana.ai. הסתייגות חשובה: עם ההשקה השירות אינו זמין באיחוד האירופי ובאזור הכלכלי האירופי — Sakana מציינת כי העבודה על התאמה ל-GDPR טרם הושלמה.

49 צפיות

תגובות

קראו כתבות נוספות בנושא זה:

מצאתם טעות או אי-דיוק?הערותיכם ייבחנו בהקדם האפשרי.