ג׳מיני 4 פרו דלף? המודל הסודי של גוגל עשוי כבר להיות חזק יותר מאסטרה ופייבל 🚨
דיווחים מסין מצביעים על אפשרות מסקרנת: 🤫
מודל אנונימי בשם "ג׳מיני 3.8 פלאש", שהופיע בפלטפורמת ארנה, עשוי להיות למעשה גרסה מוקדמת של מודל הדגל הבא של גוגל דיפמיינד - ג׳מיני 4 פרו. 🔎
והמספרים? אם הם אמיתיים, מדובר בקפיצת מדרגה רצינית. ↗️
המודל קיבל לכאורה: 88% ב-DeepSWE v1.1 - יכולות קידוד ✔️
2,064 אלואו ב-GDPval-AA v2 ✔️
95.3% ב-Terminal-bench 2.1 - עבודה עם מסופים וכלי פיתוח ✔️
86.8% ב-OSWorld-2.0 - ביצוע משימות מורכבות במחשב. ✔️
התוצאות הללו גבוהות משמעותית מהתוצאות שגוגל פרסמה עבור ג׳מיני 3.8 פלאש, שעמדו על 73.7%, 1,545, 89.4% ו-59.0% בהתאמה. 📊
וזה בדיוק מה שהדליק את האינטרנט. 📇
בבדיקות משתמשים, המודל לכאורה הפגין יכולות חזקות במיוחד ביצירת ממשקי משתמש, גרפיקת SVG, תלת-ממד ופיתוח משחקים. ⭐
כלומר, לא רק "לכתוב תשובה טובה יותר", אלא לבצע עבודה אמיתית באמצעות כלים - בדיוק המקום שבו הדור החדש של מודלי הבינה מנסה לפרוץ קדימה. 🧱
ומה שמעניין אפילו יותר יש דיווחים שלפיהם גוגל כבר עובדת על לולאת שיפור עצמי רקורסיבית, RSI, ובמקביל הקדימה את שלב הלמידה המוקדמת של ג׳מיני 4. 🎯
אם זה נכון, המשמעות עשויה להיות הרבה מעבר לעוד שדרוג של מודל.
המירוץ עובר ממודלים שמבינים טקסט למערכות שמסוגלות לתכנן, להשתמש בכלים, לבצע משימות ולשפר את עצמן. 🤖
אם הפערים בנתונים יתבררו כנכונים, גוגל עשויה להיכנס לסיבוב הבא של מלחמת המודלים עם נשק כבד מאוד. 🔫
והכי חשוב - המירוץ ל-AI ממש לא נעצר - הוא פשוט עבר לשלב שבו השאלה היא כבר לא מי יודע יותר, אלא מי יודע לעשות יותר. 🤖
ואנחנו רק מחכים לשמוע על כמה GPU אימנו את המודל החדש... ⚡️