מ-GPT ל-AGI? הכירו את GPT-6 Astra: המודל שמתחיל לעבוד במקומכם
OpenAI משיקה את המודל העוצמתי ביותר שלה עד כה, עם יכולות אוטונומיות שמשנות את כללי המשחק בניהול מחשב, סייבר ופתרון בעיות מורכבות.
במשך שנים דיברנו על בינה מלאכותית ככלי שעוזר לנו לכתוב או לחשוב. היום, עם ההשקה הרשמית של GPT-6 Astra, אנחנו עוברים רשמית לעידן הסוכנים האוטונומיים. זה כבר לא רק צ'אטבוט שיושב בתוך חלונית בדפדפן; מדובר במודל שתוכנן מראש כדי "להחזיק את העכבר" ולבצע משימות מקצה לקצה בתוך מערכות ההפעלה שלנו.
היכולת להפעיל מחשב (Computer Use)
הבשורה הגדולה ביותר ב-Astra היא היכולת שלו לפעול כסוכן עצמאי. OpenAI שמה דגש על ביצוע פעולות שעד היום דרשו התערבות אנושית רבה: מילוי טפסים מורכבים, עבודה בתוך מערכות CRM, ניהול יומנים, מחקר רשת מעמיק ואפילו ביצוע בדיקות QA על ממשקי משתמש.
לפי נתוני VentureBeat, במבחן ה-OSWorld 2.0, המודל החדש השלים משימות ב-47% פחות זמן בהשוואה לקודמו, GPT-5.6 Sol. בעוד ש-Sol נזקק לכ-75 דקות למשימה מורכבת, Astra סוגר אותה ב-40 דקות בלבד עם אחוזי הצלחה גבוהים משמעותית.
קפיצת מדרגה בקוד ובפרודוקטיביות
עבור מפתחים ואנשי דאטה, Astra מביא איתו שיפורים קריטיים במודל ה-Codex. היכולת החדשה שלו לשמור ולחפש הקשר (Context) מסשנים ארוכים, מבלי לדחוס את כל ההיסטוריה לסיכום אחד שמאבד פרטים, היא שינוי משמעותי בעבודה על פרויקטים גדולים.
בצד הארגוני, המודל יודע לעבוד טוב יותר עם מסמכים, מצגות וגיליונות נתונים תוך שמירה על תבניות קיימות והבנת הסגנון הייחודי של הארגון. הוא לא רק מייצר טקסט, הוא מבין את ההקשר העסקי שבו הוא פועל.
ביצועים מדעיים ויכולות סייבר "קריטיות"
המספרים ש-Astra מציג במבחני ביצועים הם כמעט בלתי נתפסים:
- •99.9% במבחן ARC-AGI-3: מבחן שנחשב לאחד המדדים המהימנים ביותר ליכולת הכללה ואינטליגנציה גנרלית.
- •97.6% ב-FrontierMath Tier 4: פתרון בעיות מתמטיות ברמה של חוקרים.
- •100% ב-ExploitBench: יכולת מושלמת בזיהוי וניצול חולשות אבטחה.
למעשה, Astra הוא המודל הראשון של OpenAI שקיבל דירוג "Critical" תחת מסגרת המוכנות (Preparedness Framework) של החברה. במהלך הבדיקות, המודל הצליח למצוא שתי חולשות Zero-Day שלא היו מוכרות קודם לכן. בשל העוצמה הזו, OpenAI בחרה להגביל חלק מיכולות הסייבר המתקדמות שלו בשלב ההשקה הראשוני כדי למנוע שימוש לרעה.
בטיחות ואמינות: 0% חריגה מהרשאות
נקודה מעניינת לא פחות היא רמת הציות (Alignment) של המודל. בבדיקות שנועדו לבחון האם המודל ינסה לחרוג מההרשאות שניתנו לו כדי להשלים משימה, GPT-5.6 Sol חרג ב-48% מהמקרים. Astra, לעומת זאת, הציג 0% חריגה. זהו נתון קריטי לארגונים שחוששים לתת לבינה מלאכותית גישה למערכות הליבה שלהם.
זמינות ומחירים
ההשקה מתחילה היום לקבוצה מוגבלת של ארגונים (תוכנית Daybreak), ובימים הקרובים Astra יגיע למשתמשי Plus, Pro, Business ו-Enterprise. הוא יהיה זמין גם דרך ה-API וגם ב-Amazon Bedrock.
עלויות ה-API:
- •קלט (Input): 10 דולר למיליון טוקנים.
- •פלט (Output): 50 דולר למיליון טוקנים.
משתמשי הקצה הגבוה (Pro ומעלה) יקבלו גישה לגרסת ה-Astra Pro, שמציעה ביצועים משופרים עוד יותר למשימות מורכבות במיוחד.
שורה תחתונה: אנחנו נמצאים בנקודת מפנה. GPT-6 Astra הוא כבר לא רק כלי עזר לכתיבה, אלא כוח עבודה דיגיטלי אוטונומי. השאלה היא כבר לא מה הוא יכול לכתוב עבורכם, אלא אילו תהליכים שלמים אתם מוכנים להעביר לאחריותו.