חזרה לכתבות

FLUX 3: מודל העולם שמשנה את פסי הייצור של אאודי

23 ביולי 202684

FLUX 3: מודל העולם שיוצא מהמסך אל רצפת הייצור של אאודי

הוא כבר מזמן לא רק מחולל תמונות מרשים. הדור החדש של Black Forest Labs משלב וידאו, סאונד וחיזוי פעולות פיזיות כדי להבין איך העולם באמת עובד. ברוכים הבאים לעידן ה-Visual Intelligence.

כשמדברים על בינה מלאכותית יוצרת (Generative AI), אנחנו רגילים לחשוב על פרומפטים שמתורגמים לפיקסלים יפים על מסך. אבל ההכרזה האחרונה של Black Forest Labs על FLUX 3 משנה את חוקי המשחק. החברה, שהוקמה על ידי המוחות שמאחורי Stable Diffusion, החליטה שהגיע הזמן להפסיק "לצייר" את העולם ולהתחיל להבין אותו.

FLUX 3 הוא לא סתם עוד גרסה משופרת. הוא מוגדר כ"מודל עולם" (World Model) – מערכת שאומנה באופן מולטי-מודאלי על וידאו, סאונד ותמונות בו-זמנית. התוצאה? מודל שלא רק יודע איך נראה כיסא, אלא מבין את הפיזיקה שלו: איך הוא נשמע כשגוררים אותו, איך הוא מתנהג כשאובייקט אחר מתנגש בו, ואיך אור טבעי אמור להשתקף עליו מזוויות שונות.

ממעבדה למפעל: המהפכה של mimic ו-Audi

היישום המרתק ביותר של FLUX 3 לא קורה בסטודיו לעיצוב, אלא על רצפת הייצור. חברת הרובוטיקה mimic כבר הטמיעה את המודל החדש (תחת השם FLUX-mimic) במפעלי הרכב של אאודי.

עד היום, אימון רובוט לביצוע פעולה מורכבת – כמו הרכבת חלקים גמישים או טיפול ברכיבים שמשנים את צורתם – דרש עשרות שעות של איסוף דאטה ידני וסימולציות מפרכות. עם FLUX 3, הסיפור אחר לגמרי:

  • חיסכון בזמן: המודל זקוק לחצי שעה של וידאו בלבד כדי ללמוד תנועה חדשה, במקום 30 שעות ומעלה בשיטות הישנות.
  • הבנת חומרים: בזכות האימון על וידאו, הרובוט מבין אינטואיטיבית איך חומרים מתכופפים וזזים במרחב.
  • דיוק פנומנלי: היכולת לחזות את ה"פריים הבא" הופכת לפקודות תנועה מדויקות עבור הזרוע הרובוטית.

הריאליזם החדש בכלי העבודה שלכם

אל דאגה, המהפכה הזו מגיעה גם למעצבים ולמפתחים. FLUX 3 ממשיך להשתלב עמוק בתוך אקו-סיסטם של כלים מוכרים כמו Adobe Photoshop ו-Picsart.

בניגוד למודלים קודמים שלעיתים יצרו תחושה "פלסטיקית" או חוסר עקביות בתאורה, FLUX 3 מביא רמת ריאליזם שנובעת מהבנה עמוקה של טקסטורות וחומרים. כשאתם מבקשים ממנו ליצור השתקפות של מים על בד, הוא לא רק מעתיק דפוסים של פיקסלים – הוא מחשב איך המים אמורים להיספג ולהחזיר אור בהתבסס על המודל הפיזיקלי שהוא למד.

למה זה חשוב לנו?

המעבר ממודלים של שפה (LLMs) ומודלים של תמונות למערכות של "Visual Intelligence" הוא נקודת המפנה. אנחנו נעים לעבר עולם שבו AI לא רק כותב לנו קוד או מייצר מצגות, אלא מסוגל לפעול בתוך המציאות הפיזית.

עבור מפתחי No-Code ו-Low-Code, זהו פתח לעידן חדש של אוטומציה. היכולת להגדיר פעולות רובוטיות או תהליכי ייצור מורכבים באמצעות הדגמה ויזואלית פשוטה, מבלי לכתוב שורת קוד אחת של קינמטיקה, היא לא פחות ממהפכה.

בשורה התחתונה: FLUX 3 מוכיח שתמונות היו רק מגרש האימונים. המטרה האמיתית היא להעניק למערכות AI את היכולת להבין את העולם הפיזי כדי שהן יוכלו להתחיל לפעול בתוכו, לייצר עבורנו ולפתור בעיות מורכבות במציאות – ולא רק על המסך.

רוצים להישאר מעודכנים בכל מה שחם ב-AI ובאוטומציה? לעדיכונים בטלגרם | עקבו בוואטסאפ | Instagram

תודה לערוץ Spotlight by Daniel Trabelsi של דניאל טרבלסי על השיתוף ועל ההשראה לכתבה הזו.

הצטרפו לערוץ
#בינה מלאכותית#FLUX 3#אאודי#רובוטיקה#Black Forest Labs#מודל עולם#למידת מכונה