חזרה לכתבות

המהפכה של מיקרוסופט: המודלים החדשים שמשנים את חוקי ה-AI

24 ביולי 2026292

המהפכה של מיקרוסופט: המודלים החדשים שמוציאים את OpenAI מהתמונה

במשך זמן רב מיקרוסופט נתפסה כ"שותפה הבכירה" של OpenAI, אבל המהלכים האחרונים שלה מבהירים שהיא לא מתכוונת להישען על גב של אף אחד אחר. עם ההשקה של שני מודלים חדשים ממשפחת MAI, ענקית התוכנה מסמנת טריטוריה חדשה: ביצועי קצה בייצור תמונות וקול, לצד חיסכון אדיר בעלויות.

אם עד לא מזמן כשדיברנו על מחוללי תמונות בתוך המוצרים של מיקרוסופט (כמו Bing Image Creator) הנחנו שמדובר ב-DALL-E של OpenAI, הרי שהמציאות השתנתה. מיקרוסופט עוברת למודלים ביתיים (In-house) שמאפשרים לה שליטה מלאה על התוצאה, המהירות ובעיקר על הכיס.

MAI-Image-2.5 Pro: כשפוטו-ריאליזם פוגש עקביות

האתגר הכי גדול של מודלי תמונות עד היום היה עקביות. ניסיתם פעם לייצר דמות ולשים אותה בכמה סצנות שונות? בדרך כלל תקבלו תוצאות דומות, אבל לא זהות. מודל ה-MAI-Image-2.5 Pro החדש מגיע לפתור בדיוק את זה.

הוא מציע רמה חדשה של פוטו-ריאליזם, אבל הבשורה האמיתית היא ה-"Character Lock" – היכולת לשמור על זהות של דמות או מוצר לאורך סדרה של תמונות או עריכות. מעבר לזה, המודל פותר את אחת הבעיות המביכות ביותר בתחום: כתיבת טקסט בתוך תמונה. במקום אותיות מעוותות וג'יבריש, המודל יודע לרנדר טקסט קריא ומדויק בפוסטרים, מיתוג וגרפיקה.

לפי הנתונים שמיקרוסופט פרסמה, המעבר למודל הזה בתוך PowerPoint ו-OneDrive הוביל לחיסכון של עד 84% בעלויות ה-GPU לעומת המודלים הקודמים של OpenAI. זה נתון שמשנה לחלוטין את הכדאיות הכלכלית של הטמעת AI בארגונים גדולים.

MAI-Voice-2 Flash: סוף לעידן הדיבור הרובוטי המגמגם

בתחום הקול, הבעיה הכי גדולה היא לא האיכות, אלא ה-"Latency" (השיהוי). כשאתם מדברים עם סוכן AI והוא לוקח שתי שניות לעבד את התשובה לפני שהוא מתחיל לדבר, החוויה מרגישה שבורה ולא טבעית.

מודל ה-MAI-Voice-2 Flash תוכנן במיוחד כדי להיות מהיר בטירוף. הוא מוריד את זמן התגובה למינימום (חצי מהזמן של המודלים הקודמים), מה שמאפשר שיחה שזורמת כמעט כמו עם בן אדם.

למה זה קריטי?

  • מוקדי שירות לקוחות: חברות כמו T-Mobile ו-EasyJet כבר מטמיעות את המודל במוקדים שלהן כדי לנהל שיחות בזמן אמת בלי שיהוקים.
  • סוכנים אישיים: עוזרות חכמות הופכות להיות פרטנר לשיחה, לא רק מכונה שמחכה לפקודות.
  • חיסכון: המודל זול ב-32% מהגרסאות הקודמות, מה שמאפשר להריץ אותו בקנה מידה עצום בלי לפשוט רגל.

השורה התחתונה: שליטה מלאה ב-Stack

השחרור של הדגמים האלו הוא חלק מאסטרטגיה רחבה יותר שנקראת Microsoft Foundry. מיקרוסופט רוצה שכל ה-Stack הטכנולוגי שלה – מהענן (Azure) ועד המודלים עצמם – יהיה בבעלותה.

עבורנו, המשתמשים והמפתחים, זה אומר כלי עבודה חזקים יותר, זמינים יותר וזולים יותר. המודלים זמינים כעת ב-Public Preview דרך קטלוג המודלים של Azure, וניתן להתחיל להטמיע אותם כבר היום בפתרונות No-code או בפיתוח ישיר.

למידע נוסף וגישה למודלים, כדאי לבקר ב-אתר הרשמי של Microsoft AI או לבדוק את התיעוד ב-Azure AI Foundry.

מה אתם אומרים? האם העקביות של התמונות היא מה שיגרום לכם לעבור ל-Bing, או שהמהירות של הקול היא ה-Game Changer האמיתי?

תודה לערוץ Spotlight by Daniel Trabelsi של דניאל טרבלסי על השיתוף ועל ההשראה לכתבה הזו.

הצטרפו לערוץ
#מיקרוסופט#בינה מלאכותית#מודלי שפה#MAI#OpenAI#טכנולוגיה#מחולל תמונות#בינה מלאכותית יוצרת