בימים האחרונים שחררו שלוש החברות הגדולות בעולם הבינה המלאכותית עדכונים כמעט במקביל. OpenAI הוציאה מודל עוצמתי ומופלא במיוחד, אנתרופיק איחדה את הזיכרון של קלוד, וגוגל שדרגה את מודל הווידיאו שלה ב-Flow. בכתבה הזו נעבור על שלושת העדכונים, נסביר איך משתמשים בהם בפועל, ונבין מה כל זה אומר לגבינו.
OpenAI משחררת את המודל החזק ביותר שלה ומכריזה על צעד משמעותי לעבר עידן ה-AGI
גולת הכותרת של העדכונים היא ההשקה של GPT 6 שציפינו לה זמן רב, ונחשבת לתמודל החזק ביותר של OpenAI. ההשקה לוותה בכינוי Astra, שאומר “כוכבים”. המשמעות במקרה הזה היא לא מקרית, מכיוון שלפי OpenAI, מדובר במודל עם יכולות פורצות דרך שעשויות להוביל אל עבר פתחו של עידן ה-AGI. ההשקה קודמה באמצעות סרטון מרשים שהציג את יכולותיו המופלאות של המודל החדש באפליקציית הדקסטופ.
מה זה אומר בפועל? אפשר להוציא איתו לפועל פרויקטים מרהיבים ומטורפים. כך למשל, אנחנו יכולים ליצור משחק תלת מימד מרשים במקביל לביצוע המטלות היומיומיות שלנו ברשת באמצעות פקודות קוליות שנותנים למודל: החל מציור ראשוני של רכיבי המשחק, דרך עיצוב המשחק ושליחתו לרשת, ועד לייצור דגמי פיזיים של הרכיבים הניתנים להדפסה.
המודל הזה משוחרר בהדרגה, ובשלב הראשון הוא יופץ למנויים המשלמים כבר בתחילת שבוע הבא. מן הסתם נוכל כולנו ליהנות מהיתרונות של GPT 6 בקרוב מאוד.

קלוד זוכר עכשיו הכל, בכל מקום – ואתם מחליטים מה נשאר
אנתרופיק, החברה שמפתחת את קלוד, איחדה השבוע את הזיכרון של הצ’אט הרגיל עם הזיכרון של Claude Cowork. המשמעות: כל מה שקלוד לומד עלינו בשיחה רגילה עובר איתנו גם כשאנחנו נותנים ל-Cowork משימה לבצע, ולהפך. שינוי חשוב לא פחות: הזיכרון מתעדכן תוך כדי השיחה עצמה, ולא רק מסכם אותה בסופה. אם סיפרנו לקלוד שדדליין של פרויקט זז לספטמבר, הוא כבר יזכור את זה בשיחה הבאה, בלי שנצטרך להזכיר לו שוב.
השליטה, כרגיל, נשארת אצלנו: תחת Settings > Memory – אפשר לראות בדיוק מה קלוד זוכר, לפי נושאים, לערוך או למחוק כל פריט, ואפילו לעצור את הזיכרון או לאפס אותו לגמרי. העדכון פעיל כברירת מחדל למשתמשי Free, Pro ו-Max באתר, במחשב ובנייד (כדאי לוודא שהאפליקציה מעודכנת לגרסה האחרונה).
גוגל משדרגת את עורך הווידיאו שלה ליכולות של סטודיו קולנוע
גוגל הציגה את Omni 1.1 Flash, הגרסה המשודרגת של מודל יצירת ועריכת הווידיאו שפועל בתוך Google Flow, כלי יצירת הוידיאו שלה. השדרוג מוסיף כמה יכולות שהופכות את יצירת הסרטונים לפרקטית הרבה יותר, גם למי שלא עורך וידאו כמקצוע.
אפשר עכשיו לקבוע לא רק איך הסרטון נפתח אלא גם איך הוא מסתיים (בגרסת הדסקטופ), כך שדמויות ועלילה נשארות עקביות משוט לשוט. גם הרחבת סצנות השתפרה: המודל בוחן עכשיו עד עשר שניות מהסרטון הקיים במקום רק את השנייה האחרונה, כך שההמשך נראה טבעי יותר, וסך הכל אפשר להאריך סרטון עד 40 שניות בקפיצות של עשר שניות. למי שרוצה רק לנסות רעיון במהירות, יש עכשיו אפשרות ליצור טיוטות באיכות 360p שנוצרות מהר יותר בכ-60% ועולות שליש מהמחיר של יצירה רגילה.
היכולות החדשות זמינות למי שמחובר ל-Google Flow דרך flow.google או דרך האפליקציה לנייד (כרגע ב-Android), במסגרת המנויים בתשלום של Gemini.
אז מה בעצם משותף לכל זה?
בשלושת העדכונים האלו רואים את אותה תזוזה: הבינה המלאכותית מפסיקה להיות רק כלי שעונה לנו על שאלות, והופכת לגורם שפועל בשמנו, זוכר אותנו לאורך זמן, ויוצר עבורנו תוצרים מוגמרים בזמן קצר.
