OpenAI חושפת את מודל GPT 5.2: הנה מה שצריך לדעת עליו

OpenAI חשפה את GPT-5.2, סדרת המודלים המתקדמת ביותר שלה עד כה, אשר נועדה לייעל באופן דרמטי עבודת ידע מקצועית. בפעם הראשונה, מודל בינה מלאכותית מצליח לעקוף מומחים אנושיים בביצוע משימות מורכבות, כולל בניית מצגות וכתיבת קוד, תוך שהוא פועל במהירות ובעלות נמוכה באופן קיצוני.
OpenAI חושפת את מודל GPT 5.2 הנה מה שצריך לדעת עליו

עבור רבים מאיתנו, הכלים מבוססי הבינה המלאכותית הפכו מזמן לחלק בלתי נפרד משגרת העבודה. תראו, משתמש ממוצע בגרסת הארגונית של ChatGPT כבר מדווח שהוא חוסך בין 40 ל-60 דקות ביום, ואנשים שמסתמכים עליה בצורה כבדה מספרים על חיסכון של למעלה מ-10 שעות בשבוע. עכשיו, עם ההשקה של GPT-5.2, חברת OpenAI מצהירה כי הכלי נועד "לפתוח ערך כלכלי" גדול עוד יותר עבור המשתמשים.

חשוב להבין שזה לא רק שדרוג קטן.

המודל החדש עבר שיפורים מהותיים כמעט בכל תחום מקצועי וטכני. המפתחים מסבירים שהוא הרבה יותר טוב ביצירת מצגות מורכבות, בניית גיליונות נתונים (ספרדשיטים) מקצועיים, כתיבת קוד, הבנת תמונות וגרפים, וניהול פרויקטים מרובי-שלבים. במילים אחרות, הוא מעוצב כדי לשמש כ"סוכן" שיכול לבצע רצף של משימות מורכבות מתחילתן ועד סופן, בלי שצריך להכניס לו הוראות מפורטות בכל שלב.

הבדיקות הפנימיות של OpenAI מראות כי GPT-5.2 משיג שיאים חדשים בשלל מדדי ביצוע, אך הנתון שבאמת מקפיץ את העין הוא זה שקשור לביצועים המקצועיים שלו.

עוקף את האנושי: כך ה-AI מנצח את המקצוענים

ההצהרה הדרמטית ביותר של OpenAI נוגעת למבחן שנקרא GDPval. המבחן הזה בודק את יכולת המודל לבצע משימות עבודת ידע מוגדרות היטב, כאלה שקיימות ב-44 מקצועות שונים התורמים לתוצר הלאומי הגולמי של ארה"ב (GDP). מדובר במשימות הדורשות תוצרים אמיתיים, כמו מצגות מכירה, גיליונות נתונים חשבונאיים, או תרשימי ייצור.

התוצאות הן לא פחות ממדהימות: GPT-5.2 Thinking (אחת מגרסאות המודל) מנצח או משווה את ביצועיו למומחים אנושיים מובילים בתעשייה ב-70.9% מהמקרים. לשם השוואה, הגרסה הקודמת (GPT-5) עמדה על 38.8% בלבד. זה הופך את GPT-5.2 למודל הראשון שהשיג ביצועים ברמה של מומחה אנושי או גבוהה ממנה במדד מקצועי רחב היקף כזה.

אגב, לצד הדיוק, היתרון הכלכלי הוא עצום. על פי נתוני החברה, GPT-5.2 מייצר תוצרים עבור אותן משימות מקצועיות במהירות גבוהה פי 11 ובעלות שהיא פחות מאחוז אחד מעלותם של אנשי המקצוע האנושיים. חשוב להדגיש כי המסקנה המיידית היא שכאשר המודל הזה משולב בפיקוח אנושי, הוא יכול להאיץ דרמטית את קצב העבודה. אחד השופטים שבדק את התוצרים במבחן GDPval אפילו ציין: "זו קפיצה מרגשת ובולטת באיכות התוצר… זה נראה כאילו נעשה על ידי חברה מקצועית עם צוות".

גם בתחום כתיבת הקוד, המודל החדש עולה לראש הטבלה, ומשיג שיפורים משמעותיים בפתרון משימות הנדסת תוכנה מורכבות. המפתחים ימצאו שהוא אמין יותר באיתור באגים בקוד ייצור, יישום בקשות לתכונות חדשות וארגון מחדש של בסיסי קוד גדולים. הבונוס הוא שהוא חזק במיוחד בפיתוח "קצה קדמי" (Front-end), ואף יכול ליצור סימולציות מורכבות של גלי ים או כרטיסי ברכה לחג מונפשים, והכול מפרומפט אחד בלבד.

הדיוק הלא ייאמן: פחות טעויות וזיכרון ארוך במיוחד

בואו נודה על האמת, אחת הבעיות הגדולות ביותר עם מודלי בינה מלאכותית עד היום הייתה ה"הזיות", אותן טעויות ודברים שהמודל ממציא. החדשות הטובות הן שגם כאן נרשמה קפיצת מדרגה. GPT-5.2 מדווח על 30% פחות טעויות בהשוואה לקודמו (GPT-5.1) במערך שאילתות משתמשים. עבור אנשי מקצוע, זה אומר פחות בדיקות חוזרות כשהם משתמשים במודל למחקר, ניתוח או תמיכה בהחלטות. הוא פשוט הופך להיות כלי אמין יותר לעבודת ידע יומיומית.

המודל גם קובע שיא חדש ביכולת להבין הקשר ארוך. הוא יכול לקרוא ולנתח מסמכים ארוכים מאוד, עד 256 אלף טוקנים (יחידות מידע), כמעט ללא שגיאות. משמעות הדבר היא שסוף סוף יש כלי שיכול להתמודד עם ניתוח מעמיק של דו"חות, חוזים משפטיים, מאמרים מדעיים ופרויקטים מרובי-קבצים, והוא שומר על קוהרנטיות ודיוק לאורך מאות אלפי מילים.

מעבר לכך, גם יכולות הראייה של המודל השתפרו דרמטית. הוא חותך את שיעורי השגיאה בחצי בניתוח תרשימים והבנת ממשקי משתמש של תוכנות. GPT-5.2 יכול לפרש בצורה מדויקת יותר צילומי מסך, דיאגרמות טכניות ודוחות חזותיים. הוא אפילו מבין טוב יותר את המיקום היחסי של אלמנטים בתוך תמונה.

לדוגמה, כאשר נדרש לפתור בעיית שירות לקוחות מורכבת הכוללת מספר שלבים (כמו נוסע שמדווח על עיכוב בטיסה, פספוס טיסת המשך, אובדן מזוודה, וצורך במושב מיוחד מסיבות רפואיות), GPT-5.2 יכול לנהל את כל שרשרת המשימות, שינוי כרטיס, סידור מושב מיוחד ופיצוי, ולספק פתרון שלם בהרבה מהדורות הקודמים. מנכ"ל חברת טריפל ווייל אף אמר כי המודל "מזכיר קסם טהור".

האם אנחנו עדים לשינוי של פעם בדור?

תראו, מה שאנחנו רואים כאן הוא לא רק "מודל חדש". מדובר בקפיצת מדרגה ב"אינטליגנציה כללית", כפי ש-OpenAI עצמה מגדירה זאת. כשאנשי מקצוע כמו מנכ"ל טריפל ווייל מדווחים שהם קיפלו מערכת מסועפת של סוכנים (Agtens) מרובים לתוך "סוכן-על" (Mega-Agent) יחיד, זה מעיד על שינוי ארכיטקטוני שלם באופן שבו עסקים מתחילים להשתמש בבינה מלאכותית. זה כבר לא רק כלי כתיבה או סיכום פשוט.

אבל חשוב לזכור, המודל, למרות כוחו, עדיין אינו מושלם. "כמו כל המודלים, GPT-5.2 Thinking אינו מושלם. לכל דבר קריטי, בדקו את התשובות שלו שוב", כותבים ב-OpenAI. זו בדיוק התובנה הנדרשת כרגע: ה-AI מפסיק להיות רק "צעצוע" טכנולוגי והופך למנוע כלכלי עצום, שיכול לחסוך שעות עבודה רבות ולעלות על ביצועי האדם במשימות מוגדרות. התפקיד שלנו משתנה, ועובר מביצוע יומיומי של משימות ידע, לפיקוח ובדיקה של התפוקה המדהימה שהמנוע הזה יכול לייצר.