שילוב חסר תקדים: OpenAI חושפת מודלים חדשים o3 ו‑o4‑mini

המודלים החדשים o3 ו‑o4‑mini חושבים עמוק יותר, יודעים להפעיל את כל הכלים של ChatGPT בעצמם ומגיעים בשילוב חסר תקדים של ביצועים, עלות ויעילות אנרגטית. השקה מדורגת התחילה כבר ביום רביעי (16.4.25) למנויי Plus, Pro ו‑Team.
שילוב חסר תקדים OpenAI חושפת מודלים חדשים o3 ו‑o4‑mini

הדור החדש של המודלים

אחרי יותר משנה של ניסויים במודלים מסדרת o‑series, חברת OpenAI מציגה שני כוכבים חדשים: o3 – המודל החזק ביותר שיצא עד כה – ו‑o4‑mini, הגרסה הקומפקטית והזריזה שנועדה לתת הכי הרבה היגיון. שניהם אומנו לחשוב לפני שהם מדברים: במקום תשובות אינסטנט, הם מבצעים שרשראות חשיבה ארוכות, מפורקות ומודרכות־כלים ואז מחברים תשובה אחת מגובשת, לרוב בפחות מדקה.

מה חדש מתחת למכסה המנוע

  • גישה לכל הכלים ב‑ChatGPT – החידוש המשמעותי: המודלים בוחנים בעצמם אם כדאי להפעיל חיפוש‑רשת, להריץ קוד Python, לבצע File‑Search או אפילו ליצור תמונה – ומשלבים את התוצאה במענה הסופי.
  • למידת חיזוק בקנה מידה ענק – החברה הרחיבה באדריכלות RL מסיבית; כל “מחזור מחשבה” מקבל ניקוד, והמנגנון למד לנצל עוד “זמן CPU” כשזה משפר דיוק.
  • חשיבה עם תמונות – o3 ו‑o4‑mini לא רק “רואים” תמונה, אלא משתמשים בה בלולאת החשיבה: יכולים לסובב, להגדיל ולנתח שרטוט תוך כדי פתרון בעיה.

ביצועים במבחנים אקדמיים

מדד o1 o3 o4‑mini
AIME 2025 (אין‑כלים) 74 % 91.6 % 93.4 %
Codeforces (עם טרמינל) 1891 ELO 2706 2719
MMMU (בעיות קולג’ ויזואליות) 77.6 % 82.9 % 81.6 %

במילים פשוטות: o3 קובע שיא חדש כמעט בכל בנצ’מרק, בעוד o4‑mini מציע תוצאה דומה – במחיר וקצב גבייה נמוכים בהרבה, לכן מתאים לביצועים בהיקף גבוה.

שימוש חכם בכלי ChatGPT

המודלים מאומנים “לחשוב כמו מנהל פרוייקט”:

  1. מפרקים את הבקשה למשימות משנה.
  2. בוחרים כלים רלוונטיים: חיפוש, קוד, עיבוד מסמך, יצירת תמונה.
  3. מריצים אותם בסדר אסטרטגי וממזגים את הפלט.

דוגמה שהציגה החברה: תחזית ביקוש אנרגיה בקליפורניה בקיץ 2026. o3 חיפש נתוני רשת ציבוריים, כתב סקריפט Python, יצר גרף ושילב הסבר – הכול בשאילתה אחת.

יעילות ועלות

גרף “עלות‑תועלת” שהוצג בהשקה מראה שמודל o3 עולה פחות ממודל o1 להשגת אותה רמת דיוק, ו‑o4‑mini מזנק צעד נוסף קדימה לעומת o3‑mini. המשמעות למפתחים: חשבוניות API קטנות יותר או פי שניים קריאות באותו תקציב.

בטיחות ובקרת סיכונים

OpenAI בנתה מחדש את מערך הדאטה להתנגדויות, הוסיפה אלפי פריטים בתחומי ביו‑ריסק, יצירת נוזקה וג’יילברייקס ועיבתה מוניטור LLM שמזהה 99 % מהחריגות האנושיות בקמפיין רד‑טים. לפי מסגרת Preparedness, שני המודלים נמצאים מתחת לרמת סיכון “High” בשלושת התחומים: כימיה/ביולוגיה, סייבר, ו‑AI Self‑Improvement.

זמינות ומעבר חלק

  • ChatGPT: החל מהיום מחליפים o3 ו‑o4‑mini את o1 ו‑o3‑mini במבחר המודלים למנויי Plus, Pro ו‑Team.
  • API: זמינים במוקד Chat Completions וגם ב‑Responses API – עם אפשרות לשמור טוקנים סביב קריאות פונקציה.
  • חינם: משתמשי Free יוכלו לטעום את o4‑mini באמצעות הכפתור “Think” בעורך השאילתה.
  • Enterprise ו‑Edu: יקבלו גישה בעוד שבוע.

Codex CLI – סוכן הקוד על המחשב

לצד המודלים משיקה OpenAI כלי קוד פתוח חדש: Codex CLI. זהו סוכן טרמינל מינימלי שמריץ את o3/o4‑mini בלוקאל, מחבר צילומי מסך או שרטוטי סקיצה ישירות לקוד המקומי ומקבל החלטות בנוגע להרצה או שינוי הקבצים. החברה מקצה קרן של מיליון דולר (בקרדיטים API) ל‑25 אלף פרויקטים שישתמשו בכלי.

צפו בהדרכה

מה עוד מצפה לנו?

לדברי OpenAI, הסדרה o מתכנסת עם מודלי GPT הקונברסציוניים: יעד החברה הוא עוזר שיכול לדבר באופן טבעי וגם להחליט עצמאית מתי לגשת לכל כלי, לשאוב מידע עדכני, להריץ תסריטים ולהחזיר תוצאה מאומתת – הכול בשיחה אחת. גרסת o3‑pro עם תמיכה מלאה בכלים צפויה להשתחרר בשבועות הקרובים.