GPT‑4.1: המנוע החדש של OpenAI פורץ גבולות קוד והוראות

הדור הבא של מודלי GPT מציע קפיצה בביצועי קוד, הבנה עמוקה של הוראות וחלון הקשר עצום – במחיר ומהירות משתלמים יותר מתמיד.
GPT‑4.1 המנוע החדש של OpenAI פורץ גבולות קוד והוראות

OpenAI הכריזה על משפחת GPT‑4.1 – שלושה מודלים (GPT‑4.1, GPT‑4.1 mini ו‑GPT‑4.1 nano) שמחליפים את GPT‑4o ומעליהם בכל פרמטר כמעט. הם מצוידים ב‑חלון הקשר של עד מיליון טוקנים – פי 8 מגודל קוד המקור המלא של React – ובידע מעודכן עד יוני 2024.

במילים פשוטות, GPT‑4.1 יודע “להחזיק בראש” הרבה יותר מידע בבת‑אחת, להבין הוראות מורכבות בלי לטעות ולענות מהר יותר ובזול יותר מהדגמים הקודמים – כך שאם תבקשו ממנו לסכם ספר שלם, לנסח חוזה או לעזור בשיחה עם שירות לקוחות, הוא יעשה זאת בצורה מדויקת, רציפה וידידותית יותר מאי‑פעם.

שלישייה מנצחת

מודל ייעוד מרכזי יתרון בולט
GPT‑4.1 משימות מורכבות, סוכנים, קוד הכי חכם, 1M טוקנים
GPT‑4.1 mini יישומים עתירי תעבורה מהיר ב‑50 % מ‑4o, זול ב‑83 %
GPT‑4.1 nano השלמות, סיווגים בזמן אמת המודל הזול והזריז ביותר, עדיין עם 1M טוקנים

שדרוגי קוד

  • ‎54.6 %‎ ב‑SWE‑bench Verified – עלייה של ‎21.4 %‎ נקודות על 4o.
  • פי 2 דיוק בהפקת diff ב‑Aider polyglot.
  • ב‑Frontend העדיפו בודקים אתרים ש‑4.1 כתב ב‑80 % מהמקרים.

הוראות שמבוצעות בדיוק

ב‑MultiChallenge מקבל 4.1 ‎38.3 %‎ – שיפור דו־ספרתי לעומת 4o. במבחני פורמט של OpenAI הוא מכפיל הצלחה במשימות “קשות” הכוללות דרישות שלילה, סידור ודדליינים קפדניים.

הקשר ארוך באמת

Needle‑in‑Haystack? 4.1 מאחז את “המחט” בכל מיקום לאורך מיליון טוקנים. במבחן MRCR החדש הוא מתמודד בהצלחה עם מספר “מחטים” חבויות ומבחן Graphwalks מראה שהמודל שומר על הגיון מרובה־קפיצות ב‑62 % דיוק – הבדל ניכר מול 4o.

ביצועים חזותיים

ב‑MMMU, MathVista ו‑CharXiv Reasoning מציג 4.1 mini תוצאות הגבוהות או שוות ל‑4o – הישג מרשים למודל “קטן”. ב‑Video‑MME (סרטים של שעה ללא כתוביות) 4.1 קובע שיא חדש: 72 %.

חסכוני יותר, מהיר יותר

OpenAI שיפרה את מערך ההרצה ומעניקה הנחת 75 % בקאשים (לעומת 50 %). המחיר ל‑1 M טוקנים ב‑4.1 עומד על ‎$2 קלט ו‑$8 פלט; ב‑nano – ‎$0.10‎ ו‑$0.40‎ בהתאמה. בנוסף, אין תוספת תשלום על הקשר ארוך.

סוף עידן GPT‑4.5

גרסת 4.5 Preview תכבה ב‑14 ביולי 2025. OpenAI מציעה שלושה חודשי מעבר ומבטיחה שכל “ההומור והנואנס” של 4.5 שולבו במשפחה החדשה.

איך זה נראה בשטח?

  • Windsurf דיווחה על עלייה של ‎60 %‎ בקוד שמתקבל בביקורת ראשונה.
  • Blue J הגדילה דיוק בסוגיות מס ב‑53 %.
  • Carlyle הצליחה לנתח קובצי PDF ואקסל ענקיים עם שיפור של ‎50 %‎.

השלכות למפתחים

  • סוכנים חכמים – עם Responses API המודלים מחליטים לבד מתי לחפש ברשת, להפעיל Python או לפענח מסמך כבד.
  • קוד ענק – ניתן להזין רפוזיטורי שלם בפעם אחת, לבקש “תקן את הבאג בבילד” ולקבל PR מוכן.
  • שיחות ארוכות – בוט תמיכה יזכור את כל ההיסטוריה של הלקוח בלי לאבד קונטקסט.
  • עלות/תועלת – mini ו‑nano מאפשרים שירותים חינמיים או זולים יותר עם אותה איכות.

מבט קדימה

OpenAI רומזת שה‑4.1 הוא צעד לכיוון איחוד קווי ה‑GPT וה‑o: מודל שמצד אחד משוחח באופן טבעי, ומצד שני מפעיל כלים ומבצע משימות מורכבות לבדו. הגרסה הבאה – GPT‑4.1 pro עם גישה מלאה לכלים – כבר בדרך, ולפי קצב ההתקדמות, חוויית השימוש בצ'אט GPT והשימושים ב-API ממשיכה להתקרב ל‑“עוזר על” אמיתי.