ביום רביעי, 17 ביולי 2025, הכריזה OpenAI על השקת אחד השדרוגים המשמעותיים ביותר במוצר הדגל שלה: ChatGPT Agent, מערכת סוכנת מתקדמת, שפועלת על גבי המודל GPT ויודעת לא רק לשוחח, אלא גם לפעול. בניגוד לעבר, כעת צ'אט GPT לא רק עוזר לך לחשוב, הוא גם מבצע את המשימות בפועל, תוך שימוש במחשב וירטואלי עצמאי, דפדפן גרפי, גישה ל-API, ושליטה מלאה באינטראקציה עם אתרי אינטרנט.
עד כה, יכולותיו של ChatGPT נמדדו בעיקר ברמת ההבנה והניסוח. אבל ה-Agent החדש הופך את הכלי הזה לעובד אקטיבי, אחד שמקבל הנחיות כמו "תכנן ארוחת בוקר יפנית לארבעה ורכוש את המצרכים", או "סכם את פגישות השבוע הקרוב לפי אירועים שקרו אצל הלקוחות", ופשוט מבצע. הוא נכנס לאתרים, מאמת זהויות (באישור המשתמש), מריץ קוד, מסכם מידע, ומייצר מסמכים מוכנים לעריכה, אקסלים, מצגות וסיכומים.
ה-Agent מאחד בין שלושה כלים קודמים שפותחו ב-OpenAI:
-
Operator – שידע לגלוש, ללחוץ, ולהזין מידע באתרים.
-
Deep Research – שהתמקד במחקר עמוק וסיכום מידע.
-
ChatGPT – מודל השיח החכם והגמיש.
שילוב הכוחות מאפשר ל-Agent לעבוד עם כלים שונים לפי הצורך: לדוגמה, להתחיל בחיפוש טקסטואלי, לעבור לגלישה גרפית כדי לנווט באתר מורכב, להריץ קוד לניתוח נתונים, ואז לחזור לדפדפן כדי להוריד תוצאות.
אלו 4 החידושים שחשוב להכיר:
1. תמיד בשליטת המשתמש
למרות האוטומציה המרשימה, OpenAI מדגישה כי השליטה תמיד נשארת אצל המשתמש: כל פעולה מהותית דורשת אישור מפורש, ניתן לעצור את התהליך בכל שלב, להתערב ידנית, או לדרוש דו"ח מצב. בשימושים קריטיים כמו שליחת מיילים או גישה לנתונים רגישים, מופעלת “watch mode”, שמחייבת פיקוח פעיל.
2. מדויק יותר מבני אדם
ChatGPT Agent לא רק מבצע משימות, הוא עושה זאת טוב יותר מרוב האנשים, לפחות לפי OpenAI. במדד Humanity’s Last Exam, שמודד ביצועי AI בשאלות ברמה מקצועית, הסוכן קבע שיא חדש עם 41.6% הצלחה – זינוק של כמעט 20% לעומת המודלים הקודמים.
בתחומים כמו ניתוח דאטה (DSBench), בניית מודלים פיננסיים, או ניווט באינטרנט למציאת מידע מורכב (BrowseComp), הסוכן עקף את הביצועים של בני אדם, ואף התמודד בהצלחה עם FrontierMath – אוסף בעיות מתמטיות שדורשות שעות ממתמטיקאים.
3. עבודה ללא מאמץ
השימושים המעשיים חוצים את הגבולות בין הבית למשרד: מיצירת דוחות פיננסיים וארגון פגישות מחדש, דרך בניית מצגות על בסיס דאטה חי, ועד תכנון חופשות או ארוחות ערב כולל הזמנות. אפשר לקבוע משימות שיחזרו אוטומטית, כמו סיכום שבועי בכל יום שני, וההתראות יגיעו לנייד עם סיום הביצוע.
4. מגבלות בטיחות חדשות
העוצמה הזו מגיעה עם אחריות: הסוכן יכול לפעול על מידע פרטי ולבצע פעולות ישירות, ולכן OpenAI שילבה בו את מערך הבטיחות המתקדם ביותר שלה. הוא מאומן לזהות מתקפות "הזרקת פקודות" (prompt injection) – שיטה בה קוד זדוני מסתתר באתר במטרה לגרום לו לפעול בניגוד לכוונת המשתמש.
בנוסף, הוחלו מגבלות יזומות על משימות רגישות כמו העברת כספים, וניתן בלחיצה אחת למחוק את כל המידע שנאסף במהלך הגלישה.
מי יכול להשתמש ביכולות החדשות?
החל מהיום, משתמשי Pro, Plus ו-Team יכולים להפעיל את ה-Agent דרך תפריט הכלים בצ'אט. משתמשי Pro יקבלו גישה מלאה עוד היום, Plus ו-Team בימים הקרובים, ואילו לקוחות Enterprise ו-Education בשבועות הבאים.
משתמשים באירופה ובשוויץ עדיין ממתינים לפתיחה הרשמית, בהתאם לרגולציות.







