היסטוריה קטנה התרחשה בשבוע שעבר בעולם הבינה המלאכותית. OpenAI, החברה שפיתחה את צ'אט גי פי טי, השיקה שני מודלים חדשים תחת השם gpt-oss, והפעם, בניגוד לרוב המודלים של החברה, מדובר במודלים בקוד פתוח. מדובר ב־gpt-oss-120b וב־gpt-oss-20b, שני מודלים רבי עוצמה שזמינים להורדה, הפעלה והתאמה אישית על ידי כל מפתחת, סטארטאפ, אוניברסיטה או ממשלה.
וזה לא רק הקוד שפתוח. OpenAI מצהירה שהמודלים האלו מסוגלים להתמודד עם אתגרים מורכבים בתחום ההנמקה, המתמטיקה, הבריאות והקוד, תוך עמידה בסטנדרטים של בטיחות, יעילות וקלות פריסה.
ביצועים של GPT-4 במחשב אחד
gpt-oss-120b נחשב למודל מרשים במיוחד. הוא מגיע לרמות ביצוע כמעט זהות ל־o4-mini, אחד ממודלי ההנמקה המובילים של OpenAI, אך יכול לפעול על כרטיס גרפי בודד בנפח 80 גיגה בלבד. הגרסה הקלה יותר, gpt-oss-20b, מסוגלת לרוץ על מחשבים עם 16 גיגה זיכרון בלבד.
במבחנים שנעשו על ידי החברה, שני המודלים הציגו תוצאות גבוהות במתמטיקה תחרותית, רפואה, פתרון בעיות וקריאה של קוד. הם אף עלו בביצועיהם על מודלים מסחריים כמו GPT‑4o במבחנים מסוימים.
שני המודלים תומכים בשימוש בכלים כמו חיפוש באינטרנט והרצת קוד, יודעים לבצע chain-of-thought reasoning, ומסוגלים לספק תשובות מותאמות לפי רמת עומק נדרשת. כל זה, לפי OpenAI, בצורה שמתאימה לפריסה על גבי שרתים מקומיים, מחשבים אישיים, ואפילו מכשירים בשטח.
זמינים, פתוחים, ונתמכים על ידי כל התעשייה
כדי להבטיח שהמודלים יהיו נגישים ככל האפשר, OpenAI שיתפה פעולה מראש עם חברות כמו Hugging Face, vLLM, Ollama, AWS, Microsoft, Groq, ועוד. הגרסאות שהושקו כבר מותאמות לפלטפורמות כמו PyTorch, Metal, ואפילו Windows, וכוללות כלים להטמעה, הפעלה, התאמה והאצה.
בנוסף, OpenAI פרסמה גם את הטוקנייזר שבו השתמשה לאימון המודלים, קוד בשם o200k_harmony, וכן רנדרר תואם בפייתון ובראסט. לדברי החברה, אלו הם מודלי השפה הפתוחים הראשונים שהיא מפרסמת מאז GPT‑2, וייתכן שמדובר בצעד הכי משמעותי שלה בזירה הזו עד כה.
למה בכלל צריך מודלים בקוד פתוח?
לא כל אחד מחפש לפתח אפליקציית בינה מלאכותית חדשה, ולרובנו אין גישה לשרתים עתירי כוח או לצוות מחקר של עשרות מדענים. אבל דווקא בגלל זה, המודלים הפתוחים כמו gpt-oss יכולים לשנות את התמונה.
כשמודל בקוד פתוח הופך לזמין, כל מי שיש לו מחשב חזק, כמו למשל: סטודנט, חוקר, יזמית צעירה, ארגון אזרחי או מורה בבית ספר, יכול להפעיל אותו, ללמוד ממנו, לבנות עליו דברים חדשים, או להתאים אותו בדיוק למה שהוא צריך.
אז מה אפשר לעשות איתו בפועל?
-
לפתח עוזרים אישיים מקומיים שלא דורשים חיבור לאינטרנט, ושומרים על פרטיות המשתמשים.
-
להכשיר את המודל לתחום מסוים כמו רפואה, חינוך או משפט, על בסיס חומרים מותאמים.
-
לשלב אותו באפליקציות, רובוטים או כלים קיימים, בלי לשלם על כל שאילתה או להמתין לאישור משירות חיצוני.
-
לנתח מסמכים, לעבד שפה, לכתוב קוד, לחקור טקסטים, ולבצע עשרות משימות שבעבר דרשו כלי ענן יקרים.
-
ללמוד איך AI באמת עובד, לקרוא את המודל, לפרק אותו ולהרכיב אותו מחדש, משהו שאי אפשר לעשות עם מודלים מסחריים סגורים.
מעבר לשימושים הפרקטיים, יש פה גם עניין של שקיפות ושליטה. כשמודל פתוח, הציבור יכול לבדוק מה הוא יודע, איך הוא מגיב, ואפילו אילו הטיות עלולות להיות בו. זה מה שמאפשר גם רגולציה טובה יותר וגם פיתוח בטוח יותר של טכנולוגיות חדשות.
במילים פשוטות, זה דמוקרטיזציה של הבינה המלאכותית. לא עוד טכנולוגיה שמוחזקת רק בידי ענקיות, אלא כוח שיכול להגיע לכל אחד.
בטיחות מעל הכול – גם בקוד פתוח
בעולם שבו שחרור מודל קוד פתוח עלול לשמש גורמים עוינים, OpenAI שמה דגש מיוחד על בטיחות. כל אחד מהמודלים עבר אימון נגד בקשות מזיקות, סינון של מידע מסוכן באימון הראשוני, ושלב מתקדם של אימון מבוקר על פי מסגרת הבטיחות של החברה.
החוקרים אף ביצעו ניסוי של כוונון זדוני, שבו דימו מה תוקף עלול לנסות להוציא מהמודל אם ינסה להתאימו לתחומי סייבר או ביולוגיה. גם לאחר ניסוי קצה כזה, רמת המסוכנות של המודל נותרה נמוכה יחסית. מסקנת החברה: ניתן לשחרר את המודלים ברמת סיכון מנוהלת.
OpenAI פונה לקהילה העולמית, לא רק כצרכנית אלא גם כשותפה. החברה הכריזה על תחרות red teaming פתוחה, עם פרסים בגובה חצי מיליון דולר, שבה יוזמנו חוקרים ויוצרי תוכנה לבדוק את גבולות המודלים החדשים, לנסות לחשוף בעיות בטיחות, ולהציע פתרונות.
בסוף האתגר, החברה תפרסם דו"ח מסכם ומאגר נתונים פתוח שיסייע לכלל הקהילה לחזק את האקוסיסטם של מודלים פתוחים. בעידן שבו שאלות של שקיפות, שליטה וביזור עומדות במרכז השיח על AI, מדובר באיתות חזק בכיוון של דמוקרטיזציה טכנולוגית.
לא רק למפתחים
אחת ההצהרות החשובות במאמר היא שמודלים פתוחים מהסוג הזה יכולים להוות אלטרנטיבה ראויה גם במקומות שבהם אין תשתית מתקדמת או תקציב לשכור מודלים מסחריים. gpt-oss נועד להורדה, התאמה והפעלה על תשתיות מקומיות, בלי להסתמך על שירותי ענן יקרים או מגבלות גישה.
כך, למשל, מוסדות חינוך, מחקר רפואי במדינות מתפתחות, ואפילו ארגונים קטנים יוכלו להפעיל בינה מתקדמת עם שליטה מלאה על הנתונים והמודל.
שחרור gpt-oss-120b ו־gpt-oss-20b מסמן שינוי בתפיסת העולם של OpenAI כלפי קוד פתוח. הוא מציע איזון בין עוצמה לבטיחות, בין ביצועים מרשימים לנגישות רחבה, ובין פיתוח פנימי לאקו־סיסטם שיתופי.
לפי החברה, המודלים הפתוחים לא מחליפים את אלו שב־API, אלא משלימים אותם. הם מאפשרים גמישות רבה יותר, שקיפות גבוהה יותר, ומעודדים קהילות פיתוח חדשות להצטרף למהפכה. איך זה ייראה בשטח? תלוי במי שייבחר להשתמש בהם.







