OpenAI הכריזה השבוע על שני מודלים חדשים - GPT-6 Sol ו-GPT-6 Luna - והפעם החדשות הגדולות הן לא רק ביצועים, אלא מחיר. החברה הודיעה על הוזלה של 50% ואף יותר במחירי ה-API, וטענה שמדובר במחיר קבוע ולא במבצע השקה זמני. ההכרזה מגיעה יום אחרי ש-Anthropic השיקה את Claude Opus 5.5, וביחד שתי ההודעות מסמנות שלב חדש במלחמת המחירים בין חברות הבינה המלאכותית המובילות.
עיקרי הדברים
- OpenAI השיקה שני מודלים חדשים - GPT-6 Sol למשימות פיתוח מורכבות, ו-GPT-6 Luna למשימות פשוטות בנפח גבוה
- מחיר GPT-6 Sol ירד ל-2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט - חצי מהמחיר של GPT-5.6 Sol
- מחיר GPT-6 Luna ירד ל-0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט
- שני המודלים משתמשים בשיטות האימון של הדגל GPT-6 Astra, עם שיפור בדיוק ובצמצום טעויות
- ההשקה מגיעה יום אחרי Claude Opus 5.5 של Anthropic, בעיצומה של תחרות מחירים בין החברות המובילות בתחום
- המודלים זמינים כבר עכשיו ב-API של OpenAI, וב-ChatGPT למשתמשי Plus, Pro, Business, Enterprise ו-Edu
מה זה GPT-6 Sol ו-GPT-6 Luna?
שני המודלים ממשיכים את משפחת GPT-6, שהחלה עם השקת הדגל GPT-6 Astra בתחילת החודש. במקום להשיק עוד גרסת פרימיום יקרה, OpenAI בחרה הפעם להתמקד בנגישות - מודלים חזקים אך זולים משמעותית, שמיועדים לשימוש יומיומי בקנה מידה גדול.
GPT-6 Sol מיועד למשימות פיתוח מורכבות - כתיבת קוד, סקירת קוד, איתור באגים וניתוח נתונים. GPT-6 Luna, לעומת זאת, נבנה למשימות פשוטות בנפח גבוה - סיכום מסמכים, חילוץ מידע ומענה לשאלות שגרתיות. שני המודלים אומנו בשיטות דומות לאלה של GPT-6 Astra, כך שהם מביאים חלק מהשיפורים של הדגל - בעבודה מקצועית, בדייקנות, בכתיבת קוד ובשימוש במחשב - לגרסאות מהירות וזולות יותר.
לפי הודעת OpenAI, בבדיקות יישור (alignment) פנימיות שני המודלים מציגים שיפור לעומת הגרסאות הקודמות שלהם מדור GPT-5.6, כולל ירידה משמעותית בשיעור הטענות המטעות לגבי עבודת קוד שבוצעה. שיעור ההטעיה של Sol ירד ל-1.3% לעומת 10.4% בגרסה הקודמת, ושל Luna ל-2.8% לעומת 9.5%. OpenAI מציינת עם זאת שמדובר בבדיקות אדוורסריות שלא בהכרח משקפות שימוש רגיל.
כמה עולים המודלים החדשים?
ההוזלה היא הסיפור המרכזי בהשקה הזו. GPT-6 Sol עולה כעת 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט - בדיוק חצי מהמחיר של GPT-5.6 Sol. GPT-6 Luna עולה 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט, ירידה של כ-50% בקלט וכ-58% בפלט לעומת הגרסה הקודמת. לפי דובר החברה שדיבר עם VentureBeat, מדובר במחירי קבע ולא במבצע השקה זמני.
חלק מההוזלה מגיע משיפורים בזיכרון מטמון (caching) ובתשתית ההסקה. OpenAI מציעה כעת הנחה של 90% על קריאות טוקני קלט שכבר נמצאים במטמון, ולטענתה השדרוג בשיטת המטמון הפחית ביותר ממחצית את נפח הטוקנים שצריך לעבד מחדש, כפי שנמדד על מיליארדי בקשות ב-GitHub Copilot.
איך זה נראה מול התחרות?
המחיר החדש של GPT-6 Sol - 2 דולר קלט ו-10 דולר פלט - מציב אותו בדיוק באותה רמת מחיר כמו Claude Sonnet 5 של Anthropic, וזול משמעותית מ-Claude Opus 5.5 שהושק יום קודם לכן במחיר של 4 דולר קלט ו-20 דולר פלט. מנגד, מודל ה-Flash הנוכחי של גוגל, Gemini 3.8 Flash, עדיין זול יותר בטווח הארוך - גם אחרי העלאת מחיר מתוכננת בינואר 2027. מודלים בקוד פתוח כמו MiMo-V2.6-Pro של שיאומי מציעים חיסכון נוסף של כ-78% במחיר הקלט לעומת Sol.
התמונה הכוללת היא של תחרות מחירים אגרסיבית בין כל השחקניות הגדולות בתעשייה - OpenAI, Anthropic וגוגל - כאשר כל אחת מנסה למצוא את שיווי המשקל בין ביצועים, עלות ונגישות ללקוחות עסקיים ולמפתחים בודדים.
מה אומרים בדיקות הביצועים?
OpenAI בחרה להציג את הביצועים במונחים של "עלות למשימה שהושלמה" ולא רק בציוני בנצ'מרק גולמיים. ב-AutomationBench בדרגת מאמץ גבוהה, Sol השיג שיעור הצלחה של 33.2% בעלות של 0.27 דולר למשימה - לטענת החברה, פי 11 זול יותר למשימה בהשוואה ל-Opus הקודם. ב-DeepSWE, מבחן קידוד מוכר, Sol השיג 68.8% הצלחה - מעט מתחת ל-69.9% שהשיגה Fable 5, אך בעלות נמוכה בכ-80% למשימה. ב-OSWorld 2.0, מבחן שימוש במחשב, Sol השיג 60.5% הצלחה.
לא כל התמונה חיובית. בבדיקות עצמאיות שנערכו לאחר ההשקה נמצא כי השיפור בציוני הבנצ'מרק אמיתי אך מצומצם ולא אחיד בין הבדיקות השונות - ב-DeepSWE, למשל, GPT-6 Sol דורג נמוך יותר מ-GPT-5.6 Sol בכל רמות המאמץ שנבדקו. כלומר, מי שמחפש שיפור ביצועים דרמטי צריך להתייחס בזהירות לכותרות השיווקיות ולבדוק את הנתונים לפי סוג המשימה.
מתי אפשר להתחיל להשתמש, ולמי זה מתאים?
שני המודלים זמינים כבר כעת דרך ה-API של OpenAI תחת השמות gpt-6-sol ו-gpt-6-luna, וכן ב-ChatGPT Work וב-Codex למשתמשי Plus, Pro, Business, Enterprise ו-Edu. משתמשי Free ו-Go מקבלים גישה ל-Luna דרך אפליקציית הדסקטופ. OpenAI מבצעת פריסה הדרגתית כדי לשמור על יציבות המערכת.
מבחינת התאמה מעשית - Luna מתאים לעבודות נפח גבוה עם יעד צר וברור: חילוץ מידע, כיווץ מסמכים ומענה לשאלות פשוטות, כאשר העלות הנמוכה מאפשרת להריץ אותו על כמויות גדולות של בקשות. Sol מתאים לבניית פיצ'רים, סקירת קוד, איתור באגים וניתוח נתונים - עבודות שדורשות יותר מיקוד אך עדיין לא ברמת המורכבות שמצדיקה שימוש ב-Astra היקר יותר.
טבלת השוואת מחירים
| מודל | קלט (למיליון טוקנים) | פלט (למיליון טוקנים) |
|---|---|---|
| GPT-6 Luna | 0.10 דולר | 0.50 דולר |
| Gemini 3.8 Flash (נוכחי) | 0.75 דולר | 3.75 דולר |
| GPT-6 Sol | 2.00 דולר | 10.00 דולר |
| Claude Sonnet 5 | 2.00 דולר | 10.00 דולר |
| Claude Opus 5.5 | 4.00 דולר | 20.00 דולר |
| GPT-6 Astra (Standard) | 10.00 דולר | 50.00 דולר |
מה זה אומר למפתחים ולעסקים בישראל?
עבור צוותי פיתוח וחברות שכבר משלבות מודלי שפה בתהליכי עבודה, ההוזלה מורידה משמעותית את העלות השוטפת של הרצת סוכני AI, כלי קוד וצ'אטבוטים בנפח גבוה. הוזלה של 50% במחיר משמעה שאפשר להכפיל את היקף השימוש באותה תקציב, או לחלופין לצמצם עלויות משמעותית תוך שמירה על אותה רמת שירות. במקביל, ההנחה של 90% על טוקנים ממוטמנים הופכת שימושים חוזרים - כמו סוכני קוד שעובדים על אותו קונטקסט שוב ושוב - לזולים משמעותית יותר.
מבחינת עסקים ישראליים, המשמעות המעשית היא שהמחסום הכלכלי לשילוב בינה מלאכותית בתהליכי עבודה ממשיך לרדת. חברות קטנות ובינוניות שעד לאחרונה נמנעו משימוש נרחב במודלים מתקדמים בגלל עלות, יכולות כעת לשקול מחדש - במיוחד כשמתחרות כמו Anthropic וגוגל ממשיכות ללחוץ את המחירים כלפי מטה בתגובה.
שאלות נפוצות
מה ההבדל בין GPT-6 Sol ל-GPT-6 Luna?
Sol מיועד למשימות פיתוח מורכבות יותר כמו כתיבת קוד וניתוח נתונים, בעוד ש-Luna בנוי למשימות פשוטות בנפח גבוה כמו סיכום וחילוץ מידע, במחיר נמוך משמעותית.
האם ההוזלה במחירים זמנית?
לפי OpenAI, לא. דובר החברה אמר במפורש ל-VentureBeat שמדובר במחירי קבע ולא במבצע השקה.
איך המחיר של GPT-6 Sol משתווה ל-Claude?
הוא זהה למחיר של Claude Sonnet 5 (2 דולר קלט, 10 דולר פלט), וזול פי שניים מ-Claude Opus 5.5.
האם המודלים החדשים חזקים יותר מ-GPT-5.6?
ברוב הבדיקות כן, אך השיפור אינו אחיד בכל הבנצ'מרקים - בחלק מבדיקות הקוד GPT-6 Sol אף דורג מעט נמוך יותר מקודמו.
איפה אפשר להשתמש במודלים החדשים?
דרך ה-API של OpenAI, וכן ב-ChatGPT Work וב-Codex עבור משתמשי Plus, Pro, Business, Enterprise ו-Edu. Luna זמין גם למשתמשי Free ו-Go דרך אפליקציית הדסקטופ.
למה OpenAI מוזילה את המחירים דווקא עכשיו?
ההשקה מגיעה בעיצומה של תחרות מחירים בין OpenAI, Anthropic וגוגל, לצד שיפורים טכנולוגיים בזיכרון מטמון שמאפשרים לחברה להוזיל עלויות תפעול ולהעביר חלק מהחיסכון ללקוחות.
מקורות: הודעת OpenAI הרשמית, VentureBeat, Quartz

