OpenAI השיקה אתמול (22 בספטמבר) שני מודלים חדשים - GPT-6 Sol ו-GPT-6 Luna. אלה מצטרפים למשפחת GPT-6 שנפתחה עם השקת GPT-6 Astra בתחילת החודש, והפעם עם מסר ברור - אותה רמת ביצועים בערך, במחיר נמוך משמעותית. המחירים ל-API ירדו בחצי לעומת הדור הקודם, וחברות שמריצות עומסי עבודה גדולים דרך ה-API של OpenAI ירגישו את זה כבר בחשבון הבא.
עיקרי הדברים
- OpenAI השיקה את GPT-6 Sol (למשימות מורכבות וקוד) ואת GPT-6 Luna (למשימות מהירות בנפח גבוה)
- מחיר GPT-6 Sol ב-API ירד ל-2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט - חצי ממחיר GPT-5.6 Sol
- מחיר GPT-6 Luna ירד ל-0.10 דולר קלט ו-0.50 דולר פלט למיליון טוקנים
- לפי OpenAI, Sol טועה בערך בחצי מהתדירות של הדור הקודם
- המודלים זמינים כבר ב-ChatGPT Work וב-Codex, ו-Luna זמין גם למשתמשי Free ו-Go באפליקציית הדסקטופ
- ההשקה מגיעה ימים ספורים אחרי ש-Anthropic השיקה את Opus 5.5 במחיר תחרותי, בעיצומה של מלחמת מחירים בין החברות
מה זה בעצם GPT-6 Sol ו-GPT-6 Luna?
שני המודלים בנויים על אותה שיטת אימון שעמדה מאחורי GPT-6 Astra, המודל הדגל שהושק בתחילת ספטמבר. OpenAI לקחה את השיפורים שהביאו את Astra לביצועים גבוהים בעבודה מקצועית, דיוק עובדתי, כתיבת קוד, שימוש במחשב והתאמה להנחיות - והעבירה אותם למודלים מהירים וזולים יותר.
החלוקה בין השניים ברורה. GPT-6 Sol מיועד לעבודה יומיומית שדורשת חשיבה - כתיבת קוד, ניתוח מורכב, משימות סוכנים אוטונומיים. GPT-6 Luna מיועד לתפקידים פקידותיים בנפח גבוה - סיכום מסמכים, חילוץ מידע ממאגרי נתונים ומענה על שאלות פשוטות, כשהדגש הוא על מהירות ועלות נמוכה ולא על עומק חשיבה.
שני המודלים גם מאמצים את סגנון התקשורת של Astra - תשובות קצרות יותר עם פחות ז'רגון, בלי לוותר על התוכן עצמו.
כמה עולה להשתמש במודלים החדשים?
הורדת המחירים היא הסיפור המרכזי של ההשקה. הנה הפער בין הדור הקודם לחדש:
| מודל | קלט (למיליון טוקנים) | פלט (למיליון טוקנים) | שימוש מיועד |
|---|---|---|---|
| GPT-6 Sol | 2 דולר | 10 דולר | קוד, ניתוח מורכב, סוכנים אוטונומיים |
| GPT-5.6 Sol (קודם) | 4 דולר | 20 דולר | אותו ייעוד, מחיר כפול |
| GPT-6 Luna | 0.10 דולר | 0.50 דולר | סיכום, חילוץ מידע, שאלות פשוטות |
| GPT-5.6 Luna (קודם) | 0.20 דולר | 1.20 דולר | אותו ייעוד, מחיר גבוה יותר |
מעבר למחיר הבסיסי, OpenAI הוסיפה הנחות של עד 90 אחוז על קריאות טוקנים מהזיכרון המטמון (cache), וכלים חדשים למעקב אחר ביצועי המטמון ואיתור בקשות לא יעילות. מפתחים יכולים גם לכוון את רמת ה"מחשבה" של המודל ולשלוט בנקודות שבירת המטמון בלי לאבד את ההקשר השמור.
איך המודלים מתפקדים בבדיקות ביצועים?
OpenAI פרסמה כמה נתוני השוואה שממקמים את Sol מול מודלים מתחרים, בעיקר מול Claude של Anthropic:
- ב-AutomationBench, מבחן למשימות סוכנים אוטונומיים, Sol הגיע ל-33.2 אחוז הצלחה ברמת חשיבה מקסימלית, בעלות של 0.27 דולר למשימה - לעומת 26.9 אחוז של Claude Opus 5, במחיר גבוה פי 11 בערך
- ב-Agents' Last Exam, מבחן למשימות מקצועיות מורכבות, Sol הגיע ל-56.4 אחוז, בעלות נמוכה בכ-60 אחוז מ-Claude Opus 5
- ב-DeepSWE v1.1, מבחן הנדסת תוכנה, Sol הגיע ל-68.8 אחוז ו-Luna ל-66.6 אחוז, בעלות נמוכה משמעותית מ-Claude Fable 5
- ב-OSWorld 2.0, מבחן שימוש במחשב, Sol הגיע ל-60.5 אחוז, בעלות נמוכה בכ-80 אחוז מ-Claude Opus 5
- בבדיקת הדיוק העובדתי הפנימית של OpenAI, Sol טועה בערך בחצי מהפעמים לעומת GPT-5.6 Sol
חשוב לשים את זה בפרופורציה - אלה נתונים שפרסמה OpenAI עצמה, ולא בדיקה עצמאית. בכל מקרה, גם גורמים חיצוניים מציינים ש-Sol משתווה או עוקף את Claude Fable 5.1 בחלק מהמבחנים, בעוד שמודל ה-Opus 5.5 החדש של Anthropic דווקא מנצח את Astra במשימות קוד וידע מסוימות. התמונה, במילים אחרות, לא חד-משמעית לטובת אף אחת מהחברות.
מתי ואיפה אפשר להשתמש במודלים?
המודלים עולים לאוויר בהדרגה. ב-ChatGPT Work וב-Codex הם זמינים כבר עכשיו למשתמשי Plus, Pro, Business, Enterprise ו-Edu. משתמשי Free ו-Go מקבלים גישה ל-Luna דרך אפליקציית הדסקטופ בלבד. בשלב זה שני המודלים עוד לא זמינים במצב הצ'אט הרגיל - הפריסה שם נמשכת לאורך היום.
מפתחים שעובדים מול ה-API יכולים לקרוא למודלים ישירות דרך המזהים gpt-6-sol ו-gpt-6-luna.
איך זה משתלב במלחמת המחירים מול Anthropic?
ההשקה לא מתרחשת בוואקום. יום קודם לכן הכריזה Anthropic על Claude Opus 5.5 - מודל חזק יותר במחיר נמוך יותר משמעותית מהדור הקודם שלה. שתי החברות מפרסמות תוך פחות מ-48 שעות מודלים חדשים שמדגישים בדיוק את אותו דבר - ביצועים גבוהים, מחיר נמוך. זה מצטרף למגמה רחבה יותר בשוק המודלים הגדולים, שבה חברות מתחרות פחות על "מי חכם יותר" ויותר על "מי נותן יותר תמורה לדולר" בעומסי עבודה אמיתיים בפרודקשן.
לעסקים שמריצים כמויות גדולות של קריאות API - שירותי לקוחות אוטומטיים, עיבוד מסמכים, סוכני קוד - התחרות הזו מתורגמת ישירות לחיסכון. חברה שמריצה מיליוני קריאות בחודש לדגם מסוג Luna תרגיש הבדל תקציבי מיידי.
מה זה אומר למפתחים ולעסקים בישראל?
לצוותי פיתוח שכבר עובדים עם GPT-5.6 Sol או Luna, המעבר צפוי להיות פשוט יחסית - אותה מבנה API, מחירים נמוכים יותר וביצועים משופרים. לחברות ששוקלות עדיין באיזה ספק לבחור, הפער במחיר בין Sol ל-Luna שימושי כמדריך - Sol מתאים למשימות שדורשות שיקול דעת, ו-Luna למשימות חוזרות בנפח גבוה שבהן העלות היא הגורם המכריע.
שווה לבדוק את שני הכיוונים - גם GPT-6 וגם Claude Opus 5.5 - לפני קבלת החלטה, כי הביצועים משתנים בהתאם לסוג המשימה. מבחן קוד לא ידמה בהכרח מבחן סיכום מסמכים, וכדאי להריץ בדיקה על נתוני אמת מהמוצר שלכם ולא להסתמך רק על בנצ'מארקים שפרסמו החברות עצמן.

