OpenAI הכריזה אתמול (5 באוקטובר) על הדרך שבה היא מתכוונת לעמוד בדרישות חוק ה-AI האירופי (EU AI Act) לסימון טקסט שנוצר על ידי מודלים שלה. מדובר בטכנולוגיה בשם textGrain - סימן מים נסתר שמוטבע בבחירת המילים של ChatGPT ו-Codex, ושאפשר לאתר אותו באמצעות גלאי ייעודי. הצעד מגיע כמה חודשים אחרי שאנתרופיק עוררה סערה עם מהלך דומה ב-Claude, אבל OpenAI בחרה בגישה מצומצמת בהרבה - גם בהיקף הפריסה וגם בברירת המחדל.
תמצית מהירה
- OpenAI מכריזה על textGrain - טכנולוגיית סימון טקסט נסתרת ל-ChatGPT, Codex וה-API, כדי לעמוד בדרישת חוק ה-AI האירופי לסימון תוכן סינתטי.
- ב-API הסימון יהיה אופציונלי מהיום לכל המשתמשים בעולם, לדגמים נבחרים, וכבוי כברירת מחדל.
- ב-ChatGPT וב-Codex הסימון יופעל בשבועות הקרובים, ובשלב זה רק למשתמשים זכאים באיחוד האירופי.
- הגלאי שמאתר את הסימן יהיה פתוח בשלב זה רק לחוקרים מאושרים ולגופי מחקר - לא לציבור הרחב.
- בדיקה של OpenAI מראה שהחלפת 10% מהמילים בטקסט בסינונימים מורידה את שיעור הגילוי מ-92% ל-66%, והחלפת 25% מהמילים מורידה אותו ל-17% בלבד.
- בניגוד לגישת אנתרופיק, שמפעילה סימון כברירת מחדל, OpenAI משאירה את הבחירה בידי המפתחים והמשתמשים - לפחות בשלב הזה.
מה בעצם OpenAI הכריזה?
בפוסט רשמי שפורסם ב-5 באוקטובר 2026, OpenAI הציגה את האופן שבו היא מתכננת לעמוד בדרישת ה-AI Act האירופי לסמן תוכן שנוצר על ידי מודלי שפה, כך שיהיה אפשר לזהות אותו. החוק מחייב חברות שמפתחות מודלים גנרטיביים לסמן פלט טקסטואלי בצורה שניתנת לאיתור, וכל חברות ה-AI הגדולות נדרשות להתאים את עצמן אליו. OpenAI מציינת שהיא בוחנת את הנושא כבר תקופה, אבל רק עכשיו היא מציגה פתרון מוכן לשימוש בפועל - ולא מבטיחה הפעלה מלאה בכל המוצרים בבת אחת.
ההכרזה מגיעה כמה חודשים אחרי שאנתרופיק הכריזה שClaude יתחיל לסמן טקסט כדי לעמוד באותה דרישה, מה שעורר דיון ציבורי נרחב על פרטיות, שקיפות והשפעה אפשרית על כותבים שמשתמשים בכלי AI כעזר כתיבה. OpenAI בחרה להציג את עצמה כצועדת באותו כיוון, אבל עם היקף מצומצם משמעותית בשלב הנוכחי.
איך עובדת טכנולוגיית textGrain?
textGrain היא שיטת סימון מים סטטיסטית. בכל פעם שהמודל צריך לבחור בין כמה מילים שמתאימות באופן שווה למשפט, הוא נוטה - לפי מפתח סודי שמוכר רק ל-OpenAI - לכיוון מילה אחת ולא אחרת. התבנית הזו לא ניכרת לקורא רגיל ולא משפיעה, לפי החברה, על המשמעות, האיכות או קריאות הטקסט. הגלאי של OpenAI סורק טקסט ומחפש את העקבות הסטטיסטיות של התבנית הזו, ועל סמך זה מעריך אם קטע מסוים נכתב בעזרת מודל של OpenAI.
חשוב להבין - הגלאי לא יכול לקבוע אם טקסט נכתב על ידי מתחרה כמו Claude או Gemini, מכיוון שהמפתח הסודי הוא ייחודי למערכת של OpenAI. כלומר, אין כאן כלי אוניברסלי לאיתור תוכן AI, אלא מנגנון שמזהה ספציפית פלט שמקורו במודלים של OpenAI. החברה מציינת שהיא מתכננת לפרסם דוח טכני מפורט על אופן הפעולה של textGrain, ושהדוח יתעדכן בשבועות הקרובים עם פרטים נוספים. יש גם כוונה להפוך את הטכנולוגיה לקוד פתוח, כך שגופים אחרים יוכלו לבנות עליה.
מתי זה מופעל - וליותר מי בדיוק?
הפריסה בפועל מחולקת לשני מסלולים נפרדים. ב-API, החברה מאפשרת מהיום (5 באוקטובר) לכל מפתח בעולם להפעיל סימון מים עבור דגמים נבחרים - אבל זה אופציונלי ולא מופעל אוטומטית. מי שלא יבחר להפעיל את זה, הטקסט שלו ייצא ללא סימון בכלל.
לעומת זאת, ב-ChatGPT וב-Codex הסימון יתחיל להיכנס לתוקף בשבועות הקרובים, אבל רק עבור משתמשים זכאים באיחוד האירופי - כלומר לא פריסה גלובלית, ולא כברירת מחדל לכל מי שמשתמש במוצרים האלה בכל העולם. בפועל, מי שמחוץ לאירופה ולא עובד דרך ה-API לא יראה כרגע שינוי בשירות.
OpenAI פתחה גם הרשמה לגישה לגלאי סימני המים, אבל בשלב הזה הגישה מוגבלת לחוקרים מאושרים ולגופי מחקר מורשים בלבד - לא לכל מי שמבקש. החברה מנמקת את זה בצורך להעריך ולשפר את הטכנולוגיה לפני שהיא נפתחת לקהל רחב יותר.
למה OpenAI בחרה בגישה מוגבלת יותר מאנתרופיק?
ההבדל המרכזי בין שתי החברות הוא ברירת המחדל. Claude של אנתרופיק מפעילה סימון מים אוטומטית על הטקסט שהוא מייצר, בלי שהמשתמש צריך לבחור בכך. OpenAI, לעומת זאת, משאירה את ההחלטה בידי המפתחים - וב-API הסימון כבוי כברירת מחדל גם היום. גם ב-ChatGPT וב-Codex, ההפעלה בשלב הראשון מוגבלת גיאוגרפית לאיחוד האירופי בלבד, ולא לכל המשתמשים.
הגישה הזו משקפת זהירות מצד OpenAI, שמציינת בעצמה שהטכנולוגיה עדיין בשלבי הערכה, ושהיא מצפה "לחזור ולבחון את הגישה שלה ככל שהטכנולוגיה, הסטנדרטים והעדויות יתפתחו". במילים אחרות - החברה לא רואה את זה כפתרון סופי, אלא כצעד ראשון שעוד ישתנה.
כמה אפקטיבי הסימון באמת - והמגבלות שהחברה עצמה מודה בהן
OpenAI לא מסתירה שהטכנולוגיה רחוקה מלהיות חסינה. בבדיקה שבוצעה על קטעי טקסט של 400 טוקנים, החלפה של 10% מהמילים בסינונימים הורידה את שיעור הגילוי מכ-92% לכ-66%. החלפה של 25% מהמילים הורידה את הגילוי עוד יותר - ל-17% בלבד. במילים פשוטות - עריכה בסיסית של הטקסט, גם אם לא מכוונת לחמוק מגילוי, יכולה לפגוע משמעותית ביכולת לזהות את הסימן.
החברה מציינת גם מגבלות נוספות: הגילוי פחות מדויק בטקסטים קצרים, ובתחומים מסוימים כמו מתמטיקה, שבהם יש פחות גמישות בבחירת מילים ולכן פחות "מקום" להטביע את הסימן. OpenAI מדגישה גם שסימן מים לא שווה הוכחה - הוא לא מודד תרומה אנושית, לא קובע בעלות או אחריות על התוכן, לא מזהה את המשתמש הספציפי, ולא מאשר נכונות עובדתית. וגם ההיפך נכון: היעדר סימן מים לא מוכיח שטקסט נכתב בידי אדם.
נתון מעניין נוסף שעלה מהנתונים של OpenAI - טקסט עם סימן מים לא פגע בביצועי המודל, ובחלק מהמבדקים אפילו ניקוד מעט גבוה יותר מטקסט בלי סימון. כך זה נראה במודל Astra max של החברה, לפי כמה ממבדקי הייחוס המרכזיים:
| מבדק ביצועים | טקסט ללא סימון | טקסט עם textGrain |
|---|---|---|
| Artificial Analysis Intelligence Index | 49.57 | 49.76 |
| AutomationBench | 34.09% | 34.86% |
| DeepSWE v1.1 | 72.80% | 71.68% |
| Terminal-Bench 4.0 | 53.90% | 56.06% |
| Terminal-Bench Science 0.1 | 56.90% | 60.00% |
| BrowseComp | 87.92% | 87.35% |
| HealthBench Professional | 64.27% | 64.60% |
| GPQA Diamond | 94.44% | 93.94% |
הפערים בטבלה קטנים לשני הכיוונים, כך ש-OpenAI קובעת שאין פגיעה משמעותית בביצועי המודל כתוצאה מהוספת הסימון.
OpenAI מול אנתרופיק - השוואה מהירה
| פרמטר | OpenAI (textGrain) | אנתרופיק (Claude) |
|---|---|---|
| ברירת מחדל ב-API | כבוי, אופציונלי | מופעל כברירת מחדל |
| היקף פריסה ב-ChatGPT/Codex | איחוד אירופי בלבד, בהדרגה | פריסה גלובלית |
| גישה לגלאי | חוקרים וגופי מחקר מאושרים בלבד | גישה מורחבת יותר כבר בשלב מוקדם |
| תכנון קוד פתוח | כוונה מוצהרת לפרסם בקוד פתוח | לא פורסם בקוד פתוח |
מה זה אומר למשתמשים ולעסקים בישראל?
בשלב הזה ההשפעה המעשית על משתמשים בישראל מוגבלת למדי. מי שעובד עם ChatGPT או Codex מחוץ לאיחוד האירופי לא יראה שינוי בטקסט שמתקבל. מי שמשתמש ב-API ורוצה לבדוק את הטכנולוגיה יכול לבחור להפעיל אותה באופן יזום על דגמים נתמכים, אבל זה דורש החלטה מודעת ולא קורה אוטומטית.
עבור עסקים שעובדים עם לקוחות אירופיים, או שמייצאים תוכן לשווקים שבהם ה-AI Act חל, כדאי להכיר את הנושא כבר עכשיו - גם אם הוא עדיין לא רלוונטי ישירות לשוק המקומי. ה-AI Act האירופי משפיע על הדרך שחברות AI גדולות מעצבות את המוצרים שלהן בכל העולם, כך שסביר שבהמשך נראה גם פריסה רחבה יותר, כולל אפשרות שהחברה תרחיב את הסימון למשתמשים מחוץ לאיחוד האירופי.
בשורה התחתונה - זו עדיין לא מערכת שתסמן אוטומטית כל טקסט שנכתב על ידי ChatGPT בעולם, אבל זה הצעד הברור ביותר שOpenAI עשתה בנושא עד כה, ומסמן כיוון שבו מתקדמת כל תעשיית ה-AI תחת לחץ רגולטורי אירופי.
מקורות: 9to5Mac, BleepingComputer, The New Stack

