- מה: שכבת מהירות פרימיום, הוכרזה ב-DevDay 2026 ב-29 בספטמבר.
- מהירות: עד פי 8 ב-Codex, עד פי 6 ב-API, עד כ-300 טוקנים בשנייה.
- מחיר: לפי הדיווחים, פי 6 מהתעריף הרגיל ופי 3 ממצב Fast.
לפי התיעוד של OpenAI, Ultrafast תומך רק בעיבוד בארצות הברית ובעיבוד גלובלי. הוא לא עובד עם נקודות קצה אזוריות באירופה, ולכן ארגון שמחויב לשמירת נתונים באירופה לא יוכל להשתמש בו.
OpenAI מוכרת עכשיו משהו חדש: לא מודל, אלא זמן.
Ultrafast מריץ את אותו מודל עד פי 8 מהר יותר ב-Codex. המחיר: פי 6.
לפעמים זו העסקה הכי טובה שתעשו החודש. ולפעמים זה פשוט לשרוף כסף.
בקצרה
- מה: שכבת מהירות פרימיום, הוכרזה ב-DevDay 2026 ב-29 בספטמבר.
- מהירות: עד פי 8 ב-Codex, עד פי 6 ב-API, עד כ-300 טוקנים בשנייה.
- מחיר: לפי הדיווחים, פי 6 מהתעריף הרגיל ופי 3 ממצב Fast.
- מודלים: GPT-6 Astra עכשיו, GPT-6.1 Sol בקרוב.
- מי מקבל: ב-API כולם. ב-ChatGPT וב-Codex, Pro 500 ו-Enterprise.
מה זה Ultrafast?
Ultrafast היא שכבת השירות המהירה ביותר ב-API של OpenAI. היא מריצה את אותו מודל בקצב גבוה בהרבה, עד פי 8 ב-Codex ועד פי 6 ב-API, בתמורה לתעריף גבוה יותר. היא לא משנה את איכות התשובה, רק את המהירות שבה היא מגיעה.
כמה Ultrafast מהיר, וכמה הוא עולה?
| פרמטר | Ultrafast |
|---|---|
| מהירות ב-Codex | עד פי 8 מהרגיל |
| מהירות ב-API | עד פי 6 מהרגיל |
| קצב | עד כ-300 טוקנים בשנייה |
| מחיר | פי 6 מהתעריף הרגיל, פי 3 ממצב Fast (לפי הדיווחים) |
| מודלים | GPT-6 Astra, ו-GPT-6.1 Sol בקרוב |
| אזורי עיבוד | ארצות הברית ועיבוד גלובלי בלבד |
איך מפעילים Ultrafast ב-API?
לפי התיעוד, מגדירים בכל בקשה שני פרמטרים: את המודל (gpt-6-astra) ואת service_tier בערך ultrafast. OpenAI ממליצה לעבוד דרך WebSocket כדי שתקורת הרשת לא תאכל את הרווח במהירות.
מגבלות הקצב ל-GPT-6 Astra ב-Ultrafast, לפי התיעוד:
| דרגה | טוקנים לדקה |
|---|---|
| 1 עד 3 | 500,000 |
| 4 | 1,000,000 |
| 5 | 5,000,000 |
ארגונים עם צוות לקוח ב-OpenAI יכולים לבקש מגבלות גבוהות יותר.
מי מקבל Ultrafast ב-ChatGPT?
ב-ChatGPT וב-Codex, Ultrafast שמור ל-Pro 500, המסלול החדש ב-500 דולר בחודש, ולארגוני Enterprise. זה המסלול היחיד מבין מסלולי ה-Pro שכולל אותו. השוויתי בין Pro 500 ל-Pro 200 בנפרד.
ומה זה אומר לעסק שלכם?
השאלה היא לא "כמה זה עולה", אלא "כמה עולה לחכות".
Ultrafast משתלם כש:
- אדם יושב ומחכה. מפתח ששולח משימה ל-Codex עשרות פעמים ביום. כל דקה שחוזרת אליו שווה יותר מהטוקנים.
- לקוח מחכה. סוכן שירות או מכירה שעונה בזמן אמת. תשובה איטית היא לקוח שהלך.
- תהליך מחזיק צוות. שלב אחד איטי בשרשרת שכל השאר תלויים בו.
Ultrafast לא משתלם כש:
- העבודה רצה בלילה. שם Batch ו-Flex נותנים 50% הנחה, בכיוון ההפוך.
- הארגון מחויב לעיבוד באירופה. Ultrafast לא תומך בזה.
מי שעובד עם Codex כל יום ירוויח מהמדריך המלא ל-Codex, ולתמונה המלאה של הערב, ריכזתי את כל הכרזות OpenAI DevDay 2026.
מקורות
- Ultrafast mode, תיעוד ה-API של OpenAI
- DevDay 2026 announcements, פורום המפתחים של OpenAI
- VentureBeat על GPT-6.1 Sol ו-Ultrafast
- The Next Web על Pro 500
בשורה התחתונה
מהירות הפכה למוצר עם תג מחיר. מי שימדוד כמה עולה לו דקת המתנה, ידע בדיוק מתי לשלם עליה.
יעקב צדק, מרצה, יועץ ומטמיע AI בארגונים, ומוביל קהילות בתחומי ה-AI, ה-GEO והטמעות AI, עם מעל 150,000 אנשים.
קורס במתנה עם ברכה אישית מכם, מסירה מיידית או בתאריך שתבחרו, וגישה לכל החיים.


