- מה זה: המודל הקולי של OpenAI, בנוי בארכיטקטורת full-duplex: מקשיב ומדבר בו זמנית.
- מתי: ב-ChatGPT Voice מ-8 ביולי 2026, ב-API מ-10 בספטמבר 2026.
- מחיר: 5 סנט לדקה לשכבת הקול, בחיוב לפי שניות. מודל הרקע והכלים בנפרד.

מכינים את הדף בשבילך

מכינים את הדף בשבילך
רוב העוזרים הקוליים מחכים שתסיימו לדבר, מנחשים שסיימתם, ורק אז מתחילים לחשוב. GPT-Live-1 מקשיב ומדבר באותו רגע: אפשר לקטוע אותו, לעצור לחשוב, לשנות כיוון. מ-10 בספטמבר הוא זמין למפתחים ב-5 סנט לדקה. המדריך המלא: איך זה עובד, המספרים, הקולות, הטלפוניה, החשבון האמיתי, ומה מומחים מצאו כשבדקו אותו בעצמם.

GPT-Live-1 עצמו הוא רק שכבת השיחה. כשצריך לחשוב לעומק, לחפש או להפעיל כלים, הוא מעביר את העבודה למודל אחר ברקע, כמו GPT-6 Astra, וממשיך לדבר איתכם בזמן שהעבודה מתבצעת. זו הסיבה שהמחיר של 5 סנט לדקה הוא רק חלק מהחשבון.
רוב העוזרים הקוליים עובדים ככה: מחכים שתסיימו לדבר, מנחשים שסיימתם, ורק אז מתחילים לחשוב. ב-10 בספטמבר 2026 OpenAI הביאה למפתחים מודל שלא מחכה.
GPT-Live-1 מקשיב ומדבר באותו רגע. אפשר לקטוע אותו באמצע משפט, לעצור לחשוב בלי שהוא יקפוץ, לשנות כיוון, ולהמשיך כאילו יש מישהו בצד השני. הוא הופעל ב-ChatGPT Voice כבר ביולי, ועכשיו הוא זמין ב-API ב-5 סנט לדקה.
המדריך הזה עובר על כל מה שבדקנו מול המקורות הרשמיים ומול בדיקות עצמאיות: איך הארכיטקטורה עובדת, מה המספרים אומרים, מה זה עולה באמת, איך מחברים לטלפון, ומה עדיין לא פתור.
GPT-Live-1 הוא מודל קולי של OpenAI שמעבד את הקול הנכנס והיוצא ברציפות, במקום בתורות, ולכן יכול להקשיב ולדבר באותו רגע. הוא מטפל בשיחה עצמה: קצב, קטיעות, הפסקות, "אהה" של הקשבה. כשצריך לחשוב לעומק, לחפש או להפעיל כלי, הוא מעביר את המשימה למודל רקע וממשיך לדבר בינתיים.
זה מודל של שכבת שיחה, לא מודל של אינטליגנציה. ההבחנה הזאת היא המפתח לכל השאר: למחיר, לארכיטקטורה, ולמה שהוא לא יודע לעשות לבד.
כדי להבין למה זה חדש, כדאי לראות מה היה לפני. OpenAI עצמה מתארת שלוש גישות:
| דור | איך זה עובד | הבעיה |
|---|---|---|
| שרשור (cascaded) | זיהוי דיבור, מודל שפה, ואז סינתזה לקול | כל מעבר מוסיף עיכוב ומאבד מידע. תשובות איטיות ומקוטעות |
| מבוסס תורות (turn-based) | מודל אחד מעבד ומייצר קול, אבל בתורות נפרדים | חייב לחכות שתשתקו. הפסקה קצרה או רעש נחשבים "סוף התור", והוא קוטע בזמן הלא נכון |
| full-duplex (GPT-Live) | מודל אחד מעבד קלט ומייצר פלט ברציפות | מקבל החלטות כמה פעמים בשנייה: לדבר, להקשיב, לעצור, לקטוע, להפעיל כלי |
ChatGPT Voice המקורי היה שרשור. Advanced Voice Mode היה מבוסס תורות. GPT-Live הוא הדור השלישי.
8 ביולי 2026: OpenAI השיקה את GPT-Live ב-ChatGPT Voice, בשתי גרסאות, GPT-Live-1 ו-GPT-Live-1 mini. לפי החברה, יותר מ-150 מיליון אנשים מדברים עם ChatGPT מדי שבוע דרך קול והכתבה. במקביל, המשתמשים קיבלו שלוש רמות חשיבה: מיידית, בינונית וגבוהה, כשמאחורי הקלעים עבד GPT-5.5.
31 ביולי 2026: קול שנוצר עם GPT-Live קיבל סימן מים של SynthID, עם כלי אימות ציבורי ו-API לבדיקת מקור.
10 בספטמבר 2026: ההשקה ב-API, עם יכולות שנבנו למפתחים: העברת חשיבה למודל לבחירתכם, שליטה בטון ובקצב דרך הנחיית המערכת, תמלול מובנה, הטיית מילות מפתח, זיהוי תורות למי שצריך, וטלפוניה.
Building with ChatGPT Voice
הסרטון הרשמי של OpenAI: שליטה במחשב וניהול כמה סוכנים ב-ChatGPT Work וב-Codex, רק בקול. הפיצ'ר מופעל על GPT-Live, ולכן יכול לדבר, להקשיב ולתאם עבודה באפליקציה באותו זמן. בסרטון: גיבוש רעיון לפיצ'ר, ניפוי שגיאות עם Codex, והשקה.
OpenAI · 23.7.2026 · דקה ו-9 שניות
OpenAI gave ME early access to the new ChatGPT voice model (GPT-Live-1)
יוצר תוכן שקיבל גישה מוקדמת למודל ביום ההשקה ב-ChatGPT מדגים שיחות אמיתיות: קטיעות באמצע משפט, הפסקות לחשיבה, ואיך המודל מגיב כשמשנים כיוון. מתאים למי שרוצה לשמוע את ההבדל לפני שקורא על הארכיטקטורה.
FatherPhi · 8.7.2026 · 13 דקות
BREAKING: GPT-Live-1 Is in the API at 5¢ a Minute, I Interrupted It Mid-Call
בדיקה עצמאית יום אחרי ההשקה ב-API: מפתח מקים סשן, קוטע את המודל באמצע תשובה, ובודק איך הוא מתמודד עם רעש ועם שינוי נושא. שימושי כדי לראות את התהליך הטכני מקצה לקצה, ולא רק את ההדגמה של היצרן.
Hyperautomation Labs · 11.9.2026 · 10 דקות
הרעיון המרכזי ב-API הוא הפרדה בין שתי שכבות. השכבה הקדמית היא GPT-Live-1: מקשיבה, מדברת, ומחליטה מתי להעביר עבודה. השכבה האחורית היא המודל והכלים שאתם בוחרים: שם מתבצעים החשיבה, החיפוש והפעלת הכלים.
לפי OpenAI, אפשר לשלב מודל זול ומהיר למשימות בנפח גבוה, כמו תיאום פגישות ועדכוני הזמנה, ומודל חשיבה כמו GPT-6 Astra לבעיות מורכבות. אפשר גם לחבר מודל של ספק אחר. ההעברה מתבצעת בשני מסלולים: ניהול על ידי OpenAI (Responses delegation), או ניהול בצד שלכם (client delegation), כשהיישום שלכם מקבל את ההקשר, מריץ מה שצריך, ומחזיר תשובה לשכבת הקול.

קרדיט: OpenAI
התוצאה העסקית של ההפרדה הזו הופיעה בציטוט של מנהל הטכנולוגיות של חברת בריאות, Tony Stoyanov, בהודעת ההשקה: המעבר מארכיטקטורת שרשור ל-GPT-Live-1 "פישט את בסיס הקוד ב-80% והסיר 23 אלף שורות קוד".
OpenAI פרסמה מדדים שמשווים את המודל החדש ל-GPT-Realtime-2.1 ול-GPT-Realtime-2. אלה מדדי ההשקה של היצרן, ולכן כדאי לקרוא אותם כנקודת פתיחה ולא כהוכחה סופית.
| מדד | מה הוא מודד | GPT-Live-1 | GPT-Realtime-2.1 |
|---|---|---|---|
| Tau3 (Voice) Intelligence | משימות שירות לקוחות בדיבור, בתחומי תעופה, קמעונאות וטלקום, עם GPT-6 Astra ברקע | 86.2% | 45.7% |
| Full Duplex Bench v1.5 Interactivity | תגובה לדיבור ברקע, לדיבור אל אדם אחר, לאישורי הקשבה ולקטיעות | 80.1% | 45.4% |
| Turn-taking latency | כמה מהר הסוכן מתחיל לענות אחרי שהמשתמש סיים | 0.798 שניות | 1.41 שניות |

קרדיט: OpenAI

קרדיט: OpenAI

קרדיט: OpenAI
במדד הפעלת הכלים (Full Duplex Bench v3), שבודק בקשות מדוברות עם הפסקות ותיקונים עצמיים, OpenAI מדווחת על 87% הצלחה בסדר קריאות הכלים.
שימו לב לכוכבית בתחתית מדד Tau3: התוצאה מושגת עם GPT-6 Astra ברמת חשיבה בינונית ברקע. המודל הקולי לבד לא מגיע לשם, וזה בדיוק העניין.

קרדיט: OpenAI, Yelp
עד היום היו ב-API מעט קולות בזמן אמת. עם GPT-Live-1 OpenAI הרחיבה את הבחירה ל-12 קולות במבטאים, בניבים ובשפות שונות: Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta ו-Cinder. לפי החברה, אפשרויות הקול והשפות ימשיכו להתרחב בחודשים הקרובים. קול מותאם אישית למותג ניתן דרך צוות המכירות בלבד.

קרדיט: OpenAI
לפי התיעוד, המודל עובד דרך נקודת קצה ייעודית, v1/live/sessions, ולא דרך Chat Completions או Responses. שלוש דרכי חיבור:
הגדרת סשן בסיסית כוללת את שם המודל gpt-live-1, את המודאליות (קול וטקסט) ואת הנחיית השיחה, שבה מגדירים סגנון, טון, קצב, ומתי להעביר עבודה למודל הרקע.
מגבלת סשנים במקביל תלויה בדרגת החשבון: 25 בדרגה 1, 50 בדרגה 2, 200 בדרגה 3, 300 בדרגה 4 ו-500 בדרגה 5. תאריך הידע של המודל: 31 ביולי 2025.

קרדיט: OpenAI
5 סנט לדקה הם רק שכבת הקול. החיוב לפי שניות, בלי עיגול לדקה שלמה, וזה טוב לשיחות קצרות. אבל כל חשיבה שמתבצעת במודל הרקע, כל חיפוש וכל הפעלת כלי מחויבים בנפרד, לפי הטוקנים של אותו מודל.
חישוב לדוגמה למוקד קטן:
בדיקה עצמאית שפורסמה השבוע העלתה נקודה שכדאי לקחת בחשבון בשירות לקוחות: החיוב לפי זמן שיחה, לא לפי פנייה שנפתרה. סוכן שמאריך בשיחה מייקר את החודש, גם אם הוא נחמד מאוד.
ההודעה הרשמית מספרת חצי סיפור. הנה מה שעלה מבדיקות של מפתחים ומבקרים בימים הראשונים:
מה עבד:
מה פחות:
OpenAI לא פרסמה רשימת שפות נתמכות ל-API. לגבי GPT-Live בכלל היא כותבת שהמודל עבר אופטימיזציה לשפות הנפוצות ב-ChatGPT, ושבחלק מהשפות ייתכן מבטא לא טבעי או פערי שטף, שהיא עובדת לשפר.
לפני שבונים סוכן קולי בעברית, ארבע בדיקות שאנחנו ממליצים להריץ על שיחות אמיתיות:
| מתאים | פחות מתאים |
|---|---|
| סוכנים טלפוניים לתיאום, הזמנות ועדכוני סטטוס | תרחישים שבהם כל שנייה של שיחה עולה כסף ואין דרך לקצר |
| לימוד שפות ותרגול שיחה | סוכנים שדורשים ידע עסקי עמוק בלי לבנות שכבת רקע |
| עוזרים בדיבור בתוך אפליקציות ותוכנות | ארגונים שצריכים קול ממותג בלי מגע עם צוות המכירות |
| החלפת ארכיטקטורת שרשור קיימת שסובלת מעיכובים | שפות שעדיין לא נבדקו על שיחות אמיתיות |
הפער בין "עוזר קולי" ל"סוכן קולי" נסגר השבוע, ומי שיש לו מוקד טלפוני, גם קטן, צריך לשאול שאלה אחת: אילו שיחות אצלנו הן חוזרות, קצרות ומבוססות מידע ידוע? אישור תור, מצב הזמנה, שעות פתיחה, ניתוב. אלה השיחות הראשונות שכדאי לבדוק על המודל הזה, כי שם העלות נמוכה והסיכון קטן.
הסדר הנכון: קודם שכבת רקע שמכירה את העסק (מאגר ידע, כלים, כללי מדיניות), ורק אז שכבת הקול. מי שמתחיל מהקול מקבל סוכן שנשמע מצוין ולא יודע כלום. מדריך מעשי לבניית השכבה הזאת בעברית: סוכן AI לשירות לקוחות בעברית. ומי שרוצה להבין את מודל הרקע שמאחורי המספרים הטובים ביותר, ימצא אותו במדריך ל-GPT-6 Astra.
GPT-Live-1 לא הפך את ה-AI לחכם יותר. הוא הפך את השיחה איתו לטבעית יותר, והוציא את החשיבה למקום אחר. זו הפרדה נכונה, וזו גם הסיבה שהמחיר של 5 סנט לדקה הוא רק ההתחלה של החשבון. מי שבונה נכון, עם מודל רקע שמכיר את העסק, מקבל לראשונה סוכן טלפוני שאפשר לקטוע באמצע משפט. מי שמחבר רק את הקול, מקבל שיחה נעימה מאוד עם מישהו שלא יודע כלום.