אמ;לק: בין אפריל ליוני 2026, OpenAI שחררו את GPT-5.5 (5$ קלט / 30$ פלט למיליון טוקנים), DeepSeek שחררו את V4 במשקלים פתוחים (עכשיו 0.435$ / 0.87$ לגרסת ה-Pro), Google השיקו ב-I/O את Gemini 3.5 Flash (1.50$ / 9$), ו-Anthropic הוציאו את Claude Fable 5, ואז משכו אותו שלושה ימים אחר כך בעקבות צו פיקוח על יצוא מארה"ב. Veo 4, Sora 3, Llama 5 ו"Qwen 4" מעולם לא יצאו. זאת הרשימה האמיתית נכון ל-19 ביוני 2026.
כל הפיד שלי מתלהב ממודלים שלא קיימים. Veo 4, Sora 3, Llama 5, Gemini 4, "Qwen 4": כולם צצו השנה בשרשורים נסערים, ואף אחד מהם לא אמיתי. אז עברתי על כל שחרור חזית מאפריל עד יוני 2026, הצלבתי מול עמודים רשמיים ותמחור רשמי, וזרקתי את השמועות לפח. מה שנשאר קצר, מוזר, ושימושי.
כל שחרור שתראו כאן מאומת, עדכני ל-19 ביוני 2026, ומתומחר ממקורות רשמיים. את המזויפים אני קובר בקצרה בסוף, כי לדעת מה לא יוצא חוסך לכם בדיוק כמה זמן.
מודלי הטקסט שבאמת יצאו
ארבעה מודלי טקסט הגדירו את הרבעון, ואי אפשר היה לפזר אותם רחוק יותר זה מזה במחיר. GPT-5.5 של OpenAI נחת ב-23 באפריל עם חלון הקשר של מיליון טוקנים וניצחונות בבנצ'מארקים של קוד, ב-5$ למיליון טוקני קלט ו-30$ למיליון טוקני פלט. יום אחד אחר כך, DeepSeek הפילו את V4 (גרסאות V4-Pro ו-V4-Flash), משקלים פתוחים תחת רישיון MIT, ו-ב-23 במאי הפכו את הנחת ההשקה של 75% לקבועה: V4-Pro עולה עכשיו 0.435$ קלט ו-0.87$ פלט. זה בערך פי 34 זול יותר בפלט מ-GPT-5.5, על ביצועים שכמעט נוגעים בחזית.
OpenAI shipped GPT-5.5 at $5/$30 per 1M tokens with a 1M context window, then shut down the Sora video app and deprecated its API.
הכי מתאים ל: General knowledge workers needing a capable all-in-one assistant, Developers wanting quick code generation with GPT Image and Codex integration
ואז Google ענו ב-I/O ב-19 וב-20 במאי. הם השיקו את Gemini 3.5 Flash ב-1.50$ קלט ו-9$ פלט, הכריזו על Gemini 3.5 Pro להשקה ביוני, וחשפו את Gemini Omni, מודל שמתחיל מווידאו ומשולב בתוך משפחת Gemini.
Google launched Gemini 3.5 Flash ($1.50/$9) and Gemini Omni at I/O 2026; the rumored Veo 4 never shipped.
הכי מתאים ל: Google Workspace users wanting native AI inside Docs, Gmail, and Sheets, Researchers needing citation-backed outputs via NotebookLM
רוצים את הקריאה הכנה שלי? לרוב העבודות בתשלום, GPT-5.5 ו-Gemini 3.5 עדיין מנצחים בליטוש ובאקוסיסטם. אבל אם החשבון שלכם הוא הצוואר בקבוק, קשה להתווכח עם DeepSeek V4-Flash ב-0.14$ קלט. תשוו את החשבון בפירוק התמחור של משפחת GPT-5.4 שלנו. ההבדל פה הוא לא ניואנס, הוא סדר גודל.
טיפ: תנתבו קריאות זולות ובנפח גבוה (סיכומים, סיווג, טיוטות) ל-DeepSeek V4-Flash ב-0.14$ למיליון קלט, ותשמרו את GPT-5.5 ל-5% מהפרומפטים שבאמת צריכים את ההיסק שלו. על 10 מיליון טוקנים ביום, הפיצול הזה חותך חשבון יומי של 300$ למתחת ל-40$. בשקלים זה הפער בין 33 אלף ש"ח לבערך 4,400 ש"ח בחודש.
סאגת Claude Fable 5: יצא, ונמשך תוך 72 שעות
הסיפור הזה פשוט פראי. Anthropic שחררו את Claude Opus 4.8 לזמינות כללית ב-28 במאי. ואז, ב-9 ביוני, הם הוציאו את Claude Fable 5, הגרסה הציבורית הראשונה של מחלקת ה"Mythos" המוגבלת שלהם, ב-10$ קלט ו-50$ פלט, לצד Mythos 5 הנעול לעבודות אבטחה סמוכות-ממשלה.
Anthropic shipped Opus 4.8, then released and within days suspended Claude Fable 5 and Mythos 5 under a US export-control directive.
הכי מתאים ל: Knowledge workers doing deep document analysis and long-form writing, Developers who need precise instruction-following for complex multi-step tasks
שלושה ימים אחר כך זה נעלם. ב-12 ביוני, צו פיקוח על יצוא מארה"ב הורה ל-Anthropic לחתוך גישה לשני המודלים מכל אזרח זר, בכל מקום, כולל העובדים של החברה עצמה. בלי יכולת לסנן לפי לאום בזמן אמת, Anthropic משכו אותם מכולם באותו יום, 12 ביוני. הדיווחים קוראים לזה הפעם הראשונה שמעבדה מובילה מורידה מודל פרוס מהאוויר בצו פדרלי. הטריגר המוצהר: הממשל האמין שמישהו מצא דרך לפצח (jailbreak) את Fable 5.
אם חיברתם משהו ל-Fable 5 בחלון של שלושת הימים, הוא עכשיו אופליין בלי תאריך שחזור. תיפלו חזרה ל-Opus 4.8 (5$ / 25$), שנשאר זמין ומכסה כמעט כל משימה שאינה אבטחתית. אל תבנו תלות בלעדית במודל אחד, כי בדיוק כמו פה, הוא יכול להיעלם בלילה.
הכלים זזו בשקט בזמן שהמודלים עשו רעש
שכבת הסוכנים וכלי הקוד המשיכה לשחרר בלי דרמות. Claude Code עדיין על קו ה-2.1.x, לא ה-2.2 שעליו שמועות: גרסה 2.1.179 נחתה ב-16 ביוני, והטלאים המשיכו להגיע, עם גרסה 2.1.183 שיצאה ב-19 ביוני. השינוי הבולט הגיע ב-10 ביוני עם גרסה 2.1.172, שבה תת-סוכנים יכולים עכשיו להוליד תת-סוכנים משלהם עד חמש רמות עומק. זאת רקורסיה אמיתית בכלי CLI שרץ בפרודקשן. בתור מי שמריץ Claude Code על שתי מכונות במקביל יומיום, רמת העומק החמישית היא ההבדל בין סוכן יחיד שנתקע לבין צוות שמפרק לבד פרויקט שלם.
Still on the 2.1.x line (v2.1.183 as of June 19, 2026); sub-agents can now spawn their own sub-agents up to five levels deep.
הכי מתאים ל: Senior developers who want to delegate long autonomous tasks and review results, DevOps teams integrating AI into CI pipelines for automated test fixing
סביבו, ה-Gemini CLI של Google (רישיון Apache 2.0) ונחילי תת-הסוכנים של Codex מ-OpenAI שמרו על הלחץ של הקוד הפתוח, בזמן שOpenAI Workspace Agents ו-Anthropic Managed Agents החליפו מכות בזירה הארגונית. גם הצנרת התבגרה: A2A v1.0 עברה ל-GA ו-MCP הוסיף תמיכת OAuth 2.1, שניהם עכשיו תחת ממשל של Linux Foundation. במילים פשוטות: הסטנדרטים שמחברים בין סוכנים הפכו מניסוי לתשתית.
השמועות שמעולם לא יצאו
אז אילו שחרורים מהוללים הם בעצם אוויר חם? לא מעט, והתבנית מספרת סיפור. כל אחד מהשמות למטה הופיע בעשרות פוסטים בביטחון מלא.
| השחרור שעליו שמעו | מה באמת נכון (יוני 2026) |
|---|---|
| Veo 4 | מעולם לא יצא. החשיפה של Google ב-I/O הייתה Gemini Omni, לא Veo 4 עצמאי. |
| Sora 3 | לא קיים. OpenAI סגרו את אפליקציית Sora ב-26 באפריל; ה-API הוצא משימוש ונסגר סופית ב-24 בספטמבר 2026. |
| Llama 5 | לא שוחרר. המודל של Meta השנה היה Muse Spark, פנייה למשקלים סגורים, לא Llama. |
| Claude Sonnet 4.7 | דולג. קו ה-Sonnet של Anthropic קופץ ל-4.8, ועדיין לא שוחרר נכון ל-19 ביוני 2026. |
| "Qwen 4" ו"Kling 4" | שמות שגויים. Alibaba משחררים Qwen 3.6; מודל הווידאו הנוכחי של Kuaishou הוא Kling 3.0. |
שימו לב לתבנית: מודלי וידאו כל הזמן מחליקים קדימה, ושמות רועשים של "גרסה ראשית הבאה" נוטים להיות המצאות של מעריצים. כלל אצבע: ככל שהמספר עגול ומרשים יותר, כך גדל הסיכוי שמישהו פשוט המציא אותו.
טיפ: לפני שאתם בונים על מודל כלשהו, תחפשו את כרטיס המודל הרשמי שלו ואת מחיר ה-API למיליון טוקנים. אם אף אחד מהשניים לא קיים, הוא עוד לא באמת שוחרר. הבדיקה הזאת לבדה קברה כל שחרור מזויף למעלה, בפחות משלוש דקות לכל אחד. אל תסתמכו על צילום מסך, כי צילומי מסך מזייפים בקלות.
למה זה חשוב לכם כשאתם בוחרים
הסיפור האמיתי של אביב 2026 הוא לא השקה בודדת. הוא פער של פי 34 במחיר הפלט בין מודל החזית הפתוח הזול ביותר לבין הסגור היקר ביותר, ועוד סיכון חדש: מודל יכול עכשיו להיעלם בן לילה בצו ממשלתי. שני הכוחות האלה אמורים לשנות איך אתם מתכננים את הסטאק, לא רק איזה כלי אתם פותחים בבוקר.
אם עלות היא האילוץ שלכם, שכבת המשקלים הפתוחים (DeepSeek V4, Qwen 3.6, Kimi K2.6) מספיק טובה לרוב העבודות בשבריר מהמחיר. אם אמינות חשובה יותר, המודלים הסגורים עדיין מובילים. אבל Fable 5 הוכיח ש"זמין היום" זה לא "זמין בשבוע הבא", אז תחווטו מודל גיבוי מהיום הראשון. בפועל זה אומר שורת קוד אחת שמחליפה ספק, לא ארכיטקטורה מחדש בלחץ.
שאלות נפוצות
DeepSeek V4 באמת זול יותר מ-GPT-5.5?
כן, בפער עצום. נכון ליוני 2026, DeepSeek V4-Pro עולה 0.435$ קלט ו-0.87$ פלט למיליון טוקנים, בזמן ש-GPT-5.5 עולה 5$ קלט ו-30$ פלט. זה הופך את V4-Pro לזול יותר בפלט בערך פי 34, ו-V4-Flash (0.14$ / 0.28$) זול עוד יותר. DeepSeek גם פתוח במשקלים תחת רישיון MIT, אז אתם יכולים להריץ אותו על התשתית שלכם בלי לשלם לאף אחד למיליון טוקן.
מה קרה ל-Claude Fable 5?
Anthropic שחררו את Claude Fable 5 ב-9 ביוני 2026, ואז השעו אותו (ואת Mythos 5) ב-12 ביוני אחרי צו פיקוח על יצוא מארה"ב שאסר גישה לאזרחים זרים. נכון ל-19 ביוני 2026, שני המודלים אופליין לכל המשתמשים, בלי תאריך שחזור מוכרז. אם בניתם עליו, ההמלצה היחידה היא לעבור ל-Opus 4.8 כבר עכשיו.
האם Google שחררו את Veo 4 ב-I/O 2026?
לא. למרות ספקולציות כבדות, Veo 4 מעולם לא הוכרז. החשיפה של Google ב-I/O 2026 בתחום הווידאו הייתה Gemini Omni, מודל שמתחיל מווידאו בתוך משפחת Gemini. מודלי הווידאו שעדיין רצים אצל Google הם קו Veo 3.1, כולל Veo 3.1 Lite.
מהי הגרסה האחרונה של Claude Code?
נכון ל-19 ביוני 2026, Claude Code נמצא בגרסה 2.1.183, עדיין בסדרת ה-2.1.x (גרסה 2.1.179 נחתה ב-16 ביוני, וגרסה 2.1.183 יצאה ב-19 ביוני). אין גרסה 2.2. הפיצ'ר הבולט האחרון, שנוסף בגרסה 2.1.172 ב-10 ביוני, מאפשר לתת-סוכנים להוליד תת-סוכנים משלהם עד חמש רמות עומק, וזה משנה את הדרך שבה אתם מפרקים פרויקט גדול לעבודה מקבילה.
אם אתם שואלים אותי
התמורה הכי טובה לכסף עכשיו: DeepSeek V4 (משקלים פתוחים, MIT, 0.435$ / 0.87$ ל-Pro) לעבודה בנפח גבוה שבה אתם שולטים בסטאק.
הכל-בכל הכי טוב: GPT-5.5 או Gemini 3.5 אם אתם רוצים ליטוש, אקוסיסטם ותמיכה מעל מחיר נטו.
הצעד הבא שלכם: תבחרו מודל זול אחד ומודל פרימיום אחד, תחווטו את שניהם לאפליקציה מאחורי מתג יחיד, ותריצו את עומס העבודה האמיתי שלכם דרך כל אחד במשך יום. הפער במחיר כבר מספיק גדול שהבדיקה משלמת על עצמה לפני הצהריים. ועוד דבר: תסמנו את העמוד הזה, כי עד אוגוסט חצי ממנו כבר יהיה לא מעודכן. מתי בפעם האחרונה בדקתם כמה אתם משלמים על מודל, שמודל זול פי 34 היה מבצע את אותה משימה בדיוק?
