ChatGPT, Claude או Gemini — מה מתאים למה
השאלה כמעט תמיד מגיעה באותה צורה: ״איזה כדאי לי לקחת?״ וכמעט תמיד השואל מצפה לשם.
לא תקבלו כזה כאן. לא מפחדנות, אלא כי כבר בערך שנה שהתשובה הכנה היא אחרת: ברוב המשימות הפער בין שלושת המודלים המובילים קטן מהפער שבין שאלה מנוסחת היטב לשאלה מנוסחת גרוע. ובמקומות שבהם כן יש הבדל ברור, הוא כמעט אף פעם לא נמצא במקום שבו טבלאות ההשוואה מחפשות אותו.
אז זה לא דירוג. זו החלטה לפי משימה — עם תאריך תוקף, כי לטקסט הזה יש תפוגה.
גילוי נאות
הטיוטה הראשונה של הטקסט הזה נכתבה עם Claude. זה צריך להיות גלוי לפני שנאמר כאן משהו על איזה מודל טוב יותר במה.
מכך נובעים שני דברים. ראשית, מאחורי כל מספר עומד מקור שאפשר לפתוח בעצמכם — אף אחד מהם לא מגיע מאתר השוואות; כולם מגיעים מדפי המחירים והתיעוד של הספקים עצמם, או ממקורות בעלי שם שצוינו. שנית, הפוסט הזה לא מכתיר מנצח. במקום שיש לי דעה, היא מסומנת ככזו.
ועוד דבר: אין כאן קישור שותפים. גם לא יכול להיות — OpenAI, Anthropic ו-Google פשוט לא מפעילות תוכניות שותפים. מה שבמקרה הזה מפשט את הדברים בצורה נעימה.
מה יש כרגע
What's available right now
GPT-5.6 Sol
Top model, coding and agents
Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.
GPT-5.6 Terra
Everyday work
The model the free and Go tiers run on.
GPT-5.6 Luna
Fast and cheap
Claude Fable 5
Strongest model, long-horizon work
Requires 30-day data retention — not available under zero data retention.
Claude Opus 4.8
Coding and agents
Claude Sonnet 5
Everyday work
Introductory price 2 / 10 until 31 August 2026.
Claude Haiku 4.5
Fast and cheap
The only model in this field without a million-token context.
Gemini 3.6 Flash
Workhorse
17% cheaper on output than 3.5 Flash — Google's current default model.
Gemini 3.5 Flash
Predecessor, still available
Gemini 3.5 Flash-Lite
High-volume work
The cheapest output price in the whole field.
Gemini 3.1 Pro
Google's largest model — still labelled preview
Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.
Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.
נכון ל-24 July 2026. מחירי מחירון בדולר אמריקאי, לפני הנחות לעיבוד באצווה (batch) או לשמירה במטמון (caching) — אלה מוזילות משמעותית את החשבון אצל כל שלושת הספקים. יש לבדוק אצל הספק לפני כל החלטה.
שני דברים בולטים ברגע ששמים את זה זה לצד זה.
חלון ההקשר מת כטיעון. במשך שנתיים, ״כמה טקסט נכנס״ היה קריטריון ההבחנה החזק ביותר. היום כל השלושה נמצאים סביב מיליון טוקנים — בערך 700,000 מילים, כמה רומנים עבים בבת אחת. רק המודל הקטן ביותר של Claude יוצא מהשורה עם 200,000. מי שעדיין בוחר לפי חלון ההקשר היום, בוחר לפי קריטריון שהספקים כבר הורידו מהשולחן מזמן.
המודל הגדול ביותר של Google נושא את התווית ״תצוגה מקדימה״ כבר חודשים. ב-19 במאי, בכנס המפתחים שלה, הכריזה Google על Gemini 3.5 Pro — ״כבר בשימוש פנימי״, יציאה ״בחודש הבא״. ב-21 ביולי, חודשיים אחר כך, הגיעו במקום זאת שלושה מודלים חדשים, ואף אחד מהם לא היה 3.5 Pro. המודל החזק ביותר הזמין של Google עדיין נושא את מספר הגרסה 3.1 ואת המילה ״Preview״ בשמו. כל השאר במבחר הוא מודל Flash — המחלקה המהירה והזולה.
זו לא שערורייה, אבל זו תבנית: אצל שלושתם, מה שמוכרז ומה שאפשר בפועל לקנות הם שתי רשימות שונות.
ההחלטה, לפי משימה
כתיבת קוד ועבודה אוטונומית ארוכה
זו הקטגוריה השנויה ביותר במחלוקת — והבנצ’מארקים לא סותרים זה את זה, הם מודדים דברים שונים.
Claude Opus 4.8 מוביל ב-SWE-Bench Pro (משימות GitHub אמיתיות) עם 69.2%. GPT-5.6 Sol קובע שיא חדש של 53.6 ב-״Agents’ Last Exam״, ומקדים שם בנוחות את Claude Fable 5. Gemini 3.5 Flash מדווח על 76.2% ב-Terminal-Bench 2.1. שלוש בחינות, שלושה מנצחים.
Simon Willison, שמשתמש בשלושתם מדי יום וכותב עליהם בפכחון כבר שנים, ניסח את זה כך אחרי ההשקה של GPT-5.6: למרות ציוני השיא, המודל לא נראה לו טוב יותר מ-Claude Fable במשימות קידוד מורכבות.
העצה שלי: אל תחליטו כאן לפי המודל, תחליטו לפי הכלים סביבו — עד כמה הדבר משתלב בעורך שלכם, בטרמינל שלכם, בהרגלים שלכם. המודלים קרובים זה לזה יותר מהסביבות שבהן הם רצים.
תמונה, וידאו, קול
הנקודה היחידה עם תשובה ברורה: Google.
Google היא היחידה מבין השלושה שבה יצירת תמונה ווידאו נמצאת על אותה רשימת מחירים כמו מודלי השפה — Veo 3.1 החל מ-$0.05 לשנייית וידאו, Imagen 4 החל מ-$0.02 לתמונה. בנוסף לכך יש את Gemini Omni, מודל וידאו שאפשר לערוך על פני כמה סבבי שיחה, והוא זוכר על מה דיברתם קודם באותה שיחה.
אם התחום שלכם הוא מדיה, זו לא החלטה צמודה.
קריאה וסיכום מסמכים ארוכים
לא משנה. באמת לא. ראו למעלה — שלושתם בולעים כמה מאות עמודים בבת אחת. השתמשו במה שכבר פתוח אצלכם.
הרבה עבודות קטנות, אוטומטיות
ל-Gemini 3.5 Flash-Lite יש את מחיר הפלט הזול ביותר בכל התחום — $0.30 בקלט ו-$2.50 בפלט למיליון טוקנים — פי שניים עד שלושה פחות מהמודלים הקטנים של שני הספקים האחרים.
אבל זהירות עם החשבון הזה, ראו את הקטע הבא.
אם אתם כבר חיים בתוך Google
הכניסה הזולה ביותר בתחום היא Google AI Plus ב-$4.99 — עם 400 GB אחסון בנוסף. והמסלול של Google ב-$19.99 כולל YouTube Premium Lite.
זו הסיבה האמיתית ש-Google מנצחת אצל משתמשים פרטיים, ואין לזה שום קשר לאיכות המודל. אם אתם משלמים על אחסון ועל YouTube בין כה וכה, ה-AI קרוב לחינם על הנייר.
אם הגנת מידע חשובה מקצועית
פרט שכמעט לא מופיע באף השוואה: המודל החזק ביותר של Anthropic, Fable 5, דורש שמירת נתונים של 30 יום ולא זמין כלל תחת מדיניות אפס-שמירת-נתונים. אם המשרד, הקליניקה או הלקוח שלכם מחייבים בדיוק את זה, הדגל נופל מהשולחן — ואתם נשארים עם Opus 4.8, לא עם Fable.
שורות כאלה חיות בתיעוד למפתחים, לא בדפי המוצר.
מה שהבנצ’מארקים משמיטים
המחיר לטוקן שבור כמדד. המודלים ״חושבים״ לפני שהם עונים, וטוקני החשיבה האלה נמצאים על אותו חשבון כמו התשובה. מודל בחצי המחיר לטוקן שחושב פי שלושה יותר זמן יוצא יקר יותר בסוף החודש. Willison אומר בדיוק את זה: השוואת מחיר-לטוקן גולמית הפכה למטעה. מי שבאמת רוצה לדעת כמה משהו עולה לו צריך להעביר את המשימה הטיפוסית שלו דרך שלושתם ולהסתכל על החשבון — לא על רשימת המחירים.
המבחנים מוערכים על ידי הנבחנים. אחרי שהמודלים של OpenAI פיגרו אחרי אלה של Anthropic ב-SWE-Bench Pro, פרסמה OpenAI ביקורת על אותו בנצ’מארק — בהערכה שכ-30% מהמשימות שלו שבורות. זה יכול להיות נכון לחלוטין מבחינה עובדתית. זה עדיין עד המעיד למען עצמו. ואותה זהירות תקפה גם בכיוון ההפוך: מי שחוגג בנצ’מארק שהוא מוביל בו מעוניין באותה מידה.
ומאז יולי 2026, הספק כבר לא מחליט לבד מתי מודל יוצא לדרך. GPT-5.6 קיבל אישור להפצה רחבה רק אחרי בדיקה שהושלמה על ידי גוף ממשלתי אמריקאי — Center for AI Standards and Innovation במשרד המסחר האמריקאי. זה אומר יותר על השנים הקרובות מכל אחוז בפוסט הזה.
כמה זה עולה
What it costs
ChatGPT Go
€8 / month
The cheap middle tier. Runs on Terra.
ChatGPT Plus
€23 / month
The plan most people mean. Free choice of model.
ChatGPT Pro
€229 / month
For constant use and Sol reasoning without a tight cap.
Claude Pro
$20 / month ($17 billed annually)
Includes Claude Code. No cheaper middle tier exists.
Claude Max
from $100 / month ($200 for 20×)
5× or 20× Pro's usage limits. Same models.
Google AI Plus
$4.99 / month
The cheapest entry in the field, incl. 400 GB storage.
Google AI Pro
$19.99 / month
Plus YouTube Premium Lite and storage — the bundle is the argument.
Google AI Ultra
$99.99 / month ($199.99 for 20×)
5× or 20× Pro's limits, 20 TB storage.
נכון ל-24 July 2026. OpenAI מציגה מחירים ביורו עבור גרמניה, ואילו Anthropic ו-Google מציגות דולרים — לכן שני המטבעות מופיעים כאן בדיוק כפי שכל ספק מציין אותם.
הפער שבולט: ל-Claude אין מסלול ביניים זול. הוא עובר ישר מחינם ל-$20. ל-ChatGPT יש לשם כך את Go ב-€8, Google AI Plus עומד על $4.99. מי שמשתמש ב-AI באופן קבוע אבל לא מקצועי, פשוט לא מוצא אצל Anthropic הצעה מתאימה.
ומהצד השני: Claude Pro כולל את Claude Code, כלי התכנות, ללא תוספת מחיר. מי שזה חשוב לו כבר יודע את זה.
למה לטקסט הזה יש תאריך תפוגה
תראו את הקצב.
OpenAI: GPT-5.1 בנובמבר 2025, 5.2 בדצמבר, 5.4 במרץ 2026, 5.5 ב-23 באפריל, 5.6 ב-9 ביולי. חמישה דורות בשמונה חודשים.
Google: Gemini 3.5 Flash ב-19 במאי, Gemini 3.6 Flash ב-21 ביולי. חודשיים.
מה שזה אומר בפועל: מנוי שנתי הוא לא הימור על מודל, הוא הימור על ספק — המודל שבחרתם לא יתקיים בצורה הזו בעוד שנה. Anthropic מפרסמת $17 במקום $20 בחיוב שנתי; אלה $36 חיסכון תמורת זה שלא תוכלו להתחרט במשך שנים עשר חודשים. בתחום שמוציא דגל חדש כל שמונה שבועות, זו העסקה הגרועה יותר.
שלמו חודשי. זו העצה המעשית ביותר בפוסט הזה כולו.
המסקנה שלי
אם אתם רוצים אחד ומעדיפים להפסיק לחשוב על זה: קחו את זה שהממשק שלו הכי פחות מפריע לכם. הפער באיכות ישפיע על העבודה שלכם פחות מהשאלה אם אתם נהנים לפתוח את הדבר הזה.
אם אתם יכולים לשלם על שניים, הצירוף ההגיוני הוא לא ״הכי טוב פלוס השני הכי טוב״ — אלא אחד לטקסט וקוד, אחד למדיה — ובמקום השני הזה, Google כמעט ללא מתחרים.
ואם בעוד שלושה חודשים תתהו שוב אם בחרתם נכון: הפוסט הזה יעודכן עד אז. היסטוריית הגרסאות בתחתית מראה לכם מה השתנה.
עבור הכלים שמסביב למודלים — תמונה, וידאו, מוזיקה, עריכה, אוטומציה — אני מנהל אינדקס נפרד ומתעדכן באופן שוטף של 137 כלי AI.
מקורות
הכול נבדק ב-24 ביולי 2026.
- תמחור ה-API של Gemini — Google, כל מחירי המודלים וחלונות ההקשר
- הצגת Gemini 3.6 Flash, 3.5 Flash-Lite ו-3.5 Flash Cyber — Google, 21 ביולי 2026
- Google משחררת שלושה מודלי Gemini חדשים — אבל לא 3.5 Pro — TechCrunch, 21 ביולי 2026
- כל מה שהוכרז ב-Google I/O 2026 — Google, 20 במאי 2026
- מסלולי ה-AI של Google — Google, מאי 2026
- משפחת GPT-5.6 החדשה: Luna, Terra, Sol — Simon Willison, 9 ביולי 2026, כולל מחירי API והקשר בנצ’מארקים
- מסלולים ומחירים — Anthropic
אם משהו כאן נראה לכם מיושן או שגוי: כתבו לי. בדיוק בשביל זה נמצא התאריך למעלה.
תגובות
התחברו כדי להגיב, לאהוב ולשמור. התחברות →
אין עדיין תגובות. כתבו את הראשונה.