השאלה כמעט תמיד מגיעה באותה צורה: ״איזה כדאי לי לקחת?״ וכמעט תמיד השואל מצפה לשם.

לא תקבלו כזה כאן. לא מפחדנות, אלא כי כבר בערך שנה שהתשובה הכנה היא אחרת: ברוב המשימות הפער בין שלושת המודלים המובילים קטן מהפער שבין שאלה מנוסחת היטב לשאלה מנוסחת גרוע. ובמקומות שבהם כן יש הבדל ברור, הוא כמעט אף פעם לא נמצא במקום שבו טבלאות ההשוואה מחפשות אותו.

אז זה לא דירוג. זו החלטה לפי משימה — עם תאריך תוקף, כי לטקסט הזה יש תפוגה.

גילוי נאות

הטיוטה הראשונה של הטקסט הזה נכתבה עם ⁦Claude⁩. זה צריך להיות גלוי לפני שנאמר כאן משהו על איזה מודל טוב יותר במה.

מכך נובעים שני דברים. ראשית, מאחורי כל מספר עומד מקור שאפשר לפתוח בעצמכם — אף אחד מהם לא מגיע מאתר השוואות; כולם מגיעים מדפי המחירים והתיעוד של הספקים עצמם, או ממקורות בעלי שם שצוינו. שנית, הפוסט הזה לא מכתיר מנצח. במקום שיש לי דעה, היא מסומנת ככזו.

ועוד דבר: אין כאן קישור שותפים. גם לא יכול להיות — ⁦OpenAI⁩,‏ ⁦Anthropic⁩ ו-⁦Google⁩ פשוט לא מפעילות תוכניות שותפים. מה שבמקרה הזה מפשט את הדברים בצורה נעימה.

מה יש כרגע

What's available right now

ChatGPT OpenAI

GPT-5.6 Sol

Top model, coding and agents

$5 / $30 1,050,000 tokens 9 July 2026

Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.

GPT-5.6 Terra

Everyday work

$2.50 / $15 1,050,000 tokens 9 July 2026

The model the free and Go tiers run on.

GPT-5.6 Luna

Fast and cheap

$1 / $6 1,050,000 tokens 9 July 2026

Claude Anthropic

Claude Fable 5

Strongest model, long-horizon work

$10 / $50 1,000,000 tokens 2026

Requires 30-day data retention — not available under zero data retention.

Claude Opus 4.8

Coding and agents

$5 / $25 1,000,000 tokens 2026

Claude Sonnet 5

Everyday work

$3 / $15 1,000,000 tokens 2026

Introductory price 2 / 10 until 31 August 2026.

Claude Haiku 4.5

Fast and cheap

$1 / $5 200,000 tokens 2025

The only model in this field without a million-token context.

Gemini Google

Gemini 3.6 Flash

Workhorse

$1.50 / $7.50 1,048,576 tokens 21 July 2026

17% cheaper on output than 3.5 Flash — Google's current default model.

Gemini 3.5 Flash

Predecessor, still available

$1.50 / $9 1,048,576 tokens 19 May 2026

Gemini 3.5 Flash-Lite

High-volume work

$0.30 / $2.50 1,048,576 tokens 21 July 2026

The cheapest output price in the whole field.

Gemini 3.1 Pro

Google's largest model — still labelled preview

$2–$4 / $12–$18 1,048,576 tokens 2026

Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.

Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.

נכון ל-24 July 2026. מחירי מחירון בדולר אמריקאי, לפני הנחות לעיבוד באצווה (batch) או לשמירה במטמון (caching) — אלה מוזילות משמעותית את החשבון אצל כל שלושת הספקים. יש לבדוק אצל הספק לפני כל החלטה.

שני דברים בולטים ברגע ששמים את זה זה לצד זה.

חלון ההקשר מת כטיעון. במשך שנתיים, ״כמה טקסט נכנס״ היה קריטריון ההבחנה החזק ביותר. היום כל השלושה נמצאים סביב מיליון טוקנים — בערך ⁦700,000⁩ מילים, כמה רומנים עבים בבת אחת. רק המודל הקטן ביותר של ⁦Claude⁩ יוצא מהשורה עם ⁦200,000⁩. מי שעדיין בוחר לפי חלון ההקשר היום, בוחר לפי קריטריון שהספקים כבר הורידו מהשולחן מזמן.

המודל הגדול ביותר של ⁦Google⁩ נושא את התווית ״תצוגה מקדימה״ כבר חודשים. ב-19 במאי, בכנס המפתחים שלה, הכריזה ⁦Google⁩ על ⁦Gemini 3.5 Pro⁩ — ״כבר בשימוש פנימי״, יציאה ״בחודש הבא״. ב-21 ביולי, חודשיים אחר כך, הגיעו במקום זאת שלושה מודלים חדשים, ואף אחד מהם לא היה ⁦3.5 Pro⁩. המודל החזק ביותר הזמין של ⁦Google⁩ עדיין נושא את מספר הגרסה ⁦3.1⁩ ואת המילה ״Preview״ בשמו. כל השאר במבחר הוא מודל ⁦Flash⁩ — המחלקה המהירה והזולה.

זו לא שערורייה, אבל זו תבנית: אצל שלושתם, מה שמוכרז ומה שאפשר בפועל לקנות הם שתי רשימות שונות.

ההחלטה, לפי משימה

כתיבת קוד ועבודה אוטונומית ארוכה

זו הקטגוריה השנויה ביותר במחלוקת — והבנצ’מארקים לא סותרים זה את זה, הם מודדים דברים שונים.

⁦Claude Opus 4.8⁩ מוביל ב-⁦SWE-Bench Pro⁩ (משימות ⁦GitHub⁩ אמיתיות) עם ⁦69.2%⁩. ⁦GPT-5.6 Sol⁩ קובע שיא חדש של ⁦53.6⁩ ב-״⁦Agents’ Last Exam⁩״, ומקדים שם בנוחות את ⁦Claude Fable 5⁩. ⁦Gemini 3.5 Flash⁩ מדווח על ⁦76.2%⁩ ב-⁦Terminal-Bench 2.1⁩. שלוש בחינות, שלושה מנצחים.

⁦Simon Willison⁩, שמשתמש בשלושתם מדי יום וכותב עליהם בפכחון כבר שנים, ניסח את זה כך אחרי ההשקה של ⁦GPT-5.6⁩: למרות ציוני השיא, המודל לא נראה לו טוב יותר מ-⁦Claude Fable⁩ במשימות קידוד מורכבות.

העצה שלי: אל תחליטו כאן לפי המודל, תחליטו לפי הכלים סביבו — עד כמה הדבר משתלב בעורך שלכם, בטרמינל שלכם, בהרגלים שלכם. המודלים קרובים זה לזה יותר מהסביבות שבהן הם רצים.

תמונה, וידאו, קול

הנקודה היחידה עם תשובה ברורה: ⁦Google⁩.

⁦Google⁩ היא היחידה מבין השלושה שבה יצירת תמונה ווידאו נמצאת על אותה רשימת מחירים כמו מודלי השפה — ⁦Veo 3.1⁩ החל מ-⁦$0.05⁩ לשנייית וידאו, ⁦Imagen 4⁩ החל מ-⁦$0.02⁩ לתמונה. בנוסף לכך יש את ⁦Gemini Omni⁩, מודל וידאו שאפשר לערוך על פני כמה סבבי שיחה, והוא זוכר על מה דיברתם קודם באותה שיחה.

אם התחום שלכם הוא מדיה, זו לא החלטה צמודה.

קריאה וסיכום מסמכים ארוכים

לא משנה. באמת לא. ראו למעלה — שלושתם בולעים כמה מאות עמודים בבת אחת. השתמשו במה שכבר פתוח אצלכם.

הרבה עבודות קטנות, אוטומטיות

ל-⁦Gemini 3.5 Flash-Lite⁩ יש את מחיר הפלט הזול ביותר בכל התחום — ⁦$0.30⁩ בקלט ו-⁦$2.50⁩ בפלט למיליון טוקנים — פי שניים עד שלושה פחות מהמודלים הקטנים של שני הספקים האחרים.

אבל זהירות עם החשבון הזה, ראו את הקטע הבא.

אם אתם כבר חיים בתוך Google

הכניסה הזולה ביותר בתחום היא ⁦Google AI Plus⁩ ב-⁦$4.99⁩ — עם ⁦400 GB⁩ אחסון בנוסף. והמסלול של ⁦Google⁩ ב-⁦$19.99⁩ כולל ⁦YouTube Premium Lite⁩.

זו הסיבה האמיתית ש-⁦Google⁩ מנצחת אצל משתמשים פרטיים, ואין לזה שום קשר לאיכות המודל. אם אתם משלמים על אחסון ועל ⁦YouTube⁩ בין כה וכה, ה-⁦AI⁩ קרוב לחינם על הנייר.

אם הגנת מידע חשובה מקצועית

פרט שכמעט לא מופיע באף השוואה: המודל החזק ביותר של ⁦Anthropic⁩,‏ ⁦Fable 5⁩, דורש שמירת נתונים של 30 יום ולא זמין כלל תחת מדיניות אפס-שמירת-נתונים. אם המשרד, הקליניקה או הלקוח שלכם מחייבים בדיוק את זה, הדגל נופל מהשולחן — ואתם נשארים עם ⁦Opus 4.8⁩, לא עם ⁦Fable⁩.

שורות כאלה חיות בתיעוד למפתחים, לא בדפי המוצר.

מה שהבנצ’מארקים משמיטים

המחיר לטוקן שבור כמדד. המודלים ״חושבים״ לפני שהם עונים, וטוקני החשיבה האלה נמצאים על אותו חשבון כמו התשובה. מודל בחצי המחיר לטוקן שחושב פי שלושה יותר זמן יוצא יקר יותר בסוף החודש. ⁦Willison⁩ אומר בדיוק את זה: השוואת מחיר-לטוקן גולמית הפכה למטעה. מי שבאמת רוצה לדעת כמה משהו עולה לו צריך להעביר את המשימה הטיפוסית שלו דרך שלושתם ולהסתכל על החשבון — לא על רשימת המחירים.

המבחנים מוערכים על ידי הנבחנים. אחרי שהמודלים של ⁦OpenAI⁩ פיגרו אחרי אלה של ⁦Anthropic⁩ ב-⁦SWE-Bench Pro⁩, פרסמה ⁦OpenAI⁩ ביקורת על אותו בנצ’מארק — בהערכה שכ-⁦30%⁩ מהמשימות שלו שבורות. זה יכול להיות נכון לחלוטין מבחינה עובדתית. זה עדיין עד המעיד למען עצמו. ואותה זהירות תקפה גם בכיוון ההפוך: מי שחוגג בנצ’מארק שהוא מוביל בו מעוניין באותה מידה.

ומאז יולי 2026, הספק כבר לא מחליט לבד מתי מודל יוצא לדרך. ⁦GPT-5.6⁩ קיבל אישור להפצה רחבה רק אחרי בדיקה שהושלמה על ידי גוף ממשלתי אמריקאי — ⁦Center for AI Standards and Innovation⁩ במשרד המסחר האמריקאי. זה אומר יותר על השנים הקרובות מכל אחוז בפוסט הזה.

כמה זה עולה

What it costs

ChatGPT OpenAI

ChatGPT Go

€8 / month

The cheap middle tier. Runs on Terra.

ChatGPT Plus

€23 / month

The plan most people mean. Free choice of model.

ChatGPT Pro

€229 / month

For constant use and Sol reasoning without a tight cap.

Claude Anthropic

Claude Pro

$20 / month ($17 billed annually)

Includes Claude Code. No cheaper middle tier exists.

Claude Max

from $100 / month ($200 for 20×)

5× or 20× Pro's usage limits. Same models.

Gemini Google

Google AI Plus

$4.99 / month

The cheapest entry in the field, incl. 400 GB storage.

Google AI Pro

$19.99 / month

Plus YouTube Premium Lite and storage — the bundle is the argument.

Google AI Ultra

$99.99 / month ($199.99 for 20×)

5× or 20× Pro's limits, 20 TB storage.

נכון ל-24 July 2026. OpenAI מציגה מחירים ביורו עבור גרמניה, ואילו Anthropic ו-Google מציגות דולרים — לכן שני המטבעות מופיעים כאן בדיוק כפי שכל ספק מציין אותם.

הפער שבולט: ל-⁦Claude⁩ אין מסלול ביניים זול. הוא עובר ישר מחינם ל-⁦$20⁩. ל-⁦ChatGPT⁩ יש לשם כך את ⁦Go⁩ ב-⁦€8⁩, ⁦Google AI Plus⁩ עומד על ⁦$4.99⁩. מי שמשתמש ב-⁦AI⁩ באופן קבוע אבל לא מקצועי, פשוט לא מוצא אצל ⁦Anthropic⁩ הצעה מתאימה.

ומהצד השני: ⁦Claude Pro⁩ כולל את ⁦Claude Code⁩, כלי התכנות, ללא תוספת מחיר. מי שזה חשוב לו כבר יודע את זה.

למה לטקסט הזה יש תאריך תפוגה

תראו את הקצב.

⁦OpenAI⁩:‏ ⁦GPT-5.1⁩ בנובמבר 2025,‏ ⁦5.2⁩ בדצמבר,‏ ⁦5.4⁩ במרץ 2026,‏ ⁦5.5⁩ ב-23 באפריל,‏ ⁦5.6⁩ ב-9 ביולי. חמישה דורות בשמונה חודשים.

⁦Google⁩:‏ ⁦Gemini 3.5 Flash⁩ ב-19 במאי,‏ ⁦Gemini 3.6 Flash⁩ ב-21 ביולי. חודשיים.

מה שזה אומר בפועל: מנוי שנתי הוא לא הימור על מודל, הוא הימור על ספק — המודל שבחרתם לא יתקיים בצורה הזו בעוד שנה. ⁦Anthropic⁩ מפרסמת ⁦$17⁩ במקום ⁦$20⁩ בחיוב שנתי; אלה ⁦$36⁩ חיסכון תמורת זה שלא תוכלו להתחרט במשך שנים עשר חודשים. בתחום שמוציא דגל חדש כל שמונה שבועות, זו העסקה הגרועה יותר.

שלמו חודשי. זו העצה המעשית ביותר בפוסט הזה כולו.

המסקנה שלי

אם אתם רוצים אחד ומעדיפים להפסיק לחשוב על זה: קחו את זה שהממשק שלו הכי פחות מפריע לכם. הפער באיכות ישפיע על העבודה שלכם פחות מהשאלה אם אתם נהנים לפתוח את הדבר הזה.

אם אתם יכולים לשלם על שניים, הצירוף ההגיוני הוא לא ״הכי טוב פלוס השני הכי טוב״ — אלא אחד לטקסט וקוד, אחד למדיה — ובמקום השני הזה, ⁦Google⁩ כמעט ללא מתחרים.

ואם בעוד שלושה חודשים תתהו שוב אם בחרתם נכון: הפוסט הזה יעודכן עד אז. היסטוריית הגרסאות בתחתית מראה לכם מה השתנה.

עבור הכלים שמסביב למודלים — תמונה, וידאו, מוזיקה, עריכה, אוטומציה — אני מנהל אינדקס נפרד ומתעדכן באופן שוטף של ⁦137⁩ כלי ⁦AI⁩.

מקורות

הכול נבדק ב-24 ביולי 2026.

אם משהו כאן נראה לכם מיושן או שגוי: כתבו לי. בדיוק בשביל זה נמצא התאריך למעלה.