דלג לתוכן
Gemini ו-Claudeהשוואה דרך צ׳אט 3

אותה שאלה נשלחת לשני המנועים.

Gemini מול Claude — מי נותן תשובה טובה יותר?

שאל שאלה והשווה בעצמך: אותה שאלה נשלחת ל-⁠Gemini ול-⁠Claude, ותקבל את שתי התשובות ותשובה משולבת.

למה להשוות דווקא בין Gemini ל-Claude?

Gemini ו-Claude הושקו באותו חודש, מרץ 2023, אם כי Gemini נקרא אז Bard וקיבל את שמו הנוכחי רק בפברואר 2024. מאחוריו עומדת Google, והפיתוח נעשה ב-Google DeepMind. את Claude מפתחת Anthropic, חברה שהקימו ב-2021 כמה מעובדי OpenAI לשעבר, ובהם דריו אמודיי ודניאלה אמודיי. החברה מזוהה עם הדגש על בטיחות AI.

ההשוואה בין השניים שימושית במיוחד כשהשאלה משלבת שני דברים: עובדות שצריך לדעת, וטקסט שצריך לכתוב היטב. רבים מזכירים את Gemini בזכות רוחב הידע הכללי, ואת Claude בזכות כתיבה ארוכה וזהירה. כשבקשה אחת דורשת את שניהם, למשל הסבר מדעי שצריך להפוך לטקסט לילדים, מעניין לראות מי מאזן ביניהם טוב יותר.

ההבדלים העיקריים בין Gemini ל-Claude

תחוםGeminiClaude
מי מפתחGoogle DeepMind, של GoogleAnthropic
הושקמרץ 2023, בשם Bardמרץ 2023
מה משתמשים רבים מצייניםידע כללי רחב, קשר לעולם של Googleכתיבה ארוכה, טון זהיר
בצ׳אט 3טקסט בלבד, בלי Gmail, Docs ו-Mapsטקסט בלבד

באפליקציה של Google, Gemini מתחבר לשירותים כמו Gmail, Docs ו-Maps, אבל כאן החיבורים האלה לא זמינים, ואף מנוע לא גולש ברשת בזמן אמת. כלומר, כל מה ש-Gemini עונה כאן נשען על מה שהמודל עצמו יודע, ומידע מהזמן האחרון עלול לחסור בו, בדיוק כמו אצל Claude. המודלים שעונים כאן הם בדרך כלל המהירים והחסכוניים של Google ושל Anthropic, ומודל חזק יותר של כל אחת מהן עשוי לענות אחרת.

לשיחה עם אחד מהם בלבד יש עמודים נפרדים: Gemini בעברית ו-Claude בעברית. בשיחה כזאת אפשר לעבור למנוע אחר באמצע, והשיחה נמשכת מאותה נקודה.

ידע רחב מול כתיבה זהירה

התיאורים הנפוצים של שני המודלים טובים כנקודת פתיחה, ותו לא. כך תבדקו אותם בעצמכם:

  • שאלות ידע: ל-Gemini יש שם של מודל עם ידע כללי רחב. בשאלות על היסטוריה, גאוגרפיה או מדע, בדקו את הפרטים הקטנים, כמו שנים, שמות ומספרים. שם רואים את ההבדל בין ידע לבין ניחוש שנשמע בטוח.
  • טקסטים ארוכים: Claude מקבל מחמאות רבות על כתיבה ארוכה ושקולה. בכתבה, במכתב או בסיכום מפורט, בדקו אם הטקסט שומר על קו אחד מההתחלה ועד הסוף, או מתפזר באמצע.
  • נושאים רגישים: טון זהיר עוזר כשכותבים על נושא טעון, למשל הודעה לעובדים על שינוי בתנאים או תגובה לביקורת ברשת. מצד שני, זהירות יתר יכולה להפוך תשובה פשוטה לשורה של הסתייגויות.
  • עברית: משימה עם ניבים או משלב רשמי תראה לכם מהר מי מרגיש בבית.

איך להשוות: עובדות לחוד, ניסוח לחוד

הדרך הפשוטה להשוות בין Gemini ל-Claude היא לקרוא כל תשובה פעמיים. בקריאה הראשונה התעלמו מהסגנון ובדקו רק תוכן: אילו עובדות יש בתשובה, האם היא עונה על מה ששאלתם, והאם יש בה טענה שנשמעת בטוחה מדי. בקריאה השנייה עשו את ההפך, והסתכלו רק על הכתיבה: מבנה, עברית, טון.

הפיצול הזה חשוב, כי טקסט כתוב היטב משכנע גם כשהוא טועה, ותשובה יבשה יכולה להיות מדויקת לגמרי. כשמפרידים בין הקריאות, לסגנון קשה יותר לטשטש טעות.

עוד שלושה דברים ששווה לבדוק:

  • אורך: אם אחת התשובות ארוכה פי שניים, חפשו מה יש בה שאין בשנייה. לפעמים זה מידע, ולפעמים רק מילים.
  • אי-ודאות: תשובה טובה מסמנת מה ידוע ומה שנוי במחלוקת. מודל שמציג השערה כעובדה דורש בדיקה כפולה.
  • מבנה: בקשו צורה מסוימת, טבלה או רשימה, ובדקו מי עמד בבקשה.

שאלות שכדאי לנסות

חלק מהשאלות כאן בנויות משני חלקים, ידע וכתיבה, כדי שתוכלו לראות את שני הצדדים בתשובה אחת. נסו אחת מהן בכלי שלמעלה:

  1. תסביר איך עובדת התפלת מים, ואחר כך תכתוב על זה פסקה לעלון של בית ספר יסודי. החלק הראשון בודק ידע, והשני בודק כתיבה לקהל מסוים.
  2. תסכם את העלילה של "סיפור פשוט" של ש״י עגנון בחמש שורות, בלי לגלות את הסוף. ידע ספרותי, עם הוראה שקל להפר.
  3. מה הקשר בין הצהרת כורש לשיבת ציון? תן תאריכים משוערים. שאלה היסטורית עם פרטים שאפשר לבדוק באנציקלופדיה.
  4. מה ידוע בוודאות על חומר אפל, ומה עדיין לא? מבחן לכנות: מודל טוב יפריד בין מה שידוע לבין מה שעדיין פתוח.
  5. תכתוב ברכה מחורזת ליום ההולדת ה-70 של סבתא שאוהבת גינון ושבץ נא. בקשה עם חרוזים חושפת מיד אם העברית טבעית או מאולצת.
  6. איך אומרים בעברית "It's raining cats and dogs"? תן שתי חלופות שישראלים באמת אומרים. כאן רואים אם המודל מתרגם את הרעיון או נתקע על המילים.
  7. תבנה לי תוכנית לימוד של שבועיים למבחן בסטטיסטיקה, שעתיים ביום, בטבלה. תכנון ומבנה באותה בקשה. בדקו שהשעות מסתדרות ושנשאר זמן לחזרה.

אם תדביקו טקסט משלכם, הורידו ממנו פרטים אישיים: השאלות נשלחות לעיבוד אצל Google ו-Anthropic, וגם למודל שכותב את התשובה המשולבת (כרגע של Anthropic).

מה אומרת רמת ההסכמה בין Gemini ל-Claude?

אחרי ששני המנועים עונים, צ׳אט 3 מחבר את התשובות לתשובה משולבת אחת ומציין את רמת ההסכמה ביניהן. הסכמה גבוהה מעודדת. Gemini ו-Claude פותחו בשתי חברות שונות, ובכל זאת שניהם יכולים לטעות באותו פרט, ולכן גם הסכמה כזאת היא לא הוכחה.

"הסכמה חלקית" אומרת שיש בסיס משותף ויש פרטים שבהם התשובות נפרדות. בשאלות שמשלבות עובדות והסבר, התחילו מהפרטים העובדתיים שבמחלוקת. הבדלי ניסוח יכולים לחכות.

וכשמופיע "המודלים חלוקים", זה הזמן לפתוח מקור חיצוני, או להוסיף קול שלישי ולשלוח את אותה שאלה גם ל-ChatGPT בעמוד ההשוואה המשולשת. ואם הנושא רפואי, משפטי או כספי, התייעצו עם איש מקצוע, גם כשהשניים מסכימים.

שאלות נפוצות

מה עדיף, Gemini או Claude?

תלוי במה שאתם צריכים. Gemini נחשב בעיני רבים לבעל ידע כללי רחב, ו-Claude לכותב זהיר של טקסטים ארוכים, אבל אלה רק נטיות כלליות. אם השאלה שלכם משלבת עובדות וטקסט, שלחו אותה לשניהם בכלי שבראש העמוד, ובדקו כל חלק בנפרד: את העובדות מול מקור, ואת הניסוח בקריאה בקול.

מה ההבדל בין Gemini ל-Claude?

Gemini הוא המודל של Google, ומאחורי הפיתוח שלו עומדת Google DeepMind; הוא התחיל במרץ 2023 בשם Bard. Claude הושק באותו חודש, והוא פרי עבודה של Anthropic, חברה צעירה יותר שמזוהה עם בטיחות AI. בתוך האפליקציה של Google, Gemini עובד גם עם המייל, המסמכים והמפות שלכם. כאן, בצ׳אט 3, אין חיבורים כאלה, ושני המודלים עונים על סמך מה שכתבתם ומה שהם עצמם יודעים.

מי מהם טוב יותר בעברית, Gemini או Claude?

שניהם מטפלים בעברית היטב, והאיכות משתנה לפי סוג המשימה. מי שכותב הרבה בעברית ירוויח מבדיקה אחת על טקסט אמיתי משלו, כמו מכתב רשמי, ברכה מחורזת או הסבר של ניב. הקריאה בקול עושה את העבודה: עברית מתורגמת קל יותר לשמוע מאשר לראות.

האם Gemini ו-Claude מחוברים לאינטרנט בצ׳אט 3?

לא. בצ׳אט 3 המנועים לא מחפשים ברשת בזמן אמת, וזה נכון גם ל-Gemini של Google. לכן תשובות על אירועים מהזמן האחרון עלולות להיות חסרות או לא מעודכנות. אם שאלתם על משהו שקרה השבוע, בדקו את התשובה במקור חדשותי, ושימו לב איזה מהמודלים מודה שהוא לא יודע.

למה Gemini ו-Claude נותנים תשובות שונות לאותה שאלה?

כי מדובר במודלים נפרדים, של Google ושל Anthropic. לפעמים ההבדל הוא רק בסגנון, ולפעמים אחד מהם טועה. רמת ההסכמה שהכלי מציג עוזרת להבין באיזה מצב אתם: הסכמה גבוהה, הסכמה חלקית או המודלים חלוקים. במחלוקת, בדקו את הנקודה השנויה במקור חיצוני לפני שאתם סומכים על אחת התשובות.

אפשר להשתמש ב-Gemini וב-Claude בחינם?

כן, דרך צ׳אט 3: בחינם, בלי הרשמה ובלי כרטיס אשראי. יש מגבלה יומית, ובה ההשוואות, גם בין שני מנועים, מוגבלות יותר מהודעות רגילות. ההיסטוריה נשמרת אצל צ׳אט 3 ומקושרת לדפדפן שלכם, ואפשר למחוק אותה. המודלים מגיעים דרך ה-API של שתי החברות, והגרסה יכולה להיות שונה ממה שרואים באפליקציות שלהן ולהשתנות עם הזמן.