OpenAI ו-Anthropic הציגו דור חדש של בינה מלאכותית

Anthropic ו-OpenAI הציגו כמעט בו-זמנית דגמי AI חדשים: Claude Opus 5.5 ו-GPT-6 Sol/Luna. החברות מורידות את עלות ה-API ומשפרות את היעילות, תוך העברת המיקוד ממרוץ הכוח למאבק על מחיר וביצועים. בדיקות בלתי תלויות מראות הובלה של Anthropic בתכנות, ושל OpenAI בתהליכים עסקיים.

ב-22 בספטמבר, Anthropic ו-OpenAI הציגו כמעט בו-זמנית את הדור הבא של מודלי הבינה המלאכותית שלהן. Anthropic השיקה את Claude Opus 5.5, בעוד OpenAI השיקה את GPT-6 Sol ו-GPT-6 Luna. שתי החברות הורידו משמעותית את עלות ה-API: אצל Anthropic העלות ירדה ל-4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט, בעוד OpenAI מדווחת על הפחתה של כ-50% ביחס למחירי הדור הקודם. Anthropic גם פתרה את בעיית ה"Claudish" – הנטייה של המודל לניסוחים תבניתיים. לפי בדיקות בלתי תלויות, Claude Opus 5.5 קיבלה 58 נקודות במדד Intelligence Index, ותפסה את המקום הראשון, והראתה דיוק של 67.7% ב-Humanity's Last Exam לעומת 57.2% של GPT-6 Astra. בתכנות, Opus 5.5 קיבלה 66.4% ב-Terminal-Bench 4.0 לעומת 57.9% של GPT-6 Astra. עם זאת, בתהליכים עסקיים (AutomationBench), GPT-6 Astra קיבלה 41.4% לעומת 40% של Opus 5.5, ובמחקר מדעי (Terminal-Bench-Science) – 64.6% לעומת 58.7%. המאמר מציין כי הורדות המחיר נובעות מתחרות, במיוחד מצד דגמים סיניים, ומלחץ רגולטורי, כולל חוק ה-AI האירופי. עבור חברות ישראליות, זה פותח הזדמנויות אך דורש בחינה מחודשת של פרוטוקולי האבטחה.

OpenAI ו-Anthropic הציגו דור חדש של בינה מלאכותית