Fable 5 лидирует в бенчмарке по кодингу, а показатели GPT-5.5 резко рухнули
Модель Claude Fable 5 установила новый рекорд в бенчмарке MirrorCode, в то время как GPT-5.5 показала резкое снижение результатов из-за изменения условий тестирования.
Модель Claude Fable 5 установила новый рекорд в бенчмарке MirrorCode, в то время как GPT-5.5 показала резкое снижение результатов из-за изменения условий тестирования.
GPT-5.6 Sol демонстрирует производительность на уровне флагманов Anthropic, сокращая расходы на использование ИИ в три раза и меняя правила игры на рынке.
Anthropic представила стратегии использования Claude Fable 5 в качестве менеджера для Sonnet 5, что позволяет сократить расходы на ИИ почти вдвое без потери качества.
Инженер Google DeepMind перенес культовую игру Command & Conquer: Generals на iOS за несколько часов, используя инструменты Anthropic.
Исследование Принстона показало, что современные ИИ-агенты слабы в долгосрочном планировании: в симуляции стартапа CEO-Bench большинство моделей обанкротились.
Правительство США обвиняет Anthropic в игнорировании протоколов безопасности при выпуске Fable 5, требуя невозможной защиты от взлома нейросетей.