Исследование выявило 3 ошибки в логике, из-за которых ИИ спотыкается даже на простых задачах
Исследование ARC-AGI-3 показало, что даже передовые модели вроде GPT-5.5 совершают критические ошибки в логике, не дотягивая до 1% успеха.
Исследование ARC-AGI-3 показало, что даже передовые модели вроде GPT-5.5 совершают критические ошибки в логике, не дотягивая до 1% успеха.
Глава OpenAI Сэм Альтман анонсировал запуск GPT-5.5 Cyber, специализированной модели для экспертов по кибербезопасности, ориентированной на защиту критической инфраструктуры.
OpenAI и AWS объявили о глубокой интеграции моделей GPT-5.5 и инструментов Codex в облачную платформу Amazon Bedrock для корпоративных клиентов.
OpenAI представила новое руководство по промптингу для GPT-5.5, призывая разработчиков отказаться от наследия старых моделей ради повышения эффективности.
OpenAI прекратила развитие Codex как отдельной линейки, объединив возможности программирования с основной моделью GPT-5.5 для улучшения агентных функций.
OpenAI выпустила GPT-5.5 — модель с упором на автономное выполнение задач и использование инструментов. Производительность выросла, но стоимость API увеличилась вдвое.
OpenAI готовится представить GPT-5.5 Spud — промежуточную модель с повышенной эффективностью токенов, которая уже обходит конкурентов в тестах на логику и дизайн.