Почему ИИ-агенты заходят в тупик: проблема не в поиске, а в неумении уточнять детали
Новое исследование Tencent и Университета Цинхуа выявило главную слабость ИИ-агентов: они предпочитают бесконечный поиск простому уточнению задачи у пользователя.
Новости о нейросетях для программирование с AI, кодинг-ассистенты, AI для разработчиков, инструменты и фреймворки
Новое исследование Tencent и Университета Цинхуа выявило главную слабость ИИ-агентов: они предпочитают бесконечный поиск простому уточнению задачи у пользователя.
Стартап Base44, принадлежащий Wix, выпускает собственную языковую модель Base1, чтобы снизить зависимость от внешних API и улучшить экономику продукта.
Что включает ИТ-аудит компании, какие риски он выявляет и почему это первый шаг к автоматизации и безопасности.
Система Murakkab от MIT и Microsoft автоматизирует настройку сложных ИИ-цепочек, сокращая расходы на облачные вычисления и потребление энергии до 75%.
OpenAI представила функцию Record & Replay для приложения Codex, позволяющую ИИ запоминать рабочие процессы пользователя и повторять их автономно.
Разработчики теперь могут превращать сессии кодинга в Claude Code в интерактивные веб-страницы с автоматическим обновлением и историей версий.
Модель GLM-5.2 от Z.AI показала превосходство над GPT-5.5 в сложных задачах программирования, предлагая открытые веса и контекстное окно в 1 миллион токенов.
Исследователи представили CacheWise — систему управления кэшем для LLM, которая значительно ускоряет работу ИИ-агентов за счет умного предсказания повторного использования данных.
Новое исследование SWE-Explore показало, что ИИ-агенты для кодинга успешно находят нужные файлы, но катастрофически теряют точность при локализации конкретных строк с багами.
Система Mod-Guide внедряет технологию RAG в процессы модерации контента, позволяя ИИ учитывать уникальный культурный и исторический контекст малых этнических групп.