Исследователи предложили способ обучать LLM суммаризации процессов мышления через RLVR
Исследователи представили ReSum — метод обучения LLM самостоятельному сжатию своих мыслей для повышения точности и сокращения затрат на токены.
Исследователи представили ReSum — метод обучения LLM самостоятельному сжатию своих мыслей для повышения точности и сокращения затрат на токены.
OpenAI и Anthropic вступают в борьбу за корпоративных клиентов, снижая стоимость доступа к своим API на фоне подготовки к IPO.
Система Mod-Guide внедряет технологию RAG в процессы модерации контента, позволяя ИИ учитывать уникальный культурный и исторический контекст малых этнических групп.
Исследователи представили LCLM — модели, которые сжимают входные данные в 16 раз до обработки декодером, обеспечивая кратный прирост скорости работы нейросетей.
Компания Anthropic столкнулась с критикой из-за ограничения мощности моделей для конкурентов и запуска сервисов, вытесняющих собственных партнеров.
GitHub внедрил экспериментальную функцию /security-review в Copilot CLI, позволяющую находить уязвимости в коде с помощью ИИ прямо в терминале.
Исследователи из Sapient представили архитектуру HRM-Text, позволившую обучить базовую модель с 1 млрд параметров всего за 1500 долларов, бросив вызов доминированию тяжелых трансформеров.
Команда Anthropic доказала, что современные ИИ-модели способны проводить реверс-инжиниринг патчей безопасности и создавать рабочие эксплойты в течение одного дня.
Google выпустила модель DiffusionGemma, использующую диффузионный метод вместо посимвольной генерации. Это позволяет обрабатывать 256 токенов параллельно и ускорять работу на GPU до 4 раз.
Новый бенчмарк ALE от ученых из Беркли показал, что GPT-5.5 справляется с комплексными профессиональными задачами лучше конкурентов, хотя общий уровень готовности ИИ остается низким.