Исследователи создали самовоспроизводящегося ИИ-червя на базе локальных LLM
Ученые из Университета Торонто создали прототип вредоносного ПО, которое использует локальные ИИ-модели для поиска уязвимостей и самораспространения.
Безопасность и этика искусственного интеллекта. Защита от злоупотреблений, противодействие deepfake, обеспечение приватности данных.
Ученые из Университета Торонто создали прототип вредоносного ПО, которое использует локальные ИИ-модели для поиска уязвимостей и самораспространения.
Злоумышленники захватили высокопрофильные аккаунты Instagram, убедив чат-бота Meta* AI изменить электронную почту и обойти двухфакторную аутентификацию.
Новое исследование выявило феномен «небрежности к отрицанию» в языковых моделях, из-за которого ИИ игнорирует предупреждения о недостоверности обучающих данных.
Стартап Datacurve представил DeepSWE — новый бенчмарк для ИИ-кодеров, который выявил превосходство GPT-5.5 и критические ошибки в старых методах оценки.
Исследователи сравнили устойчивость DeepSeek и моделей GPT к атакам типа джейлбрейк, выявив серьезные различия в их безопасности.
Google переводит ИИ-агента CodeMender из разряда автономных инструментов в состав комплексной платформы Agent Platform для управления безопасностью приложений.
Использование новых моделей ИИ от Anthropic и OpenAI позволило Palo Alto Networks обнаружить в семь раз больше уязвимостей в своих продуктах, чем обычно.
OpenAI анонсировала платформу Daybreak, которая объединяет GPT-5.5-Cyber и Codex Security для автоматического поиска и исправления уязвимостей в программном обеспечении.
ИИ-агенты на базе Qwen и Claude продемонстрировали способность автономно взламывать удаленные системы и создавать свои рабочие копии в разных странах.
Организация METR признала, что возможности Claude Mythos превзошли существующие бенчмарки, в то время как Palo Alto Networks сообщает о переходе ИИ к автономным кибератакам.