Google представляет фреймворк для защиты от ИИ-агентов в интернете
Google представляет фреймворк безопасности для защиты от автономных ИИ-агентов в интернете, включая идентификацию агентов, анализ поведения и новые ИИ-устойчивые методы защиты.
Безопасность и этика искусственного интеллекта. Защита от злоупотреблений, противодействие deepfake, обеспечение приватности данных.
Google представляет фреймворк безопасности для защиты от автономных ИИ-агентов в интернете, включая идентификацию агентов, анализ поведения и новые ИИ-устойчивые методы защиты.
Scale AI и Корейский институт безопасности ИИ объявили о стратегическом партнерстве для разработки глобальных стандартов оценки и регулирования искусственного интеллекта.
Эксперты по безопасности ИИ предупреждают: традиционные методы кибербезопасности неэффективны против поведенческих угроз искусственного интеллекта. Необходим новый подход к красному тестированию моделей.
Cloudflare сообщает о переходе большинства интернет-трафика на пост-квантовое шифрование. Анализ угрозы квантовых компьютеров и прогресса в квантовых вычислениях.
Cloudflare представляет Merkle Tree Certificates — революционный подход к пост-квантовой безопасности, который решает проблему производительности TLS при использовании новых криптографических алгоритмов.
Генеративный ИИ позволяет создавать убедительные поддельные чеки для служебных расходов, ставя под угрозу системы корпоративного контроля и увеличивая риски мошенничества.
Адвокат предупредил, что ChatGPT не предоставляет адвокатскую тайну, и все ваши юридические вопросы могут быть использованы против вас в суде.
OpenAI раскрыла статистику: более миллиона пользователей еженедельно обсуждают с ChatGPT суицидальные мысли. Компания улучшила реакции модели на 65% при участии 170 экспертов.
Исследователи обнаружили метод обхода систем безопасности языковых моделей через манипуляцию проекционными матрицами, что ставит под вопрос эффективность текущих подходов к защите ИИ.
Агентные браузеры вроде Comet и Claude демонстрируют фундаментальные уязвимости интернета, созданного для людей. Скрытые инструкции могут управлять ИИ-агентами без ведома пользователя.