Google представил Speech-to-Retrieval — архитектуру для прямого поиска по голосу
Google Research представил Speech-to-Retrieval — технологию для прямого поиска по голосу без преобразования в текст, устраняя ошибки распознавания речи.
Новости о Google в контексте ИИ — технологический гигант с мощным AI-подразделением. DeepMind, Gemini, Bard. Пионер в машинном обучении и поиске.
Google Research представил Speech-to-Retrieval — технологию для прямого поиска по голосу без преобразования в текст, устраняя ошибки распознавания речи.
Google представила ИИ-агента Gemini 2.5 Pro Computer Use, который автономно работает в браузере: заполняет формы, нажимает кнопки и проходит капчи.
Google расширяет доступ к no-code платформе Opal в 15 странах, включая Канаду, Индию и Японию, с улучшениями производительности и отладки.
Фреймворк ReasoningBank позволяет ИИ-агентам учиться на успехах и ошибках, повышая эффективность решения задач на 8.3% и сокращая операционные затраты вдвое.
Google представил Gemini 2.5 Computer Use — ИИ-модель для управления пользовательскими интерфейсами. Агенты могут кликать, вводить текст и выполнять задачи в веб-приложениях.
Данные SimilarWeb показывают снижение трафика на австралийские новостные сайты после внедрения Google AI Overviews. Мелкие издатели предупреждают об увольнениях.
Google расширяет функциональность ИИ-ассистента Jules для разработчиков, добавляя инструменты командной строки и API для глубокой интеграции в рабочие процессы.
Google Research представила PASTA — агент обучения с подкреплением для интерактивной генерации изображений, который обучается на предпочтениях пользователя в реальном времени.
Google представила интерактивную сегментацию изображений в Snapseed для iOS. Технология работает полностью на устройстве, позволяя выделять объекты касанием за 20 мс.
Google блокирует ИИ-поиск по запросам о деменции Трампа, но обрабатывает аналогичные запросы о Байдене и Обаме, демонстрируя селективный подход к политически чувствительным темам.