Внутренний монолог Claude стал доступен для чтения благодаря методу J-Lens
Anthropic представила инструмент J-Lens, который позволяет видеть внутренние процессы рассуждений модели Claude до того, как она выдаст готовый ответ.
Революция искусственного интеллекта в научных исследованиях. От предсказания структуры белков до поиска новых лекарств. Машинное обучение в физике, химии, биологии, астрономии.
Anthropic представила инструмент J-Lens, который позволяет видеть внутренние процессы рассуждений модели Claude до того, как она выдаст готовый ответ.
Исследование UC Berkeley выявило резкий рост отличных оценок после запуска ChatGPT, который связан с использованием ИИ в домашних заданиях, а не с успехами в учебе.
OpenAI запустила LifeSciBench — экспертный бенчмарк из 750 задач для оценки работы ИИ в области биомедицины и фармацевтики.
Исследование причин, по которым популярные языковые модели, включая ChatGPT, испытывают трудности с грамматикой и контекстом романских языков.
Британский стартап Oriole Networks совместно с AMD развернул первую коммерческую ИИ-систему на базе фотонной сети, радикально снижая энергопотребление и простои GPU.
Ученые из MIT и IBM создали датасет ChartNet, содержащий более миллиона графиков, чтобы научить ИИ-модели точно интерпретировать визуальные данные и бизнес-отчеты.
Масштабный аудит 2,5 миллионов биомедицинских статей выявил резкий всплеск вымышленных цитат, созданных нейросетями, что ставит под угрозу точность медицинских протоколов.
Google запускает Gemini for Science — коллекцию инструментов на базе ИИ, призванных ускорить научные исследования и автоматизировать анализ данных.
OpenAI представила доказательство, опровергающее 80-летнюю гипотезу Пауля Эрдёша. В отличие от прошлых заявлений, текущий успех подтвержден экспертным сообществом.
Новый математический бенчмарк SOOHAK выявил неспособность ведущих ИИ-моделей распознавать некорректные условия задач и их низкую эффективность в высшей математике.