Together AI обновил сервис тонкой настройки больших языковых моделей
Together AI обновила платформу для тонкой настройки ИИ-моделей: поддержка 100B+ параметров, удвоение длины контекста и прямая интеграция с Hugging Face Hub.
DeepSeek — языковая модель из Китая с публичным API и веб-чатом. Линейка включает диалоговую модель deepseek-chat и reasoning-модель deepseek-reasoner
Together AI обновила платформу для тонкой настройки ИИ-моделей: поддержка 100B+ параметров, удвоение длины контекста и прямая интеграция с Hugging Face Hub.
Новое исследование оценило языковые модели по риску провокации психоза. GPT-5 и Claude показали лучшие результаты, в то время как DeepSeek признан наиболее опасным для уязвимых пользователей.
Китайский ИИ-стартап DeepSeek готовит агентную модель с автономным выполнением задач и самообучением для конкуренции с GPT-5 уже в 2025 году.
Простой и подробный гайд для новичков — как сделать API ключ Deepseek.
Цель: за 60–90 минут вы сделаете простого Telegram-бота, который отвечает на ваши сообщения с помощью ИИ и помнит контекст короткой переписки.
Исследование показало, что языковые модели не способны к клиническим рассуждениям и работают по шаблонам, что делает их ненадежными для медицинской практики.
Новый тест Spiral-Bench выявил радикальные различия в безопасности языковых моделей: от осторожного GPT-5 до рискованного Deepseek.
Cohere выпустила Command A Reasoning — первую языковую модель с функцией логического вывода для корпоративных задач. Модель поддерживает 256k токенов и 23 языка.
Китайский стартап DeepSeek выпустил модель V3.1, которая конкурирует с GPT-5 по производительности, но предлагает более выгодные условия для разработчиков благодаря открытой архитектуре.
DeepSeek представила гибридную модель V3.1 с двумя режимами работы, которая превзошла собственную модель рассуждений R1 в тестах при радикально низких ценах.