«Яндекс» выложил в открытый доступ две ИИ-модели на 35 млрд и 80 млрд параметров. Зачем компании нужны относительно компактные модели и как там ответили на критику Сбера — в «Технологиях и трендах» на Радио РБК
«Яндекс» открыл разработчикам две ИИ-модели на 35 млрд и 80 млрд параметров. Первая предназначена прежде всего для поиска информации и суммаризации текстов, вторая — для более сложных задач, в том числе в математике и инженерных областях. Обе модели компания называет обученными с нуля.
«Для реализации сценария, когда искусственный интеллект отвечает на вопросы не из собственной памяти, а анализируя какие-то источники, эта модель подходит замечательным образом. Она в таком сценарии не уступает или практически не уступает очень большой модели, но при этом работает очень быстро», — пояснил директор по развитию технологий искусственного интеллекта «Яндекса» Александр Крайнов.
В «Яндексе» объясняют ставку на относительно небольшие модели высокой стоимостью вычислений: компания ищет способы сохранять качество при меньших затратах ресурсов. При этом обучение модели на 80 млрд параметров с учетом предварительных экспериментов заняло больше года.
Крайнов также прокомментировал заявление главы Сбера Германа Грефа о том, что «Яндекс» дообучает китайскую Qwen. По его словам, выпуск новых моделей не был ответом на эту критику, а цель компании — создавать собственные технологии и оставаться среди мировых лидеров в области ИИ.

37 минут назад
1









English (US) ·
Russian (RU) ·