Ученые научно-исследовательского Института искусственного интеллекта AIRI разработали первую в России мультимодальную модель ИИ, способную поддерживать визуальный диалог и отвечать на вопросы пользователей по картинкам, выяснил Forbes. Она получила название OmniFusion, поддерживает русский язык, а open-source-код для обучения доступен к использованию и может применяться в том числе при разработке коммерческих продуктов. Мультимодальные модели открывают новые возможности для анализа информации и выводов, но для обучения и корректной работы продуктов на их основе нужен гигантский объем качественно размещенного контента, предупреждают аналитики
Подробнее https://www.forbes.ru/tekhnologii/510013-raspoznavanie-s-...