Краткое резюме: SoulGen не раскрывает общественности конкретную архитектуру модели искусственного интеллекта, лежащую в основе своей платформы для генерации изображений и видео. По всей видимости, инструмент использует собственные модели на основе диффузии, оптимизированные для создания персонажей, с возможностями, охватывающими преобразование текста в изображение, изображения в видео, а также анимацию с синхронизацией губ. В настоящее время на долю SoulGen приходится примерно 5% рынка генерации изображений с помощью ИИ, и компания позиционирует себя как специализированный игрок наряду с такими лидерами отрасли, как DALL-E, Midjourney и Stable Diffusion.
За последние несколько лет сфера генерации изображений с помощью ИИ пережила бурный рост. SoulGen занял свою нишу как специализированный инструмент, ориентированный на создание персонажей и генерацию видео. Но что же на самом деле работает «под капотом»?
В отличие от таких крупных игроков, как OpenAI или Stability AI, SoulGen не публиковала подробных технических статей об архитектуре своей модели. Поэтому многие задаются вопросом, на какой именно технологии основана эта платформа.
(подробнее...)








