Компания Apple разработала очередную нейросеть, которая использует большие языковые модели (LLM) для анимации статических изображений на основе текстовых подсказок пользователя.
Подписаться на iGuides в Telegram, чтобы узнать обо всем первым
Apple описывает инновацию в новой исследовательской работе под названием «Keyframer: Расширение возможностей дизайна анимации с использованием больших языковых моделей».
«Хотя интерфейсы с одноразовыми подсказками распространены в коммерческих системах преобразования текста в изображение, таких как Dall·E и Midjourney, мы утверждаем, что анимация требует более сложного набора пользовательских факторов, таких как время и координация, которые трудно полностью указать в одной подсказке — таким образом, мы предлагаем альтернативные подходы, которые позволят пользователям итеративно создавать и уточнять созданные проекты, особенно для анимации.
Чтобы создать анимацию, пользователю нужно загрузить изображение в формате SVG, а затем ввести подсказки. После этого Keyframer сгенерирует код CSS для анимации, а пользователь сможет отредактировать код напрямую или с помощью дополнительных текстовых запросов.
Напомним, недавно Apple запустила ещё одну нейросеть для генерации статичных изображений по текстовым запросам. Вполне вероятно, что все ИИ-наработки компания интегрирует в iOS 18, официальный анонс которой состоится на WWDC 2024 в июне.



