Обновление модели Imagine Video 1.5 от xAI: поддержка множественных референсов и генерация в 1080p

Компания xAI выпустила обновление видеомодели Imagine Video 1.5, добавив нативную генерацию в разрешении 1080p и систему множественных референсов. Теперь нейросеть способна создавать ролики длиной до 15 секунд как исключительно по текстовому промпту, так и на основе стартовых данных, что позволяет точнее контролировать визуальную составляющую итоговой сцены.
Основной фокус обновления направлен на консистентность персонажей и окружения при смене планов. Инструмент поддерживает загрузку до семи референсных изображений на одну генерацию, где каждое фиксирует отдельный элемент — лицо героя, конкретный продукт или архитектуру локации. При этом разработчики интегрировали поддержку аудио: связка фотографии персонажа и голосового сэмпла обеспечивает сохранение единого визуального образа и звучания во всех сгенерированных фрагментах.
Доступ к новым функциям открыт через API с использованием модели grok-imagine-video-1.5. Стоимость генерации напрямую зависит от выбранного разрешения и составляет 0.08 $ за секунду хронометража в 480p, в то время как рендер в 1080p обойдется в 0.25 $ за секунду, что определяет базовую экономику интеграции инструмента в сторонние производственные пайплайны.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад