• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ProNeiroMir
Портал генеративных нейросетей
Категория:

Генерация видео

    Генерация видео

    Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

    admin 11.08.2026


    xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию, а голосовой референс переносит в новую сцену ещё и тембр героя. Заодно появились генерация видео из текстового описания и нативное разрешение 1080p.

    Содержание

    1. Семь референсов на одну генерацию
    2. Голос держится вместе с лицом
    3. Видео из текста и 1080p
    4. Пока США и старшие подписки
    5. Реклама, ведущие, товарные ролики
    6. Veo и Runway пришли раньше
    7. Лицо и голос без согласия

    Grok Imagine — генератор изображений и видео от xAI, встроенный в Grok (Грок) и вынесенный отдельным разделом на grok.com. Обновление 31 июля компания подаёт как переход от разовых красивых роликов к съёмке сериями, где персонаж и обстановка не меняются от кадра к кадру. Функции включаются постепенно, и часть из них пока заперта на верхних подписках.

    Семь референсов на одну генерацию

    Каждое изображение-референс в Grok Imagine закрепляет один элемент сцены — лицо, товар или локацию. Остальное меняется по промпту. Можно оставить героя и переставить его в другой интерьер, оставить интерьер и поменять героя, либо зафиксировать оба слоя и менять только действие. Предел — семь референсов на одну генерацию.

    Ролик теперь собирается из повторяющихся элементов. Раньше похожего результата добивались десятком попыток с одним и тем же промптом, и совпадение получалось случайным.

    Голос держится вместе с лицом

    Вторая новинка релиза — голосовой референс. В Grok Imagine загружаются два файла, фотография персонажа и образец его голоса, после чего в новых сценах сохраняются и внешность, и звучание. Повторяемость голоса оставалась слабым местом генеративного видео дольше, чем повторяемость картинки: лицо ещё как-то удавалось удержать, а тембр героя плавал от ролика к ролику.

    Видео из текста и 1080p

    Grok Imagine научился делать видео из одного текстового описания, стартовое изображение больше не нужно. Технически xAI связала собственную генерацию картинок с режимом image-to-video: модель сначала рисует кадр, потом его оживляет.

    Второе изменение — нативные 1080p для обоих режимов, и текстового, и картиночного. Текст-в-видео и высокое разрешение уже открыты всем на grok.com/imagine, в приложениях для iOS и Android.

    Пока США и старшие подписки

    Референсы изображений и голоса стартовали 31 июля только в США и только для SuperGrok Heavy и SuperGrok Plus, двух верхних тарифов. xAI обещает раскатить их на остальные уровни в течение нескольких дней. Разработчикам изображения-референсы, генерация из текста и 1080p доступны в API под моделью grok-imagine-video-1.5; голосовой референс там выдают по отдельному запросу через отдел продаж.

    Последняя деталь говорит сама за себя. Перенос голоса xAI пока не готова отдавать в самообслуживание.

    Реклама, ведущие, товарные ролики

    Набор референсов переводит Grok Imagine в разряд рабочих инструментов для задач, где картинка обязана повторяться. Первыми открываются несколько сценариев:

    • рекламная серия, где товар выглядит одинаково во всех кадрах;
    • виртуальный ведущий с закреплённым лицом и голосом;
    • короткие скетчи и сериалы с постоянными персонажами;
    • демонстрация одного продукта в разных обстановках и ракурсах.

    Veo и Runway пришли раньше

    Сама идея опорных изображений на рынке не первый год. У Google в Veo работает режим Ingredients to Video, Runway с четвёртого поколения строит консистентность персонажей на референсах, Kling держит лицо через отдельную модель головы. Аргумент Grok Imagine — объём: семь опорных изображений против трёх у Veo, плюс голос, которого в связке «лицо и сцена» у конкурентов нет. Насколько уверенно это держится на длинных сценах, покажут ролики пользователей, а не демо на сайте xAI.

    Лицо и голос без согласия

    Связка «портрет плюс образец голоса» — ровно та функциональность, из которой делают дипфейки, и у Grok Imagine уже есть репутационный шлейф после историй с генерацией изображений реальных людей. Придержать голосовые референсы за формой обращения к продажам выглядит осознанной страховкой. Публичная часть продукта при этом принимает загруженные фотографии без такой оговорки. Проверочная точка близко: когда референсы раскатят на все тарифы и за пределы США, станет видно, справляются ли фильтры xAI с потоком портретов живых людей.



    Источник

    11.08.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация видео

    MiniMax выпустила видеомодель H3 — ролики в 2K со звуком

    admin 10.08.2026
    10.08.2026

    MiniMax 31 июля представила H3 — мультимодальную видеомодель, которая принимает текст, изображения, видео и звук и выдаёт ролики до 15 …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Революционная платформа KLING AI для генерации видео теперь доступна каждому

    admin 01.08.2026
    01.08.2026

    Китайская платформа KLING AI, которая нашумела благодаря своим выдающимся возможностям генерации видео, теперь открыта для всех без необходимости телефонной верификации. …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    admin 30.07.2026
    30.07.2026

    Firefly Video Model теперь могут протестировать все желающие. Этот инструмент позволяет создавать 5-секундные видеоролики в 1080p на основе текстовых описаний …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    admin 29.07.2026
    29.07.2026

    Платформа Freepik первой в мире внедрила Google Veo 2 — новую модель генерации видео от Google DeepMind. Интеграция этой технологии …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Pika Labs представляет Pika 2.2: Новая эра в AI-видеогенерации с 10-секундными клипами

    admin 28.07.2026
    28.07.2026

    Pika Labs снова удивляет мир искусственного интеллекта: новая модель Pika 2.2 поднимает планку возможностей AI-видеогенерации, предлагая пользователям более длинные и …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    HeyGen представил обновление AI-аватаров: теперь еще реалистичнее

    admin 27.07.2026
    27.07.2026

    Компания HeyGen, известная своими решениями для генерации видео с искусственным интеллектом, обновила технологию UGC (User-Generated Content) AI-аватаров. Теперь виртуальные персонажи …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Новая модель Runway Gen-4: реалистичные видео и полный контроль над сюжетом

    admin 26.07.2026
    26.07.2026

    Gen-4 предлагает более высокую реалистичность, согласованность и контроль над визуальным повествованием. Новая технология уже доступна подписчикам и открывает новые горизонты …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Higgsfield AI анонсировала Higgsfield Mix: новый инструмент для создания кинематографических видео

    admin 25.07.2026
    25.07.2026

    Компания Higgsfield AI представила инструмент Higgsfield Mix, позволяющий создавать невозможные с точки зрения физики движения камеры в видео. Новинка открывает …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Kling 2.0 открывает новую главу в генерации визуального контента

    admin 24.07.2026
    24.07.2026

    Китайская платформа Kling 2.0 от Kuaishou выходит на новый уровень: искусственный интеллект научился создавать видео и изображения с кинематографическим качеством …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели

    11.08.2026
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

    11.08.2026
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

    11.08.2026
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

    11.08.2026
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026

Рубрики

  • Генерация видео (97)
  • Генерация звука (14)
  • Генерация изображений (86)
  • Генерация текста (52)
  • Новости (48)
  • Обзор сервисов (14)

OpenAI выпустит GPT-6 Astra в сентябре? Всё, что...

11.08.2026

Grok Imagine научился править картинку по кускам: xAI...

11.08.2026

Grok Imagine получил референсы персонажей и голоса: xAI...

11.08.2026

Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

11.08.2026

ChatGPT Images 2.0. Создание картинок с нуля теперь...

11.08.2026

Обзоры

  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    11.08.2026

Выбор редакции

  • Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

    26.06.2026
  • Консистентность персонажей и стилей в нейросетях — что это и как сохранить

    22.06.2026
  • Промт для Nano Banana: Кадр с брызгами воды и контровым светом заката

    30.06.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- proneiromir.ru


Наверх
ProNeiroMir
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов