• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ProNeiroMir
Портал генеративных нейросетей
Категория:

Обзор сервисов

    Обзор сервисов

    ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    admin 11.08.2026


    Помните, как год назад весь интернет был завален фотографиями в стиле Studio Ghibli? Это случилось в марте 2025-го, когда OpenAI впервые встроила генерацию изображений прямо в ChatGPT. Результат получился достаточно убедительным, чтобы разойтись миллионами репостов. Однако при этом у той версии было одно стойкое слабое место; а именно, текст внутри картинок. Надписи получались кривыми, буквы слипались или переставлялись местами, и дизайнеры это очень хорошо знали. В апреле 2026 года OpenAI выпустила Images 2.0; на сей раз текст внутри картинок наконец перестал быть проблемой.

    Чем новая версия отличается от предыдущей

    Сразу же стоит отметить, что Images 2.0 представляет собой не обновление поверх старой версии. OpenAI переписала архитектуру модели с нуля. Предыдущие версии, в том числе DALL-E 3, работали по принципу диффузии: модель постепенно «проявляла» изображение из шума, как фотограф в темной комнате. Images 2.0 устроена иначе. Она генерирует картинку примерно так же, как языковая модель генерирует текст: последовательно, часть за частью. Именно поэтому текст на изображениях теперь выходит читаемым. Модель понимает буквы как смысловые единицы, а не просто рисует похожие на них фигуры.

    Вместе с Images 2.0 OpenAI официально завершила эпоху DALL-E. 12 мая 2026 года обе версии, DALL-E 2 и DALL-E 3, были отключены. Images 2.0 теперь единственная модель для генерации изображений в ChatGPT и через API.

    DALL-E 3 была отдельным инструментом, подключенным к ChatGPT снаружи. Images 2.0 встроена в ChatGPT напрямую: она видит контекст разговора, помнит, о чем шла речь раньше, и генерирует картинки исходя из этого. Если попросить «сделай вариант, но более мрачный», она поймет это с первого раза.

    Что умеет модель и кому она будет интересна

    Существенным образом в новой модели изменилась работа с текстом внутри изображений. Постеры, рекламные макеты, меню, обложки, UI-скриншоты – все это раньше требовало ручной доработки, потому что надписи получались неразборчивыми. Сейчас модель справляется с этим в один проход без последующего редактирования. Помимо английского, хорошо работают языки с нелатинскими алфавитами, с которыми старые модели справлялись совсем плохо.

    Разрешение выросло до 2K, а через API доступна экспериментальная генерация в 4K. Форматы гибкие: можно выбирать соотношение сторон от очень широкого горизонтального до вытянутого вертикального.

    Есть два режима работы. Обычный режим, когда пользователь просто описывает, что нужно, и сразу получает результат. Второй называется Thinking; для него нет переключателя, он активируется автоматически. В данном случае модель сначала обдумывает задачу, при необходимости ищет информацию в интернете, а потом генерирует. В этом режиме можно попросить сделать сразу до восьми картинок на одну тему; и персонажи, предметы и стиль останутся одинаковыми на всех восьми. Режим пригодится при создании серии иллюстраций или нескольких рекламных вариантов с одним героем. Режим Thinking доступен на платных планах (Plus, Pro, Business и Enterprise).

    Доступ к Images 2.0 в ChatGPT есть у всех пользователей, в том числе и тех, у кого бесплатный план. Разница между планами заключается в количестве запросов и в доступе к режиму Thinking.

    Точки, в которых модель не справляется

    Как отмечают эксперты Креатор Проджект, несмотря на весь прогресс, есть вещи, которые у обозреваемой модели пока не выходят надежно. Логотипы конкретных брендов, особенно если компания обновляла фирменный стиль, зачастую воспроизводятся неточно. В тестах некоторые пользователи не смогли добиться правильного логотипа даже за несколько итераций; иногда модель воспроизводила устаревший вариант, которого уже несколько лет нет в использовании.

    У модели есть дата обрезки знаний; это декабрь 2025 года. То есть, события, лица, продукты, тренды – словом, все, появившееся после этой даты, она может изображать неверно или отказываться от запроса. Режим Thinking частично компенсирует это за счет поиска в интернете, но такой поиск не заменяет актуальные знания полностью.

    Скорость генерации тоже не самая высокая. Сложные запросы, особенно в режиме Thinking, занимают больше времени, чем у некоторых конкурентов. Если нужно выполнить разовую задачу, то критичным это не будет, однако если, к примеру, нужно несколько десятков изображений, тогда данный фактор стоит учитывать.

    Таким образом, модель Images 2.0 стала заметным шагом вперед, после которого генерация изображений в ChatGPT стала инструментом для реальных рабочих задач, а не только источником красивых картинок для соцсетей. Текст читается, языков стало больше, стиль держится на нескольких картинках сразу. Ограничения тоже есть имеются; к ним относят проблемы с генерацией логотипов, актуальность данных, скорость работы. Однако они теперь уже другого порядка.



    Источник

    11.08.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    admin 11.08.2026
    11.08.2026

    OpenAI выпустила новые голосовые модели под названием GPT-Live-1 и GPT-Live-1 mini, заявив, что они звучат более естественно и лучше справляются с очередностью …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    admin 11.08.2026
    11.08.2026

    ???? Введение Higgsfield AI — мощная нейросеть для генерации видео с уникальными визуальными эффектами. Один из самых узнаваемых среди них …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    GPT-5.5-Cyber. Почему новую версию не покажут обычным пользователям

    admin 10.08.2026
    10.08.2026

    Недавно британский государственный институт, который проверяет ИИ-модели на предмет опасных способностей, дал нейросети GPT-5.5 необычную задачу. Ей подсунули программу со …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    OmniVoice от Xiaomi. Как работает ИИ, способный говорить на сотнях языков

    admin 10.08.2026
    10.08.2026

    Несколько секунд чьего-то голоса, и нейросеть от Xiaomi уже готова заговорить этим голосом хоть на суахили, хоть на узбекском. Да …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    admin 10.08.2026
    10.08.2026

    ???? Введение С каждым днём всё больше пользователей интересуются продвинутыми возможностями нейросети Higgsfield AI — от уникальных эффектов до создания …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Почему все снова говорят о китайской модели DeepSeek? Чем удивила новая модель V4

    admin 09.08.2026
    09.08.2026

    Полтора года назад китайская компания DeepSeek выпустила модель R1, и за один день акции Nvidia потеряли почти 600 миллиардов долларов …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Google научила нейросеть монтировать видео через чат. На что способна Gemini Omni

    admin 09.08.2026
    09.08.2026

    Если взглянуть на то, что происходит с искусственным интеллектом прямо сейчас, возникает чувство, что технологические компании только и делают, что …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Higgsfield AI vs Pika Labs vs Runway — Сравнение лучших нейросетей для генерации видео

    admin 09.08.2026
    09.08.2026

    ???? Введение С развитием генеративных нейросетей всё больше креаторов и SMM-специалистов задаются вопросом:какая из платформ — Higgsfield AI, Pika Labs …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Stable Audio 3.0. На что способна новая музыкальная ИИ-модель Stability AI

    admin 01.08.2026
    01.08.2026

    Большинство крупных технологических компаний пока что соревнуются в генерации видео и текста. А вот что касается Stability AI, эта организация …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели

    11.08.2026
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

    11.08.2026
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

    11.08.2026
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

    11.08.2026
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026

Рубрики

  • Генерация видео (97)
  • Генерация звука (14)
  • Генерация изображений (86)
  • Генерация текста (52)
  • Новости (48)
  • Обзор сервисов (14)

OpenAI выпустит GPT-6 Astra в сентябре? Всё, что...

11.08.2026

Grok Imagine научился править картинку по кускам: xAI...

11.08.2026

Grok Imagine получил референсы персонажей и голоса: xAI...

11.08.2026

Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

11.08.2026

ChatGPT Images 2.0. Создание картинок с нуля теперь...

11.08.2026

Обзоры

  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    11.08.2026

Выбор редакции

  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    10.08.2026
  • Банки Беларуси интегрируют искусственный интеллект для борьбы с мошенничеством

    27.07.2026
  • Google обновила Gemini 3 Deep Think — ИИ выходит в лаборатории и инженерные цеха

    29.06.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- proneiromir.ru


Наверх
ProNeiroMir
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов