• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ProNeiroMir
Портал генеративных нейросетей
Категория:

Новости

    Новости

    Google выпустила DiffusionGemma: текст блоками и до 4x ускорение генерации

    admin 18.07.2026


    Google представила DiffusionGemma — экспериментальную открытую модель, которая собирает текст крупными блоками вместо привычной генерации по одному токену. За счёт этого она работает до 4 раз быстрее на видеокартах. Модель вышла под свободной лицензией Apache 2.0, веса уже выложены на Hugging Face.

    Содержание

    1. Печатная машинка уступает место печатному станку
    2. 26 миллиардов параметров, в работе — 3,8
    3. Где двунаправленное внимание решает
    4. Скорость есть, за неё заплатили качеством
    5. Веса уже на Hugging Face
    6. Ниша для экспериментов, не замена флагмана

    Печатная машинка уступает место печатному станку

    Обычная языковая модель работает как машинистка: выдаёт по одному токену слева направо и каждый следующий рассчитывает только после предыдущего. На сервере это незаметно — облако склеивает тысячи запросов в пакеты и загружает железо равномерно. На домашнем GPU при одном пользователе картина иная: видеокарта простаивает, пока ждёт очередное «нажатие клавиши».

    DiffusionGemma переносит на текст приём из генераторов изображений. Те стартуют с цветового шума и постепенно проявляют картинку; модель Google так же начинает с холста из случайных токенов-заглушек и за несколько проходов уплотняет его до связного текста. За один проход она обрабатывает блок в 256 токенов целиком. Отсюда метафора самой Google: 

    Вместо машинистки — печатный станок, отпечатывающий абзац одним движением.

    26 миллиардов параметров, в работе — 3,8

    Под капотом DiffusionGemma — Mixture of Experts на 26 млрд параметров, из которых при выводе активны лишь 3,8 млрд (схема, где под каждый запрос включается только часть «экспертов»). В квантованном виде модель помещается в 18 ГБ видеопамяти, то есть в потолок топовых потребительских карт.

    Скорость Google измеряет конкретно: больше 1000 токенов в секунду на одной NVIDIA H100 и больше 700 — на игровой RTX 5090. Прирост до 4 раз достигается за счёт смены узкого места: декодирование смещается с пропускной способности памяти на вычисления, которыми ускоритель загружается полнее.

    Основа — семейство Gemma 4 и исследования Gemini Diffusion, поверх которых добавлена отдельная «диффузионная голова», заточенная под скорость.

    Где двунаправленное внимание решает

    Главное отличие от обычных моделей в том, что каждый токен в блоке видит все остальные, и предыдущие, и последующие. Для линейного текста это просто ускорение. На «нелинейных» задачах эффект качественный: вставка кода в середину функции, правка внутри готового абзаца, аминокислотные последовательности, математические графы.

    Показательный пример привела команда Unsloth, дообучившая DiffusionGemma играть в судоку. Авторегрессионные модели спотыкаются на этой задаче: каждая цифра зависит от ещё не написанных. Двунаправленное внимание снимает проблему, потому что модель оценивает всё поле сразу.

    Сюда же относится самокоррекция. За несколько проходов модель перечитывает собственный блок и правит ошибки на ходу, вместо того чтобы тащить их дальше по тексту, как при пословной генерации.

    Скорость есть, за неё заплатили качеством

    Google не прячет компромисс. По качеству вывода DiffusionGemma уступает обычной Gemma 4, и за максимальное качество компания прямо советует брать стандартную версию. Это инструмент для исследователей и разработчиков под скоростные интерактивные локальные сценарии: редактирование на лету, быстрые итерации, генерация в реальном времени.

    Второе ограничение — экономика. Ускорение работает на локальном и низконагруженном выводе. В облаке с высоким потоком запросов авторегрессионные модели и так загружают железо плотно, поэтому параллельное декодирование там приносит всё меньше выгоды и может выйти дороже в обслуживании. Отдельная оговорка для владельцев Mac: на Apple Silicon с общей памятью, упирающейся в её пропускную способность, того же ускорения может не быть.

    Веса уже на Hugging Face

    Запуск поддержан широким набором инструментов: MLX, vLLM, Hugging Face Transformers. Дообучение идёт через NVIDIA NeMo, Unsloth и собственный JAX-тулбокс Google под названием Hackable Diffusion. Поддержку llama.cpp обещают вскоре.

    С железом Google работала вместе с NVIDIA: квантование под RTX 5090 и 4090, ускоренные ядра NVFP4 (4-битные вычисления с плавающей точкой) для серверных Hopper и Blackwell, готовность к настольным DGX Spark и DGX Station. Попробовать модель можно и в облаке — через Model Garden на Gemini Enterprise Agent Platform или NVIDIA NIM.

    Ниша для экспериментов, не замена флагмана

    DiffusionGemma — не замена Gemma 4, и Google это не скрывает. Текстовая диффузия годами жила в исследованиях и плохо масштабировалась на большие модели; здесь её довели до открытой версии, которую можно скачать и запустить на домашней карте. Реальную ценность покажут не цифры скорости, а то, приживётся ли подход в живых сценариях: редактуре кода, инструментах с мгновенным откликом, задачах, где текст устроен нелинейно. Пока это сильная техническая заявка, проверять которую будут разработчики на своих RTX.



    Источник

    18.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Новости

    Агенты Claude заработали по расписанию и с ключами, скрытыми от модели

    admin 17.07.2026
    17.07.2026

    10 июня 2026 года на конференции Code with Claude Tokyo компания Anthropic объявила сразу о трёх обновлениях для работы с …

    0 VKOdnoklassnikiEmail
  • Новости

    Hermes Agent превращает профили ИИ-агентов в управляемую систему

    admin 16.07.2026
    16.07.2026

    Nous Research развивает Hermes Agent как автономного ИИ-агента с памятью, навыками и несколькими рабочими профилями. После крупного релиза v0.16.0 команда …

    0 VKOdnoklassnikiEmail
  • Новости

    Perplexity открыла Deep Research через Sonar API для разработчиков

    admin 15.07.2026
    15.07.2026

    Perplexity открыла Deep Research для разработчиков через Sonar API. Теперь исследовательский режим компании можно встраивать в собственные продукты, исследовательские агенты …

    0 VKOdnoklassnikiEmail
  • Новости

    IPO SpaceX сделало Илона Маска первым триллионером на бумаге

    admin 14.07.2026
    14.07.2026

    Reuters и Forbes после IPO SpaceX рассчитали состояние Илона Маска выше $1,1 трлн. По этой методике он стал первым человеком …

    0 VKOdnoklassnikiEmail
  • Новости

    Hermes Agent получил Automation Blueprints: повторяющиеся задачи теперь можно запускать через диалог

    admin 13.07.2026
    13.07.2026

    Nous Research представила Automation Blueprints для Hermes Agent — систему шаблонов, которая превращает регулярные автоматизации в разговорные сценарии с пошаговой …

    0 VKOdnoklassnikiEmail
  • Новости

    Moonshot AI открыла Kimi-K2.7-Code для программирования и кодовых агентов

    admin 12.07.2026
    12.07.2026

    Moonshot AI выпустила и открыла веса Kimi-K2.7-Code — новой модели для программирования и агентских задач. Модель доступна через Kimi API, …

    0 VKOdnoklassnikiEmail
  • Новости

    США ограничили доступ к Fable 5 и Mythos 5 спустя несколько дней после релиза

    admin 11.07.2026
    11.07.2026

    США ограничили иностранный доступ к моделям Anthropic Fable 5 и Mythos 5. После директивы Минторга компания отключила модели для всех …

    0 VKOdnoklassnikiEmail
  • Новости

    Учёные выдумали болезнь. Через несколько недель её начали диагностировать чат-боты

    admin 10.07.2026
    10.07.2026

    Исследователи придумали несуществующее заболевание, чтобы проверить устойчивость ИИ-моделей к ложной информации. Через некоторое время чат-боты начали уверенно описывать эту болезнь …

    0 VKOdnoklassnikiEmail
  • Новости

    OpenAI и Broadcom представили Jalapeño — чип для ускорения ChatGPT, Codex и будущих агентов

    admin 09.07.2026
    09.07.2026

    OpenAI и Broadcom представили Jalapeño — первый специализированный чип OpenAI для ускорения ответов LLM. Его планируют использовать в инфраструктуре ChatGPT, …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • OpenAI выпустит GPT-6 Astra в сентябре? Всё, что известно о новой ИИ-модели

    11.08.2026
  • Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

    11.08.2026
  • Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

    11.08.2026
  • Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

    11.08.2026
  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026

Рубрики

  • Генерация видео (97)
  • Генерация звука (14)
  • Генерация изображений (86)
  • Генерация текста (52)
  • Новости (48)
  • Обзор сервисов (14)

OpenAI выпустит GPT-6 Astra в сентябре? Всё, что...

11.08.2026

Grok Imagine научился править картинку по кускам: xAI...

11.08.2026

Grok Imagine получил референсы персонажей и голоса: xAI...

11.08.2026

Генератор изображений OpenAI рисует изображения детей, курящих сигареты.

11.08.2026

ChatGPT Images 2.0. Создание картинок с нуля теперь...

11.08.2026

Обзоры

  • ChatGPT Images 2.0. Создание картинок с нуля теперь происходит иначе, и это заметно

    11.08.2026
  • OpenAI представила новые голосовые модели GPT-Live-1 для более естественного общения

    11.08.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    11.08.2026

Выбор редакции

  • OpenAI представила обновлённый ChatGPT Images: до 4× быстрее и с новым творческим пространством

    19.06.2026
  • ТОП-10 промтов для Luma AI: оживляем фото через видео

    25.06.2026
  • Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

    20.06.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- proneiromir.ru


Наверх
ProNeiroMir
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов