• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ProNeiroMir
Портал генеративных нейросетей
Категория:

Новости

    Новости

    Alibaba открыла веса Qwen3.8-Flash-Next и показала, из чего будет собрана Qwen4

    admin 18.09.2026


    Alibaba выложила в открытый доступ Qwen3.8-Flash-Next — экспериментальную модель, на которой обкатывается архитектура будущей Qwen4. Из 125 миллиардов параметров она задействует шесть, а обучение, по расчётам компании, обошлось вдевятеро дешевле прошлого флагмана. Веса опубликованы 26 августа.

    Содержание

    1. Активны шесть миллиардов из 125
    2. Словарь на 20 миллионов сочетаний
    3. Вдевятеро дешевле в обучении
    4. Бенчмарки Alibaba против Opus 4.6
    5. Три двери в Qwen3.8-Flash-Next
    6. Дешёвый исполнитель для рутины
    7. Qwen4 покажет, сработала ли ставка

    Qwen3.8-Flash-Next — не очередная модель в линейке, а витрина инженерных решений. Команда Qwen прямо называет её предварительным показом архитектуры Qwen4 и выкладывает веса, чтобы решения можно было пощупать до выхода основной линейки. Параллельно Alibaba открыла продакшен-версию Qwen3.8-Flash через собственное облако.

    Активны шесть миллиардов из 125

    Qwen3.8-Flash-Next построена по схеме смеси экспертов. Модель большая, но на каждый токен включается лишь малая её часть. В основе 125 миллиардов параметров, разложенных на 512 экспертов, и на обработку одного токена запускаются десять выбранных плюс один общий. Работают в итоге около шести миллиардов параметров.

    Внимание тоже перекроено. Три слоя из каждых четырёх используют Gated DeltaNet — линейный механизм, который считает контекст заметно дешевле обычного. Четвёртый слой отдан собственной разработке Qwen Sparse Attention, где лёгкий индексатор выбирает из контекста только нужные куски, а не просматривает его целиком. Родной контекст — 262 тысячи токенов, с растяжкой методом YaRN он доходит до миллиона.

    Словарь на 20 миллионов сочетаний

    Самое необычное в Qwen3.8-Flash-Next лежит рядом с основной моделью. На втором слое подключена таблица из 20 миллионов устойчивых сочетаний слов — пар и троек, которые модель не вычисляет заново, а просто достаёт готовыми. Весит эта таблица 51 миллиард параметров и на видеокарте не живёт. Её держат в обычной оперативной памяти и подгружают заранее.

    Приём даёт модели дополнительную ёмкость почти без расхода дорогой видеопамяти. Рядом работает модуль предсказания сразу нескольких токенов на 4 миллиарда параметров, который ускоряет генерацию. На диске всё вместе занимает 180 миллиардов параметров — 172 ГиБ в формате FP8 и 335 ГиБ в BF16.

    Вдевятеро дешевле в обучении

    Экономику Alibaba выносит вперёд самой архитектуры. Обучение Qwen3.8-Flash-Next обошлось примерно в девять раз дешевле, чем обучение более крупной Qwen3.7-Plus, и при этом результаты компания заявляет выше.

    Продакшен-версия Qwen3.8-Flash в облаке QwenCloud стоит $0,16 за миллион входных токенов и $0,47 за миллион выходных. Это примерно двенадцатая часть цены старшей Qwen3.8-Max. Для агентных сценариев, где модель гоняет длинные цепочки вызовов, разница в двенадцать раз важнее лишнего процента на бенчмарке.

    Бенчмарки Alibaba против Opus 4.6

    Опубликованные цифры выглядят внушительно. Qwen3.8-Flash-Next обходит Claude Opus 4.6 Max на задачах программирования и офисной автоматизации:

    • SWE-bench Pro — 62,5 против 53,4;
    • LiveCodeBench v6 — 91,9 против 88,8;
    • CoWorkBench — 73,9 против 68,2;
    • JobBench — 55,7 против 36,6;
    • следование инструкциям — 81,3 против 62,5.

    Отстаёт модель там, где нужны сложные рассуждения. На Humanity’s Last Exam у неё 35,9 против 40,0 у Claude, а на Agents’ Last Exam её обходит DeepSeek -V4-Flash.

    Здесь нужно оговориться. Все цифры получены самой Alibaba на её собственных прогонах, набор бенчмарков компания подбирала сама, а по DeepSWE в отчёт пошёл лучший результат из двух разных методик замера. Это нормальная практика вендорских отчётов, но читать её стоит как заявку, которую предстоит проверять независимым замерщикам.

    Три двери в Qwen3.8-Flash-Next

    Веса лежат на Hugging Face и ModelScope, запускать модель рекомендуют через SGLang, vLLM или TokenSpeed. Локальный запуск упирается в железо — 172 ГиБ даже в сжатом формате означают серверную сборку, а не домашнюю видеокарту.

    Второй путь — облако Alibaba, где работает продакшен-версия Qwen3.8-Flash по объявленным ценам за токены. Третий — сторонние площадки, которые обычно подключают свежие открытые модели в первые дни после релиза, и Qwen здесь не исключение.

    Лицензия называется qwen-community-1.0, и это не Apache. Открытые веса тут не равны свободному использованию, так что перед коммерческим внедрением текст лицензии придётся прочитать целиком.

    Дешёвый исполнитель для рутины

    Для тех, кто гоняет ИИ на потоке задач, интерес Qwen3.8-Flash-Next держится на цене за токен, а не на строчках в таблице. Разбор выгрузок, переписывание описаний, сверка данных между таблицами, черновая обработка текстов — сценарии, где объём важнее последнего процента качества.

    Проверять модель имеет смысл на своей типовой пачке задач, а не на бенчмарках Alibaba. Сравнение стоимости прогона и качества на собственных данных даст ответ быстрее любого отчёта.

    Qwen4 покажет, сработала ли ставка

    Двумя днями раньше похожую ставку сделала Z.ai со своей GLM-5.3-Flash — та же крайняя разреженность, тот же миллион токенов контекста, та же экономия на внимании. Разница в открытости цифр. Alibaba называет цену за токен прямо, а Z.ai поштучную стоимость так и не объявила.

    Qwen3.8-Flash-Next остаётся черновиком, каким её и подают. Настоящую проверку архитектура пройдёт в Qwen4, где те же решения придётся масштабировать на флагман. До этого момента девятикратная экономия на обучении — цифра из отчёта компании, а не подтверждённый результат.



    Источник

    18.09.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Новости

    Xbox в этом году выпустит ИИ‑помощника Gaming Copilot на консолях текущего поколения

    admin 17.09.2026
    17.09.2026

    Xbox, согласно сообщению GamesRadar, в этом году готовится запустить своего ИИ-помощника Gaming Copilot на «консолях текущего поколения». Сонали Ядав, менеджер …

    0 VKOdnoklassnikiEmail
  • Новости

    Anthropic пустила ИИ-агентов к микроскопам, дозаторам и роботам-манипуляторам

    admin 17.09.2026
    17.09.2026

    Claude всю ночь перебирал настройки лазера в квантовом компьютере QuEra и поднял успешность его восстановления с 58% до 99,3%. 27 …

    0 VKOdnoklassnikiEmail
  • Новости

    Encyclopedia Britannica и Merriam‑Webster подали в суд на OpenAI из‑за нарушения авторских прав

    admin 16.09.2026
    16.09.2026

    Encyclopedia Britannica и издатель словарей Merriam-Webster подали иск против OpenAI, утверждая, что компания использовала их защищённый авторским правом контент для …

    0 VKOdnoklassnikiEmail
  • Новости

    Google пустила Gemini в полные тексты книг — по одной купленной копии на читателя

    admin 16.09.2026
    16.09.2026

    Google договорилась с издательствами о доступе Gemini к полным текстам книг. 27 августа заработала Expert Intelligence — купленную в Google …

    0 VKOdnoklassnikiEmail
  • Новости

    Российский ИИ составил расписание «Мосгортранса» и высвободил два автобуса

    admin 15.09.2026
    15.09.2026

    На маршрутах «Мосгортранса» две недели работало расписание, которое составил искусственный интеллект: автобусы выходили на линию без потерянных рейсов и жалоб …

    0 VKOdnoklassnikiEmail
  • Новости

    OpenAI закрывает Sora и делает ставку на Codex и «суперприложение» ChatGPT

    admin 14.09.2026
    14.09.2026

    Во вторник OpenAI объявила: «Мы прощаемся с Sora» — инструментом генерации видео, который компания запустила в конце 2024 года и …

    0 VKOdnoklassnikiEmail
  • Новости

    Tencent выложила Hy4 preview под Apache 2.0 — 770 миллиардов параметров в открытом доступе

    admin 14.09.2026
    14.09.2026

    Tencent выложила в открытый доступ веса Hy4 preview — модели на 770 миллиардов параметров с контекстом свыше миллиона токенов. Лицензия …

    0 VKOdnoklassnikiEmail
  • Новости

    Википедия ужесточает правила использования ИИ при написании статей

    admin 13.09.2026
    13.09.2026

    По мере того как ИИ все активнее проникает в редакционную и медийную сферы, сайты спешно пытаются установить основные правила его …

    0 VKOdnoklassnikiEmail
  • Новости

    OpenAI отключает Cursor от своих моделей после покупки редактора компанией SpaceX

    admin 13.09.2026
    13.09.2026

    OpenAI отключит редактор Cursor от своих моделей 12 ноября. Поводом стала покупка Cursor компанией SpaceX — соблюдение условий использования компаниями …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Claude Code будет работать в автоматическом режиме по умолчанию
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI
  • Южная Корея введет обязательную маркировку ИИ-рекламы для защиты потребителей
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Claude Code будет работать в автоматическом режиме по умолчанию

    11.10.2026
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI

    11.10.2026
  • Южная Корея введет обязательную маркировку ИИ-рекламы для защиты потребителей

    11.10.2026
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API

    10.10.2026
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

    10.10.2026
  • Удаляйте, изолируйте и редактируйте: Figma добавила мощные ИИ-инструменты

    10.10.2026

Рубрики

  • Генерация видео (116)
  • Генерация звука (25)
  • Генерация изображений (90)
  • Генерация текста (77)
  • Новости (135)
  • Обзор сервисов (115)

Claude Code будет работать в автоматическом режиме по...

11.10.2026

Ставка на вайб-кодинг: Mistral представила Devstral 2 и...

11.10.2026

Южная Корея введет обязательную маркировку ИИ-рекламы для защиты...

11.10.2026

OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный...

10.10.2026

Google представила функцию ИИ-обзоров новостей для ведущих мировых...

10.10.2026

Обзоры

  • Claude Code будет работать в автоматическом режиме по умолчанию

    11.10.2026
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI

    11.10.2026
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

    10.10.2026

Выбор редакции

  • Промт для Nano Banana: Эффект распада на светящиеся частицы и цифровой трансценденции

    04.07.2026
  • Что известно о планах OpenAI по внедрению рекламы в ChatGPT

    02.10.2026
  • Pixi запустила приложение для отправки ИИ-персонажей в дополненной реальности

    26.08.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- proneiromir.ru


Наверх
ProNeiroMir
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов