• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
ProNeiroMir
Портал генеративных нейросетей
Категория:

Обзор сервисов

    Обзор сервисов

    Что изменилось в новой флагманской модели Anthropic Claude Opus 4.8

    admin 05.10.2026


    В мае 2026 года компания Anthropic обновила флагманскую модель Opus до версии 4.8. И на первый взгляд, этот апдейт не несет в себе особых новшеств. Та же цена, чуть лучше цифры в бенчмарках. Однако за формулировкой «улучшения по всем показателям» прячется история о том, как компания пыталась сделать модель более здравомыслящей и честной, не растеряв ее деловую хватку. Без потерь, впрочем, не обошлось.

    Что нового предложили разработчики

    Модель доступна через API под именем claude-opus-4-8, цена осталась прежней (5 долларов за миллион входящих токенов, 25 – за выходные; при этом быстрый режим стал более дешевым). В Claude.ai и Cowork появился ползунок «усилий». Чем выше его значение, тем дольше и глубже думает модель. Однако при этом лимит, конечно, расходуется в данном случае быстрее.

    Обновленная модель Claude Code умеет сама планировать работу, запускать сотни параллельных субагентов. Нейросеть проверяет результат перед тем, как отчитаться. В таком режиме нейросеть способна самостоятельно провести миграцию кодовой базы на сотни тысяч строк, от старта до готового результата.

    Честность против деловой хватки

    Первые впечатления пользователей были смешанными. В первый день многие жаловались на многословность и академическую сухость, будто модель нарочно спорила с любым утверждением, лишь бы не показаться подхалимом. Через день-два ощущение сгладилось.

    Один пользователь заметил: со старыми моделями работал пошаговый разбор по пунктам, а с 4.8 такой подход буксует. Модель переусердствует и жжет токены там, где хватило бы обозначить цель и отпустить ее работать самостоятельно. Особенно это заметно при написании скилов для самой Claude – формулировать задачу для скила модель умеет лучше автора. Цифры подтверждают: Opus 4.8 – первая модель линейки, ни разу не выдавшая ложные числа в тесте на некритичную отчетность о результатах, а в задаче на поиск ошибки по нескольким файлам отработала без единой промашки. Что касается прежней версии, то она ошибалась в четверти случаев. Также модель примерно вчетверо реже пропускает недочеты в собственном коде, не комментируя их.

    Обратная сторона осторожности

    У этой честности есть цена, и Anthropic ее не скрывает. Claude стала более склонна к избыточно развернутым отказам; тут-то и проявилась оборотная сторона добросовестности. Устойчивость к промпт-инъекциям без дополнительной защиты тоже слегка просела: доля успешных атак на профильном бенчмарке выросла с 6 до 9,5 %, хотя штатные защитные механизмы возвращают показатель на прежний уровень. Для тех, кто строит агентов через API, есть нюанс: на тесте использования браузера атаки пробивали голую модель почти в трети случаев, а с защитой Anthropic – лишь в долях процента. Безопасность оказывается не свойством самой модели, а результатом работы обвязки вокруг нее.

    Нагляднее всего компромисс виден в симуляции под названием «Vending-Bench 2» от Andon Labs: модели выдают 500 стартовых долларов и год на управление вендинговым бизнесом. На максимальном режиме Opus 4.8 закончил год с 2992 долларами против почти 11 тыс. у предшественника – около четверти прежнего результата. Причина прозаична: у прежней версии было отдельное обучение деловым навыкам и противостоянию манипуляциям других агентов, но именно оно подталкивало модель к нечестности, и в 4.8 его убрали. Модель стала честнее, но заодно легче обманываемой и слабее в переговорах.

    Где Anthropic видит следующий шаг

    При этом сама компания описывает 4.8 довольно сдержанно. В Anthropic называют обновление «скромным, но ощутимым» улучшением по сравнению с предыдущей версией и отдельно признают, что работа над снижением стоимости таких возможностей еще продолжается. То есть ставка сделана не только на дальнейшее наращивание интеллекта: следующая проблема – сделать сопоставимые с Opus возможности доступными дешевле.

    Одновременно компания готовит следующий, уже более высокий класс моделей. В рамках проекта «Project Glasswing» отдельные организации тестируют Claude Mythos Preview для задач кибербезопасности. Но Anthropic пока не собирается выпускать такие системы массово: модели этого уровня, по оценке самой компании, требуют более сильных защитных механизмов. Таким образом, развитие линейки упирается уже не просто в вопрос «насколько умнее сделать модель», а в то, насколько безопасно дать ей возможность действовать самостоятельно в чувствительных областях.

    Заключение

    Как подчеркивают эксперты Креатор Проджект, Claude Opus 4.8 интересен именно тем, что его нельзя однозначно назвать улучшением по принципу «новая версия просто лучше старой». Когда от модели требуется проверить собственную работу или не выдавать неподтвержденный результат за факт, прогресс выглядит убедительно. Но в автономной работе, особенно там, где нужны переговоры, сопротивление манипуляциям и самостоятельное принятие коммерческих решений, улучшение оказалось неоднозначным.

    Поэтому главное изменение в Opus 4.8 – скорее смена приоритетов, чем очередной рывок в бенчмарках. Anthropic сознательно поставила надежность и честность выше части прежней деловой хватки, а затем начала строить вокруг модели инструменты, позволяющие управлять глубиной рассуждений и безопасностью. В результате 4.8 лучше показывает себя там, где модель должна быть аккуратным исполнителем, но пока требует большей осторожности там, где ей предлагают полностью заменить человека. И, судя по планам Anthropic, следующий этап гонки будет проходить уже не только за интеллект, но и за способ его безопасного применения.



    Источник

    05.10.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Компании, связанные с ИИ, компенсируют падение остальных отраслей на Уолл-стрит

    admin 05.10.2026
    05.10.2026

    Акции выросли на Уолл-стрит в пятницу второй день подряд, полностью отыграв потери начала недели. Технологические акции вновь стали основной движущей …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Sakana Fugu: ИИ, который учится управлять другими ИИ

    admin 04.10.2026
    04.10.2026

    22 июня 2026 года японская лаборатория Sakana AI (Токио) представила свой новый коммерческий продукт под названием Sakana Fugu. Компанию основали …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    GLM 5.3: мощнее в коде и кибербезопасности

    admin 03.10.2026
    03.10.2026

    14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской модели. Она …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Слабое звено ИИ-браузеров: OpenAI делится подробностями о борьбе с инъекциями подсказок

    admin 03.10.2026
    03.10.2026

    Даже несмотря на то что OpenAI усиливает защиту своего браузера Atlas AI от кибератак, компания признает: инъекции подсказок (prompt injection) …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    OpenAI представила GPT 5.6. Три модели, новые агенты и снижение цен

    admin 02.10.2026
    02.10.2026

    Летом 2026 года компания OpenAI представила свое новое семейство моделей под общим названием GPT 5.6. Релиз получился довольно необычным по …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Что известно о планах OpenAI по внедрению рекламы в ChatGPT

    admin 02.10.2026
    02.10.2026

    OpenAI рассматривает возможность внедрения нового формата рекламы в ChatGPT под названием «спонсированный контент», который может повлиять на ваши решения о …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    GigaChat 3.5 Ultra. Обзор новой флагманской модели Сбера

    admin 01.10.2026
    01.10.2026

    6 июля 2026 года команда Сбера представила свою новую флагманскую модель искусственного интеллекта под названием GigaChat 3.5 Ultra. Релиз стал …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Индия требует от X немедленных изменений в чат-боте Grok из-за непристойного контента

    admin 01.10.2026
    01.10.2026

    Индия потребовала от социальной платформы Илона Маска X немедленно внести технические и процедурные изменения в её ИИ-чат-бот Grok после того, …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Генерация изображений с «глубоким мышлением»: Seedream 5.0 Pro

    admin 30.09.2026
    30.09.2026

    Компания ByteDance представила Seedream 5.0 Pro 8 июля 2026 года. Это флагманская мультимодальная модель для генерации и редактирования изображений, ее …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Claude Code будет работать в автоматическом режиме по умолчанию
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI
  • Южная Корея введет обязательную маркировку ИИ-рекламы для защиты потребителей
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Claude Code будет работать в автоматическом режиме по умолчанию

    11.10.2026
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI

    11.10.2026
  • Южная Корея введет обязательную маркировку ИИ-рекламы для защиты потребителей

    11.10.2026
  • OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный режим в API

    10.10.2026
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

    10.10.2026
  • Удаляйте, изолируйте и редактируйте: Figma добавила мощные ИИ-инструменты

    10.10.2026

Рубрики

  • Генерация видео (116)
  • Генерация звука (25)
  • Генерация изображений (90)
  • Генерация текста (77)
  • Новости (135)
  • Обзор сервисов (115)

Claude Code будет работать в автоматическом режиме по...

11.10.2026

Ставка на вайб-кодинг: Mistral представила Devstral 2 и...

11.10.2026

Южная Корея введет обязательную маркировку ИИ-рекламы для защиты...

11.10.2026

OpenAI добавила Ultrafast для GPT‑6.1 Sol — ускоренный...

10.10.2026

Google представила функцию ИИ-обзоров новостей для ведущих мировых...

10.10.2026

Обзоры

  • Claude Code будет работать в автоматическом режиме по умолчанию

    11.10.2026
  • Ставка на вайб-кодинг: Mistral представила Devstral 2 и инновационный Vibe CLI

    11.10.2026
  • Google представила функцию ИИ-обзоров новостей для ведущих мировых СМИ

    10.10.2026

Выбор редакции

  • Нью-Йорк не будет строить крупные дата-центры в течение года из-за ИИ

    18.08.2026
  • Roblox представила функцию Build для создания игр на смартфоне с помощью ИИ

    18.08.2026
  • Ideogram 2.0: Новый стандарт генерации изображений с помощью ИИ

    13.07.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 3

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- proneiromir.ru


Наверх
ProNeiroMir
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов