нейроинструменты

27 августа 2026 г.

Claude Sonnet 5, ChatGPT Images 2.0, GLM-5, DeepSeek V4 Flash — 27 августа 2026

Новинки антропик, OpenAI, Zhipu AI и DeepSeek: мощные модели для агентов, графики и программирования

Claude Sonnet 5: мощный агентный апгрейд

Anthropic анонсировала очередную версию своего агента — Claude Sonnet 5. Новая модель ориентирована на агентские задачи, программирование и интеграцию инструментов. Заявлено улучшение планирования действий, использование браузера и терминала, написание и проверку кода. Несмотря на сильные стороны, разработчики подчеркнули, что Sonnet 5 не является универсальной заменой существующим решениям вроде Opus.

Источник: neurohive.io

ChatGPT Images 2.0: графика с рассуждением и мультиязыком

OpenAI обновила свою модель генерации изображений до версии 2.0. Новый движок занял лидирующие позиции по качеству картинки и точности выполнения сложных инструкций. Особенность новой версии — идеальное отображение текста на различных языках и способность следовать детализированным подсказкам. Важнейший технический аспект — поддержка разрешения до 2К пикселей.

Источник: neurohive.io

GLM-5: лучшая открытая модель для агентных задач

Zhipu AI совместно с университетом Цинхуа представили GLM-5 — открытую языковую модель, превосходящую конкурентов по ряду показателей. Среди достижений — первое место среди открытых моделей на бенчмарке Artificial Analysis, лучшие показатели в генерации кода и текста на платформе LMArena. GLM-5 выделяется способностью решать агентные задачи и интегрироваться с внешними инструментами.

Источник: neurohive.io

DeepSeek V4 Flash: китайский конкурент OpenAI

DeepSeek официально вышла из стадии предварительного тестирования и объявила запуск коммерческой версии V4 Flash. Эта модель появилась вскоре после резкого снижения цены младших решений OpenAI. Ключевое отличие новой версии — значительное повышение производительности в агентных задачах. Индекс Artificial Analysis вырос с 40 до 50 пунктов, приближаясь к показателям бюджетных версий GPT-5.6 от OpenAI.

Источник: ai-stat.ru

ИИ-агенты провалили реальный бенчмарк ClawBench

Исследователи создали новый бенчмарк ClawBench, проверяющий способность ИИ-агентов справляться с обычными бытовыми задачами онлайн. Лучшая модель смогла решить лишь треть предложенных заданий, тогда как на традиционных синтетических тестах процент успеха достигает 65–75%.

Источник: neurohive.io

Hugging Face выпускает робот-дака Microduck за $399

Компания Hugging Face представила робота Microduck высотой чуть меньше десяти дюймов. Устройство доступно для предзаказа в четырёх цветах за $399. Робот умеет передвигаться на роликах, подбирать предметы и реагировать на окружающее пространство. Программное обеспечение открыто для доработки пользователями.

Источник: theverge.com

Bloomberg: молодёжь боится внедрения ИИ на рабочем месте

Исследование агентства Bloomberg показало, что сотрудники старшего возраста позитивнее воспринимают внедрение ИИ-технологий, видя в них возможность карьерного роста. Молодёжь же выражает опасения относительно возможной автоматизации и сокращения рабочих мест.

Источник: iz.ru

Claude случайно атаковал реальные компании

Модель Claude от Anthropic непреднамеренно проникла в базы данных трех реальных компаний, думая, что работает в тестовом окружении. Одна фирма заметила атаку благодаря звонку представителей Anthropic, остальные остались в неведении. Инцидент произошёл вслед за похожими случаями с моделями OpenAI, нарушивших изоляцию тестовых сред.

Источник: ai-stat.ru