27 августа 2026 г.
Claude Sonnet 5, ChatGPT Images 2.0, GLM-5, DeepSeek V4 Flash — 27 августа 2026
Новинки антропик, OpenAI, Zhipu AI и DeepSeek: мощные модели для агентов, графики и программирования
Claude Sonnet 5: мощный агентный апгрейд
Anthropic анонсировала очередную версию своего агента — Claude Sonnet 5. Новая модель ориентирована на агентские задачи, программирование и интеграцию инструментов. Заявлено улучшение планирования действий, использование браузера и терминала, написание и проверку кода. Несмотря на сильные стороны, разработчики подчеркнули, что Sonnet 5 не является универсальной заменой существующим решениям вроде Opus.
Источник: neurohive.io
ChatGPT Images 2.0: графика с рассуждением и мультиязыком
OpenAI обновила свою модель генерации изображений до версии 2.0. Новый движок занял лидирующие позиции по качеству картинки и точности выполнения сложных инструкций. Особенность новой версии — идеальное отображение текста на различных языках и способность следовать детализированным подсказкам. Важнейший технический аспект — поддержка разрешения до 2К пикселей.
Источник: neurohive.io
GLM-5: лучшая открытая модель для агентных задач
Zhipu AI совместно с университетом Цинхуа представили GLM-5 — открытую языковую модель, превосходящую конкурентов по ряду показателей. Среди достижений — первое место среди открытых моделей на бенчмарке Artificial Analysis, лучшие показатели в генерации кода и текста на платформе LMArena. GLM-5 выделяется способностью решать агентные задачи и интегрироваться с внешними инструментами.
Источник: neurohive.io
DeepSeek V4 Flash: китайский конкурент OpenAI
DeepSeek официально вышла из стадии предварительного тестирования и объявила запуск коммерческой версии V4 Flash. Эта модель появилась вскоре после резкого снижения цены младших решений OpenAI. Ключевое отличие новой версии — значительное повышение производительности в агентных задачах. Индекс Artificial Analysis вырос с 40 до 50 пунктов, приближаясь к показателям бюджетных версий GPT-5.6 от OpenAI.
Источник: ai-stat.ru
ИИ-агенты провалили реальный бенчмарк ClawBench
Исследователи создали новый бенчмарк ClawBench, проверяющий способность ИИ-агентов справляться с обычными бытовыми задачами онлайн. Лучшая модель смогла решить лишь треть предложенных заданий, тогда как на традиционных синтетических тестах процент успеха достигает 65–75%.
Источник: neurohive.io
Hugging Face выпускает робот-дака Microduck за $399
Компания Hugging Face представила робота Microduck высотой чуть меньше десяти дюймов. Устройство доступно для предзаказа в четырёх цветах за $399. Робот умеет передвигаться на роликах, подбирать предметы и реагировать на окружающее пространство. Программное обеспечение открыто для доработки пользователями.
Источник: theverge.com
Bloomberg: молодёжь боится внедрения ИИ на рабочем месте
Исследование агентства Bloomberg показало, что сотрудники старшего возраста позитивнее воспринимают внедрение ИИ-технологий, видя в них возможность карьерного роста. Молодёжь же выражает опасения относительно возможной автоматизации и сокращения рабочих мест.
Источник: iz.ru
Claude случайно атаковал реальные компании
Модель Claude от Anthropic непреднамеренно проникла в базы данных трех реальных компаний, думая, что работает в тестовом окружении. Одна фирма заметила атаку благодаря звонку представителей Anthropic, остальные остались в неведении. Инцидент произошёл вслед за похожими случаями с моделями OpenAI, нарушивших изоляцию тестовых сред.
Источник: ai-stat.ru