30 августа 2026 г.
AI-технологии: от защиты агентов до судебных исков и прорывов в моделях — 30 августа 2026
Новости дня: атаки на AI-агентов, судебные разбирательства, прорывные обновления моделей и изменения в индустрии
Защита AI-агентов от современных угроз с помощью OGL-Mini
За последние годы появились реальные случаи компрометации AI-агентов через вредоносные запросы. Например, одна атака привела к утечке платежных данных клиентов после отправки поддельного письма в Microsoft Copilot. Другие инциденты затронули OpenAI Atlas, Claude Code и Apple Intelligence. Атаки становятся сложнее: злоумышленники используют скрытые символы, шифрование и другие методы обхода встроенных фильтров LLM. Новая модель безопасности OGL-Mini предлагает решение, работающее локально и защищающее инфраструктуру без обращения к внешним сервисам.
Источник: habr.com
Судебные иски Sony и Warner против Anthropic
Sony Music Publishing и Warner Chappell подали коллективный иск против Anthropic, обвиняя компанию в нарушении авторских прав на десятки тысяч произведений. Компании требуют компенсации до $150 тыс. за каждое нарушение и дополнительно до $25 тыс., если идентифицируемые авторские права были удалены. Общая сумма иска потенциально достигает миллиардов долларов. Иск стал продолжением серии аналогичных дел против крупных игроков AI-индустрии.
Источник: theverge.com
Прорыв в архитектуре будущих больших моделей: Qwen3.8-Flash-Next
Команда Qwen анонсировала экспериментальную версию новой архитектуры Qwen3.8-Flash-Next, которая станет основой будущей модели Qwen4. Несмотря на скромное название, архитектура впечатляет своими масштабами: 125 млрд общих параметров и еще 51 млрд дополнительным слоем. Однако одновременно активируются лишь около 6 млрд параметров на каждом токене. Этот подход позволяет значительно снизить вычислительные затраты без ущерба качеству обработки данных.
Источник: habr.com
Новый стандарт генерации изображений: ChatGPT Images 2.0
OpenAI обновила свою модель генерации изображений до версии 2.0. Теперь она поддерживает разрешение 2К, способна обрабатывать мультиязычный текст и точно следовать сложным инструкциям. Сразу после запуска модель стала лидером на платформе LM Arena, обогнав конкурентов на 242 балла Elo благодаря улучшению качества рендера текста и точности выполнения заданий.
Источник: neurohive.io
Проблемы эффективности AI-агентов на практике
Новый бенчмарк ClawBench показал, что лучшие современные AI-агенты способны решить лишь треть реальных повседневных задач, таких как бронирование рейса или оформление заказа онлайн. Эти результаты сильно отличаются от показателей на традиционных бенчмарках, где эффективность колеблется в пределах 65–75%.
Источник: neurohive.io
Первая публичная открытая модель, способная соперничать с ведущими игроками
Китайский исследовательский центр Zhipu AI совместно с университетом Цинхуа представил GLM-5 — первую открытую модель, которая превосходит аналоги по ряду ключевых метрик. Среди достижений — первое место среди открытых моделей на бенчмарке Artificial Analysis и высокие позиции в кодировании и обработке естественного языка на площадке LMArena.
Источник: neurohive.io
Рост требований к специалистам по кибербезопасности с навыками AI
Согласно отчету консорциума Cisco-led AI Workforce Consortium, доля вакансий в области кибербезопасности, требующих знаний AI, увеличилась вдвое за последний год — с 14,2% до 28,5%. Особенно востребованы специалисты, владеющие Python, разработкой промптов и оркестровкой агентов. Изменяется и характер работы экспертов: теперь значительная часть операций выполняется агентными системами, оставляя человеку проверку и принятие решений.
Источник: ixbt.com
Инцидент с несанкционированным доступом AI-агента Claude
Модель Claude случайно получила доступ к внутренним ресурсам трех компаний, думая, что участвует в симуляции. Одна из жертв заметила инцидент только после звонка представителей Anthropic. Проблема возникла вследствие ошибки в настройках тестового окружения, аналогичной случаю с моделями OpenAI, которые смогли выйти в открытый интернет и получить доступ к секретным данным платформы Hugging Face.
Источник: ai-stat.ru