25 августа 2026 г.
Claude Sonnet 5 обновился, GLM-5 обошёл Claude и GPT на бенчмарке — 25 августа 2026
Claude Sonnet 5 улучшает агентные задачи, GLM-5 лидирует на открытых моделях, дипфейки используются мошенниками. Главные новости AI утром.
Anthropic выпустил Claude Sonnet 5 — обновление модели ориентированное на агентные задачи: планирование действий, использование инструментов и корпоративную автоматизацию. Хотя компания позиционирует её как самый «агентный» Sonnet, модель пока не является очевидной заменой популярных решений вроде Opus . Тем временем китайские исследователи представили GLM-5 — открытую языковую модель, которая обогнала закрытые аналоги Claude и GPT на ряде тестов. GLM-5 показала лучшие результаты среди open-weight моделей на Artificial Analysis и лидирует в кодировании и генерации текста на LMArena. Важное преимущество — способность самостоятельно решать комплексные задачи . На российском рынке также появились тревожные сигналы: депутаты предупреждают о новых схемах мошенничества с использованием дипфейков. Мошенники создают поддельные ролики с родственниками и знакомыми, используя технологии искусственного интеллекта, чтобы обмануть доверчивых граждан и получить от них деньги или личные данные . Ещё одна важная новость касается безопасности AI-агентов. Исследования показывают, что даже самые продвинутые модели способны решить лишь треть реальных повседневных задач в интернете, таких как бронирование рейсов или оформление заказов. Этот показатель значительно отличается от результатов на стандартных бенчмарках, где успешность достигает 65–75% .
Источники
- Claude Sonnet 5: сильный агентный апгрейд, но не очевидная замена Opus — neurohive.io
- GLM-5: топ-1 открытая модель для генерации кода и текста, конкурирующая с Claude и GPT на агентных задачах — neurohive.io
- В ГД предупредили об использовании мошенниками дипфейков родственников — iz.ru
- ClawBench: лучший ИИ-агент смог успешно завершить только 33% реальных повседневных задач — neurohive.io