2 сентября 2026 г.
Claude Sonnet 5, ChatGPT Images 2.0, GLM-5, DeepSeek V4 Flash — 2 сентября 2026
Новые версии моделей Claude, ChatGPT Images, GLM-5 и DeepSeek показывают улучшения в генерации изображений, агентных задачах и производительности.
Claude Sonnet 5: сильный агентный апгрейд, но не очевидная замена Opus
Anthropic выпустила Claude Sonnet 5 — обновленную модель серии Claude, доступную бесплатно. Ориентация на агентские задачи, программирование и инструменты. Улучшения включают планирование действий, использование браузера и терминала, написание и проверку кода. Несмотря на сильные стороны, модель не заменяет Opus из-за специфики применения.
Источник: neurohive.io
ChatGPT Images 2.0: первая в рейтингах генерация изображений с высоким разрешением и мультиязыком
OpenAI анонсировала ChatGPT Images 2.0 на базе gpt-image-2. Новая модель лидирует по качеству генерации изображений: точное следование сложным инструкциям, идеальное отображение текста на различных языках, разрешение 2К. Рост рейтинга Elo на 242 пункта относительно конкурентов.
Источник: neurohive.io
GLM-5: лучшая открытая модель для генерации текста и кода, конкурент Claude и GPT
Zhipu AI и Tsinghua University представили GLM-5 — открытую языковую модель, лидирующую по бенчмаркам: первое место среди открытых моделей на Artificial Analysis и LMArena, лучшее решение задач с инструментами на BrowseComp и HLE. Способность решать комплексные задачи делает её серьезным соперником закрытых моделей.
Источник: neurohive.io
DeepSeek V4 Flash: улучшение агентности после переобучения, ответ на ценовую войну OpenAI
DeepSeek официально выпустил V4 Flash, отвечая на снижение цены младших моделей OpenAI. Новый релиз сохраняет архитектуру и параметры предыдущей версии, улучшая результаты исключительно за счет переобучения. Основное внимание уделено агентским задачам: рост индекса Artificial Analysis с 40 до 50 пунктов, приближаясь к показателям GPT-5.6 Luna.
Источник: ai-stat.ru
ClawBench: лучшие ИИ-агенты завершают только треть реальных повседневных задач
Новый бенчмарк ClawBench оценивает способность ИИ-агентов справляться с настоящими повседневными задачами вроде бронирования рейсов и оформления заказов. Лучший результат показал Claude Sonnet 4.6 — всего 33% успеха. Традиционные бенчмарки демонстрируют значительно лучшие показатели (65–75%), подчеркивая разрыв между академическими тестами и реальной жизнью.
Источник: neurohive.io
Гонки нейросетей: турнир семи моделей выявляет различия в скорости и качестве
Автор провёл экспериментальное соревнование семи популярных нейросетевых моделей, сравнивая скорость и точность выполнения практических задач. Подключив модели через OpenRouter, автор обнаружил значительные отличия в результатах. Исследование показывает важность тестирования моделей на реальных кейсах перед внедрением в проекты.
Источник: habr.com
Нейросети учат распознавать мошеннические письма и тексты
Amazon добавила функцию проверки подозрительных сообщений в голосовом помощнике Alexa для покупок. Теперь пользователи смогут узнать, является ли письмо или сообщение подлинным. Функция основана на анализе текста и сравнении с базой известных шаблонов мошенничества.
Источник: techcrunch.com
Искусственный интеллект помогает ускорить цветокоррекцию фотографий на планшетах
YADRO улучшила процесс обработки фото на планшетах благодаря использованию нейросети MSLTNet. Задача состояла в усилении цветов и контраста без появления артефактов и задержек. Решение позволяет обрабатывать снимки высокого разрешения быстро и качественно, делая технологию доступной для широкого круга пользователей.
Источник: habr.com