нейроинструменты

2 сентября 2026 г.

Claude Sonnet 5, ChatGPT Images 2.0, GLM-5, DeepSeek V4 Flash — 2 сентября 2026

Новые версии моделей Claude, ChatGPT Images, GLM-5 и DeepSeek показывают улучшения в генерации изображений, агентных задачах и производительности.

Claude Sonnet 5: сильный агентный апгрейд, но не очевидная замена Opus

Anthropic выпустила Claude Sonnet 5 — обновленную модель серии Claude, доступную бесплатно. Ориентация на агентские задачи, программирование и инструменты. Улучшения включают планирование действий, использование браузера и терминала, написание и проверку кода. Несмотря на сильные стороны, модель не заменяет Opus из-за специфики применения.

Источник: neurohive.io

ChatGPT Images 2.0: первая в рейтингах генерация изображений с высоким разрешением и мультиязыком

OpenAI анонсировала ChatGPT Images 2.0 на базе gpt-image-2. Новая модель лидирует по качеству генерации изображений: точное следование сложным инструкциям, идеальное отображение текста на различных языках, разрешение 2К. Рост рейтинга Elo на 242 пункта относительно конкурентов.

Источник: neurohive.io

GLM-5: лучшая открытая модель для генерации текста и кода, конкурент Claude и GPT

Zhipu AI и Tsinghua University представили GLM-5 — открытую языковую модель, лидирующую по бенчмаркам: первое место среди открытых моделей на Artificial Analysis и LMArena, лучшее решение задач с инструментами на BrowseComp и HLE. Способность решать комплексные задачи делает её серьезным соперником закрытых моделей.

Источник: neurohive.io

DeepSeek V4 Flash: улучшение агентности после переобучения, ответ на ценовую войну OpenAI

DeepSeek официально выпустил V4 Flash, отвечая на снижение цены младших моделей OpenAI. Новый релиз сохраняет архитектуру и параметры предыдущей версии, улучшая результаты исключительно за счет переобучения. Основное внимание уделено агентским задачам: рост индекса Artificial Analysis с 40 до 50 пунктов, приближаясь к показателям GPT-5.6 Luna.

Источник: ai-stat.ru

ClawBench: лучшие ИИ-агенты завершают только треть реальных повседневных задач

Новый бенчмарк ClawBench оценивает способность ИИ-агентов справляться с настоящими повседневными задачами вроде бронирования рейсов и оформления заказов. Лучший результат показал Claude Sonnet 4.6 — всего 33% успеха. Традиционные бенчмарки демонстрируют значительно лучшие показатели (65–75%), подчеркивая разрыв между академическими тестами и реальной жизнью.

Источник: neurohive.io

Гонки нейросетей: турнир семи моделей выявляет различия в скорости и качестве

Автор провёл экспериментальное соревнование семи популярных нейросетевых моделей, сравнивая скорость и точность выполнения практических задач. Подключив модели через OpenRouter, автор обнаружил значительные отличия в результатах. Исследование показывает важность тестирования моделей на реальных кейсах перед внедрением в проекты.

Источник: habr.com

Нейросети учат распознавать мошеннические письма и тексты

Amazon добавила функцию проверки подозрительных сообщений в голосовом помощнике Alexa для покупок. Теперь пользователи смогут узнать, является ли письмо или сообщение подлинным. Функция основана на анализе текста и сравнении с базой известных шаблонов мошенничества.

Источник: techcrunch.com

Искусственный интеллект помогает ускорить цветокоррекцию фотографий на планшетах

YADRO улучшила процесс обработки фото на планшетах благодаря использованию нейросети MSLTNet. Задача состояла в усилении цветов и контраста без появления артефактов и задержек. Решение позволяет обрабатывать снимки высокого разрешения быстро и качественно, делая технологию доступной для широкого круга пользователей.

Источник: habr.com