Люди набирают 100%, а GPT-5.4 — всего 0,26%: неожиданный бенчмарк

На одном из бенчмарков люди набрали 100% правильных ответов, а GPT-5.4 — всего 0,26% . Результат шокирует: мы привыкли думать, что ИИ уже превзошёл...

1 мин чтения 0 Обновлено 01.04.2026

Новый тест показал, что ИИ далеко не во всём умнее людей

На одном из бенчмарков люди набрали 100% правильных ответов, а GPT-5.4 — всего 0,26%. Результат шокирует: мы привыкли думать, что ИИ уже превзошёл человека, но есть задачи, где разница колоссальна.

В чём подвох

Детали конкретного бенчмарка показывают: тест проверяет не эрудицию, а контекстное понимание — способность учитывать неявные связи, культурный контекст, здравый смысл. Это именно то, что LLM пока плохо умеют.

Что это значит

Искусственный интеллект силён в задачах с чёткими правилами: математика, код, перевод. Но в задачах, требующих глубокого понимания контекста — человеческий интеллект пока вне конкуренции. Это не повод расслабиться, а напоминание: ИИ — инструмент, а не замена мозга.

Парадокс бенчмарков

Ситуация показывает проблему бенчмарков в целом. Один тест — GPT-5.4 проигрывает людям. Другой — превосходит. Ключевой вопрос не «кто умнее», а «в чём именно умнее». Для бизнеса важнее не абстрактный IQ модели, а конкретные задачи, которые она решает лучше человека.

Материал был полезен?
AI-инструменты без границ

Получите доступ к нужному AI-сервису уже сегодня

ChatGPT, Claude, Gemini, MiniMax и агенты для кода — предложения проверенных продавцов по доступным ценам. Оплата российскими картами, через СБП или криптовалютой.

Проверенные продавцы Быстрая выдача Доступные цены
Прокрутить вверх