
GPTZero нашёл AI-галлюцинации в четырёх отчётах PwC Middle East
Сервис GPTZero, предназначенный для обнаружения текстов, сгенерированных AI, выявил выдуманные факты и числа (галлюцинации) в четырёх финансовых отчётах PwC Middle East. Ранее аналогичные расследования GPTZero уже приводили к отзыву отчётов аудиторских компаний EY и KPMG. Это ставит вопрос о надёжности финансовой отчётности, подготовленной с использованием AI-инструментов, и об ответственности аудиторов за конечный результат.
Что именно нашёл GPTZero в отчётах PwC?
В ходе плановой проверки PwC Middle East сервис выявил в четырёх отчётах факты, которые невозможно верифицировать из открытых источников: выдуманные цитаты, несуществующие данные и ложные утверждения. PwC — одна из крупнейших аудиторских компаний в мире, и её отчёты используются инвесторами, регуляторами и партнёрами для принятия бизнес-решений. GPTZero использует статистический анализ — измеряет перплексию (непредсказуемость текста) и ищет паттерны, характерные для текстов, написанных большими языковыми моделями. Ранее исследование Epoch AI показало, что AI-детекторы текста проваливают до 48% стилевых имитаций, что подтверждает сложность задачи даже для специализированных инструментов.
Какие факты и цифры известны из расследования?
Ранее аналогичные расследования GPTZero уже имели последствия для индустрии. Компании EY и KPMG отзывали свои отчёты после того, как проверка выявляла проблемы с AI-порождённым контентом. Это ставит вопрос об ответственности аудиторов за конечный результат, особенно когда при подготовке документов используются языковые модели. Согласно исследованиям, более половины AI-агентов дают неверные ответы из-за проблем с контекстом, что объясняет склонность моделей к галлюцинациям при работе с большими массивами данных.
Почему это важно для аудиторской индустрии?
Использование AI для подготовки финансовых отчётов стало стандартной практикой в крупных аудиторских фирмах по всему миру. Инструменты вроде ChatGPT и Claude способны генерировать связный текст с таблицами и данными за секунды, экономя десятки часов ручной работы. Аудиторы используют их для черновиков, сводок и аналитических записок — но ответственность за точность данных остаётся на человеке. Но даже лучшие модели склонны к галлюцинациям — выдумыванию фактов, которые выглядят правдоподобно, но не соответствуют действительности. До сих пор основная дискуссия о галлюцинациях велась в контексте журналистики и академических текстов. Случай с PwC показывает, что проблема затрагивает финансовую сферу, где точность данных критически важна для принятия инвестиционных решений.
Что будет дальше?
PwC пока не опубликовала официальных комментариев. Ожидается, что инцидент усилит дискуссию о стандартах верификации AI-контента в финансовой отрасли. Аудиторские фирмы по всему миру могут быть вынуждены ввести обязательную проверку документов на AI-порождённый контент перед их публикацией. Аудиторские фирмы по всему миру могут быть вынуждены ввести обязательную проверку документов на AI-порождённый контент перед их публикацией. Крупные аудиторские компании, вероятно, разработают внутренние политики использования языковых моделей при подготовке отчётности — аналогично тому, как это уже произошло в юридической и медицинской сферах.
Подберите сервис под задачу и начните работать сегодня
ChatGPT, Claude, Gemini, MiniMax и другие инструменты для текстов, кода, изображений и автоматизации — без долгого поиска вариантов.