
Новый бенчмарк показал, что лучшие модели ИИ пока не способны превзойти инженеров, которых они призваны заменить, в решении реальных проблем. Это открытие подчеркивает сохраняющуюся важность человеческого опыта в критических ситуациях.
Результаты тестирования ИИ
Исследователи провели серию тестов, в ходе которых модели ИИ, включая GPT-4 и другие передовые системы, решали задачи, типичные для дежурного инженера. В большинстве случаев ИИ уступал человеку в скорости и точности диагностики неисправностей, особенно в нестандартных сценариях.
Почему ИИ пока не справляется
Основные причины — недостаток контекстуального понимания и неспособность адаптироваться к новым, не описанным в обучающих данных ситуациям. Инженеры, напротив, используют интуицию и опыт, что позволяет им быстрее находить решения.
Значение для рынка
Для пользователей криптообменников и других сервисов это означает, что полная автоматизация поддержки и устранения неполадок с помощью ИИ пока остается недостижимой целью. Человеческий фактор продолжит играть ключевую роль в обеспечении надежности и безопасности.

