Россияне лучше распознают ИИ в видео

Россияне лучше всего распознают контент, созданный искусственным интеллектом, в видео. Правильно определить авторство видео смогли 77% участников, говорится в исследовании Kokoc Group.

Участникам показывали тексты, изображения, аудио и видео, созданные человеком или нейросетями, а затем просили определить их происхождение. Хуже всего респонденты справились с голосовыми сообщениями: отличить живую речь от синтезированной смогли только 44%.

По словам участников, в видео нейросети чаще всего выдают нарушения логики и физики. Речь идет о ситуациях, когда из кадра исчезают объекты, колёса вращаются неправильно, а звук не совпадает с изображением.

Тексты, созданные ИИ, верно распознали 74% респондентов. Проще всего участники определяли нейросетевые сообщения в мессенджерах: с этой задачей справились 82% опрошенных.

Как отметили респонденты, ИИ в текстах часто выдают чрезмерная вежливость и слишком «идеальное» оформление. Человеческие сообщения, напротив, отличаются разговорным порядком слов и естественной манерой письма.

Авторство товарных карточек правильно определили 76% участников. Самыми трудными в текстовой категории оказались информационные статьи: их верно распознали только 64% респондентов.

Участники исследования отметили, что в таких материалах нейросети чаще используют обобщённые формулировки. Человеческий текст, по их мнению, можно узнать по самоиронии и критическому отношению к собственным выводам.

С изображениями участники справились хуже: их происхождение верно определили 65% респондентов. Художественные картины распознавать было проще — правильный ответ дали 68% участников.

При оценке картин респонденты обращали внимание на фактуру холста, следы кисти и историческую достоверность сюжета. Реалистичные фотографии пейзажей вызвали больше затруднений: их происхождение верно определили только 61% участников.

Авторы исследования объясняют это тем, что пользователи привыкли к качественной обработке снимков. Поэтому слишком «идеальные» изображения всё чаще воспринимаются как результат работы нейросети.

В аудио лучше всего участники распознавали музыку: её происхождение правильно определили 75% респондентов. Намного труднее оказалось отличить настоящий голос от синтезированного.

По словам участников, живую речь выдают паузы, дыхание и небольшие запинки. Нейросети, как они считают, говорят слишком ровно, с идеальной дикцией и почти без естественных остановок.

Многие участники признались, что вообще не слышат разницы между человеческим и цифровым голосом. Исследование также показало, что представления пользователей о признаках качественного контента меняются.

Если раньше грамотный текст, аккуратная композиция и качественная картинка воспринимались как плюс, то теперь именно такие признаки чаще вызывают подозрения. Небольшие ошибки, дрожащая камера, неровные линии и лёгкая хрипотца в голосе многие участники назвали признаками человеческого контента.

Респондентов раздражает не сам факт использования ИИ, а попытки выдать такой контент за созданный человеком, особенно в рекламе, службах поддержки и других сервисах. При этом использование ИИ для рутинных задач многие воспринимают спокойно.

При обнаружении нейроконтента в музыке, живописи и личном общении пользователи чаще теряют доверие к источнику. Около 30% участников считают, что хорошо понимают признаки генерации и могут распознавать нейросети по техническим деталям.

Половина респондентов признали, что технологии развиваются быстрее, чем их способность распознавать ИИ. Ещё 20% после теста заявили, что больше не уверены, смогут ли отличить человеческий контент от нейросетевого.

Источник: RB.RU — https://rb.ru/news/77-rossiyan-raspoznayut-ii-v-video-pri-etom-bolshe-poloviny-ne-mogut-otlichit-cifrovoj-golos-ot-nastoyashego/

Читать новости ИИ и технологий в Telegram.


Оцените статью
Gimal-Ai