Опираясь на проведенные экспертные интервью и на исследования, которые были сделаны в ходе работы, можно сформировать рекомендации для сотрудников СМИ, которые помогут отличить подлинное видео от дипфейка.
1. Если журналист сомневается в подлинности изображения, он может загрузить его в поисковую систему для поиска по похожим картинкам. Если в качестве похожих изображений выводятся схожие с нашим изображением, но с какими-то изменениями - перед нами дипфейк.
2. Журналист может рассматривать артефакты на фотографии или видеозаписи. Должны настораживать замыливание или ненатуральная резкость отдельных участков фото или видео, разная цветопередача на разных участках фото или видео. Стоит обращать особое внимание на артефакты на границах лица, а также на то, насколько натурально выглядят волосы на фотографии или видеозаписи, не кажутся ли они "приклеенными" к лицу. В Приложении 4 размещено дипфейк-фото, волосы на котором прорисованы недостаточно детально, а некоторые пряди расположены не на своем месте. На волосы всегда стоит обращать особое внимание: именно на краях прически чаще всего возникают какие-либо артефакты или ощущение того, что прическа была перенесена с другого фото или видео.
3. Если вам кажется, что человек на видео выглядит как-то не так - скорее всего, так и есть. Исследования Сывей Люя доказывают, что на подсознательном уровне наше подсознание реагирует на большинство дипфейков, даже если мы не видим доказательств искусственного происхождения фотографии или видеозаписи. Стоит обратить внимание на то, как человек на видео моргает, как движется его рот во время разговора. Совпадают ли движения рта с теми словами, которые он произносит? Нет ли в движении рта монотонности? Меняется ли мимика человека в течение разговора? Пропорционально ли лицо человека в кадре? Ответы на эти вопросы могут помочь обнаружить дипфейк. Reuters также выделяет такое свойство дипфейков, как отсутствие "живости" глаз. Мимика человека - это не только движение губ, но еще движение глаз: недоверие, удивление, ужас, восторг - все эти эмоции мы проявляем в том числе с помощью глаз.
4. Не стоит забывать, что дипфейки - это не только подделка видеоряда, но еще и подделка аудиодорожки. Сама видеозапись может выглядеть абсолютно натурально и не являться дипфейком, но те слова, которые говорит человек, могут быть изменены. Здесь важно отследить, насколько движение губ совпадает с произносимыми словами. Нет ли моментов, когда губы все еще шевелятся, но человек ничего не произносит? Также может помочь поиск исходной видеозаписи, ведь обычно дипфейки делают уже на основе существующих фрагментов, и остается их только найти.
5. Тяжелее всего обнаружить дипфейк-аудиозапись, которая может быть представлена, как запись разговора. Все неестественные моменты речи могут быть замаскированы шумом, который является вполне естественным для диктофонной записи. Всегда обращайте внимание на интонацию, с которой говорит человек. Если речь безэмоциональна и монотонна, а между всеми словами и предложениями расставлены примерно одинаковые по длительности паузы - скорее всего, аудиозапись поддельная. В речи любого человека будут присутствовать паузы разной длительности, во время которых он подбирает слова или переводит дыхание. Даже если голос человека на записи кажется вам близким и знакомым, всегда считывайте такие сигналы, которые свидетельствовали бы о подделке.
6. Если результатом возможного дипфейка становится какое-то известное/должностное лицо, можно попросить комментарии у его пресс-службы. Конечно, если речь идет о журналистском расследовании, такие меры применить не получится.
7. Всегда стоит анализировать источник информации, который предоставил материал. Если он анонимный - стоит проводить проверку намного более качественно и постараться выйти с источником на связь. В случае, если материал уже опубликован в нескольких СМИ, стоит предупредить о своих опасениях по поводу реальности контента и спросить, какие меры были предприняты для обнаружения дипфейка, а также поинтересоваться, откуда появился материал.
8. При получении любых материалов от анонимных источников стоит искать других свидетелей события и, если это возможно, просить у них подтверждение в виде фотографий или видеозаписи с места происшествия. Эти меры помогут удостовериться в подлинности публикуемого материала.
9. Если самостоятельно доказать недостоверность материала не получается, можно показать его экспертам по машинному обучению и работе с нейросетями. Как правило, таким людям бывает проще определить, является ли материал дипфейком.
10. Старайтесь быть в курсе всех тенденций в сфере дипфейков и смотреть все новости, которые связаны с этой технологией. По данным Reuters, журналисты, которые знают, какими особенностями обладают дипфейки, с гораздо большей вероятностью смогут отличить их от реальных материалов.
11. Если подозрения в подлинности контента не исчезают, но информация должна быть опубликована, стоит отразить свои опасения в начале материала. В случае, если опасения подтверждаются, всегда нужно предоставлять опровержение.
Заключение
Цель данного исследования заключалась в изучении влияния технологии дипфейк на индустрию производства новостей. В первой главе рассматривается теоретическая база исследования: дается определение терминам "фейк", "дипфейк", объясняются причины снижения доверия к журналистскому контенту, а также анализируются изменения, происходящие в медиа.
Во второй главе была рассмотрена технология дипфейк и изучен объем технических знаний, требующихся для его написания. Мы изучили библиотеку Keras для глубокого обучения, рассмотрели принцип работы генеративно-состязательных алгоритмов (GAN), с помощью которых пишутся современные дипфейки. Был проведен эксперимент, в ходе которого удалось написать дипфейк при помощи открытой библиотеки DeepFaceLab, не обладая специальными навыками. Этот эксперимент позволил сделать вывод о том, что создавать дипфейки может практически любой человек, потративший несколько часов на овладевание новой технологией. Это значит, что в будущем будет создаваться еще больше недостоверного контента, поэтому журналистам необходим свод рекомендаций, которые позволили бы обнаруживать дипфейки. Создание таких рекомендаций стало итогом нашей работы.
Для того, чтобы создать рекомендации по обнаружению дипфейков, была рассмотрена общемировая практика по их распознаванию, в частности, деятельность агентства MediFor и курс от новостного агентства Reuters. Затем мы рассмотрели решения соревнования по обнаружению дипфейков, которое проходило на платформе Kaggle, и поговорили с участниками данного соревнования. В ходе интервью и анализа решений мы собрали универсальные рекомендации по обнаружению дипфейков для сотрудников СМИ.
Полученные рекомендации применимы для выявления аудио, видео и фотоматериалов, которые являются дипфейками. Выпускная работа снабжена приложением, где размещены дипфейк-кадры, на примере которых объясняется, по каким признакам можно выявлять дипфейк.
В работе мы ответили на поставленные исследовательские вопросы. В рамках ответа на вопрос о влиянии технологии дипфейк на журналистику было выявлено, что технология дипфейк может негативно влиять на медиаиндустрию: представлены примеры, в которых дипфейки способны разрушить карьеру политиков или журналистов. Так произошло с журналистом-расследователем Раной Айюб, дипфейк на которую негативно сказался на ее профессиональной деятельности. В рамках ответа на вопрос, как технология дипфейк влияет на доверие к журналистскому контенту, было выявлено, что потенциальное снижение доверия отмечают сами сотрудники СМИ, связывая его с распространением дипфейков и отсутствием технических средств в редакциях для их регулирования. Возможное снижение доверия к журналистскому контенту отмечают и представители data science индустрии, которые понимают механизм создания и распространения дипфейков. Они выражают опасение, что создатели дипфейков рано или поздно захотят воспользоваться индустрией производства новостей как сильным инструментом влияния на общественность. Для того, чтобы этого избежать, журналистам важно относиться ко всему поступающему контенту как к потенциальному дипфейку. В качестве ответа на последний исследовательский вопрос, как журналист может отличать дипфейк-контент от реального, были сформированы рекомендации по обнаружению дипфейков для сотрудников СМИ.
Список использованной литературы и источников
1. Adolf Hitler "Downfall Movie" to Mauricio Macri. (Faceswap Deeplearning) // YouTube URL: https://www.youtube.com/watch?v=M8t6hGRtDac (дата обращения: 05.03.2020).
2. China seeks to root out fake news and deepfakes with new online content rules // Reuters URL: https://www.reuters.com/article/us-china-technology/china-seeks-to-root-out-fake-news-and-deepfakes-with-new-online-content-rules-idUSKBN1Y30VU (дата обращения: 07.04.2020).
3. Creating a data set and a challenge for deepfakes // Facebook AI URL: https://ai.facebook.com/blog/deepfake-detection-challenge (дата обращения: 10.04.2020).
4. DARPA is funding new tech that can identify manipulated videos and `deepfakes' // techcrunch URL: https://techcrunch.com/2018/04/30/deepfakes-fake-videos-darpa-sri-international-media-forensics/ (дата обращения: 12.04.2020).
5. DeepFake (дипфейк) - реалистичная замена лиц на видео при помощи нейронных сетей // URL: https://yablyk.com/335033-deepfake-dipfejk-realistichnaya-zamena-lic-na-video-pri-pomoshhi-nejronnyx-setej/ (дата обращения: 03.02.2020).
6. Deepfake Detection Challenge // Kaggle URL: https://www.kaggle.com/c/deepfake-detection-challenge (дата обращения: 10.04.2020).
7. Deepfake technology shows the emperor (or the girl of your dreams) has no clothes // RT URL: https://www.rt.com/op-ed/463137-deep-fake-technology-nude/ (дата обращения: 07.03.2020).
8. DeepFake-туториал: создаем собственный дипфейк в DeepFaceLab // proglib URL: https://proglib.io/p/deepfake-tutorial-sozdaem-sobstvennyy-dipfeyk-v-deepfacelab-2019-11-16#comments (дата обращения: 12.04.2020).
9. False news 70 percent more likely to spread on Twitter: study // Reuters URL: https://www.reuters.com/article/us-usa-cyber-twitter/false-news-70-percent-more-likely-to-spread-on-twitter-study-idUSKCN1GK2QQ (дата обращения: 10.03.2020).
10. Fraudsters Used AI to Mimic CEO's Voice in Unusual Cybercrime Case // The Wall Street Journal URL: https://www.wsj.com/articles/fraudsters-use-ai-to-mimic-ceos-voice-in-unusual-cybercrime-case-11567157402 (дата обращения: 02.04.2020).
11. Fukuyama F. Trust: The Social Virtues and the Creation of Prosperity. - New York: Free Press, 1995. - 457 c.
12. Github URL: https://github.com/alievk/avatarify (дата обращения: 19.04.2020).
13. How can journalists help solve the global problem of deepfakes? // WNIP URL: https://whatsnewinpublishing.com/how-can-journalists-help-solve-the-global-problem-of-deepfakes/ (дата обращения: 20.04.2020).
14. I Was The Victim Of A Deepfake Porn Plot Intended To Silence Me // URL: https://www.huffingtonpost.co.uk/entry/deepfake-porn_uk_5bf2c126e4b0f32bd58ba316?guce_referrer=aHR0cHM6Ly93d3cuZ29vZ2xlLmNvbS8&guce_referrer_sig=AQAAAC6Ay04Tlda6iImxNR74VOSAJ8GJ_h2pDhDSPWs4CJQHedRAsPsfZDkLRyRBud1oX4j4MGSkMLVbnM7_vjwa9EZs1V7MQM-to8wfRbCzhH9iR6rDbL0x8hPDXrZmMn5HBxVvC2ZSQGqKVcLBAtEWjfUAh_gL8RAOOaDSVFC1cePL&guccounter=2 (дата обращения: 02.02.2020).
15. Identifying and tackling manipulated media // Reuters URL: https://www.reuters.com/manipulatedmedia?utm_campaign=ProMedia%20Report&utm_medium=email&utm_source=Revue%20newsletter&fbclid=IwAR2uk8TKSlBF4lSrM0KCgGT5ErbGACj8JEKOXjBi39EHTEq_UOo5msaH2lc (дата обращения: 20.04.2020).
16. Merkel Trump Deepfake // YouTube URL: https://www.youtube.com/watch?v=5hZOcmqWKzY (дата обращения: 05.03.2020).
17. Reuters Institute Digital News Report 2019 // Reuters Institute URL: https://reutersinstitute.politics.ox.ac.uk/sites/default/files/inline-files/DNR_2019_FINAL.pdf (дата обращения: 09.03.2020).
18. Six lessons from my deepfakes research at Stanford // Medium URL: https://medium.com/jsk-class-of-2019/six-lessons-from-my-deepfake-research-at-stanford-1666594a8e50 (дата обращения: 02.02.2020).
19. Terrifying high-tech porn: Creepy 'deepfake' videos are on the rise // Fox News URL: https://www.foxnews.com/tech/terrifying-high-tech-porn-creepy-deepfake-videos-are-on-the-rise (дата обращения: 02.02.2020).
20. The National Law Information Center is the Korean representative legal informalion web site URL: http://law.go.kr/LSW/eng/engLsSc.do?menuId=2§ion=lawNm&query=robot&x=18&y=29#liBgcolor4 (дата обращения: 07.04.2020).
21. The world's top deepfake artist is wrestling with the monster he created // MIT Technology Review URL: https://www.technologyreview.com/s/614083/the-worlds-top-deepfake-artist-is-wrestling-with-the-monster-he-created/?fbclid=IwAR2Vp_eBCwv5ZHL8-tulfBmH_KSjunMQ2MG4uhbBeibY83jZ55x-_DzydIg (дата обращения: 20.04.2020).
22. What is fake news? How to spot it and what you can do to stop it // The Guardian URL: https://www.theguardian.com/media/2016/dec/18/what-is-fake-news-pizzagate (дата обращения: 02.02.2020).
23. Why is Hanne Decoutere so peeved? // VRT NWS URL: https://www.vrt.be/vrtnws/en/2019/02/27/why-is-hanne-decoutere-so-peeved/ (дата обращения: 10.02.2020).
24. Ахирвар К. Состязательные сети. Проекты. - М.: ДМК Пресс, 2020. - 252 с.
25. Будущее журналистики и журналист будущего: обзор исследовательских мнений // CyberLeninka URL: https://cyberleninka.ru/article/n/buduschee-zhurnalistiki-i-zhurnalist-buduschego-obzor-issledovatelskih-mneniy (дата обращения: 06.04.2020).
26. Галерея нейросетевого искусства // Яндекс URL: https://yandex.ru/lab/ganart (дата обращения: 19.04.2020).
27. Генеративно-состязательная нейросеть (GAN). Руководство для новичков // Neurohive URL: https://neurohive.io/ru/osnovy-data-science/gan-rukovodstvo-dlja-novichkov/ (дата обращения: 10.04.2020).
28. Доверие: ключевое понятие теории социального капитала // CyberLeninka URL: https://cyberleninka.ru/article/n/doverie-kak-klyuchevoe-ponyatie-teorii-sotsialnogo-kapitala (дата обращения: 07.03.2020).
29. Ефанов А. А Падение доверия к телевидению: социологический взгляд на проблему. // Вестник ЮжноУральского государственного университета. Социально-гуманитарные науки, 2018. - 130 c.
30. Журналистика: от чего зависит доверие тех, кто ей служит // CyberLeninka URL: https://cyberleninka.ru/article/n/zhurnalistika-ot-chego-zavisit-doverie-tem-kto-ey-sluzhit (дата обращения: 07.03.2020).
31. Ильченко С.Н. Журналистика источников лжеинформации: кризис доверия в условиях шоу-цивилизации // Век информации. 2015. - 227 с.
32. Индийский политик сделал дипфейки собственной речи на других языках, чтобы привлечь больше избирателей // TJournal URL: https://tjournal.ru/internet/144420-indiyskiy-politik-sdelal-dipfeyki-sobstvennoy-rechi-na-drugih-yazykah-chtoby-privlech-bolshe-izbirateley (дата обращения: 10.03.2020).
33. Информационная перегрузка // Национальный исследовательский университет "Высшая школа экономики" URL: https://iq.hse.ru/news/215584230.html (дата обращения: 15.04.2020).
34. Искусственный интеллект, разработанный в Сколково, посоветовал россиянам бежать из страны // ИА "Панорама" URL: https://panorama.pub/25978-iskusstvennyj-intellekt.html (дата обращения: 09.03.2020).
35. К чему привело развитие дипфейков и что будет дальше // URL: https://news.rambler.ru/other/42984873-k-chemu-privelo-razvitie-dipfeykov-i-chto-budet-dalshe/?updated (дата обращения: 03.02.2020).
36. Как изменилась журналистика за последние 10 лет // Медиастанция URL: https://mediastancia.com/articles/3955/ (дата обращения: 07.03.2020).
37. Министерство обороны США попытается решить проблему deepfake // Хабр URL: https://habr.com/ru/news/t/463395/ (дата обращения: 12.04.2020).