Что такое хороший тест антивируса? - Тесты и сравнения - Форумы Anti-Malware.ru Перейти к содержанию
OlegAndr

Что такое хороший тест антивируса?

Recommended Posts

OlegAndr

Ну давайте попробуем, коллеги подмогнут, я уверен.

Итак что такое хороший тест антивируса???

1. Он должен быть репрезентативным.

2. Он должен быть правильно проведен

3. Он должен быть проверяемым.

Что значит репрезентативным?

Вот например Лаборатория Касперского получает 125 000 уникальных семплов малвары в день. Что на этом фоне тест на основе 300 вирусов, на основе 1000 вирусов? Их можно все пропустить и все равно это будет укладываться в погрешность.

Я правда мат. статистику никогда не любил, но очевидно всякому что проверять надо на ГОРАЗДО большем числе файлов, чтобы иметь возможность делать выводы на основе этого.

Тесты коллекций которые проводятся лидерами сравнительного тестирования в мире - Av-Test.org, Av-Comparatives.org, VirusBuletein занимают ДНИ и количество семплов измеряется миллионами.

Небольшое количество семплов может быть оправдано только в случае если:

1. Измеряется способность ловить самый свежак - то есть семплы проверяются сразу при появлении их во каналах распространения - спам финишг рассылка и прочее. Тогда количество семплов будет измеряться десятками за день теста. Но это уже ограничение физическое - тестер не сможет обрабатывать больше без потери качества исследования. Также такие результаты всегда надо смотреть на более большом отрезке -месяц и больше.

2. Измеряется способность лечить сложные угрозы. - так как реально сложных угроз мало, то и количество исследуемых файлов может быть невелико, но тут уже результаты могут быть поставлены под сомнение.

Некоторые начинают учитывать распространенность семпла при подсчете результата. Например есть семплы которые стыдно не ловить - они например пол интернета заразили, а есть какое-то поделие васи которое он принес в школу и заразил петю, обидно конечно но не так опасно. Тут начинается целая история как эти данные собирать и учитывать.

Что значит правильно проведен?

Это значит что методология (страшное слово) должна не вызывать вопросов.

Например все файлы по которым проводится проверка должны быть действительно вредоносными.

Тест должен проводиться в условиях приближенных к реальным - на реальном железе (это важно для корректной работы всех систем антивиурса), с реальным доступом в интернет (это важно для работы облачных технологий), на реальных системах, актуальными версиями АВ-продуктов.

Файлы не только проверять на обнаружение но еще и запускать - т.к. многие технологии позволяют отследить вредоносную активность при запуске но не ругаться на файл пока он лежит на винте просто так.

Что значит должен быть проверяемым?

Это значит что коллекция по которой проводился тест, или, как минимум пропуски, должны быть доступны антивирусным лабораториям для проверки. Тут нет никаких предубеждений - все абсолютно тестовые лаборатории случается записывают в пропуски неработоспособные вирусы, либо не вредоносные файлы.

Например считать вредной чистую утилиту, которая кем-то где-то была интегрирована с вирусом, и с тех пор обнаруживается некоторыми несознательными АВ-лабораториями. Это случается постоянно, поэтому ВСЕ нормальные лаборатории прежде чем публиковать результаты предоставляют промахи для того чтобы АВ-вендоры могли подтвердить или опровергнуть вредоносность.

Самопальные Тестеры-энтузиасты которые говорят "я тут нашел свежей малвары и никто ее не ловит" сразу получают вопросы типа

1. Действительно ли это малвара и насколько она репрезентативна.

2. насколько она свежая (в принципе это неважно, чем старее тем больше шансов что она в базах, но были случаи когда проверялась дос-малвара, которая вообще не запускается на тех системах для которых предназначены современные антивирусы)

3. какой продукт ты тестировал

4. как ты тестировал

5. покажи, что именно не ловится и см пункт 1.

  • Upvote 11

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Тесты коллекций которые проводятся лидерами сравнительного тестирования в мире - Av-Test.org, Av-Comparatives.org, VirusBuletein занимают ДНИ и количество семплов измеряется миллионами.

Небольшое количество семплов может быть оправдано только в случае если:

Я бы заметил, что тесты на детект мертвых тушек файловыми сканерами себя принципиально исчерпали. При этой уже не имеет никакой роли сколько там самплов. Все равно мы имеем:

1. Братскую могилу тушек, которых уже нет в дикой природе здесь и сейчас. Они были когда-то там и их детект сейчас не говорит о качестве защиты.

2. Не учитывается работа множества технологий защиты, отличных от файлового сканирования. Тут и веб-фильтрация, и блокирование эксплойтов, HIPS и т.д.

3. Кто верифицирует самплы в коллекциях? Что это реально вредоносы. Эта проблема была актуальна даже 7-8 лет назад, когда цифры были совсем другие. Слышал много баек на тему мусора в коллкциях Av-Test.org, Av-Comparatives.org.

4. Происхождение больших коллекций. Не надо питать иллюзий, что кто-то из независимых тест-лабов способен собрать соизмеримое с вендорами кол-во самплов. Происхождение коллекций у проводящих такие тесты лабораторий - тайна за семью печатями. ;)

Поэтому принципиально считаю тесты на коллециях из N каких-то там файлов полным ацтоем незаслуживающим никакого внимания.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
military

OlegAndr,спасибо за интересную тему.

3. Кто верифицирует самплы в коллекциях? Что это реально вредоносы. Эта проблема была актуальна даже 7-8 лет назад, когда цифры были совсем другие.

Ежедневные коллекции с известных сайтов (virussign, malwares.safegroup ) частично решают эту проблему, например тем, что там отсутствуют дос вирусы?

Допустим мне интересно узнать детект файлового монитора у ряда АВ, то для отбора вирусов из коллекций сайтов приведенных выше, подойдет первоначальное сканирование определенным АВ, где файлы признанные 100% вредоносными, я отберу для дальнейшего сравнительного теста?

В итоге тест будет проведен на определенном кол-ве 100% вредоносных файлах, так будет правильнее?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Dmitriy K
Ежедневные коллекции с известных сайтов

Большое количество трэша/чистых файлов/кейгенов/адвар и прочего grayware

отсутствуют дос вирусы

Я бы так не говорил :D

Угрозы с префиксами win9x и макросы в этих помойках я так понимаю очень актуальны :)

где файлы признанные 100% вредоносными

Plz, дай гарантию, что это:

1) не фолс антивируса

2) файл не битый

3) актуальный вредонос

Поэтому все эти сканирования 10/100/1000/2000 неизвестных ошметков будут

полным ацтоем незаслуживающим никакого внимания

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr

Вообще тесты on-demand тушкопомоек себя действительно исчерпали.

В настоящее время самый правильный тест - это самая свежая малвара, а лучше даже живая вредоносная ссылка, которая, внимание military, проверяется на вредоносность на тестовой машине, а потом по этой ссылке ходят с машины защищенной антивирусом и смотрят результат.

То что называется RealWorld / Dynamic

Но тут опять же важна репрезентативность, а она будет страдать по причине малого числа семплов, как я говорил, смотреть только в перспективе когда наберется порядочно данных и то результаты будут плавать.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
military
Plz, дай гарантию

Dmitriy K, понимаю, гарантии быть не может. Если подобрать для этого дела антивирус с минимальными ложными срабатываниями? тот же MSE.

OlegAndr, согласен, что любой тест на сигнатурное обнаружение, будет однобоким, но стоит задача его провести. Где найти этой самой малвары по свежее или как ее "вытащить" из мегапаков?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr
Dmitriy K, понимаю, гарантии быть не может. Если подобрать для этого дела антивирус с минимальными ложными срабатываниями? тот же MSE.

OlegAndr, согласен, что любой тест на сигнатурное обнаружение, будет однобоким, но стоит задача его провести. Где найти этой самой малвары по свежее или как ее "вытащить" из мегапаков?

Ты не можешь ориентироваться на чужие вердикты, все равно есть риск ошибки. Правильнее руками проверить действия вредоноса на реальной (!) машине.

Ищут кто как, и это уже некоторое ноу-хау.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Dmitriy K
Dmitriy K, понимаю, гарантии быть не может. Если подобрать для этого дела антивирус с минимальными ложными срабатываниями? тот же MSE.

...

Где найти этой самой малвары по свежее или как ее "вытащить" из мегапаков?

Практической пользы нет, выборка - мизерная, какой смысл этим заниматься?

В этих и прочих "мегапаках" половина или больше - допотопный треш.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Plz, дай гарантию, что это:

1) не фолс антивируса

2) файл не битый

3) актуальный вредонос

Вот и по то же. Помойка непонятно кем и из чего составленная.

В настоящее время самый правильный тест - это самая свежая малвара, а лучше даже живая вредоносная ссылка, которая, внимание military, проверяется на вредоносность на тестовой машине, а потом по этой ссылке ходят с машины защищенной антивирусом и смотрят результат.

То что называется RealWorld / Dynamic

Но тут опять же важна репрезентативность, а она будет страдать по причине малого числа семплов, как я говорил, смотреть только в перспективе когда наберется порядочно данных и то результаты будут плавать.

Согласен. Для динамики надо брать многочисленную выборку, а это значит тестлаб попадает на кучу денег на построение фреймворка (железо, софт, своя разработка).

Но даже здесь еще никто не решил вопрос геотаргетинга вредоносных партнерок на базе TDS. Результаты одного и того же теста могут быть разными в разных странах. Ссылки разные, вредоносы разные.

согласен, что любой тест на сигнатурное обнаружение, будет однобоким, но стоит задача его провести. Где найти этой самой малвары по свежее или как ее "вытащить" из мегапаков?

Какой смысл в этом? Кем ставится такая задача?

Собирайте, анализируйте руками сами. Все прогоны сканерами - это полный бред.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
military
Помойка непонятно кем и из чего составленная.

Но ведь условия для всех одинаковые. 1000 файлов из которых пусть 100 или даже 200 файлов окажутся "чистыми " , и тогда их оставят все , а разницу покажет детект на оставшейся 100% малвари.

Какой смысл в этом? Кем ставится такая задача?

Мною :rolleyes:

Проактивные технологии, хипсы-шмипсы, это очень интересно, но не во всех АВ они работают как хотелось бы. Например dr.web , один из мощных АВ, один из лидеров на российском рынке, но если вредоносного файла нет в базе сигнатур, то на запуск реакции антивируса не будет. Поэтому считаю, что первым (где-то и последним )) эшелоном защиты антивируса (рассматриваю только антивирус, а не весь комплекс защиты) является сигнатурный детект.

Прошу прощения за нубские вопросы, но мне действительно хочется возможностями простого юзверя проводить приемлемые тесты, в данном случае на сигнатурный детект.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Но ведь условия для всех одинаковые. 1000 файлов из которых пусть 100 или даже 200 файлов окажутся "чистыми " , и тогда их оставят все , а разницу покажет детект на оставшейся 100% малвари.

Вы не понимаете главного, что в погоне за дешевыми регалиями в подобных тестах антивирусные вендоры детектят кучу всякого мусора, битых или вовсе чистых файлов. Стоит одному-двум задетектить чистый файл, как большинство также передерают детект. Поищите, на нашем форму полно таких тем было.

В итоге что вам покажет результат 98 из 100? Что антивирус хорошо детектит? А может то, что у него куча фалсов и бесполезных детектов "чтобы было"?

Совсем не случайно, что в таких тестах на файловых помойках чаще рулят вендоры второго и третьего эшелона, у которых несколько движков (перемножаются фалсы и ошибки) и нет даже своего вирлаба толком никакого.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Aleksandra
3. Он должен быть проверяемым.

Он должен быть прозрачным, тогда и будет проверяемым.

Что значит должен быть проверяемым?

Это значит что коллекция по которой проводился тест, или, как минимум пропуски, должны быть доступны антивирусным лабораториям для проверки.

Сумма хешей малвари которая использовалась при тестировании должна быть в паблике.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
military
А может то, что у него куча фалсов и бесполезных детектов "чтобы было"?

Вполне возможно. значит файлы должны быть заведомо только малварью.

Не совсем понятна Ваша цитата:

вендоры второго и третьего эшелона, у которых несколько движков (перемножаются фалсы и ошибки) и нет даже своего вирлаба толком никакого

Технически наверное их можно назвать вторым эшелоном, из-за отсутствия вирлаба. Все таки хочется быть уверенным, что с новым обновлением не наступят проблемы, как это было недавно с Эмсисофтом (Икарусом), хоть и очень быстро исправили.

Оценка данная Вами как "второй эшелон" основана на каких критериях? наверное не только отсутствием вирлаба?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Сумма хешей малвари которая использовалась при тестировании должна быть в паблике.

А что это даст? Вендоры и так могут получить хеши и даже самплы по запросу.

Технически наверное их можно назвать вторым эшелоном, из-за отсутствия вирлаба. Все таки хочется быть уверенным, что с новым обновлением не наступят проблемы, как это было недавно с Эмсисофтом (Икарусом), хоть и очень быстро исправили.

Оценка данная Вами как "второй эшелон" основана на каких критериях? наверное не только отсутствием вирлаба?

Под вторым эшелоном я имею в виду небольших вендоров, которые имеют скромные доли рынка в мировом масштабе, скромное кол-во инсталляций + скромные технологические возможности, включая свой вирлаб.

На рынке полно антивирусов, которые по сути представляют собой красочную упаковку с множеством этикеток чужих технологий. Например, тех же мультидвижковых продуктов полно сейчас. Велью от них в современных условиях - о-малое. Классические сигнатурные методы защиты быстро отмирают, можно хоть 10 движков поставить в ряд - только увеличится кол-во фалсов, а реальной защиты от новых угроз не добавится.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Aleksandra
А что это даст? Вендоры и так могут получить хеши и даже самплы по запросу.

Это даст прозрачность тесту, ну а на счет вендоров и так понятно.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr
Он должен быть прозрачным, тогда и будет проверяемым.

Сумма хешей малвари которая использовалась при тестировании должна быть в паблике.

Вообще-то не всем они нужны, и в публичный отчет их как правило не включают.... Но почему бы нет.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Milord
что в таких тестах на файловых помойках чаще рулят вендоры второго и третьего эшелона, у которых несколько движков (перемножаются фалсы и ошибки)

Ну как бы многодвижковые решения, можно наблюдать в первых рядах и в тестах проф тестовых лабораторий, они тоже пользуются файловыми помойками?) И вы совсем не допускаете возможности, что два антивирусных движка с минимальными фолсами и отличным детектом (а такие есть на западе) не дадут отличный продукт, который сможет конкурировать с решениями "первого эшелона") перегруженных новомодными технологиями, которые порой дают гораздо больше фолсы, чем недоработки вирлабов)

  • Like 1

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Ну как бы многодвижковые решения, можно наблюдать в первых рядах и в тестах проф тестовых лабораторий, они тоже пользуются файловыми помойками?) И вы совсем не допускаете возможности, что два антивирусных движка с минимальными фолсами и отличным детектом (а такие есть на западе) не дадут отличный продукт, который сможет конкурировать с решениями "первого эшелона") перегруженных новомодными технологиями, которые порой дают гораздо больше фолсы, чем недоработки вирлабов)

Я уже писал выше, что происхождение коллекций в так называемых вами проф. тестовых лабораториях (типа AV-Test.org или AV-Comparatives.org) никому не известно. Об этом можно только догадываться. Мусора там много, не однократно об этом слышал от вендоров, которые когда-то получали оттуда якобы пропуски. Поймите, когда разница в первой десятке 2-3%, то это как раз соответствует примерному уровню погрешности из-за ошибок в коллекции. Поэтому победа мультидвижкового продукта ровно ни о чем не говорит, ведь складываются еще и фолсы, а не только детект. А фолсы почти никто не проверяет нормально.

Более того, в погоне за детектом на этих вот тестовых коллекциях многие антивирусные компании стали детектить кучу мусора по принципу "лучше задетектить, чем объяснить почему НЕ детектим". Отсюда тупо идет гонка детектов ради самой гонки, к защите это не имеет никакого отношения. Это театр порочного круга: одни собирают непонятные коллекции, другие хотят быть крутыми на этой непонятной коллекции. А в подобной гонке особо рьяно участвуют как раз вендоры третьего эшелона. Им надо любой ценой показать свою всевдокрутизну. Для это начинаются массовые детекты всех помоек, любых упакованных объектов, любых подозрительных объектов. Некоторые даже "вредосноные" куки детектят :) Плюс передирают детекты у лидеров, так как своего вирлаба у них нет.

Про перегруженность новыми технологиями это вы классно сказали. Чего там париться, лучше сигнатур могут быть только сигнатуры. Все остальные технологии - маркетинговое фуфло и их в тестах просто вредно учитывать :) И не беда, что на дворе уже не начало 90-х, а кол-во новых самплов в сутки измеряется десятками тысяч.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr

Кто ворвался в мой тред и сломал его?

Вообще вы смотрите RAP который по замороженным базам, хотя Vb100 давно проводит более актуальные тесты с обновлениями и облаками.

Полез смотреть результаты последнего теста VB:

Response tests Day -7 Day -6 Day -5 Day -4 Day -3 Day -2 Day -1 Average

Kaspersky 87.53% 84.17% 91.67% 84.42% 87.40% 82.66% 89.58% 86.78%

G Data 86.76% 90.54% 92.77% 85.04% 86.18% 86.37% 80.95% 86.94%

TrustPort 74.04% 91.94% 84.04% 88.92% 80.40% 88.02% 87.50% 84.98%

100 раз правы те кто говорят что только сигнатурные тесты уже мало значат, и будут еще меньше значить

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr

Коллеги, by all means, давайте включать в тесты все продукты, которые хотят, правда еще лучше чтобы и те, которые не хотят, а то тут в соседней ветке недоумевают почему Dr Web отстаёт по тестам.

Другое дело, что чтобы протестить весь набор надо много сил и времени.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин

military, если возвращаться к тебе топика, но рассматривать его узко с точки зрения проверки качества защиты (т.е. детекта), то имеет смысл ориентировать только на динамические тесты (whole product tests или их еще называют RealWorld или Dynamic). Там проверяется суммартная эффективность всех технологий антивирусов. Мы делали такой тест довольно давно http://www.anti-malware.ru/antivirus_test_...-day_protection

Можно посмотреть более свежие тесты по такой методике от AV-Test.org или AV-Conparatives.org. Вот пример http://www.anti-malware.ru/forum/index.php?showtopic=20852

Как видите, там в топе совсем другие ребята, а не те, которые юзают пачками чужие движки не первой свежести.

ЗЫ GData поняв, что без своего вирлаба никак -- набрала людей. И это не единственный пример

Кстати ДА! И как говори мне их немцы, накачивают свое облако активно.

Хотя чему я удивляюсь - это ж АНТИМАЛВАР!!!

Признаться, Вас сюда в адвокаты антивирусным поделкам третьего эшелона никто и не звал. Трастпорт в руки и в пешое эротическое путешествие домой, шагом марш! :lol:

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
OlegAndr

efim

Влез в тему по критериям тестов с темой о том что многодвижковые АВ лучше, похамил немного, вызвал обратную реакцию и удалился.

Сергей Ильин

Коллеги, а давайте напишем большими буквами на видном месте, при регистрации особенно, что на ресурсе много, РЕАЛЬНО МНОГО людей которые являются признанными экспертами в реальном мире, а не только в уютненьком интернетике, которые занимаются проблематикой МНОГО ЛЕТ, и которые органически не приемлют безаплелляционные наезды, хотя и готовы дискутировать на спорные темы, пусть часто слишком бурно. -)

Этого понимания кстати я так понимаю многим не хватает, как и мне когда я начал сюда ходить....

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Коллеги, а давайте напишем большими буквами на видном месте, при регистрации особенно, что на ресурсе много, РЕАЛЬНО МНОГО людей которые являются признанными экспертами в реальном мире, а не только в уютненьком интернетике, которые занимаются проблематикой МНОГО ЛЕТ, и которые органически не приемлют безаплелляционные наезды, хотя и готовы дискутировать на спорные темы, пусть часто слишком бурно. -)

Согласен, хорошее предложение! Можно добавить в правила форума даже.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Umnik

Тема разделена.

Прелести мультидвижковости тут: http://www.anti-malware.ru/forum/index.php?showtopic=23540

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
lolowin32

Добрый день, Сергей Ильин, прочитал Ваш пост, и оказался в непонятном недоумении от Ваших мыслей по поводу теста на основе сигнатурного анализа, Вы считаете что это бесполезно сканировать "Братскую могилу тушек", спешу заметить что при сканировании этой "братской могилы" многие антивирусы находят НЕ ВСЕ вредоносные программы из архива (заведомо знаю что все вредоносы), также понимаю что сканирование только по сигнатурным базам это не панацея, нужно создавать/совершенствовать различные сервисы (облачные технологии, пополнять базу фишинговых ссылок, совершенствовать эвристику), но так как Вы говорите что это бесполезно, в этом я с Вами полностью не согласен, я считаю что сканы основанные на сигнатурах, имеют право жить. Пополняя антивирусную базу мы увеличиваем процент обнаружения вредоносов (), а уж различные модули(firewall, web protection, mail protection) помогают предотвратить проникновение вредоносных программ в систему, ну а если по стечению обстоятельств вредонос попал, то сигнатурный анализ никто пока еще не отменял

Я смотрел много тестов на ютубе про скан основанный на сигнатурах, но еще пока никто не сделал адекватный тест, с показом всех настроек(да мало ли как настроен антивирус,может на пропуск всего, а может на максимум, никто ж этого не видит)

Так что я думаю что тут еще большой плацдарм для обсуждения

Обращаюсь к публике, кто заинтересован в этом вопросе, кидаем ссыли на адекватно построенные тесты, буду рад обсудить, выслушать аргументированные за и против,

Отредактировал lolowin32

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты

  • Сообщения

    • Ego Dekker
      ESET Online Scanner был обновлён до версии 4.0.1. Приложение теперь работает только в 64-разрядной ОС.
    • Ego Dekker
      ESET Cyber Security был обновлён до версии 9.0.6700.
    • AM_Bot
      Теория звучит убедительно, но работает ли она на практике? Мы внимательно изучили Phishman 2.35 и решили не останавливаться на описании её возможностей. Вместо этого протестировали платформу на собственных сотрудниках и удивились, к каким результатам это привело.      1. Введение2. Методология тестирования Phishman 2.353. Первичное тестирование3.1. Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылки3.2. Тестирование доставки и отражения результатов в статистике3.3. Результаты атак4. Обучение4.1. Формирование учебной группы4.2. Составление образовательной программы по повышению киберкультуры4.3. Процесс обучения и его результаты5. Повторное тестирование5.1. Результаты атак6. Подведение итогов6.1. Сложности, с которыми мы столкнулись7. Впечатления от проекта команды «АМ Медиа»7.1. Реакция сотрудников7.2. Реакция организаторов7.3. Сотрудничество с вендором8. ВыводыВведениеPhishman 2.35 — это система повышения осведомлённости пользователей в сфере ИБ. Она помогает развивать киберкультуру и формировать у сотрудников устойчивые навыки безопасной работы с информацией, цифровыми сервисами и корпоративными ресурсами. В процессе обучения сотрудники учатся распознавать актуальные сценарии атак, закрепляют правильные модели поведения и в результате реже становятся причиной инцидентов, связанных с человеческим фактором.В первой части обзора Phishman 2.35 мы рассмотрели платформу с точки зрения её возможностей. Теперь пришло время проверить, как всё это работает на практике. За время проекта мы не только оценили эффективность различных сценариев, но и столкнулись с рядом особенностей, которые невозможно увидеть в документации. Одни из них влияли на ход тестирования, другие оказались скорее организационными нюансами, о которых стоит знать заранее.Методология тестирования Phishman 2.35В процессе работы с киберкультурой «АМ Медиа» мы будем использовать следующие метрики:Обученность. Отражает уровень знаний сотрудников в области ИБ. Показатель растёт, когда сотрудники осваивают темы: реагирование на инциденты, защита от социальной инженерии и другие критически важные компетенции.Иммунность. Показывает, как сотрудники применяют знания на практике. Она повышается, когда демонстрируется способность распознавать угрозы и правильно на них реагировать в реальных сценариях.Киберосознанность — итоговая метрика. Объединяет знания и практические навыки, показывая, насколько сотрудники в целом устойчивы к киберугрозам и действуют корректно при их возникновении.Прежде чем оценивать эффективность работы системы, необходимо определить отправную точку. Первичное тестирование определит, на какие сценарии реагирует каждый сотрудник, где чаще всего допускаются ошибки и какие темы требуют дополнительного развития. На основе этих данных формируется индивидуальная программа обучения: сотрудники проходят персонализированные курсы, выполняют практические задания и тесты, которые помогают устранить выявленные пробелы и закрепить необходимые навыки. В процессе обучения повышается уровень обученности, а закрепление знаний через практику влияет на показатель иммунности. После завершения обучения мы проведём повторное тестирование, которое покажет, какие изменения произошли по всем ключевым метрикам.Заключительный этап — сравнение результатов первичного и повторного тестирования. Здесь станет понятно, насколько вырос уровень киберкультуры сотрудников: изменилось ли их отношение к вопросам ИБ, стали ли они увереннее распознавать угрозы и чаще принимать безопасные решения в ситуациях, где раньше могли допустить ошибку.В качестве основного канала для рассылки фишинга выбрали электронную почту. Причина очевидна: именно она остаётся основным способом первичного контакта злоумышленников с сотрудниками и доставки фишинговых сценариев. По имеющимся оценкам, более 90 % успешных кибератак начинаются с электронного письма, поэтому исключать этот канал из подобных проверок было бы некорректно.Первичное тестированиеРеальные фишинговые атаки почти никогда не строятся по универсальному шаблону: злоумышленники адаптируют содержание писем под роль человека в компании, его рабочие процессы и типовые задачи. Поэтому при выборе целевой аудитории мы разделили сотрудников по функциям и уровню доступа к корпоративным данным, а сам проект разбили на 3 последовательные волны с разным уровнем сложности.Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылкиПосле определения целевой аудитории был проведён анализ структуры подразделений и рабочих процессов сотрудников. На этом этапе изучались:должностные обязанности;распределение зон ответственности;характер внутреннего взаимодействия между отделами;используемые адреса электронной почты;формат повседневной служебной переписки.Это позволило понять, какие сценарии коммуникации являются для сотрудников привычными и не вызывают подозрений.На основе собранных данных были подготовлены сценарии фишинговых сообщений. При разработке содержимого учитывались тематика рабочих задач, стиль корпоративного общения, оформление внутренних уведомлений и типовые причины отправки писем внутри организации. Основная задача заключалась в том, чтобы письмо воспринималось как стандартное рабочее сообщение, соответствующее реальным бизнес-процессам заказчика.Волна 1. Первая волна была построена как массовый фишинг. Сценарий — сверка графика отпусков. Для атаки создавали и настраивали пользовательский шаблон. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки.На этом этапе проверялась базовая реакция сотрудников на привычные рабочие триггеры и способность распознавать типовые признаки фишинга без привязки к конкретному подразделению. Рисунок 1. Шаблон для первой волны Рисунок 2. Вид фишингового письма из первой волны в почте Волна 2. Для каждого отдела были подготовлены письма, основанные на реальных рабочих процессах, характерных запросах и ситуациях, с которыми сотрудники регулярно сталкиваются в своей деятельности. Для атаки создали и настроили пользовательский шаблон, где-то добавили немного визуального оформления. Время начала рассылки — по запланированному времени. Рисунок 3. Пример шаблона из второй волны для отдела «Продажи» Рисунок 4. Вид фишингового письма из второй волны для отдела «Продажи» Волна 3. Здесь моделировались уже более сложные сценарии целевого фишинга (spear phishing). В письмах использовались специальные формулировки, элементы корпоративного брендирования. На этом этапе проверялась не только внимательность сотрудников, но и способность замечать менее очевидные признаки атаки в условиях, максимально приближённых к реальной целевой компрометации.За основу брали системный брендированный шаблон «Яндекс ID», добавили фишинговую форму и скорректировали немного её содержание. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 5. Пример шаблона из третьей волны Рисунок 6. Вид фишингового письма из третьей волны При переходе по ссылке открывалась фишинговая страница. Рисунок 7. Фишинговая страница Тестирование доставки и отражения результатов в статистикеДалее была подготовлена инфраструктура рассылки. После её настройки проводилось тестирование доставки сообщений. Проверялась доставка писем во входящие сообщения почтовых клиентов, анализировалась реакция антиспам-механизмов в почте, а также контролировалась корректность работы механизмов отслеживания действий пользователей. Рисунок 8. Результаты тестирования доставки и отображения сообщений в почте Тестирование прошло успешно.После завершения проверки была сформирована последовательность отправки сообщений по заранее определённым волнам. Такой подход позволил распределить нагрузку, контролировать ход тестирования и отслеживать реакцию сотрудников на различных этапах проведения проверки. Рисунок 9. Активные мероприятия Результаты атакБыли получены следующие результаты:Иммунность — 81 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 71 %.Уровень риска — 8, средний. Устойчивость формируется, но есть ещё риски. Рисунок 10. Общая информация после проведения первичного тестирования Самый низкий уровень иммунности — около 50 %, после первых двух волн атак. Рисунок 11. График иммунности во время первичного тестирования Далее — сформировали в системе отчёт по скомпрометированности сотрудников, на основании которого выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Рисунок 12. Отчёт по скомпрометированности всех сотрудников в Phishman 2.35 Таблица 1. Результаты первичного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот04,76 %4,76 %Продажи04,76 %9,52 %Продюсеры 0023,8 %Редакция0019,04 %Руководитель000 ОбучениеПервичное тестирование завершено, поэтому следующим этапом стало определение группы риска и формирование программы обучения.Формирование учебной группыНа этапе отбора рассматривались два варианта формирования учебной группы. Первый предполагал использование показателя иммунности сотрудников. Второй вариант заключался в создании правила, автоматически формирующего список сотрудников, которые были скомпрометированы в ходе проведённых проверок. Этот подход позволял сразу получить выборку пользователей, продемонстрировавших наибольшую подверженность атакам, без ожидания обновления показателей.Был выбран второй вариант. На основании созданного правила была сформирована группа для обучения: в неё вошли люди, которые были скомпрометированы в ходе первичного тестирования. Рисунок 13. Создание правила для выявления группы риска Рисунок 14. Отчёт по отработанному правилу для выявления группы риска Отдельно была сформирована группа сотрудников, успешно распознавших фишинговую атаку, для участия в обучении, направленном на поддержание киберкультуры.Составление образовательной программы по повышению киберкультурыПопавшиеся сотрудники были включены в отдельную учебную группу, для которой сформировали персональную образовательную траекторию. В неё вошли 3 микрокурса по фишингу и 1 курс по информационной безопасности. Содержание траектории было направлено на повышение устойчивости к методам социальной инженерии и снижение вероятности компрометации учётных данных. Рисунок 15. Заполнение параметров обучения сотрудников Рисунок 16. Составление учебной программы Отдельно была запущена программа обучения для сотрудников, которые не попали в выборку по результатам правила.Процесс обучения и его результатыПервый отчёт мы сформировали через 2 дня после запуска обучения, что позволило получить предварительную оценку вовлечённости сотрудников. Анализ данных показал, что наибольшую активность на начальном этапе продемонстрировали сотрудники, которые попались на фишинг. Рисунок 17. Промежуточный анализ обучения Через неделю после запуска обучения провели повторный анализ прогресса, включая оценку прохождения курсов и выявление участников, не приступивших к обучению. Рисунок 18. Отчёт по динамике обучения в Phishman 2.35 Анализ показал, что часть сотрудников не завершила обучение в установленный срок. Для обеспечения максимального охвата было принято решение о продлении сроков прохождения курсов. Рисунок 19. Продление и корректировка процесса обучения В результате фактическая продолжительность обучения составила 2 недели, что превысило первоначально установленный срок в одну неделю. Но и этого времени не хватило нашим сотрудникам. Чтобы узнать, кто оказался более ответственным, воспользовались возможностями правил. Рисунок 20. Пример настройки правила по выявлению сотрудников, прошедших обучение В результате была получена информация о сотрудниках, полностью и частично прошедших обучение. Рисунок 21. Отчёт по сработанному правилу по выявлению сотрудников, прошедших обучение Рисунок 22. Отчёт по сработанному правилу по выявлению сотрудников, частично прошедших обучение Результаты обучения:полностью прошли обучение — 52 %;частично — 22 %;не прошли обучение — 26 %.Мы проанализировали список сотрудников, не приступивших к обучению, и выяснили, что это те, кто не попался на фишинг во время первичного тестирования.Среди сотрудников, которые попались на фишинг, 80 % прошли обучение, остальные — прошли его частично. Рисунок 23. Результаты обучения сотрудников «АМ Медиа» Вместе с тем за этот период были зафиксированы положительные изменения в ключевых показателях: уровень обученности достиг 9 319 баллов, а показатель киберосознанности — 7 561 баллов. Несмотря на положительную динамику, полученные значения оставались гораздо ниже целевых ориентиров, что свидетельствует о необходимости дальнейшей работы по повышению вовлечённости сотрудников и развитию киберкультуры.Повторное тестированиеПовторное тестирование проводилось по тем же этапам, что и первичное: подготовка шаблонов, тестирование и проведение атак. Как и на первом этапе, основной задачей было сделать письмо максимально похожим на стандартную рабочую переписку, соответствующую реальным бизнес-процессам нашей компании.Подготовительный этап повторного тестирования потребовал дополнительных временных затрат, связанных с регистрацией новых доменов и расширением сценариев атак с учётом результатов первичного тестирования.Волна 1. Сценарии формировались не только для отдельных подразделений, но и адресно для конкретных сотрудников, что позволило повысить реалистичность и точность имитации фишинговых атак. Запустили несколько атак, для каждой из них были разработаны индивидуальные шаблоны электронных писем и соответствующие фишинговые формы. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 24. Пример фишингового письма для первой волны Рисунок 25. Пример фишинговой формы для письма из первой волны Волна 2. Вторая волна представляла собой массовую фишинговую кампанию. Для неё был создан и настроен пользовательский шаблон, основанный на триггерах срочности и страхе финансовых потерь. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки. Рисунок 26. Пример фишингового письма для второй волны Тестирование доставки писем и корректности отражения результатов в статистике прошло успешно.Результаты атакВ повторном тестировании приняли участие уже 23 человека. Увеличение числа участников на 2 человека связано с подключением новых сотрудников к нашему эксперименту. Резких скачков иммунности здесь не наблюдалось. Рисунок 27. График иммунности во время повторного тестирования Для дополнительной оценки мы и здесь также выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Таблица 2. Результаты повторного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот000Продажи008,7 %Продюсеры 008,7 %Редакция8,7 %08,7 %Руководитель000 Мы также посмотрели, как себя показали сотрудники, которые не прошли обучение, в повторном фишинговом тесте. По данным отчёта, в первой волне повторного тестирования на фишинг попались 40% из всех, кто не обучался. Рисунок 28. Поиск информации о сотруднике в отчёте по атакам Подведение итогов После завершения всех этапов эксперимента мы получили следующие показатели:Иммунность — 76 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 91,3 %.Уровень риска — 7, средний. Рисунок 29. Информационная панель Phishman 2.35 после завершения эксперимента После обучения и повторного тестирования добавились другие показатели:Обученность — 11 / 100. Знания отсутствуют, обучение следует начать с базового уровня.Киберосознанность — 10 / 100. Низкий уровень, сотрудники не знают, как действовать в случае угроз.Часть результатов сравнили и представили их в таблице ниже. Таблица 3. Сравнение показателей киберкультуры до и после обученияПоказательДо обученияПосле обученияОбученность09319Иммунность81 %76 %Киберосознанность 07561Охват аудитории (повторно попались на фишинг)71 %91,3 %Уровень риска87 Также проанализировали действия сотрудников после обучения и сравнили их с результатами первичного тестирования. Таблица 4. Сравнение действий сотрудников до обучения и послеОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДо обученияПосле обученияДо обученияПосле обученияДо обученияПосле обученияДокументооборот004,76 %04,76 %0Продажи004,76 %09,52 %8,7 %Продюсеры 000023,8 %8,7 %Редакция08,7 %0019,04 %8,7 %Руководитель000000 Рисунок 30. Процент попавшихся на фишинг до обучения и после по отделам Если во время первичного тестирования попалось 22 % участников, то после обучения этот показатель уменьшился и стал 12 %. Рисунок 31. Общий процент попавшихся на фишинг до обучения и после Результаты повторного тестирования показали, что, несмотря на заметное снижение количества взаимодействий с фишинговыми письмами, часть сотрудников по-прежнему выполняет действия, свидетельствующие о подверженности атакам. Это ожидаемый результат, поскольку киберкультуру невозможно сформировать за столь короткое время. Речь идёт о длительном процессе, который требует регулярной работы как со стороны специалистов по информационной безопасности, так и со стороны самих сотрудников.Наш эксперимент позволил проверить знания сотрудников, провести обучение и затем оценить, насколько полученные знания закрепились на практике. Однако с точки зрения развития киберкультуры — это лишь один из этапов работы, а не её завершение.Сложности, с которыми мы столкнулисьОсобенность нашего эксперимента — организация предварительного тестирования. Перед запуском каждой атаки мы проверяли её работу на собственном аккаунте, чтобы убедиться в корректной отработке сценария на стороне пользователя. Такие проверки попадали в общую статистику системы и оказывали влияние на итоговые показатели. Возможность исключить подобные события из расчётов отсутствует. Согласно комментариям вендора, для этих целей следует использовать отдельный тестовый стенд. Поэтому мы вели дополнительно самостоятельный анализ результатов эксперимента.Отдельные сложности возникли на этапе обучения сотрудников. Завершить обучение в установленные сроки не удалось из-за человеческого фактора. Не все участники смогли своевременно пройти назначенные материалы, что потребовало увеличения периода обучения и дополнительного контроля за его прохождением.Впечатления от проекта команды «АМ Медиа»Проведение тестирования не вызвало негативной реакции со стороны сотрудников. Хотя фишинговые сообщения активно обсуждались внутри коллектива, жалоб руководству или недовольства вида «зачем вообще было устраивать такую проверку» не возникло. Основной интерес был сосредоточен вокруг самих писем и попыток понять, что именно происходит.Реакция сотрудниковОдним из самых любопытных наблюдений стала реакция сотрудников после первой волны первичного тестирования. Полученные фишинговые сообщения быстро стали предметом обсуждения: сотрудники пересылали их друг другу, задавали вопросы коллегам и пытались разобраться, что происходит.Некоторые пошли ещё дальше и вступали в переписку с отправителем, воспринимая фишинговые письма как реальные рабочие сообщения. Это наглядно показало не только убедительность используемых сценариев, но и то, что практическое столкновение с угрозой вовлекает сотрудников в тему ИБ гораздо сильнее, чем абстрактные примеры из учебных материалов. Во время повторного тестирования такой реакции уже не возникло.Реакция организаторовЕсли для большинства сотрудников тестирование выглядело как неожиданно появившиеся письма в почте, то для команды, которой было поручено тестирование Phishman 2.35 этот проект сопровождался совсем другими эмоциями. Подготовка сценариев, запуск атак и ожидание результатов вызывали ощутимое волнение. Оказалось, что смотреть на ситуацию глазами злоумышленника не так просто, как может показаться со стороны. Приходилось постоянно задавать себе вопросы: какой сценарий покажется правдоподобным, что привлечёт внимание сотрудника, а что, наоборот, вызовет подозрения.Самыми напряжёнными были дни первой волны тестирования. На этом этапе ещё не было понимания, как сотрудники отреагируют на рассылки, насколько убедительными окажутся сценарии и не вызовет ли проверка негативной реакции внутри коллектива. С каждой новой зафиксированной активностью интерес смешивался с тревогой, а результаты ожидались едва ли не с большим нетерпением, чем сам запуск кампании.После завершения эксперимента стало легче: всё задуманное удалось реализовать, результаты были получены и проанализированы. Тем не менее полностью избавиться от мыслей о проделанной работе не получилось. Время от времени возвращаешься к отдельным этапам и задаёшься вопросом: а стоило ли сделать именно так? Может быть, какой-то сценарий можно было построить иначе, а какие-то решения принять по-другому?Наверное, это естественная часть любого практического проекта. Когда работа заканчивается, появляется возможность посмотреть на неё со стороны и критически оценить собственные решения. Именно в такие моменты часто приходят идеи, которые помогают сделать следующие проекты лучше.Сотрудничество с вендоромВ ходе подготовки и проведения эксперимента иногда возникали вопросы, связанные с настройкой платформы, особенностями реализации отдельных сценариев и интерпретацией результатов. Для их решения использовались как переписка, так и рабочие созвоны. Запросы обрабатывались оперативно, что позволяло своевременно получать необходимую информацию и не допускать задержек в выполнении работ. Поддержка была доступна не только в рабочее время, но и в выходные дни.ВыводыПовторное тестирование показало, что тщательно подготовленные и персонализированные фишинговые атаки значительно эффективнее. При наличии качественной разведки злоумышленники способны подобрать убедительный сценарий практически для любого сотрудника. А если специалист может ошибиться, то сотруднику, который не занимается вопросами ИБ каждый день, сделать это ещё проще.Работа в сфере информационной безопасности или информационных технологий сама по себе не защищает человека от фишинга, социальной инженерии и других современных атак. Мы убедились в этом на собственном опыте: даже профильные знания не гарантируют, что человек не попадется на хорошо продуманную атаку. Злоумышленники постоянно меняют сценарии, поэтому знания, полученные однажды, быстро устаревают.При помощи эксперимента мы не только проверили, насколько сотрудники готовы распознавать атаки, но и поняли, как с помощью Phishman 2.35 можно сделать работу по развитию киберкультуры системной. Вместо отдельных курсов появился понятный цикл: смоделировать атаку, оценить реакцию, провести обучение и проверить, изменилось ли поведение участников. При необходимости — повторить или скорректировать процесс при помощи рекомендаций платформы. Результаты фиксируются автоматически, поэтому можно видеть, какие темы требуют больше внимания, и развивать киберкультуру на основе реальных данных, а не предположений.Читать далее
    • PR55.RP55
    • santy
      RP55, есть у тебя ТГ?
×