Тест антивирусов на быстродействие (подготовка) - Страница 9 - Тесты и сравнения - Форумы Anti-Malware.ru Перейти к содержанию
Сергей Ильин

Тест антивирусов на быстродействие (подготовка)

Recommended Posts

Valery Ledovskoy
система должна проверяться по многим параметрам, и точность огня и скрость развертывания проводились в одном ряду с многими, абсолютно непонятными сначала тестами. Но в результате получалась некая интегральная характеристика...

Очень интересно знать, какая методика использовалась для подсчёта "интегральной характеристики" в этом случае? Не верю, что всё в кучу мешалось без весов различным характеристикам и без _обоснованной_ методики, ибо так и до трибунала можно было добраться. Секунды на развёртывание складывались с точностью огня? Да у них даже размерности разные.

Выставляете баллы? Хорошо. Тоже можно. Но характеристики разные, распределения у них тоже получатся разными по результатам теста. Соответственно, баллы нужно выставлять в соответствии с распределениями характеристик. Плюс, опять же, веса потом на характеристики навесить. Тогда можно что-то интегрировать и увидеть общую объективную картину. Как веса расставить? Да голосование пятидневное провести среди людей, которые достаточно долго на портале. Объяснить, что за голосование и что от него зависит. Плёвое дело по сути. Нет, надо бежать куда-то.

Возможностей-то куча на самом деле. И все доступны.

  • Upvote 5

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Николай Головко

За превосходное знание русского мата пользователь Dexter награждается предварительной модерацией сообщений в течение 1 календарного месяца.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Umnik

Вроде обсуждали-обсуждали, что это будет тест быстродействия, а не все-в-одном (как и все остальные), однако ж все равно это многим не нравится. Тесты разные нужны, тесты разные важны. VB тоже такой весь унылый, однако живой. Ага, потому что популярен в ничего не понимающих массах. Только сути это не меняет, ибо постоянные провалы по более чем 3-м семплам, это вполне себе показатель эффективности работы. И ступор ПК, долгая загрузка ОС, мат-перемат пользователя - тоже весомый аргумент для энд-юзера.

Не жду, но ожидаю кучу печенюшек и осуждение глупости представителя администрации. Надеюсь, сего не будет.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
dot_sent
Вроде обсуждали-обсуждали, что это будет тест быстродействия, а не все-в-одном (как и все остальные), однако ж все равно это многим не нравится. Тесты разные нужны, тесты разные важны.

Никто не спорит с тем, что тесты разные нужны и важны, вроде бы. Но если уж витает в воздухе идея проведения если не интегрального теста, то интегральной оценки на основании нескольких тестов, то почему бы не представить итоговые данные этого парциального теста в виде, удобном для сведения в некоторой будущей интегральной оценке?

Более того, можно просто выдать итоговые данные в двух формах - одна, более точная, предназначенная для профи и для будущих интегральных оценок, и, допустим, та же балльная оценка антивирусов - для публикации в прессе (Интернете) конкретно этого теста. Естественно, обе формы вывесить в паблик, чтобы потом не было вопросов. И волки целы, и овцы сыты. Ы?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
alexgr
Секунды на развёртывание складывались с точностью огня? Да у них даже размерности разные.

я ведь не зря на стандарт сослался. Каждый оцениваемый параметр существует сам по себе. Да, строится характеристика распределения и только . То есть интегральная характеристика в данном случае не в баллах представлялаь. А по каждому сравнивалась с образцом эвентуального противника.

К примеру - большинство россиян уверены, что ЗРС "Фаворит" превосходит "Пэториот". В баллах считали? нет. В дальности? нет. В количесве единиц радиоэлектронной/радиотехнической техники. Нет. Потому что сказали по ящику. А те сказали потому, что сидели дяди и сравнивали - по каждому отдельному параметру. И здесь самым правильным был бы именно такой подход.

Поэтому - можно и "голые" цифры представить. Потому что эндюзер Петро Педерашко верит не тесту, а Васе Педалькину, который у них в авторитете. А зампред банка будет главной характеристикой считать это самое быстродействие, поскольку очередь у касс его банка его лично пугает - ведь устанут ждать и побегут напротив, а это нельзя никак допустить! И каким методом спецы лепили баллы (да и лепили ли) его не возбуждает. Но вдуть нерадивого админа, который купил сей продукт - это уж как полагается. И админ не будет ссылаться на Клементи или Маркса или там на меня - ему тут же скажут, что фамилии родственников называть не надо, надо уметь отвечать за себя и за потраченные банком деньги и что это не игрушка. А вот за "откат" от вендора можно и пострадать....

Последнее - зарисовки из жизни

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Более того, можно просто выдать итоговые данные в двух формах - одна, более точная, предназначенная для профи и для будущих интегральных оценок, и, допустим, та же балльная оценка антивирусов - для публикации в прессе (Интернете) конкретно этого теста.

Вполне себе предложение. Есть ещё один вариант, который вроде бы здесь уже предлагали, и если правильно помню, то Сергей Ильин так и собирается делать. Проранжировать антивирусы по каждой из характеристик этого теста, и не выводить интегральную характеристику быстродействия. Так-то оно будет хорошо, но средний читатель статьи тогда будет задавать вопросы по поводу того, так какой же антивирус в целом быстрее? В этом случае мы ему ничего ответить не сможем, а та мысль, что по одной характеристике кто-то один быстрее, а по другой - кто-то другой быстрее, а победителей теста в целом как таковых нет, для него может оказаться слишком сложна для понимания.

alexgr , спасибо за последний пост. Так оно обычно и есть в реальности. Но думаю также, что целевая аудитория этого теста не банковские админы, которые и сами в состоянии провести тесты, которые им нужны, а пользователи попроще.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
EYE

Да, кстати, вспомнил о том, что мне так и не ответили

на недавний вопрос о способе измерения скорости, заданный еще в процессе тестирования.

Поэтому повторю его еще раз -

Как проводились измерения скорости - "с секундомером в руках", или все-таки:

Все замеры по копированию и сканированию лучше проводить при помощи специально написанных батничков, а не с секундомером в руках. Так точнее будет
?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
alexgr

батником, по параметру time

  • Upvote 5

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Тест совершенно бесполезный, ничего не показывающий и никому, кроме портала не нужный (пеар, пеар, чтоб на цньюс напечатали). А как движки у вендоров работают вы вообще в курсе, хотя бы приблизительно? А что и как они распаковывают, как далеко доходит эмулятор, в чем разница между эмуляторами с динамической трансляцией и без?

Это предмет других тестов, мы здесь сравниваем скорость работы. Если кто-то загнал в свой продукт продвинутый эмулятор, который притормаживает тачку раза так в 2, то это отвественность разработчиков и маркетинга этого вендора. Вероятно, они считают, что людям на тормоза наплевать. Пусть так, люди посмотрят результаты этого теста и разберутся, сравнят детект продуктов, посмотрят на самозащиту, лечение, на проактивку глянут ... все встанет на свои места.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Олег Гудилин
P.P.S. Ну если только вот каспер 8-9 в [***]..., то не удивлюсь. Поскольку он лично у меня начал тормозить через две недели и я его грустно снес с рабочей машины. Ох, это судьба.
Dexter, что ж у Вас за руки за такие, ну совсем ничем пользоваться не умеете:)

Ну ничего, Олег Гудилин Вам поможет:)

Я надеюсь, что он мне и понятия с мОзгами вправит.

Конечно вправит:)

А то смущаете сообщество, покушаетесь на святое, понимаешь ли...

Да еще и в преддверии результатов теста:)

EYE, товарищ Dexter всем прекрасно умеет пользовать. А вправить я ему ничего не смогу, поскольку он слишком старый и умный для этого. О чем свидетельствует его внезапный выход из подполья после кодовой фразы :)

Так что удачи на дорогах :)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин

Что же касается подсчета результатов теста, то рекомендую прочитать мой пост выше, он остался без ответов, а зря. Проблема в том, что мы не сможем сделать точную и понятную интегральную оценку по всем измеряемым параметрам. Большинство из них интересны только технарям и разработчикам тестируемых антивирусов.

Я не зря предложил выделить 3 группы параметром. В результате мы получим 3 рейтинга: быстрый монитор, быстрый сканер, минимальная нагрузка на ОС. По каждому рейтингу дадим медали и отметим победителей. Бенефиты очевидны: результаты будут понятны всем, даже домохозяйкам; методику подсчета результатов будет сложно критиковать, так как не будет весов и сложных мат. методов; результаты можно будет легко учесть в интегральном тесте.

Замечания?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
3. нагрузка на ОС (1. Время загрузки ОС, 2. Потребляемая память и загрузка процессора, 5. Время запуска 4 различных офисных программ, 6. Время скачивания файла по сети.).

Обратил я внимание на этот пост. Вот возьмём третий параметр - "загрузка на ОС". Как будем считать его? Суммировать баллы? Ок, каким образом будут выставляться баллы? Как и раньше, на глазок, или всё же обоснованно? Домохозяйкам достаточно сказать, что 5 баллов - за такой-то показатель, 4 балла - за такой, 3 - за такой и т.д. И совсем необязательно говорить, почему (да оно так и делается, в общем-то). Но для интересующихся, как мне же кажется, значения этих отрезков для каждого балла должно быть чем-то обосновано. Не обязательно вдалбливать это обоснование домохозяйкам, а так, хотя бы для собственного удовлетворения, чтобы оно было.

результате мы получим 3 рейтинга: быстрый монитор, быстрый сканер, минимальная нагрузка на ОС.

Хорошее начинание. Но внутри каждого из этих 3 супер-параметров есть другие параметры, баллы по каждому из которых нужно пронормировать, чтобы они были равноценными. Опять же, обосновать.

методику подсчета результатов будет сложно критиковать, так как не будет весов и сложных мат. методов;

Т.е. методику будет сложно критиковать, потому что её нет? :)

Помнится, парламент одной из стран как-то принимал закон о том, что число "пи" равно четырём. Тоже вот боролись за простоту понимания ;)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Обратил я внимание на этот пост. Вот возьмём третий параметр - "загрузка на ОС". Как будем считать его? Суммировать баллы? Ок, каким образом будут выставляться баллы? Как и раньше, на глазок, или всё же обоснованно? Домохозяйкам достаточно сказать, что 5 баллов - за такой-то показатель, 4 балла - за такой, 3 - за такой и т.д. И совсем необязательно говорить, почему (да оно так и делается, в общем-то). Но для интересующихся, как мне же кажется, значения этих отрезков для каждого балла должно быть чем-то обосновано. Не обязательно вдалбливать это обоснование домохозяйкам, а так, хотя бы для собственного удовлетворения, чтобы оно было.

Что значит на глазок? Начнем с того, что результаты каждого антивируса будут отнормированы по эталону. Т.е. я предлагаю сравнивать % торможения относительно чистой системы, без антивирусного ПО. Затем принимаем худший результат за 0 баллов, эталонный (отсутствие торможения) - за 5 баллов. В итоге по каждому параметру имеем "прогрессивную систему" баллов с точность до 0.01, далее суммируем полученные баллы по всем параметрам группы, все. Подойдет такой вариант?

Но для интересующихся, как мне же кажется, значения этих отрезков для каждого балла должно быть чем-то обосновано.

Отрезков больше не будем делать, это увеличивает погрешность оценки ;)

При описанном мной выше подходе остается только 1 проблема - раздача медалей. Например, максимальной торможение сканера, тянущее на Gold - это сколько? Здесь придется уже смотреть итоговые таблицы и определять границы. Пожалуй, вынесу этот вопрос на рассмотрение экспертного совета.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Deja_Vu
Фора и так есть при "прогонке" всей коллекции тестовых "чистых" файлов,

установочных пакетов, и т.д. Или Вы думаете, что не сразу реагирующий

на malware монитор, будет по-другому работать на тестовой подборке "чистых" файлов ?

Фора когда различные условия ... когда условия равные ... форы никакой нет.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Deja_Vu
Т.е. методику будет сложно критиковать, потому что её нет? :)

Помнится, парламент одной из стран как-то принимал закон о том, что число "пи" равно четырём. Тоже вот боролись за простоту понимания ;)

А зачем выводить комплексную оценку по трем этим характеристикам, что она даст?

По моему скромному мнению - ничего. -))

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Что значит на глазок? Начнем с того, что результаты каждого антивируса будут отнормированы по эталону. Т.е. я предлагаю сравнивать % торможения относительно чистой системы, без антивирусного ПО. Затем принимаем худший результат за 0 баллов, эталонный (отсутствие торможения) - за 5 баллов. В итоге по каждому параметру имеем "прогрессивную систему" баллов с точность до 0.01, далее суммируем полученные баллы по всем параметрам группы, все. Подойдет такой вариант?

О, я вижу, что говорил всё не впустую, это не может не радовать. Да, для расставления баллов вполне пойдёт.

При описанном мной выше подходе остается только 1 проблема - раздача медалей. Например, максимальной торможение сканера, тянущее на Gold - это сколько? Здесь придется уже смотреть итоговые таблицы и определять границы. Пожалуй, вынесу этот вопрос на рассмотрение экспертного совета.

Вот, а об этом я уже писал. Нужно смотреть на итоговые результаты и их распределение. Т.е. равномерно ли будут распределены результаты от наихудшего до наилучшего. Если равномерно, то и медали так же выдавать, через равномерные промежутки баллов (которые вычислены с точностью 0.01). Если же есть смещение результатов куда-то ближе к лучшему или ближе к худшему результату, то, соответственно, границы баллов, необходимые для получения медалей нужно смещать в ту или другую сторону.

Правда, медали у нас выдаются по совокупности параметров. Поэтому каждый из этих параметров, от которых зависит медаль, должен быть пронормирован исходя из распределения результатов, полученных по каждому параметру. Может быть, кто-то может что-то добавить? А то похоже на то, что я тут с мельницами воюю :)

  • Upvote 5

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
О, я вижу, что говорил всё не впустую, это не может не радовать. Да, для расставления баллов вполне пойдёт.

Ну естественно, не в пустую ;) Мы тут и ведем обсуждение для того, чтобы сделать тесты лучше.

Вот, а об этом я уже писал. Нужно смотреть на итоговые результаты и их распределение. Т.е. равномерно ли будут распределены результаты от наихудшего до наилучшего. Если равномерно, то и медали так же выдавать, через равномерные промежутки баллов (которые вычислены с точностью 0.01). Если же есть смещение результатов куда-то ближе к лучшему или ближе к худшему результату, то, соответственно, границы баллов, необходимые для получения медалей нужно смещать в ту или другую сторону.

Согласен, так и сделаем.

Правда, медали у нас выдаются по совокупности параметров. Поэтому каждый из этих параметров, от которых зависит медаль, должен быть пронормирован исходя из распределения результатов, полученных по каждому параметру.

Я думаю не стоит в этом тесте все сводить к одному набору медалей. Пусть будут медали за самый "быстрый сканер", "самый легкий ав-монитор" и "минимальную нагрузку на ОС", т.е. 3 набора наград.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
dr_dizel
батником, по параметру time

Может perfmon.exe?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
alexgr

1. Не думаю, поскольку нас интересует только временной параметр, 2. Батник устанавливает переменную и запускает нужное копирование, потом возвращает - по окончанию копирования второе значение. просто и красиво, погрешность минимальна, 3. Переделывать уже поздно

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов

Итак, рискну продолжить разговор :)

Цитата(Сергей Ильин @ 28.07.2008, 12:49) *

Что значит на глазок? Начнем с того, что результаты каждого антивируса будут отнормированы по эталону. Т.е. я предлагаю сравнивать % торможения относительно чистой системы, без антивирусного ПО. Затем принимаем худший результат за 0 баллов, эталонный (отсутствие торможения) - за 5 баллов. В итоге по каждому параметру имеем "прогрессивную систему" баллов с точность до 0.01, далее суммируем полученные баллы по всем параметрам группы, все. Подойдет такой вариант?

О, я вижу, что говорил всё не впустую, это не может не радовать. Да, для расставления баллов вполне пойдёт.

Согласен для определения качественных непрерывных показателей хороший вариант.

Правда, медали у нас выдаются по совокупности параметров. Поэтому каждый из этих параметров, от которых зависит медаль, должен быть пронормирован исходя из распределения результатов, полученных по каждому параметру. Может быть, кто-то может что-то добавить? А то похоже на то, что я тут с мельницами воюю

У нас есть три основных этапа:

1. Снятие абсолютных показателей.

2. Вычисление качественных показателей относительно идеала.

3. Анализ полученных результатов и принятие решения.

Первые два пункта вроде разобраны, делается все довольно просто.

Что касается третьего пункта, то соображения у меня следующие:

1) Выделить группы критериев как предлагает Сергей, например "быстрый сканер", "самый легкий ав-монитор" и "минимальную нагрузку на ОС"

2) Далее необходимо раздать награды.

Самым объективным способом в таком случае, по-моему мнению, будут не распределение по результату и определение границ, а использование метода Парето, то есть выбор наилучшего решения, я думаю многие с ним знакомы и сводиться он к очень простым операциям для определения группы наилучших решений:

1) Отсеиваются все решения, которые имеют показатели хуже по всем критериям.

2) Далее остаются решения, которые лучше всех по одному показателю, но хуже по другому. Они как раз и будут наилучшим выбором (множеством наилучших решений). Им стоит дать наивысшие медали (Gold). Для определения лучших из лучших уже необходимы веса важности для каждого параметра, а это уже совсем другая песня, и я думаю пользователь их сможет расставить сам.

3) Что касается остальных медалей более низкого уровня, то берется подмножество отсеянное в п.1 и производиться следующая итерация для получения наград Silver. Для бронзовых наград еще одна итерация.

В итоге мы получим как раз эшелонированность (4 эшелона), причем неплохо обоснованную.

Что скажете?

Что касается общих наград (сравнение между выделенными группами критериев), то здесь уже по-любому необходимы приоритеты важности для каждого критерия, а также функция свертки, и это уже довольно нетривиально и требует очень большого количества времени дополнительно, вообщем по мне этот этап - "овчина не стоит выделки".

  • Upvote 5

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Я думаю не стоит в этом тесте все сводить к одному набору медалей. Пусть будут медали за самый "быстрый сканер", "самый легкий ав-монитор" и "минимальную нагрузку на ОС", т.е. 3 набора наград.

Так я не спорю на счёт трёх комплектов :) Я про то говорил, что каждый комплект строится на основе нескольких суб-параметров.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван

а можно будет опубликовать сначала простые абсолютные показатели и их графики, без всяких там прогрессивных шкал и эталонов?

чтобы я и другие видели: что вот такое значение без антивиря, вот такое с конкретным антивирем.

а дальше делайте какие хотите шкалы, раздавайте медали и прочее - это нужно только для пеара результатов

мне лично и многим другим нужны только цифры в секундах минутах и мегабайтах

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy

Alexandr Shabanov, да согласен. Думаю, описанный Вами подход оптимален. Парето здесь вполне подойдёт. Но в результатах обязательно нужно будет указать количественные показатели (в секундах и других единицах измерения), затем обязательно в баллах, а потом вывод на основе метода Парето.

а можно будет опубликовать сначала простые абсолютные показатели и их графики, без всяких там прогрессивных шкал и эталонов?

Думаю, от этого здесь никуда не уйти.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов
Но в результатах обязательно нужно будет указать количественные показатели (в секундах и других единицах измерения), затем обязательно в баллах, а потом вывод на основе метода Парето.

Естественно, в материале должно быть как минимум три раздела:

1) Описание тестовой среды и методологии.

2) Абсолютные показатели и их интерпретация в графическом виде (плюс относительная интерпретация).

3) Надстройка - анализ результатов.

Это логично, так как я писал уже выше данное исследование делается в несколько этапов и результат каждого достоен войти в конечный материал, к тому же от этого не убудет ^_^

P.S. Если в группах будет не больше 3х критериев, то отбор по Парето очень удобно представлять в графическом виде.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
P.S. Если в группах будет не больше 3х критериев, то отбор по Парето очень удобно представлять в графическом виде.

Я уже хочу видеть результаты :)

Насколько важны они в интегральной оценке антивируса - время покажет. Но на таких вот "простых" тестах можно обкатывать методологию более "болезненных" для вендоров тестов, и я вижу позитивные подвижки в этом плане.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты

  • Сообщения

    • Ego Dekker
      ESET Online Scanner был обновлён до версии 4.0.1. Приложение теперь работает только в 64-разрядной ОС.
    • Ego Dekker
      ESET Cyber Security был обновлён до версии 9.0.6700.
    • AM_Bot
      Теория звучит убедительно, но работает ли она на практике? Мы внимательно изучили Phishman 2.35 и решили не останавливаться на описании её возможностей. Вместо этого протестировали платформу на собственных сотрудниках и удивились, к каким результатам это привело.      1. Введение2. Методология тестирования Phishman 2.353. Первичное тестирование3.1. Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылки3.2. Тестирование доставки и отражения результатов в статистике3.3. Результаты атак4. Обучение4.1. Формирование учебной группы4.2. Составление образовательной программы по повышению киберкультуры4.3. Процесс обучения и его результаты5. Повторное тестирование5.1. Результаты атак6. Подведение итогов6.1. Сложности, с которыми мы столкнулись7. Впечатления от проекта команды «АМ Медиа»7.1. Реакция сотрудников7.2. Реакция организаторов7.3. Сотрудничество с вендором8. ВыводыВведениеPhishman 2.35 — это система повышения осведомлённости пользователей в сфере ИБ. Она помогает развивать киберкультуру и формировать у сотрудников устойчивые навыки безопасной работы с информацией, цифровыми сервисами и корпоративными ресурсами. В процессе обучения сотрудники учатся распознавать актуальные сценарии атак, закрепляют правильные модели поведения и в результате реже становятся причиной инцидентов, связанных с человеческим фактором.В первой части обзора Phishman 2.35 мы рассмотрели платформу с точки зрения её возможностей. Теперь пришло время проверить, как всё это работает на практике. За время проекта мы не только оценили эффективность различных сценариев, но и столкнулись с рядом особенностей, которые невозможно увидеть в документации. Одни из них влияли на ход тестирования, другие оказались скорее организационными нюансами, о которых стоит знать заранее.Методология тестирования Phishman 2.35В процессе работы с киберкультурой «АМ Медиа» мы будем использовать следующие метрики:Обученность. Отражает уровень знаний сотрудников в области ИБ. Показатель растёт, когда сотрудники осваивают темы: реагирование на инциденты, защита от социальной инженерии и другие критически важные компетенции.Иммунность. Показывает, как сотрудники применяют знания на практике. Она повышается, когда демонстрируется способность распознавать угрозы и правильно на них реагировать в реальных сценариях.Киберосознанность — итоговая метрика. Объединяет знания и практические навыки, показывая, насколько сотрудники в целом устойчивы к киберугрозам и действуют корректно при их возникновении.Прежде чем оценивать эффективность работы системы, необходимо определить отправную точку. Первичное тестирование определит, на какие сценарии реагирует каждый сотрудник, где чаще всего допускаются ошибки и какие темы требуют дополнительного развития. На основе этих данных формируется индивидуальная программа обучения: сотрудники проходят персонализированные курсы, выполняют практические задания и тесты, которые помогают устранить выявленные пробелы и закрепить необходимые навыки. В процессе обучения повышается уровень обученности, а закрепление знаний через практику влияет на показатель иммунности. После завершения обучения мы проведём повторное тестирование, которое покажет, какие изменения произошли по всем ключевым метрикам.Заключительный этап — сравнение результатов первичного и повторного тестирования. Здесь станет понятно, насколько вырос уровень киберкультуры сотрудников: изменилось ли их отношение к вопросам ИБ, стали ли они увереннее распознавать угрозы и чаще принимать безопасные решения в ситуациях, где раньше могли допустить ошибку.В качестве основного канала для рассылки фишинга выбрали электронную почту. Причина очевидна: именно она остаётся основным способом первичного контакта злоумышленников с сотрудниками и доставки фишинговых сценариев. По имеющимся оценкам, более 90 % успешных кибератак начинаются с электронного письма, поэтому исключать этот канал из подобных проверок было бы некорректно.Первичное тестированиеРеальные фишинговые атаки почти никогда не строятся по универсальному шаблону: злоумышленники адаптируют содержание писем под роль человека в компании, его рабочие процессы и типовые задачи. Поэтому при выборе целевой аудитории мы разделили сотрудников по функциям и уровню доступа к корпоративным данным, а сам проект разбили на 3 последовательные волны с разным уровнем сложности.Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылкиПосле определения целевой аудитории был проведён анализ структуры подразделений и рабочих процессов сотрудников. На этом этапе изучались:должностные обязанности;распределение зон ответственности;характер внутреннего взаимодействия между отделами;используемые адреса электронной почты;формат повседневной служебной переписки.Это позволило понять, какие сценарии коммуникации являются для сотрудников привычными и не вызывают подозрений.На основе собранных данных были подготовлены сценарии фишинговых сообщений. При разработке содержимого учитывались тематика рабочих задач, стиль корпоративного общения, оформление внутренних уведомлений и типовые причины отправки писем внутри организации. Основная задача заключалась в том, чтобы письмо воспринималось как стандартное рабочее сообщение, соответствующее реальным бизнес-процессам заказчика.Волна 1. Первая волна была построена как массовый фишинг. Сценарий — сверка графика отпусков. Для атаки создавали и настраивали пользовательский шаблон. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки.На этом этапе проверялась базовая реакция сотрудников на привычные рабочие триггеры и способность распознавать типовые признаки фишинга без привязки к конкретному подразделению. Рисунок 1. Шаблон для первой волны Рисунок 2. Вид фишингового письма из первой волны в почте Волна 2. Для каждого отдела были подготовлены письма, основанные на реальных рабочих процессах, характерных запросах и ситуациях, с которыми сотрудники регулярно сталкиваются в своей деятельности. Для атаки создали и настроили пользовательский шаблон, где-то добавили немного визуального оформления. Время начала рассылки — по запланированному времени. Рисунок 3. Пример шаблона из второй волны для отдела «Продажи» Рисунок 4. Вид фишингового письма из второй волны для отдела «Продажи» Волна 3. Здесь моделировались уже более сложные сценарии целевого фишинга (spear phishing). В письмах использовались специальные формулировки, элементы корпоративного брендирования. На этом этапе проверялась не только внимательность сотрудников, но и способность замечать менее очевидные признаки атаки в условиях, максимально приближённых к реальной целевой компрометации.За основу брали системный брендированный шаблон «Яндекс ID», добавили фишинговую форму и скорректировали немного её содержание. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 5. Пример шаблона из третьей волны Рисунок 6. Вид фишингового письма из третьей волны При переходе по ссылке открывалась фишинговая страница. Рисунок 7. Фишинговая страница Тестирование доставки и отражения результатов в статистикеДалее была подготовлена инфраструктура рассылки. После её настройки проводилось тестирование доставки сообщений. Проверялась доставка писем во входящие сообщения почтовых клиентов, анализировалась реакция антиспам-механизмов в почте, а также контролировалась корректность работы механизмов отслеживания действий пользователей. Рисунок 8. Результаты тестирования доставки и отображения сообщений в почте Тестирование прошло успешно.После завершения проверки была сформирована последовательность отправки сообщений по заранее определённым волнам. Такой подход позволил распределить нагрузку, контролировать ход тестирования и отслеживать реакцию сотрудников на различных этапах проведения проверки. Рисунок 9. Активные мероприятия Результаты атакБыли получены следующие результаты:Иммунность — 81 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 71 %.Уровень риска — 8, средний. Устойчивость формируется, но есть ещё риски. Рисунок 10. Общая информация после проведения первичного тестирования Самый низкий уровень иммунности — около 50 %, после первых двух волн атак. Рисунок 11. График иммунности во время первичного тестирования Далее — сформировали в системе отчёт по скомпрометированности сотрудников, на основании которого выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Рисунок 12. Отчёт по скомпрометированности всех сотрудников в Phishman 2.35 Таблица 1. Результаты первичного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот04,76 %4,76 %Продажи04,76 %9,52 %Продюсеры 0023,8 %Редакция0019,04 %Руководитель000 ОбучениеПервичное тестирование завершено, поэтому следующим этапом стало определение группы риска и формирование программы обучения.Формирование учебной группыНа этапе отбора рассматривались два варианта формирования учебной группы. Первый предполагал использование показателя иммунности сотрудников. Второй вариант заключался в создании правила, автоматически формирующего список сотрудников, которые были скомпрометированы в ходе проведённых проверок. Этот подход позволял сразу получить выборку пользователей, продемонстрировавших наибольшую подверженность атакам, без ожидания обновления показателей.Был выбран второй вариант. На основании созданного правила была сформирована группа для обучения: в неё вошли люди, которые были скомпрометированы в ходе первичного тестирования. Рисунок 13. Создание правила для выявления группы риска Рисунок 14. Отчёт по отработанному правилу для выявления группы риска Отдельно была сформирована группа сотрудников, успешно распознавших фишинговую атаку, для участия в обучении, направленном на поддержание киберкультуры.Составление образовательной программы по повышению киберкультурыПопавшиеся сотрудники были включены в отдельную учебную группу, для которой сформировали персональную образовательную траекторию. В неё вошли 3 микрокурса по фишингу и 1 курс по информационной безопасности. Содержание траектории было направлено на повышение устойчивости к методам социальной инженерии и снижение вероятности компрометации учётных данных. Рисунок 15. Заполнение параметров обучения сотрудников Рисунок 16. Составление учебной программы Отдельно была запущена программа обучения для сотрудников, которые не попали в выборку по результатам правила.Процесс обучения и его результатыПервый отчёт мы сформировали через 2 дня после запуска обучения, что позволило получить предварительную оценку вовлечённости сотрудников. Анализ данных показал, что наибольшую активность на начальном этапе продемонстрировали сотрудники, которые попались на фишинг. Рисунок 17. Промежуточный анализ обучения Через неделю после запуска обучения провели повторный анализ прогресса, включая оценку прохождения курсов и выявление участников, не приступивших к обучению. Рисунок 18. Отчёт по динамике обучения в Phishman 2.35 Анализ показал, что часть сотрудников не завершила обучение в установленный срок. Для обеспечения максимального охвата было принято решение о продлении сроков прохождения курсов. Рисунок 19. Продление и корректировка процесса обучения В результате фактическая продолжительность обучения составила 2 недели, что превысило первоначально установленный срок в одну неделю. Но и этого времени не хватило нашим сотрудникам. Чтобы узнать, кто оказался более ответственным, воспользовались возможностями правил. Рисунок 20. Пример настройки правила по выявлению сотрудников, прошедших обучение В результате была получена информация о сотрудниках, полностью и частично прошедших обучение. Рисунок 21. Отчёт по сработанному правилу по выявлению сотрудников, прошедших обучение Рисунок 22. Отчёт по сработанному правилу по выявлению сотрудников, частично прошедших обучение Результаты обучения:полностью прошли обучение — 52 %;частично — 22 %;не прошли обучение — 26 %.Мы проанализировали список сотрудников, не приступивших к обучению, и выяснили, что это те, кто не попался на фишинг во время первичного тестирования.Среди сотрудников, которые попались на фишинг, 80 % прошли обучение, остальные — прошли его частично. Рисунок 23. Результаты обучения сотрудников «АМ Медиа» Вместе с тем за этот период были зафиксированы положительные изменения в ключевых показателях: уровень обученности достиг 9 319 баллов, а показатель киберосознанности — 7 561 баллов. Несмотря на положительную динамику, полученные значения оставались гораздо ниже целевых ориентиров, что свидетельствует о необходимости дальнейшей работы по повышению вовлечённости сотрудников и развитию киберкультуры.Повторное тестированиеПовторное тестирование проводилось по тем же этапам, что и первичное: подготовка шаблонов, тестирование и проведение атак. Как и на первом этапе, основной задачей было сделать письмо максимально похожим на стандартную рабочую переписку, соответствующую реальным бизнес-процессам нашей компании.Подготовительный этап повторного тестирования потребовал дополнительных временных затрат, связанных с регистрацией новых доменов и расширением сценариев атак с учётом результатов первичного тестирования.Волна 1. Сценарии формировались не только для отдельных подразделений, но и адресно для конкретных сотрудников, что позволило повысить реалистичность и точность имитации фишинговых атак. Запустили несколько атак, для каждой из них были разработаны индивидуальные шаблоны электронных писем и соответствующие фишинговые формы. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 24. Пример фишингового письма для первой волны Рисунок 25. Пример фишинговой формы для письма из первой волны Волна 2. Вторая волна представляла собой массовую фишинговую кампанию. Для неё был создан и настроен пользовательский шаблон, основанный на триггерах срочности и страхе финансовых потерь. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки. Рисунок 26. Пример фишингового письма для второй волны Тестирование доставки писем и корректности отражения результатов в статистике прошло успешно.Результаты атакВ повторном тестировании приняли участие уже 23 человека. Увеличение числа участников на 2 человека связано с подключением новых сотрудников к нашему эксперименту. Резких скачков иммунности здесь не наблюдалось. Рисунок 27. График иммунности во время повторного тестирования Для дополнительной оценки мы и здесь также выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Таблица 2. Результаты повторного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот000Продажи008,7 %Продюсеры 008,7 %Редакция8,7 %08,7 %Руководитель000 Мы также посмотрели, как себя показали сотрудники, которые не прошли обучение, в повторном фишинговом тесте. По данным отчёта, в первой волне повторного тестирования на фишинг попались 40% из всех, кто не обучался. Рисунок 28. Поиск информации о сотруднике в отчёте по атакам Подведение итогов После завершения всех этапов эксперимента мы получили следующие показатели:Иммунность — 76 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 91,3 %.Уровень риска — 7, средний. Рисунок 29. Информационная панель Phishman 2.35 после завершения эксперимента После обучения и повторного тестирования добавились другие показатели:Обученность — 11 / 100. Знания отсутствуют, обучение следует начать с базового уровня.Киберосознанность — 10 / 100. Низкий уровень, сотрудники не знают, как действовать в случае угроз.Часть результатов сравнили и представили их в таблице ниже. Таблица 3. Сравнение показателей киберкультуры до и после обученияПоказательДо обученияПосле обученияОбученность09319Иммунность81 %76 %Киберосознанность 07561Охват аудитории (повторно попались на фишинг)71 %91,3 %Уровень риска87 Также проанализировали действия сотрудников после обучения и сравнили их с результатами первичного тестирования. Таблица 4. Сравнение действий сотрудников до обучения и послеОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДо обученияПосле обученияДо обученияПосле обученияДо обученияПосле обученияДокументооборот004,76 %04,76 %0Продажи004,76 %09,52 %8,7 %Продюсеры 000023,8 %8,7 %Редакция08,7 %0019,04 %8,7 %Руководитель000000 Рисунок 30. Процент попавшихся на фишинг до обучения и после по отделам Если во время первичного тестирования попалось 22 % участников, то после обучения этот показатель уменьшился и стал 12 %. Рисунок 31. Общий процент попавшихся на фишинг до обучения и после Результаты повторного тестирования показали, что, несмотря на заметное снижение количества взаимодействий с фишинговыми письмами, часть сотрудников по-прежнему выполняет действия, свидетельствующие о подверженности атакам. Это ожидаемый результат, поскольку киберкультуру невозможно сформировать за столь короткое время. Речь идёт о длительном процессе, который требует регулярной работы как со стороны специалистов по информационной безопасности, так и со стороны самих сотрудников.Наш эксперимент позволил проверить знания сотрудников, провести обучение и затем оценить, насколько полученные знания закрепились на практике. Однако с точки зрения развития киберкультуры — это лишь один из этапов работы, а не её завершение.Сложности, с которыми мы столкнулисьОсобенность нашего эксперимента — организация предварительного тестирования. Перед запуском каждой атаки мы проверяли её работу на собственном аккаунте, чтобы убедиться в корректной отработке сценария на стороне пользователя. Такие проверки попадали в общую статистику системы и оказывали влияние на итоговые показатели. Возможность исключить подобные события из расчётов отсутствует. Согласно комментариям вендора, для этих целей следует использовать отдельный тестовый стенд. Поэтому мы вели дополнительно самостоятельный анализ результатов эксперимента.Отдельные сложности возникли на этапе обучения сотрудников. Завершить обучение в установленные сроки не удалось из-за человеческого фактора. Не все участники смогли своевременно пройти назначенные материалы, что потребовало увеличения периода обучения и дополнительного контроля за его прохождением.Впечатления от проекта команды «АМ Медиа»Проведение тестирования не вызвало негативной реакции со стороны сотрудников. Хотя фишинговые сообщения активно обсуждались внутри коллектива, жалоб руководству или недовольства вида «зачем вообще было устраивать такую проверку» не возникло. Основной интерес был сосредоточен вокруг самих писем и попыток понять, что именно происходит.Реакция сотрудниковОдним из самых любопытных наблюдений стала реакция сотрудников после первой волны первичного тестирования. Полученные фишинговые сообщения быстро стали предметом обсуждения: сотрудники пересылали их друг другу, задавали вопросы коллегам и пытались разобраться, что происходит.Некоторые пошли ещё дальше и вступали в переписку с отправителем, воспринимая фишинговые письма как реальные рабочие сообщения. Это наглядно показало не только убедительность используемых сценариев, но и то, что практическое столкновение с угрозой вовлекает сотрудников в тему ИБ гораздо сильнее, чем абстрактные примеры из учебных материалов. Во время повторного тестирования такой реакции уже не возникло.Реакция организаторовЕсли для большинства сотрудников тестирование выглядело как неожиданно появившиеся письма в почте, то для команды, которой было поручено тестирование Phishman 2.35 этот проект сопровождался совсем другими эмоциями. Подготовка сценариев, запуск атак и ожидание результатов вызывали ощутимое волнение. Оказалось, что смотреть на ситуацию глазами злоумышленника не так просто, как может показаться со стороны. Приходилось постоянно задавать себе вопросы: какой сценарий покажется правдоподобным, что привлечёт внимание сотрудника, а что, наоборот, вызовет подозрения.Самыми напряжёнными были дни первой волны тестирования. На этом этапе ещё не было понимания, как сотрудники отреагируют на рассылки, насколько убедительными окажутся сценарии и не вызовет ли проверка негативной реакции внутри коллектива. С каждой новой зафиксированной активностью интерес смешивался с тревогой, а результаты ожидались едва ли не с большим нетерпением, чем сам запуск кампании.После завершения эксперимента стало легче: всё задуманное удалось реализовать, результаты были получены и проанализированы. Тем не менее полностью избавиться от мыслей о проделанной работе не получилось. Время от времени возвращаешься к отдельным этапам и задаёшься вопросом: а стоило ли сделать именно так? Может быть, какой-то сценарий можно было построить иначе, а какие-то решения принять по-другому?Наверное, это естественная часть любого практического проекта. Когда работа заканчивается, появляется возможность посмотреть на неё со стороны и критически оценить собственные решения. Именно в такие моменты часто приходят идеи, которые помогают сделать следующие проекты лучше.Сотрудничество с вендоромВ ходе подготовки и проведения эксперимента иногда возникали вопросы, связанные с настройкой платформы, особенностями реализации отдельных сценариев и интерпретацией результатов. Для их решения использовались как переписка, так и рабочие созвоны. Запросы обрабатывались оперативно, что позволяло своевременно получать необходимую информацию и не допускать задержек в выполнении работ. Поддержка была доступна не только в рабочее время, но и в выходные дни.ВыводыПовторное тестирование показало, что тщательно подготовленные и персонализированные фишинговые атаки значительно эффективнее. При наличии качественной разведки злоумышленники способны подобрать убедительный сценарий практически для любого сотрудника. А если специалист может ошибиться, то сотруднику, который не занимается вопросами ИБ каждый день, сделать это ещё проще.Работа в сфере информационной безопасности или информационных технологий сама по себе не защищает человека от фишинга, социальной инженерии и других современных атак. Мы убедились в этом на собственном опыте: даже профильные знания не гарантируют, что человек не попадется на хорошо продуманную атаку. Злоумышленники постоянно меняют сценарии, поэтому знания, полученные однажды, быстро устаревают.При помощи эксперимента мы не только проверили, насколько сотрудники готовы распознавать атаки, но и поняли, как с помощью Phishman 2.35 можно сделать работу по развитию киберкультуры системной. Вместо отдельных курсов появился понятный цикл: смоделировать атаку, оценить реакцию, провести обучение и проверить, изменилось ли поведение участников. При необходимости — повторить или скорректировать процесс при помощи рекомендаций платформы. Результаты фиксируются автоматически, поэтому можно видеть, какие темы требуют больше внимания, и развивать киберкультуру на основе реальных данных, а не предположений.Читать далее
    • PR55.RP55
    • santy
      RP55, есть у тебя ТГ?
×