Сравнительный анализ антивирусного ПО - Страница 4 - Тесты и сравнения - Форумы Anti-Malware.ru Перейти к содержанию
Valery Ledovskoy

Сравнительный анализ антивирусного ПО

Recommended Posts

Александр Шабанов

Для определения весов, все же необходимо знать взаимосвязи показателей

Верна ли следующая иерархическая связь?

structure.JPG

Жду комментариев :)

post-3840-1201511539_thumb.jpg

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy

Иерархия вроде бы правильная. Но это не значит, что нужно у всех компонентов (Общее обнаружение, Лечение активного заражения, Самозащита, Скорость реакции) ставить вес, равный 1. Например, скорости реакции я бы 1 не ставил, т.к. есть некоторое пересечение с Общим обнаружением. Идея такая, что без скорости реакции не будет хорошего Общего обнаружения. Я бы вообще Скорость реакции переместил под Общее обнаружение, а Общему обнаружению дал вес 2, остальным двум компонентам дал бы вес по 1.

Кроме того, в иерархии нет такого важного показателя, как нагрузка антивируса на систему. А ведь тесты такие проводились.

Возможно, я ещё какие-то из параметров, по которым можно судить о качестве антивирусов, упустил.

И всё же, когда тест будет проведён, и будут опубликованы результаты, предлагаю в описании написать несколько слов о том, что результаты интегрального теста могут не полностью отражать реальные возможности антивирусов, т.к.:

1. Идеальных тестов нет, даже приближаются к объективности только некоторые из них;

2. Результат интегрального теста отражает усреднённое мнение нескольких тестовых лабораторий и не отражают мнение всего пользовательского сообщества;

3. В интегральной оценке не учитываются те качества антивирусов, для которых не проводились (и даже не будут проводиться) тестирования, т.к. современный уровень тестирования антивирусов обладает ограниченными возможностями. Но такие важные, но непротестированные, качества антивирусов всё же есть;

4. Во всех учитываемых тестах не было проведено оценки погрешности результатов. Она может быть достаточно высока, поэтому ошибка интегральной оценки может быть ещё больше. Да, меня неоднократно критиковали за то, что я сам не могу посчитать эту погрешность, и это правда. Но погрешность таки от этого никуда не девается. vaber показывал на одном из недавних тестов (по-моему, это был тест проактивки), что погрешность может достигать нескольких десятков процентов. И если у отдельных тестов отдельных качеств антивирусов на это можно закрыть глаза, то такой интегральный тест - это намного более сильный результат. А ошибка при интегрировании может сложиться (и она обязательно сложится по закону бутерброда) :)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов

Валерий, у вас хорошие мысли, попробую ответить пока на что смогу :)

Кроме того, в иерархии нет такого важного показателя, как нагрузка антивируса на систему. А ведь тесты такие проводились.

Возможно, я ещё какие-то из параметров, по которым можно судить о качестве антивирусов, упустил.

Первоначально я предполагал взять этот параметр, Клименти проводил тесты на скорость сканирования, но в конечном счете я отказался его использовать в основном анализе, так как он никаким образом не влияет на качество защиты пользователя. Я думаю взять этот показатель как дополнительный информационный, но не играющий роль в основном рейтинге.

И всё же, когда тест будет проведён, и будут опубликованы результаты, предлагаю в описании написать несколько слов о том, что результаты интегрального теста могут не полностью отражать реальные возможности антивирусов, т.к.:

1. Идеальных тестов нет, даже приближаются к объективности только некоторые из них

Безусловно, у нас есть над чем работать :)

2. Результат интегрального теста отражает усреднённое мнение нескольких тестовых лабораторий и не отражают мнение всего пользовательского сообщества;

Это Вы очень хорошо подметили, идея такого анализа именно выразить экспертное мнение, основанное на проведенных ранее тестах.

Пользователю необязательно стопроцентно доверять данному мнению, он может его расценивать лишь как дополнительный фактор к своему решению выбора, аналогию можно провести с автомобильными журналами где проводятся сравнения автомибилей одинакового класса. В идеале полученные значения экспертного рейтинга необходимо сопоставить с пользовательским рейтингом по тем же показателям, и я уверен вскоре появится такая возможность.

3. В интегральной оценке не учитываются те качества антивирусов, для которых не проводились (и даже не будут проводиться) тестирования, т.к. современный уровень тестирования антивирусов обладает ограниченными возможностями. Но такие важные, но непротестированные, качества антивирусов всё же есть;

Именно поэтому я считаю необходимым сделать классификацию всех показателей качества, которая покрывала бы весь функционал современных антивирусов. Это необходимо для того, что бы определить какие тесту уже есть, а какие необходимо провести для того чтобы получить полную картину о эффективности антивирусных систем.

4. Во всех учитываемых тестах не было проведено оценки погрешности результатов. Она может быть достаточно высока, поэтому ошибка интегральной оценки может быть ещё больше. Да, меня неоднократно критиковали за то, что я сам не могу посчитать эту погрешность, и это правда. Но погрешность таки от этого никуда не девается. vaber показывал на одном из недавних тестов (по-моему, это был тест проактивки), что погрешность может достигать нескольких десятков процентов. И если у отдельных тестов отдельных качеств антивирусов на это можно закрыть глаза, то такой интегральный тест - это намного более сильный результат. А ошибка при интегрировании может сложиться (и она обязательно сложится по закону бутерброда) :)

Согласен с Вами, но тенденции и относительный уровень различных производителей проследить будет возможно.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Первоначально я предполагал взять этот параметр, Клименти проводил тесты на скорость сканирования, но в конечном счете я отказался его использовать в основном анализе, так как он никаким образом не влияет на качество защиты пользователя. Я думаю взять этот показатель как дополнительный информационный, но не играющий роль в основном рейтинге.

На качество защиты данный фактор действительно не оказывает влияние. Но оказывает влияние на качество работы за компьютером. Вспомните шутки по поводу того, что антивирус тормозит так, что вирусы просто не могут запуститься. Мне кажется, что включить данный параметр, всё же, следует, хотя бы с коэффициентом 0,25. Ибо антивирус, который мешает работе пользователя в итоге либо сносится с компьютера, либо монитор постоянно ставится на паузу (что даже хуже, чем сменить антивирус). Может, у кого-то из обитателей АМ будут ещё мнения по поводу?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
A.
На качество защиты данный фактор действительно не оказывает влияние. Но оказывает влияние на качество работы за компьютером. Вспомните шутки по поводу того, что антивирус тормозит так, что вирусы просто не могут запуститься. Мне кажется, что включить данный параметр, всё же, следует, хотя бы с коэффициентом 0,25. Ибо антивирус, который мешает работе пользователя в итоге либо сносится с компьютера, либо монитор постоянно ставится на паузу (что даже хуже, чем сменить антивирус). Может, у кого-то из обитателей АМ будут ещё мнения по поводу?

Для того чтобы сравнивать антивирусы по данному показателю - необходимо чтобы они хотя бы одни и те же файлы проверяли. А то знаем мы как некоторые летают - файлы при запуске не проверяя, то другие архивы не проверяют и так далее...

Так что, вспоминая шутки, уж пусть лучше вирусы не запускаются, чем пропускаются.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Для того чтобы сравнивать антивирусы по данному показателю - необходимо чтобы они хотя бы одни и те же файлы проверяли.

Так кто ж спорит-то, что на одинаковых файлах надо тестировать? Но тестирование-то на самом деле не сложное.

По поводу шуток я не имел в виду какой-либо конкретный антивирус. Пользователи и продуктов ЛК и продуктов "Доктор Веб", и даже продуктов ESET после выхода версии 3.0 довольно часто пишут на соответствующих форумах про то, что "антивирус тормозит невозможно". Чтобы показать таким пользователям, что не нужно без лишней надобности лазить по настройкам (особенно, когда не знаешь об их предназначении), а при оптимальных настройках всё работает как часы, как раз и нужен такой общий тест на загрузку систему. Конечно, при одинаковых настройках. В общем, показатель важный. Упускать его в интегральном тесте, считаю, нельзя.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
A.
Так кто ж спорит-то, что на одинаковых файлах надо тестировать? Но тестирование-то на самом деле не сложное.

Так на одинаковых файлах и тестируют. А в итоге получается что у одного антивируса потрачено 30 секунд и проверено 300 обьектов, а у другого потрачено 10 секунд и проверено 5 обьектов. И второй начинает гордо кричать, что он самый-самый быстрый ...

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
А в итоге получается что у одного антивируса потрачено 30 секунд и проверено 300 обьектов, а у другого потрачено 10 секунд и проверено 5 обьектов.

Нет, такие тесты нам ни к чему.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Так как проактивка составляет совокупный вес с ложными срабатываниями, т.е. если нет фолсов получишь единицу в итоге за проактивку

Нельзя эти тесты мешать. То что Клименты делает какой-то левый подсчет фолсов и подсовывает к тесту на проактивку - это его личные проблемы. Нам не следует эту ошибку повторять.

Данные по скорости работы я бы не учитывал, так как это не является ИМХО характеристикой защиты. Скорость работы - побочная характеристика продукта, ею нельзя отразить атаки малвары :-)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин

Давайте будем двигаться в сторону выводов. В теме уже много высказано здравых мыслей, нужно подводить итоги.

Если с подсчетом баллов вроде бы все ясно. С пересчетом процентов/мест в баллы все просто, результаты у обоих методов от А. и Alexandr Shabanov примерно одинаковы.

А вот с коэффициентами сложнее.

Предлагаю утвердить основной принцип, что антивирусный продукт оценивается по следующим базовым равнозначных характеристикам:

1. Эффективность обнаружение известных вирусов

2. Эффективность проактивных технологий

3. Эффективность лечения угроз

4. Качество самозащиты

Общая сумма весов будет 4, т.е. по 1 баллу на каждую группу.

В группе веса распределяются равномерно по включённым в неё тестам.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Скорость работы - побочная характеристика продукта, ею нельзя отразить атаки малвары :-)

Тем не менее мы как бы пытаемся пользователю сказать, что в общем и целом этот продукт лучше того, то этот фактор нужно учитывать тоже.

Я бы ещё добавил качество русскоязычной техподдержки (если мы говорим о российском пользователе).

Т.к. есть несколько лидеров, которые по качеству защиты примерно одинаковы, то будет вполне логичным для пользователя выбрать тот продукт, что жрёт меньше системных ресурсов и имеет оперативную внятную техподдержку на языке, которым он владеет, пусть даже этот продукт на 3-5% "хуже" защищает систему, чем другой. Как считаете?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов
Тем не менее мы как бы пытаемся пользователю сказать, что в общем и целом этот продукт лучше того, то этот фактор нужно учитывать тоже.

Да, этот показатель можно включить в материал, но он не должен иметь никакого веса, так как качественного теста с прозрачной методологией еще не было проведено. Я предлагаю следующие, то что и планировал сначала, необходимо включить это в материал как график, то есть показать корреляцию качества защиты и скорости сканирования, результаты теста Клименти для этого подойдут, и думаю для пользователя это тоже будет интересно, но только в качестве дополнения к основным выводам.

А вот с коэффициентами сложнее.

Предлагаю утвердить основной принцип, что антивирусный продукт оценивается по следующим базовым равнозначных характеристикам:

1. Эффективность обнаружение известных вирусов

2. Эффективность проактивных технологий

3. Эффективность лечения угроз

4. Качество самозащиты

Принципиально согласен, эвристику все же следует приравнять по весу.

Практически теперь предлагаю следующее:

1) Эффективность обнаружение известных вирусов - 1;

1а) Скорость реакции на новые угрозы - 0.25;

1б) Поддержка упаковщиков - 0.25;

2) Эффективность эвристического анализатора (см. замечания vaber-a :)) - 1;

3) Ложные срабатывания - 0.25;

4) Эффективность лечение активного заражения - 1;

4а) Обнаружение и лечение руткитов - 0.5;

5) Качество самозащиты - 1

Итого в идеале максимальный вес 5.25

Сергей, Валерий ? :)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice

Ничего не понимаю. Возьмем к примеру антивирус А, который ловит 50% эвристикой, 20% сигнатурами, а остальные 30% - добавляет к очередному тесту Клименти, то есть раз в полгода, будет лучше антивруса Б, который ловит эвристикой 20%, сигнатурами - 40% (на конкретный момент) а остальные 40% добавляет в течении минимально возможного времени?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Deja_Vu
Ничего не понимаю. Возьмем к примеру антивирус А, который ловит 50% эвристикой, 20% сигнатурами, а остальные 30% - добавляет к очередному тесту Клименти, то есть раз в полгода, будет лучше антивруса Б, который ловит эвристикой 20%, сигнатурами - 40% (на конкретный момент) а остальные 40% добавляет в течении минимально возможного времени?

А разве он в этот конкретный момент не лучше?

Тут другой момент, нужно бы добавить тест на лечение зараженных файлов.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов
Ничего не понимаю. Возьмем к примеру антивирус А, который ловит 50% эвристикой, 20% сигнатурами, а остальные 30% - добавляет к очередному тесту Клименти, то есть раз в полгода, будет лучше антивруса Б, который ловит эвристикой 20%, сигнатурами - 40% (на конкретный момент) а остальные 40% добавляет в течении минимально возможного времени?

Нет, если руководствоваться текущей бета-методологией, получаем следующие результаты:

1) Антивирус А

а) Эффективность обнаружение известных вирусов - 5 баллов

б) Эффективность эвристического анализатора - 2 балла

в) Скорость реакции - 0 баллов (более 16 часов)

Итого: 7 баллов

2) Антивирус Б

а) Эффективность обнаружение известных вирусов - 4 баллов

б) Эффективность эвристического анализатора - 2 балла

в) Скорость реакции - 2.5 балла (от 0 до 2 часов)

Итого: 8.5 баллов

В итоге антивирус Б является более эффективным по отношению к антивирусу А.

По-моему справедливо :)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
А разве он в этот конкретный момент не лучше?

Не понимаю, причем тут конкретный момент?

Тут другой момент, нужно бы добавить тест на лечение зараженных файлов.

Это принимается во внимание.

Нет, если руководствоваться текущей бета-методологией, получаем следующие результаты:

1) Антивирус А

а) Эффективность обнаружение известных вирусов - 5 баллов

б) Эффективность эвристического анализатора - 2 балла

в) Скорость реакции - 0 баллов (более 16 часов)

Итого: 7 баллов

2) Антивирус Б

а) Эффективность обнаружение известных вирусов - 4 баллов

б) Эффективность эвристического анализатора - 2 балла

в) Скорость реакции - 2.5 балла (от 0 до 2 часов)

Итого: 8.5 баллов

В итоге антивирус Б является более эффективным по отношению к антивирусу А.

По-моему справедливо :)

По все видимости я не разобрался в методологии. Вы указывали выше, что максимальный балл -5,25, а у Вас в итоге получилось 7 и 8,5.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов
По все видимости я не разобрался в методологии. Вы указывали выше, что максимальный балл -5,25, а у Вас в итоге получилось 7 и 8,5.

Там указан максимальный вес, то есть, если у нас есть восемь показателей эффективности и за каждый максимум можно получить 10 баллов, то в сумме максимальное число баллов может быть с учетом веса разных показателей не 80, а 52.5 :)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван
Да, этот показатель можно включить в материал, но он не должен иметь никакого веса, так как качественного теста с прозрачной методологией еще не было проведено. Я предлагаю следующие, то что и планировал сначала, необходимо включить это в материал как график, то есть показать корреляцию качества защиты и скорости сканирования, результаты теста Клименти для этого подойдут, и думаю для пользователя это тоже будет интересно, но только в качестве дополнения к основным выводам.

Принципиально согласен, эвристику все же следует приравнять по весу.

Практически теперь предлагаю следующее:

1) Эффективность обнаружение известных вирусов - 1;

1а) Скорость реакции на новые угрозы - 0.25;

1б) Поддержка упаковщиков - 0.25;

2) Эффективность эвристического анализатора (см. замечания vaber-a :)) - 1;

3) Ложные срабатывания - 0.25;

4) Эффективность лечение активного заражения - 1;

4а) Обнаружение и лечение руткитов - 0.5;

5) Качество самозащиты - 1

Итого в идеале максимальный вес 5.25

Сергей, Валерий ? :)

а почему это за эвристик надо давать целый 1 бал, а за время реакции 0,25?

это бредовая идея - потому как эвристик с тем же успехом можно считать составлящей общего детекта, что и скорость реакции.

а у вас почему-то на эвристик вес 1, а за вермя реакции - 0,25

непонятно

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Александр Шабанов
а почему это за эвристик надо давать целый 1 бал, а за время реакции 0,25?

это бредовая идея - потому как эвристик с тем же успехом можно считать составлящей общего детекта, что и скорость реакции.

а у вас почему-то на эвристик вес 1, а за вермя реакции - 0,25

непонятно

Скорость реакции не влияет на детектирование на текущий момент, этот пораметр нельзя рассматривать на равне с основными функциональными показателями, что нельзя сказать о эвристике, который работает в любой мгновенный момент. Возможно я конечно не прав, Иван, у Вас есть другие предложения по весам показателей? :)

  • Upvote 5

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван
Скорость реакции не влияет на детектирование на текущий момент, этот пораметр нельзя рассматривать на равне с основными функциональными показателями, что нельзя сказать о эвристике, который работает в любой мгновенный момент. Возможно я конечно не прав, Иван, у Вас есть другие предложения по весам показателей? :)

скорость реакции оказывает такое же влияние на уровень детектирования в данный момент как и эвристик

если вендор добавляет быстро - значит из свежего задетектит много, если эвристик хороший - аналогично значит из свежего задетектит много

я не согласен с тем, что вес скорости добавления сигнатур в 4 раза меньше веса эвристика

а что Валерий на эту тему думает?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice

Полностью согласен, скорость реакции действительно очень важный фактор. Если его не учитывать в должной мере, то это исказит эффективность интегральной оценки антивирусных средств. Дело в том, что многие вендоры добавляют значительное количество сэмплов непосредственно перед тестом. Это негативно влияет на эффективность защиты в период между тестами, ибо скорость реакции в данном случае стремиться к минимуму. То есть создается впечатление. что антивирус неплохой (так как успешно проходит тест на общий детект), а на самом деле он не обеспечивает должный уровень защиты в реальной жизни.

Вопрос в том как оценивать скорость реакции. Серьезных тестов на это счет я не видел.

Все изложенное выше - мое личное мнение. Вполне возможно ошибочное.

Отредактировал Mr. Justice

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
а что Валерий на эту тему думает?

Валерий думает по этому поводу следующее :)

Я говорил ранее, что от скорости реакции вендоров на новые вредоносы зависит на прямую общий уровень детекта в каждый момент времени. Вы, Иван, это подтвердили. И поэтому как раз я бы этому тесту поставил вес 0,25. Он очень важный, но он пересекается с тестами на общий уровень детекта. Т.е. мы этим тестом приносим мало новой информации в интегральный показатель. И если мы поставим тесту на скорость реакции 1, то значение общего уровня детекта автоматически искусственно завысится в итоговом показателе.

Почему бы тогда не сделать веса для тестов на общий уровень детекта и скорость реакции одинаковыми, но меньше 1, спросите вы?

Да потому что, как верно заметил Mr. Justice, качество таких тестов пока не на высоте относительно классических тестов на определение общего уровня детекта. Поэтому тесту на детект - 1, тесту на скорость реакции - 0,25.

P.S. Кстати, обязательно в результатах надо написать, что интегральный анализ в таком формате проводится впервые, и хотя были учтены мнения многих сторон, результаты могут оказаться не соответствующими действительности. И что если читатели результатов обнаружат серьёзные логические ошибки, то группа экспертов портала antimalware.ru учтёт их при обсуждении подготовки будущего такого теста.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Олег777

Появилась глупая мысль - сравнить и оценить 2( или более) антивируса на скорость и качество на очень трудной задаче - полная проверка компьютера с полностью установленной энциклопедией Британника 2003 (именно этой версией).

За одно - сравнить количество проверенных обьектов. ;)

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Сергей Ильин
Полностью согласен, скорость реакции действительно очень важный фактор. Если его не учитывать в должной мере, то это исказит эффективность интегральной оценки антивирусных средств. Дело в том, что многие вендоры добавляют значительное количество сэмплов непосредственно перед тестом.
Да потому что, как верно заметил Mr. Justice, качество таких тестов пока не на высоте относительно классических тестов на определение общего уровня детекта. Поэтому тесту на детект - 1, тесту на скорость реакции - 0,25.

Скорость реакции важна и она связана с общим детектом, но все таки это абсолютно другой показатель. На мой взгляд это больше относится к детектированию неизвестных угроз. Поэтому предлагаю переименовать "Эффективность эвристического анализатора" в "Эффективность защиты от новых угроз", куда включить скорость реакции с таким же баллом как тесты эвристики.

1) Эффективность обнаружение известных вирусов - 1;

1а) Поддержка упаковщиков - 0.25;

2) Эффективность защиты от новых угроз

2а) Эффективность эвристического анализатора - 0.5;

2б) Скорость реакции на новые угрозы - 0.5;

Смотрите сами, пользователю глубоко пофиг как его антивирус обнаружил вредоноса. Он включил комп, получил новую заразу по почте или браузер. Если вирлаб выпустил оперативно сигнатуру - он будет защищен, если вирлаб выпустил ранее "проактивную сигнатуру" (докрутил эвристик) - он также будет защищен. С точки зрения клиента нет никакой разницы.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Поэтому предлагаю переименовать "Эффективность эвристического анализатора" в "Эффективность защиты от новых угроз", куда включить скорость реакции с таким же баллом как тесты эвристики.

Да, такая идея уже лучше смотрится.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты

  • Сообщения

    • Ego Dekker
      ESET Online Scanner был обновлён до версии 4.0.1. Приложение теперь работает только в 64-разрядной ОС.
    • Ego Dekker
      ESET Cyber Security был обновлён до версии 9.0.6700.
    • AM_Bot
      Теория звучит убедительно, но работает ли она на практике? Мы внимательно изучили Phishman 2.35 и решили не останавливаться на описании её возможностей. Вместо этого протестировали платформу на собственных сотрудниках и удивились, к каким результатам это привело.      1. Введение2. Методология тестирования Phishman 2.353. Первичное тестирование3.1. Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылки3.2. Тестирование доставки и отражения результатов в статистике3.3. Результаты атак4. Обучение4.1. Формирование учебной группы4.2. Составление образовательной программы по повышению киберкультуры4.3. Процесс обучения и его результаты5. Повторное тестирование5.1. Результаты атак6. Подведение итогов6.1. Сложности, с которыми мы столкнулись7. Впечатления от проекта команды «АМ Медиа»7.1. Реакция сотрудников7.2. Реакция организаторов7.3. Сотрудничество с вендором8. ВыводыВведениеPhishman 2.35 — это система повышения осведомлённости пользователей в сфере ИБ. Она помогает развивать киберкультуру и формировать у сотрудников устойчивые навыки безопасной работы с информацией, цифровыми сервисами и корпоративными ресурсами. В процессе обучения сотрудники учатся распознавать актуальные сценарии атак, закрепляют правильные модели поведения и в результате реже становятся причиной инцидентов, связанных с человеческим фактором.В первой части обзора Phishman 2.35 мы рассмотрели платформу с точки зрения её возможностей. Теперь пришло время проверить, как всё это работает на практике. За время проекта мы не только оценили эффективность различных сценариев, но и столкнулись с рядом особенностей, которые невозможно увидеть в документации. Одни из них влияли на ход тестирования, другие оказались скорее организационными нюансами, о которых стоит знать заранее.Методология тестирования Phishman 2.35В процессе работы с киберкультурой «АМ Медиа» мы будем использовать следующие метрики:Обученность. Отражает уровень знаний сотрудников в области ИБ. Показатель растёт, когда сотрудники осваивают темы: реагирование на инциденты, защита от социальной инженерии и другие критически важные компетенции.Иммунность. Показывает, как сотрудники применяют знания на практике. Она повышается, когда демонстрируется способность распознавать угрозы и правильно на них реагировать в реальных сценариях.Киберосознанность — итоговая метрика. Объединяет знания и практические навыки, показывая, насколько сотрудники в целом устойчивы к киберугрозам и действуют корректно при их возникновении.Прежде чем оценивать эффективность работы системы, необходимо определить отправную точку. Первичное тестирование определит, на какие сценарии реагирует каждый сотрудник, где чаще всего допускаются ошибки и какие темы требуют дополнительного развития. На основе этих данных формируется индивидуальная программа обучения: сотрудники проходят персонализированные курсы, выполняют практические задания и тесты, которые помогают устранить выявленные пробелы и закрепить необходимые навыки. В процессе обучения повышается уровень обученности, а закрепление знаний через практику влияет на показатель иммунности. После завершения обучения мы проведём повторное тестирование, которое покажет, какие изменения произошли по всем ключевым метрикам.Заключительный этап — сравнение результатов первичного и повторного тестирования. Здесь станет понятно, насколько вырос уровень киберкультуры сотрудников: изменилось ли их отношение к вопросам ИБ, стали ли они увереннее распознавать угрозы и чаще принимать безопасные решения в ситуациях, где раньше могли допустить ошибку.В качестве основного канала для рассылки фишинга выбрали электронную почту. Причина очевидна: именно она остаётся основным способом первичного контакта злоумышленников с сотрудниками и доставки фишинговых сценариев. По имеющимся оценкам, более 90 % успешных кибератак начинаются с электронного письма, поэтому исключать этот канал из подобных проверок было бы некорректно.Первичное тестированиеРеальные фишинговые атаки почти никогда не строятся по универсальному шаблону: злоумышленники адаптируют содержание писем под роль человека в компании, его рабочие процессы и типовые задачи. Поэтому при выборе целевой аудитории мы разделили сотрудников по функциям и уровню доступа к корпоративным данным, а сам проект разбили на 3 последовательные волны с разным уровнем сложности.Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылкиПосле определения целевой аудитории был проведён анализ структуры подразделений и рабочих процессов сотрудников. На этом этапе изучались:должностные обязанности;распределение зон ответственности;характер внутреннего взаимодействия между отделами;используемые адреса электронной почты;формат повседневной служебной переписки.Это позволило понять, какие сценарии коммуникации являются для сотрудников привычными и не вызывают подозрений.На основе собранных данных были подготовлены сценарии фишинговых сообщений. При разработке содержимого учитывались тематика рабочих задач, стиль корпоративного общения, оформление внутренних уведомлений и типовые причины отправки писем внутри организации. Основная задача заключалась в том, чтобы письмо воспринималось как стандартное рабочее сообщение, соответствующее реальным бизнес-процессам заказчика.Волна 1. Первая волна была построена как массовый фишинг. Сценарий — сверка графика отпусков. Для атаки создавали и настраивали пользовательский шаблон. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки.На этом этапе проверялась базовая реакция сотрудников на привычные рабочие триггеры и способность распознавать типовые признаки фишинга без привязки к конкретному подразделению. Рисунок 1. Шаблон для первой волны Рисунок 2. Вид фишингового письма из первой волны в почте Волна 2. Для каждого отдела были подготовлены письма, основанные на реальных рабочих процессах, характерных запросах и ситуациях, с которыми сотрудники регулярно сталкиваются в своей деятельности. Для атаки создали и настроили пользовательский шаблон, где-то добавили немного визуального оформления. Время начала рассылки — по запланированному времени. Рисунок 3. Пример шаблона из второй волны для отдела «Продажи» Рисунок 4. Вид фишингового письма из второй волны для отдела «Продажи» Волна 3. Здесь моделировались уже более сложные сценарии целевого фишинга (spear phishing). В письмах использовались специальные формулировки, элементы корпоративного брендирования. На этом этапе проверялась не только внимательность сотрудников, но и способность замечать менее очевидные признаки атаки в условиях, максимально приближённых к реальной целевой компрометации.За основу брали системный брендированный шаблон «Яндекс ID», добавили фишинговую форму и скорректировали немного её содержание. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 5. Пример шаблона из третьей волны Рисунок 6. Вид фишингового письма из третьей волны При переходе по ссылке открывалась фишинговая страница. Рисунок 7. Фишинговая страница Тестирование доставки и отражения результатов в статистикеДалее была подготовлена инфраструктура рассылки. После её настройки проводилось тестирование доставки сообщений. Проверялась доставка писем во входящие сообщения почтовых клиентов, анализировалась реакция антиспам-механизмов в почте, а также контролировалась корректность работы механизмов отслеживания действий пользователей. Рисунок 8. Результаты тестирования доставки и отображения сообщений в почте Тестирование прошло успешно.После завершения проверки была сформирована последовательность отправки сообщений по заранее определённым волнам. Такой подход позволил распределить нагрузку, контролировать ход тестирования и отслеживать реакцию сотрудников на различных этапах проведения проверки. Рисунок 9. Активные мероприятия Результаты атакБыли получены следующие результаты:Иммунность — 81 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 71 %.Уровень риска — 8, средний. Устойчивость формируется, но есть ещё риски. Рисунок 10. Общая информация после проведения первичного тестирования Самый низкий уровень иммунности — около 50 %, после первых двух волн атак. Рисунок 11. График иммунности во время первичного тестирования Далее — сформировали в системе отчёт по скомпрометированности сотрудников, на основании которого выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Рисунок 12. Отчёт по скомпрометированности всех сотрудников в Phishman 2.35 Таблица 1. Результаты первичного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот04,76 %4,76 %Продажи04,76 %9,52 %Продюсеры 0023,8 %Редакция0019,04 %Руководитель000 ОбучениеПервичное тестирование завершено, поэтому следующим этапом стало определение группы риска и формирование программы обучения.Формирование учебной группыНа этапе отбора рассматривались два варианта формирования учебной группы. Первый предполагал использование показателя иммунности сотрудников. Второй вариант заключался в создании правила, автоматически формирующего список сотрудников, которые были скомпрометированы в ходе проведённых проверок. Этот подход позволял сразу получить выборку пользователей, продемонстрировавших наибольшую подверженность атакам, без ожидания обновления показателей.Был выбран второй вариант. На основании созданного правила была сформирована группа для обучения: в неё вошли люди, которые были скомпрометированы в ходе первичного тестирования. Рисунок 13. Создание правила для выявления группы риска Рисунок 14. Отчёт по отработанному правилу для выявления группы риска Отдельно была сформирована группа сотрудников, успешно распознавших фишинговую атаку, для участия в обучении, направленном на поддержание киберкультуры.Составление образовательной программы по повышению киберкультурыПопавшиеся сотрудники были включены в отдельную учебную группу, для которой сформировали персональную образовательную траекторию. В неё вошли 3 микрокурса по фишингу и 1 курс по информационной безопасности. Содержание траектории было направлено на повышение устойчивости к методам социальной инженерии и снижение вероятности компрометации учётных данных. Рисунок 15. Заполнение параметров обучения сотрудников Рисунок 16. Составление учебной программы Отдельно была запущена программа обучения для сотрудников, которые не попали в выборку по результатам правила.Процесс обучения и его результатыПервый отчёт мы сформировали через 2 дня после запуска обучения, что позволило получить предварительную оценку вовлечённости сотрудников. Анализ данных показал, что наибольшую активность на начальном этапе продемонстрировали сотрудники, которые попались на фишинг. Рисунок 17. Промежуточный анализ обучения Через неделю после запуска обучения провели повторный анализ прогресса, включая оценку прохождения курсов и выявление участников, не приступивших к обучению. Рисунок 18. Отчёт по динамике обучения в Phishman 2.35 Анализ показал, что часть сотрудников не завершила обучение в установленный срок. Для обеспечения максимального охвата было принято решение о продлении сроков прохождения курсов. Рисунок 19. Продление и корректировка процесса обучения В результате фактическая продолжительность обучения составила 2 недели, что превысило первоначально установленный срок в одну неделю. Но и этого времени не хватило нашим сотрудникам. Чтобы узнать, кто оказался более ответственным, воспользовались возможностями правил. Рисунок 20. Пример настройки правила по выявлению сотрудников, прошедших обучение В результате была получена информация о сотрудниках, полностью и частично прошедших обучение. Рисунок 21. Отчёт по сработанному правилу по выявлению сотрудников, прошедших обучение Рисунок 22. Отчёт по сработанному правилу по выявлению сотрудников, частично прошедших обучение Результаты обучения:полностью прошли обучение — 52 %;частично — 22 %;не прошли обучение — 26 %.Мы проанализировали список сотрудников, не приступивших к обучению, и выяснили, что это те, кто не попался на фишинг во время первичного тестирования.Среди сотрудников, которые попались на фишинг, 80 % прошли обучение, остальные — прошли его частично. Рисунок 23. Результаты обучения сотрудников «АМ Медиа» Вместе с тем за этот период были зафиксированы положительные изменения в ключевых показателях: уровень обученности достиг 9 319 баллов, а показатель киберосознанности — 7 561 баллов. Несмотря на положительную динамику, полученные значения оставались гораздо ниже целевых ориентиров, что свидетельствует о необходимости дальнейшей работы по повышению вовлечённости сотрудников и развитию киберкультуры.Повторное тестированиеПовторное тестирование проводилось по тем же этапам, что и первичное: подготовка шаблонов, тестирование и проведение атак. Как и на первом этапе, основной задачей было сделать письмо максимально похожим на стандартную рабочую переписку, соответствующую реальным бизнес-процессам нашей компании.Подготовительный этап повторного тестирования потребовал дополнительных временных затрат, связанных с регистрацией новых доменов и расширением сценариев атак с учётом результатов первичного тестирования.Волна 1. Сценарии формировались не только для отдельных подразделений, но и адресно для конкретных сотрудников, что позволило повысить реалистичность и точность имитации фишинговых атак. Запустили несколько атак, для каждой из них были разработаны индивидуальные шаблоны электронных писем и соответствующие фишинговые формы. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 24. Пример фишингового письма для первой волны Рисунок 25. Пример фишинговой формы для письма из первой волны Волна 2. Вторая волна представляла собой массовую фишинговую кампанию. Для неё был создан и настроен пользовательский шаблон, основанный на триггерах срочности и страхе финансовых потерь. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки. Рисунок 26. Пример фишингового письма для второй волны Тестирование доставки писем и корректности отражения результатов в статистике прошло успешно.Результаты атакВ повторном тестировании приняли участие уже 23 человека. Увеличение числа участников на 2 человека связано с подключением новых сотрудников к нашему эксперименту. Резких скачков иммунности здесь не наблюдалось. Рисунок 27. График иммунности во время повторного тестирования Для дополнительной оценки мы и здесь также выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Таблица 2. Результаты повторного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот000Продажи008,7 %Продюсеры 008,7 %Редакция8,7 %08,7 %Руководитель000 Мы также посмотрели, как себя показали сотрудники, которые не прошли обучение, в повторном фишинговом тесте. По данным отчёта, в первой волне повторного тестирования на фишинг попались 40% из всех, кто не обучался. Рисунок 28. Поиск информации о сотруднике в отчёте по атакам Подведение итогов После завершения всех этапов эксперимента мы получили следующие показатели:Иммунность — 76 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 91,3 %.Уровень риска — 7, средний. Рисунок 29. Информационная панель Phishman 2.35 после завершения эксперимента После обучения и повторного тестирования добавились другие показатели:Обученность — 11 / 100. Знания отсутствуют, обучение следует начать с базового уровня.Киберосознанность — 10 / 100. Низкий уровень, сотрудники не знают, как действовать в случае угроз.Часть результатов сравнили и представили их в таблице ниже. Таблица 3. Сравнение показателей киберкультуры до и после обученияПоказательДо обученияПосле обученияОбученность09319Иммунность81 %76 %Киберосознанность 07561Охват аудитории (повторно попались на фишинг)71 %91,3 %Уровень риска87 Также проанализировали действия сотрудников после обучения и сравнили их с результатами первичного тестирования. Таблица 4. Сравнение действий сотрудников до обучения и послеОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДо обученияПосле обученияДо обученияПосле обученияДо обученияПосле обученияДокументооборот004,76 %04,76 %0Продажи004,76 %09,52 %8,7 %Продюсеры 000023,8 %8,7 %Редакция08,7 %0019,04 %8,7 %Руководитель000000 Рисунок 30. Процент попавшихся на фишинг до обучения и после по отделам Если во время первичного тестирования попалось 22 % участников, то после обучения этот показатель уменьшился и стал 12 %. Рисунок 31. Общий процент попавшихся на фишинг до обучения и после Результаты повторного тестирования показали, что, несмотря на заметное снижение количества взаимодействий с фишинговыми письмами, часть сотрудников по-прежнему выполняет действия, свидетельствующие о подверженности атакам. Это ожидаемый результат, поскольку киберкультуру невозможно сформировать за столь короткое время. Речь идёт о длительном процессе, который требует регулярной работы как со стороны специалистов по информационной безопасности, так и со стороны самих сотрудников.Наш эксперимент позволил проверить знания сотрудников, провести обучение и затем оценить, насколько полученные знания закрепились на практике. Однако с точки зрения развития киберкультуры — это лишь один из этапов работы, а не её завершение.Сложности, с которыми мы столкнулисьОсобенность нашего эксперимента — организация предварительного тестирования. Перед запуском каждой атаки мы проверяли её работу на собственном аккаунте, чтобы убедиться в корректной отработке сценария на стороне пользователя. Такие проверки попадали в общую статистику системы и оказывали влияние на итоговые показатели. Возможность исключить подобные события из расчётов отсутствует. Согласно комментариям вендора, для этих целей следует использовать отдельный тестовый стенд. Поэтому мы вели дополнительно самостоятельный анализ результатов эксперимента.Отдельные сложности возникли на этапе обучения сотрудников. Завершить обучение в установленные сроки не удалось из-за человеческого фактора. Не все участники смогли своевременно пройти назначенные материалы, что потребовало увеличения периода обучения и дополнительного контроля за его прохождением.Впечатления от проекта команды «АМ Медиа»Проведение тестирования не вызвало негативной реакции со стороны сотрудников. Хотя фишинговые сообщения активно обсуждались внутри коллектива, жалоб руководству или недовольства вида «зачем вообще было устраивать такую проверку» не возникло. Основной интерес был сосредоточен вокруг самих писем и попыток понять, что именно происходит.Реакция сотрудниковОдним из самых любопытных наблюдений стала реакция сотрудников после первой волны первичного тестирования. Полученные фишинговые сообщения быстро стали предметом обсуждения: сотрудники пересылали их друг другу, задавали вопросы коллегам и пытались разобраться, что происходит.Некоторые пошли ещё дальше и вступали в переписку с отправителем, воспринимая фишинговые письма как реальные рабочие сообщения. Это наглядно показало не только убедительность используемых сценариев, но и то, что практическое столкновение с угрозой вовлекает сотрудников в тему ИБ гораздо сильнее, чем абстрактные примеры из учебных материалов. Во время повторного тестирования такой реакции уже не возникло.Реакция организаторовЕсли для большинства сотрудников тестирование выглядело как неожиданно появившиеся письма в почте, то для команды, которой было поручено тестирование Phishman 2.35 этот проект сопровождался совсем другими эмоциями. Подготовка сценариев, запуск атак и ожидание результатов вызывали ощутимое волнение. Оказалось, что смотреть на ситуацию глазами злоумышленника не так просто, как может показаться со стороны. Приходилось постоянно задавать себе вопросы: какой сценарий покажется правдоподобным, что привлечёт внимание сотрудника, а что, наоборот, вызовет подозрения.Самыми напряжёнными были дни первой волны тестирования. На этом этапе ещё не было понимания, как сотрудники отреагируют на рассылки, насколько убедительными окажутся сценарии и не вызовет ли проверка негативной реакции внутри коллектива. С каждой новой зафиксированной активностью интерес смешивался с тревогой, а результаты ожидались едва ли не с большим нетерпением, чем сам запуск кампании.После завершения эксперимента стало легче: всё задуманное удалось реализовать, результаты были получены и проанализированы. Тем не менее полностью избавиться от мыслей о проделанной работе не получилось. Время от времени возвращаешься к отдельным этапам и задаёшься вопросом: а стоило ли сделать именно так? Может быть, какой-то сценарий можно было построить иначе, а какие-то решения принять по-другому?Наверное, это естественная часть любого практического проекта. Когда работа заканчивается, появляется возможность посмотреть на неё со стороны и критически оценить собственные решения. Именно в такие моменты часто приходят идеи, которые помогают сделать следующие проекты лучше.Сотрудничество с вендоромВ ходе подготовки и проведения эксперимента иногда возникали вопросы, связанные с настройкой платформы, особенностями реализации отдельных сценариев и интерпретацией результатов. Для их решения использовались как переписка, так и рабочие созвоны. Запросы обрабатывались оперативно, что позволяло своевременно получать необходимую информацию и не допускать задержек в выполнении работ. Поддержка была доступна не только в рабочее время, но и в выходные дни.ВыводыПовторное тестирование показало, что тщательно подготовленные и персонализированные фишинговые атаки значительно эффективнее. При наличии качественной разведки злоумышленники способны подобрать убедительный сценарий практически для любого сотрудника. А если специалист может ошибиться, то сотруднику, который не занимается вопросами ИБ каждый день, сделать это ещё проще.Работа в сфере информационной безопасности или информационных технологий сама по себе не защищает человека от фишинга, социальной инженерии и других современных атак. Мы убедились в этом на собственном опыте: даже профильные знания не гарантируют, что человек не попадется на хорошо продуманную атаку. Злоумышленники постоянно меняют сценарии, поэтому знания, полученные однажды, быстро устаревают.При помощи эксперимента мы не только проверили, насколько сотрудники готовы распознавать атаки, но и поняли, как с помощью Phishman 2.35 можно сделать работу по развитию киберкультуры системной. Вместо отдельных курсов появился понятный цикл: смоделировать атаку, оценить реакцию, провести обучение и проверить, изменилось ли поведение участников. При необходимости — повторить или скорректировать процесс при помощи рекомендаций платформы. Результаты фиксируются автоматически, поэтому можно видеть, какие темы требуют больше внимания, и развивать киберкультуру на основе реальных данных, а не предположений.Читать далее
    • PR55.RP55
    • santy
      RP55, есть у тебя ТГ?
×