Тест av-comparatives.org на качество обнаружения (август 07) - Тесты и сравнения - Форумы Anti-Malware.ru Перейти к содержанию
Иван

Тест av-comparatives.org на качество обнаружения (август 07)

Recommended Posts

Иван

Ниже картинки с результатами нового теста антивирусов, проведенного Клименти (av-comparatives.org). Для сравнения привожу также результаты предыдущего его теста, а также результаты тестов AV-Test.org.

av_comparatives.jpg

comments.jpg

comments2.jpg

AV_Test.jpg

post-10-1188645848.jpg

post-1-1188645848.jpg

post-1-1188645849.jpg

post-1-1188645850.jpg

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy

1. Непонятно, почему в тесте участвовала бета Dr.Web 4.44, а релиз не участвовал вовсе. Если тестировать 4.44, то факультативно.

2. Действительно в тех компонентах, что перечислены у Клементи, были проблемы с шилдом, от которых падали. Сейчас в бете более новые компоненты, в которых проблема решена. Vaber может подтвердить.

Потому как бета она и в Африке бета.

В общем, по Dr.Web результаты тестирования фтопку.

Остальные можно обсуждать.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван
В общем, по Dr.Web результаты тестирования фтопку.

вы передергивате Валера.

1. Судя по предыдущим результатам и тесту AV-Test.org релизная версия 4.33 не блещет.

2. Поскольку мы говорим о тесте на общий уровень обнаружения, то бета 4.44 должна наоборот давать лучший результат, чем релиз 4.33. Ведь общий детект это в вашем случае сигнатуры+ эвристик, сигнатуры в 4.44 и 4.33 одни и те же, эвристик в 4.44 может быть только лучше.

Так что глупо не согласится что:

общий детект 4.33 (релиз)<=4.44 (бета)

Что касается креша 4.44 на ряде файлов, о котором говорит Клименти - да тут соглашусь, это стоит отнести к неустойчивости бета-версии.

Так что предлагаю вам лучше вернуться к вашему обычному тексту, в котором по краней мере есть реальный нотки: "тесты Клименти и Маркса плохие т.к. их коллекции закрыты, неизвестно как собирались и в них много мусора"

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
вы передергивате Валера.

Ничего подобного.

1. Судя по предыдущим результатам и тесту AV-Test.org релизная версия 4.33 не блещет.

Ну, не будем тут в общем про все тесты Клементи говорить, ибо тема касается только результатов за август. Вообще у меня отношение к его тестам отрицательное. Были ошибки у него и раньше. То, что он считал ложными срабатываниями, например, на деле оказывались вредоносами. Но не будем тут об этом. Предположим, что сэмплы были подобраны правильно.

2. Поскольку мы говорим о тесте на общий уровень обнаружения, то бета 4.44 должна наоборот давать лучший результат, чем релиз 4.33. Ведь общий детект это в вашем случае сигнатуры+ эвристик, сигнатуры в 4.44 и 4.33 одни и те же, эвристик в 4.44 может быть только лучше.

Тут снова не соглашусь. Эвристик в версии 4.44 лучше, но тестируется не отдельно эвристик, отдельно сигнатуры, отдельно ещё что-то. Тестируется детект в общем. Так вот. Движок, который тестировал Клементи в этом тесте, тоже был достаточно сырой. В том движке, что есть сейчас, многи проблемы были решены. Снова добавили множество пакеров, сделали более стабильным и эффективным origin и пр.

Тут по-любому нужен комплексный подход. И Клементи был не прав.

Почему вот из бет был взят только Dr.Web, почему бета NODа не была взята?

Какие-то двойные стандарты в общем.

И я думаю, что 4.33 вполне могла себя в данном случае показать лучше. Подтвердить не могу, но основания для этого есть.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван

Хорошо Валера, давайте я соглашусь с Вами и мы закончим опять намечающееся бодание в самом его начале. В результатах много других интересных фактов, кроме Доктора Веба.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Хорошо Валера, давайте я соглашусь с Вами и мы закончим опять намечающееся бодание в самом его начале. В результатах много других интересных фактов, кроме Доктора Веба.

Согласен, тем более, что действительно, таблицы богаты не только перечисленными нами интересными фактами.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван

ситуация с детектом полиморфов кстати тоже поменялась к лучшему

________________.jpg

_________________.jpg

post-10-1188661904.jpg

post-1-1188661904.jpg

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Пит

Если убрать все немецкие антивирусы с ентого рейтинга, то пожалуй соглашусь с дядькой Клементино. :wink:

Валерий, Вы не согласны с местом др.веба, тогда где по-вашему, его место в рейтинге?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Валерий, Вы не согласны с местом др.веба, тогда где по-вашему, его место в рейтинге?

Это беспредметный разговор.

В этом тесте можно, как мы сегодня убедились, оказаться на любом месте, каком захочет автор. Главное, правильно подобрать версии тестируемых компонентов.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Пит
В этом тесте можно, как мы сегодня убедились, оказаться на любом месте, каком захочет автор.

Браво! Тут наши мнения совпадают. +1

Кто ещё так считает?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
1. Непонятно' date=' почему в тесте участвовала бета Dr.Web 4.44, а релиз не участвовал вовсе. Если тестировать 4.44, то факультативно.[/quote']

Потому, что это более продвинутая в плане детекта

(например, использование Origin) достаточно стабильная (судя по отзывам и рекомендациям, с сайтов с официального (и не официального) форума Dr.Web версия антивируса. Если бы участвовала версия Dr.Web 4.33 результаты, более скромными. Не пытайтесь отрицать. Это по меньшей мере не логично и глупо.

2. Действительно в тех компонентах' date=' что перечислены у Клементи, были проблемы с шилдом, от которых падали. Сейчас в бете более новые компоненты, в которых проблема решена.[/quote']

Вы начинаете противоречить себе. Что же лучше в плане детекта старая или все же новая версия (не важно какая)?

Потому как бета она и в Африке бета.

В общем' date=' по Dr.Web результаты тестирования фтопку.Остальные можно обсуждать.[/quote']

Ну это оставим без комментариев.

Добавлено спустя 11 минут 32 секунды:

Ну' date=' не будем тут в общем про все тесты Клементи говорить, ибо тема касается только результатов за август. [/quote']

И что из этого?

Вообще у меня отношение к его тестам отрицательное. Были ошибки у него и раньше.

Где аргументы? Не нраивться результат?

То' date=' что он считал ложными срабатываниями, например, на деле оказывались вредоносами. Но не будем тут об этом.[/quote']

Ну почему же? Где примеры? Не забудьте указать процент.

Предположим' date=' что сэмплы были подобраны правильно.[/quote']

Сомневаетесь? :)

2. Поскольку мы говорим о тесте на общий уровень обнаружения' date=' то бета 4.44 должна наоборот давать лучший результат, чем релиз 4.33. Ведь общий детект это в вашем случае сигнатуры+ эвристик, сигнатуры в 4.44 и 4.33 одни и те же, эвристик в 4.44 может быть только лучше. [/quote']

Тут снова не соглашусь. Эвристик в версии 4.44 лучше, но тестируется не отдельно эвристик, отдельно сигнатуры, отдельно ещё что-то. Тестируется детект в общем. Так вот. Движок, который тестировал Клементи в этом тесте, тоже был достаточно сырой. В том движке, что есть сейчас, многи проблемы были решены. Снова добавили множество пакеров, сделали более стабильным и эффективным origin и пр.

Это не аргументы.

Тут по-любому нужен комплексный подход. И Клементи был не прав.

То есть нужно было тестировать сразу по всем показателям?

Почему вот из бет был взят только Dr.Web' date=' почему бета NODа не была взята?[/quote']

Лучше если бы тестировалась предыдущая версия? См. выше.

Какие-то двойные стандарты в общем.

Станадарты в пользу Dr.Web. NOD 32 не повезло.:)

И я думаю' date=' что 4.33 вполне могла себя в данном случае показать лучше. Подтвердить не могу, но основания для этого есть.[/quote']

См. выше. Ваши аргументы несостоятельны.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
alexgr

и все же в тестах должны участвовать релизные версии. Бетами меряться смешно, поскольку тестируемая бета может и вовсе в релиз не попасть. На то и бета, а не RC. Или - все беты на текущую дату. И дело не в том, что результаты беты лучше, это должен быть общий методологический принцип. ИМХО

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
и все же в тестах должны участвовать релизные версии. Бетами меряться смешно, поскольку тестируемая бета может и вовсе в релиз не попасть. На то и бета, а не RC. Или - все беты на текущую дату. И дело не в том, что результаты беты лучше, это должен быть общий методологический принцип. ИМХО

Да Вы правы, но в указанном случае налицо исключение.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Да Вы правы, но в указанном случае налицо исключение.

Это исключение придумал себе Клементи.

Он объяснил в результатах теста, почему взял бету, причём единственную бету среди остальных релизов?

Он просто сравнил несравнимые вещи.

Если бы он взял 4.33, там результаты были бы похуже, чем у компонентов, которые сейчас находятся в бете, но, по крайней мере, они были бы более честными и, вполне возможно, более лучшими, чем у тех компонентов, которые брал Клементи.

А у релиза 4.44 детект будет гораздо лучше, чем у того, что тестировалось.

Потому что в тех компонентах, что тестировались Клементи, были проблемы и с детектом.

А недавно повыходили обновления сканера (с исправленным шилдом).

А предрелизный движок вообще в бету ещё не попал. А в нём были решены многочисленные проблемы, которые выявились при тестировании того движка, что тестировал Клементи.

Резюме. Клементи был неправ. И не надо его оправдывать.

Добавлено спустя 2 минуты 8 секунд:

Да, почему он наравне с бетой (если ему так хотелось) не протестировал и релизную версию, чтобы быть до конца последовательным?

Тогда он мог бы показать, что действительно у 4.44 детект лучше, чем у 4.33, но хуже, чем у остальных антивирусов.

А так запросто можно утверждать всё, что угодно.

Корректность методологии Клементи часто у меня вызывает сомнения, а тут явное нарушение основополагающих принципов тестирования.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
Да Вы правы' date=' но в указанном случае налицо исключение.[/quote']
Это исключение придумал себе Клементи.

Да вы так и должны были бы ответить.

Он объяснил в результатах теста' date=' почему взял бету, причём единственную бету среди остальных релизов?

Он просто сравнил несравнимые вещи.

Если бы он взял 4.33, там результаты были бы похуже, чем у компонентов, которые сейчас находятся в бете, но, по крайней мере, они были бы более честными и, вполне возможно, более лучшими, чем у тех компонентов, которые брал Клементи.[/quote']

Я еще раз спрашиваю Вас что лучше в плане детекта Dr.Web 4.33 или Dr.Web 4.44? Вам что важна мнимая честность или истина?

А у релиза 4.44 детект будет гораздо лучше' date=' чем у того, что тестировалось.[/quote']

Естественно.

Потому что в тех компонентах' date=' что тестировались Клементи, были проблемы и с детектом.

А недавно повыходили обновления сканера (с исправленным шилдом).[/quote']

Здесь поподробнее пожалуйста.

А предрелизный движок вообще в бету ещё не попал. А в нём были решены многочисленные проблемы' date=' которые выявились при тестировании того движка, что тестировал Клементи.[/quote']

Какие проблемы? 4.44. рекомендуют к использованию уже несколько месяцев. Неофициально конечно, но...

...

Резюме. Клементи был неправ. И не надо его оправдывать.

а я его и не оправдываю. Сократ мне друг' date=' но истина дороже.....(автор не я)

Добавлено спустя 2 минуты 8 секунд:

...

Да, почему он наравне с бетой (если ему так хотелось) не протестировал и релизную версию, чтобы быть до конца последовательным?

Я уже ответил на это вопрос. Вопрос к Вам - Вы действительно считаете что версия 4.33 смотрелась бы лучше чем последние 4.44?

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван

Mr. Justice давно вас не было видно, я лично скучал :D

Спорить с Валерой мне все же кажется бесполезно, лучше вернуться к этому разговору когда AV-Test сделает через три месяца следующий свой тест (до климентьевского уж больно долго ждать полгода). Тогда я надеюсь 4.44 или что-то еще у Доктора наконец выйдет и мы все увидим, если доживем.

А еще я предлагаю vaberу исключить из ближайшего теста на активное заражение версию 4.44 и оставить 4.33. А то грех ведь бету в тесте использовать.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
Mr. Justice давно вас не было видно, я лично скучал :D

Приятно слышать. Спасибо Иван.

Спорить с Валерой мне все же кажется бесполезно,

Знаете, Валерий - очень умный человек, но его позицию я лично понимаю....Простите если обидел.

лучше вернуться к этому разговору когда AV-Test сделает через три месяца следующий свой тест (до климентьевского уж больно долго ждать полгода). Тогда я надеюсь 4.44 или что-то еще у Доктора наконец выйдет и мы все увидим, если доживем.

Правильно.

А еще я предлагаю vaberу исключить из ближайшего теста на активное заражение версию 4.44 и оставить 4.33. А то грех ведь бету в тесте использовать.

Нет. Наверно лучше тестировать обе версии.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван
Нет. Наверно лучше тестировать обе версии.

и 4.44 будет лучше, что бы там Валерий не говорил :D

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice

Нет. Наверно лучше тестировать обе версии.

и 4.44 будет лучше, что бы там Валерий не говорил :D

Верно. Кстати жду 5.0

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Иван

Меня порадовала реакция Софоса на тест, AV-Test.org (смотри картинку в первом посте выше), где они показали далеко не самый лучший результат.

Понятно, что это отмазка, но очень грамотная, выверенная, четкая и спокойная. Стоит поучиться.

http://www.sophos.com/security/blog/2007/08/527.html

Detection vs Protection

I recently wrote about a comparative test of Linux products and how such a limited test set was not representative. In the past few days AV-Test.org have released their latest set of results. The methodology used is a far better way of testing on demand detection rates.

- A large collection is used (in this case over 800,000 samples)

- All samples are verified that they execute and perform 'some sort of' malicious behavior

- Only samples from the last 6 months are used.

- All products tested use the 'maximum' possible settings

However, detection rates of large collections like this are only part of the process that should be used when evaluating security products. False positive tests are just as important, incorrectly identifying clean files can take an administrator as long to resolve as a 'real' infection.

Performance, memory footprint, detection with 'default' settings (or at least the setting you are most likely to use) are all important factors.

On demand scans are typically run periodically, whereas 'on access' scanning offers protection all the time so the detection rate, behavior and performance of this component is even more important.

Many security products contain additional protection layers, and as I have described previously the latest version of Sophos Endpoint Security and Control not only includes static scanning of files but also buffer overrun protection and runtime behavior blocking, which according to our own internal tests, catch approximately 50% of new malware without the need to produce and distribute a signature.

Having a security product on your machine is obviously vital, but just as important is the ability to manage that system, especially for our customers who are managing anywhere between 10 and 100,000 desktops. Ensuring every workstation is running up to date and correctly configured security is just as important as detection rate. We have often had cases where, once deployed, a large number of 'old' malware is discovered on a network, not because their old solution couldn’t detect the malware but because they hadn't been kept up to date or managed prior to the installation of Sophos.

Another important aspect to take into account is support. Not just the level of product support offered by the vendor, but how much resource an organization needs in order to manage and maintain the product.

There is also the question of the frequency and size of updates and of course analysis capabilities. If updates are only sent out once a day during the working week, less protection is available than a full 24 by 7 operation but conversely, having updates every few minutes or even every hour that are not well tested introduces unnecessary overhead in management and infrastructure.

So when evaluating a security product, all of these factors need to be taken into account.

- Detection tests like those carried out by reputable organisations such as AV-Test.org.

- Tests of on access and on demand default configuration like VB100 from Virus Bulletin magazine.

- Certifications on current threats such as those done by West Coast Labs.

- Independent product reviews such as those carried out by Cascadia Labs and reputable magazines.

More details of the independent tests carried out on Sophos products can be found here.

Mark Harris - Director of SophosLabs

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
Меня порадовала реакция Софоса на тест' date=' AV-Test.org (смотри картинку в первом посте выше), где они показали далеко не самый лучший результат.

Понятно, что это отмазка, но очень грамотная, выверенная, четкая и спокойная. Стоит поучиться.

[/quote']

http://www.sophos.com/security/blog/2007/08/527.html

Давайте посмотрим.

Detection vs Protection

I recently wrote about a comparative test of Linux products and how such a limited test set was not representative.

О Линуксе особый разговор.

In the past few days AV-Test.org have released their latest set of results. The methodology used is a far better way of testing on demand detection rates.

Интересное утверждение.

- A large collection is used (in this case over 800,000 samples)

Это, несомнено плюс

- All samples are verified that they execute and perform 'some sort of' malicious behavior

Особо прошу заметить данный факт. Обычно недоволньные ссылаются именно на это обстоятельство как на conditio sine qua non.

- Only samples from the last 6 months are used.

Достаточно важное обстоятельство, влияющее на респектабельность теста.

- All products tested use the 'maximum' possible settings

Весьма относительное условие.

However, detection rates of large collections like this are only part of the process that should be used when evaluating security products.

верно, но....в общем дальше

False positive tests are just as important, incorrectly identifying clean files can take an administrator as long to resolve as a 'real' infection.

Они проверены на это

Performance, memory footprint, detection with 'default' settings (or at least the setting you are most likely to use) are all important factors.

Смотря что тестируем. Правильно?

On demand scans are typically run periodically, whereas 'on access' scanning offers protection all the time so the detection rate, behavior and performance of this component is even more important.

Естественно, но я бы не стал недооценивать сканирование "по требованию".

Many security products contain additional protection layers, and as I have described previously the latest version of Sophos Endpoint Security and Control not only includes static scanning of files but also buffer overrun protection and runtime behavior blocking, which according to our own internal tests, catch approximately 50% of new malware without the need to produce and distribute a signature.

Конечно, если это учитывать, то Касперский, к примеру, был бы скромно говоря одним из личших.

Having a security product on your machine is obviously vital, but just as important is the ability to manage that system, especially for our customers who are managing anywhere between 10 and 100,000 desktops. Ensuring every workstation is running up to date and correctly configured security is just as important as detection rate. We have often had cases where, once deployed, a large number of 'old' malwareis discovered on a network, not because their old solution couldn’t detect the malware but because they hadn't been kept up to date or managed prior to the installation of Sophos.

Это верно.

Another important aspect to take into account is support. Not just the level of product support offered by the vendor, but how much resource an organization needs in order to manage and maintain the product.

Ну здесь свои лидеры.

There is also the question of the frequency and size of updates and of course analysis capabilities. If updates are only sent out once a day during the working week, less protection

Несомненно.

i

s available than a full 24 by 7 operation but conversely, having updates every few minutes or even every hour that are not well tested introduces unnecessary overhead in management and infrastructure.

Правильно, но приходится выбирать.

eSo when evaluating a security product, all of these factors need to be taken into account.

Да, конечно, но давайте определимся с критерями!

Один антивирус будет лучше другого по одному показателю, а другой - по иному. Что тестируем?

- Detection tests like those carried out by reputable organisations such as AV-Test.org.

- Tests of on access and on demand default configuration like VB100 from Virus Bulletin magazine.

- Certifications on current threats such as those done by West Coast Labs.

- Independent product reviews such as those carried out by Cascadia Labs and reputable magazines.

Все верно. но в данном случае продукт оценивается по одному показателю.

More details of the independent tests carried out on Sophos products can be found here.

Mark Harris - Director of SophosLabs

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
Я еще раз спрашиваю Вас что лучше в плане детекта Dr.Web 4.33 или Dr.Web 4.44? Вам что важна мнимая честность или истина?

Лучше в плане детекта релиз Dr.Web 4.44.

Честность не бывает мнимой.

Valery Ledovskoy писал(а):

Потому что в тех компонентах, что тестировались Клементи, были проблемы и с детектом.

А недавно повыходили обновления сканера (с исправленным шилдом).

Здесь поподробнее пожалуйста.

Были проблемы в шилде, были проблемы в движке.

Одни из этих проблем решены, другие ещё решаются.

Все эти проблемы влияют на качество детекта.

Какие проблемы? 4.44. рекомендуют к использованию уже несколько месяцев. Неофициально конечно, но...

Только в тех случаях, где это действительно необходимо.

Вопрос к Вам - Вы действительно считаете что версия 4.33 смотрелась бы лучше чем последние 4.44?

Релизная 4.44, конечно же, была бы (в будущем, конечно) лучше.

Поэтому её нужно было тестировать факультативно.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Alex_Goodwin
Лучше в плане детекта релиз Dr.Web 4.44.
Вопрос к Вам - Вы действительно считаете что версия 4.33 смотрелась бы лучше чем последние 4.44?

Релизная 4.44, конечно же, была бы (в будущем, конечно) лучше.

Поэтому её нужно было тестировать факультативно.

Валерий, не уходите от ответа, вас спрашивали про 4.33 и не релизную 4.44

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Valery Ledovskoy
А еще я предлагаю vaberу исключить из ближайшего теста на активное заражение версию 4.44 и оставить 4.33. А то грех ведь бету в тесте использовать.

Вот не надо только запугивать и передёргивать.

4.44 тестировать можно и нужно. Но! Факультативно, в дополнение к основному тесту. Т.е. протестировали релиз 4.33, составили общую таблицу, а далее уже (с соответствующими "звёздочками" и сносками) можно потестировать бету НОДа, бету Dr.Web, альфу КАВ 8.0 - что угодно.

Добавлено спустя 5 минут 34 секунды:

и 4.44 будет лучше, что бы там Валерий не говорил

Если честно, достали эти подколки :(

Пока идёт бета-тестирование, 4.44 может быть временами и лучше и хуже. Теперь понятно? Делается новый функционал, тестируется, находятся ошибки, исправляются, добавляется новый функционал, тестируется находятся ошибки. Если при этом сканер и движок меняются, то качество детекта может быть и лучше, и хуже, и таким, как в 4.33. А в определённые моменты его может вообще не быть, если альфа- или бета- модули будут ронять систему в BSOD.

Ы?

Добавлено спустя 54 секунды:

Верно. Кстати жду 5.0

Мы тоже ждём. Разработка идёт активно.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты
Mr. Justice
Я еще раз спрашиваю Вас что лучше в плане детекта Dr.Web 4.33 или Dr.Web 4.44? Вам что важна мнимая честность или истина?

Лучше в плане детекта релиз Dr.Web 4.44.

Значит получается' date=' что бета Dr.Web хуже релиза Dr. Web? Я правильно понял?

Честность не бывает мнимой.

Если честность рассматривать как поятие эквивалентное истине, то Вы правы, если Вы вкладываете в это понятие несколько иной смысл, то это называется релятивизм (чистая философия - все в мире относительно).Утилитарный подход (извините за философский понятийный аппарат) предполагает пользу, выгоду. Вы понимает о чем я???

Valery Ledovskoy писал(а):

Потому что в тех компонентах' date=' что тестировались Клементи, были проблемы и с детектом.

А недавно повыходили обновления сканера (с исправленным шилдом).

Здесь поподробнее пожалуйста. [/quote']

Какую, по Вашему мнению версию беты должны были использовать, чтобы результаты были "оптимальными"? Или 4.33 лучше любой бэты?

Были проблемы в шилде' date=' были проблемы в движке.

Одни из этих проблем решены, другие ещё решаются.

Все эти проблемы влияют на качество детекта.[/quote']

См. выше.

Какие проблемы? 4.44. рекомендуют к использованию уже несколько месяцев. Неофициально конечно' date=' но...

[/quote']

Только в тех случаях, где это действительно необходимо.

Скажите когда лучше использовать 4.33, а когда 4.44.

Поделиться сообщением


Ссылка на сообщение
Поделиться на другие сайты

  • Сообщения

    • Ego Dekker
      ESET Online Scanner 4.0.1  (Windows 10/11, 64-разрядная)
                                                                                  ●
              Руководство пользователя ESET Online Scanner 4  (PDF-файл)
    • Ego Dekker
      ESET Cyber Security был обновлён до версии 9.0.6700.
    • AM_Bot
      Теория звучит убедительно, но работает ли она на практике? Мы внимательно изучили Phishman 2.35 и решили не останавливаться на описании её возможностей. Вместо этого протестировали платформу на собственных сотрудниках и удивились, к каким результатам это привело.      1. Введение2. Методология тестирования Phishman 2.353. Первичное тестирование3.1. Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылки3.2. Тестирование доставки и отражения результатов в статистике3.3. Результаты атак4. Обучение4.1. Формирование учебной группы4.2. Составление образовательной программы по повышению киберкультуры4.3. Процесс обучения и его результаты5. Повторное тестирование5.1. Результаты атак6. Подведение итогов6.1. Сложности, с которыми мы столкнулись7. Впечатления от проекта команды «АМ Медиа»7.1. Реакция сотрудников7.2. Реакция организаторов7.3. Сотрудничество с вендором8. ВыводыВведениеPhishman 2.35 — это система повышения осведомлённости пользователей в сфере ИБ. Она помогает развивать киберкультуру и формировать у сотрудников устойчивые навыки безопасной работы с информацией, цифровыми сервисами и корпоративными ресурсами. В процессе обучения сотрудники учатся распознавать актуальные сценарии атак, закрепляют правильные модели поведения и в результате реже становятся причиной инцидентов, связанных с человеческим фактором.В первой части обзора Phishman 2.35 мы рассмотрели платформу с точки зрения её возможностей. Теперь пришло время проверить, как всё это работает на практике. За время проекта мы не только оценили эффективность различных сценариев, но и столкнулись с рядом особенностей, которые невозможно увидеть в документации. Одни из них влияли на ход тестирования, другие оказались скорее организационными нюансами, о которых стоит знать заранее.Методология тестирования Phishman 2.35В процессе работы с киберкультурой «АМ Медиа» мы будем использовать следующие метрики:Обученность. Отражает уровень знаний сотрудников в области ИБ. Показатель растёт, когда сотрудники осваивают темы: реагирование на инциденты, защита от социальной инженерии и другие критически важные компетенции.Иммунность. Показывает, как сотрудники применяют знания на практике. Она повышается, когда демонстрируется способность распознавать угрозы и правильно на них реагировать в реальных сценариях.Киберосознанность — итоговая метрика. Объединяет знания и практические навыки, показывая, насколько сотрудники в целом устойчивы к киберугрозам и действуют корректно при их возникновении.Прежде чем оценивать эффективность работы системы, необходимо определить отправную точку. Первичное тестирование определит, на какие сценарии реагирует каждый сотрудник, где чаще всего допускаются ошибки и какие темы требуют дополнительного развития. На основе этих данных формируется индивидуальная программа обучения: сотрудники проходят персонализированные курсы, выполняют практические задания и тесты, которые помогают устранить выявленные пробелы и закрепить необходимые навыки. В процессе обучения повышается уровень обученности, а закрепление знаний через практику влияет на показатель иммунности. После завершения обучения мы проведём повторное тестирование, которое покажет, какие изменения произошли по всем ключевым метрикам.Заключительный этап — сравнение результатов первичного и повторного тестирования. Здесь станет понятно, насколько вырос уровень киберкультуры сотрудников: изменилось ли их отношение к вопросам ИБ, стали ли они увереннее распознавать угрозы и чаще принимать безопасные решения в ситуациях, где раньше могли допустить ошибку.В качестве основного канала для рассылки фишинга выбрали электронную почту. Причина очевидна: именно она остаётся основным способом первичного контакта злоумышленников с сотрудниками и доставки фишинговых сценариев. По имеющимся оценкам, более 90 % успешных кибератак начинаются с электронного письма, поэтому исключать этот канал из подобных проверок было бы некорректно.Первичное тестированиеРеальные фишинговые атаки почти никогда не строятся по универсальному шаблону: злоумышленники адаптируют содержание писем под роль человека в компании, его рабочие процессы и типовые задачи. Поэтому при выборе целевой аудитории мы разделили сотрудников по функциям и уровню доступа к корпоративным данным, а сам проект разбили на 3 последовательные волны с разным уровнем сложности.Подготовка шаблонов фишинговых сообщений, инфраструктуры рассылкиПосле определения целевой аудитории был проведён анализ структуры подразделений и рабочих процессов сотрудников. На этом этапе изучались:должностные обязанности;распределение зон ответственности;характер внутреннего взаимодействия между отделами;используемые адреса электронной почты;формат повседневной служебной переписки.Это позволило понять, какие сценарии коммуникации являются для сотрудников привычными и не вызывают подозрений.На основе собранных данных были подготовлены сценарии фишинговых сообщений. При разработке содержимого учитывались тематика рабочих задач, стиль корпоративного общения, оформление внутренних уведомлений и типовые причины отправки писем внутри организации. Основная задача заключалась в том, чтобы письмо воспринималось как стандартное рабочее сообщение, соответствующее реальным бизнес-процессам заказчика.Волна 1. Первая волна была построена как массовый фишинг. Сценарий — сверка графика отпусков. Для атаки создавали и настраивали пользовательский шаблон. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки.На этом этапе проверялась базовая реакция сотрудников на привычные рабочие триггеры и способность распознавать типовые признаки фишинга без привязки к конкретному подразделению. Рисунок 1. Шаблон для первой волны Рисунок 2. Вид фишингового письма из первой волны в почте Волна 2. Для каждого отдела были подготовлены письма, основанные на реальных рабочих процессах, характерных запросах и ситуациях, с которыми сотрудники регулярно сталкиваются в своей деятельности. Для атаки создали и настроили пользовательский шаблон, где-то добавили немного визуального оформления. Время начала рассылки — по запланированному времени. Рисунок 3. Пример шаблона из второй волны для отдела «Продажи» Рисунок 4. Вид фишингового письма из второй волны для отдела «Продажи» Волна 3. Здесь моделировались уже более сложные сценарии целевого фишинга (spear phishing). В письмах использовались специальные формулировки, элементы корпоративного брендирования. На этом этапе проверялась не только внимательность сотрудников, но и способность замечать менее очевидные признаки атаки в условиях, максимально приближённых к реальной целевой компрометации.За основу брали системный брендированный шаблон «Яндекс ID», добавили фишинговую форму и скорректировали немного её содержание. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 5. Пример шаблона из третьей волны Рисунок 6. Вид фишингового письма из третьей волны При переходе по ссылке открывалась фишинговая страница. Рисунок 7. Фишинговая страница Тестирование доставки и отражения результатов в статистикеДалее была подготовлена инфраструктура рассылки. После её настройки проводилось тестирование доставки сообщений. Проверялась доставка писем во входящие сообщения почтовых клиентов, анализировалась реакция антиспам-механизмов в почте, а также контролировалась корректность работы механизмов отслеживания действий пользователей. Рисунок 8. Результаты тестирования доставки и отображения сообщений в почте Тестирование прошло успешно.После завершения проверки была сформирована последовательность отправки сообщений по заранее определённым волнам. Такой подход позволил распределить нагрузку, контролировать ход тестирования и отслеживать реакцию сотрудников на различных этапах проведения проверки. Рисунок 9. Активные мероприятия Результаты атакБыли получены следующие результаты:Иммунность — 81 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 71 %.Уровень риска — 8, средний. Устойчивость формируется, но есть ещё риски. Рисунок 10. Общая информация после проведения первичного тестирования Самый низкий уровень иммунности — около 50 %, после первых двух волн атак. Рисунок 11. График иммунности во время первичного тестирования Далее — сформировали в системе отчёт по скомпрометированности сотрудников, на основании которого выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Рисунок 12. Отчёт по скомпрометированности всех сотрудников в Phishman 2.35 Таблица 1. Результаты первичного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот04,76 %4,76 %Продажи04,76 %9,52 %Продюсеры 0023,8 %Редакция0019,04 %Руководитель000 ОбучениеПервичное тестирование завершено, поэтому следующим этапом стало определение группы риска и формирование программы обучения.Формирование учебной группыНа этапе отбора рассматривались два варианта формирования учебной группы. Первый предполагал использование показателя иммунности сотрудников. Второй вариант заключался в создании правила, автоматически формирующего список сотрудников, которые были скомпрометированы в ходе проведённых проверок. Этот подход позволял сразу получить выборку пользователей, продемонстрировавших наибольшую подверженность атакам, без ожидания обновления показателей.Был выбран второй вариант. На основании созданного правила была сформирована группа для обучения: в неё вошли люди, которые были скомпрометированы в ходе первичного тестирования. Рисунок 13. Создание правила для выявления группы риска Рисунок 14. Отчёт по отработанному правилу для выявления группы риска Отдельно была сформирована группа сотрудников, успешно распознавших фишинговую атаку, для участия в обучении, направленном на поддержание киберкультуры.Составление образовательной программы по повышению киберкультурыПопавшиеся сотрудники были включены в отдельную учебную группу, для которой сформировали персональную образовательную траекторию. В неё вошли 3 микрокурса по фишингу и 1 курс по информационной безопасности. Содержание траектории было направлено на повышение устойчивости к методам социальной инженерии и снижение вероятности компрометации учётных данных. Рисунок 15. Заполнение параметров обучения сотрудников Рисунок 16. Составление учебной программы Отдельно была запущена программа обучения для сотрудников, которые не попали в выборку по результатам правила.Процесс обучения и его результатыПервый отчёт мы сформировали через 2 дня после запуска обучения, что позволило получить предварительную оценку вовлечённости сотрудников. Анализ данных показал, что наибольшую активность на начальном этапе продемонстрировали сотрудники, которые попались на фишинг. Рисунок 17. Промежуточный анализ обучения Через неделю после запуска обучения провели повторный анализ прогресса, включая оценку прохождения курсов и выявление участников, не приступивших к обучению. Рисунок 18. Отчёт по динамике обучения в Phishman 2.35 Анализ показал, что часть сотрудников не завершила обучение в установленный срок. Для обеспечения максимального охвата было принято решение о продлении сроков прохождения курсов. Рисунок 19. Продление и корректировка процесса обучения В результате фактическая продолжительность обучения составила 2 недели, что превысило первоначально установленный срок в одну неделю. Но и этого времени не хватило нашим сотрудникам. Чтобы узнать, кто оказался более ответственным, воспользовались возможностями правил. Рисунок 20. Пример настройки правила по выявлению сотрудников, прошедших обучение В результате была получена информация о сотрудниках, полностью и частично прошедших обучение. Рисунок 21. Отчёт по сработанному правилу по выявлению сотрудников, прошедших обучение Рисунок 22. Отчёт по сработанному правилу по выявлению сотрудников, частично прошедших обучение Результаты обучения:полностью прошли обучение — 52 %;частично — 22 %;не прошли обучение — 26 %.Мы проанализировали список сотрудников, не приступивших к обучению, и выяснили, что это те, кто не попался на фишинг во время первичного тестирования.Среди сотрудников, которые попались на фишинг, 80 % прошли обучение, остальные — прошли его частично. Рисунок 23. Результаты обучения сотрудников «АМ Медиа» Вместе с тем за этот период были зафиксированы положительные изменения в ключевых показателях: уровень обученности достиг 9 319 баллов, а показатель киберосознанности — 7 561 баллов. Несмотря на положительную динамику, полученные значения оставались гораздо ниже целевых ориентиров, что свидетельствует о необходимости дальнейшей работы по повышению вовлечённости сотрудников и развитию киберкультуры.Повторное тестированиеПовторное тестирование проводилось по тем же этапам, что и первичное: подготовка шаблонов, тестирование и проведение атак. Как и на первом этапе, основной задачей было сделать письмо максимально похожим на стандартную рабочую переписку, соответствующую реальным бизнес-процессам нашей компании.Подготовительный этап повторного тестирования потребовал дополнительных временных затрат, связанных с регистрацией новых доменов и расширением сценариев атак с учётом результатов первичного тестирования.Волна 1. Сценарии формировались не только для отдельных подразделений, но и адресно для конкретных сотрудников, что позволило повысить реалистичность и точность имитации фишинговых атак. Запустили несколько атак, для каждой из них были разработаны индивидуальные шаблоны электронных писем и соответствующие фишинговые формы. Тип атаки — обычный, время начала рассылки — по запланированному времени. Рисунок 24. Пример фишингового письма для первой волны Рисунок 25. Пример фишинговой формы для письма из первой волны Волна 2. Вторая волна представляла собой массовую фишинговую кампанию. Для неё был создан и настроен пользовательский шаблон, основанный на триггерах срочности и страхе финансовых потерь. Тип атаки — обычный, время начала рассылки — сразу, при запуске атаки. Рисунок 26. Пример фишингового письма для второй волны Тестирование доставки писем и корректности отражения результатов в статистике прошло успешно.Результаты атакВ повторном тестировании приняли участие уже 23 человека. Увеличение числа участников на 2 человека связано с подключением новых сотрудников к нашему эксперименту. Резких скачков иммунности здесь не наблюдалось. Рисунок 27. График иммунности во время повторного тестирования Для дополнительной оценки мы и здесь также выполнили самостоятельный анализ результатов по отделам без учёта результатов тестирования шаблонов атак. Таблица 2. Результаты повторного тестирования по отделамОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДокументооборот000Продажи008,7 %Продюсеры 008,7 %Редакция8,7 %08,7 %Руководитель000 Мы также посмотрели, как себя показали сотрудники, которые не прошли обучение, в повторном фишинговом тесте. По данным отчёта, в первой волне повторного тестирования на фишинг попались 40% из всех, кто не обучался. Рисунок 28. Поиск информации о сотруднике в отчёте по атакам Подведение итогов После завершения всех этапов эксперимента мы получили следующие показатели:Иммунность — 76 %. Хороший иммунитет, большинство реагирует правильно. Охват аудитории (повторно попались на фишинг) — 91,3 %.Уровень риска — 7, средний. Рисунок 29. Информационная панель Phishman 2.35 после завершения эксперимента После обучения и повторного тестирования добавились другие показатели:Обученность — 11 / 100. Знания отсутствуют, обучение следует начать с базового уровня.Киберосознанность — 10 / 100. Низкий уровень, сотрудники не знают, как действовать в случае угроз.Часть результатов сравнили и представили их в таблице ниже. Таблица 3. Сравнение показателей киберкультуры до и после обученияПоказательДо обученияПосле обученияОбученность09319Иммунность81 %76 %Киберосознанность 07561Охват аудитории (повторно попались на фишинг)71 %91,3 %Уровень риска87 Также проанализировали действия сотрудников после обучения и сравнили их с результатами первичного тестирования. Таблица 4. Сравнение действий сотрудников до обучения и послеОтделЗаполнили формуОткрыли вложенияОткрыли ссылкуДо обученияПосле обученияДо обученияПосле обученияДо обученияПосле обученияДокументооборот004,76 %04,76 %0Продажи004,76 %09,52 %8,7 %Продюсеры 000023,8 %8,7 %Редакция08,7 %0019,04 %8,7 %Руководитель000000 Рисунок 30. Процент попавшихся на фишинг до обучения и после по отделам Если во время первичного тестирования попалось 22 % участников, то после обучения этот показатель уменьшился и стал 12 %. Рисунок 31. Общий процент попавшихся на фишинг до обучения и после Результаты повторного тестирования показали, что, несмотря на заметное снижение количества взаимодействий с фишинговыми письмами, часть сотрудников по-прежнему выполняет действия, свидетельствующие о подверженности атакам. Это ожидаемый результат, поскольку киберкультуру невозможно сформировать за столь короткое время. Речь идёт о длительном процессе, который требует регулярной работы как со стороны специалистов по информационной безопасности, так и со стороны самих сотрудников.Наш эксперимент позволил проверить знания сотрудников, провести обучение и затем оценить, насколько полученные знания закрепились на практике. Однако с точки зрения развития киберкультуры — это лишь один из этапов работы, а не её завершение.Сложности, с которыми мы столкнулисьОсобенность нашего эксперимента — организация предварительного тестирования. Перед запуском каждой атаки мы проверяли её работу на собственном аккаунте, чтобы убедиться в корректной отработке сценария на стороне пользователя. Такие проверки попадали в общую статистику системы и оказывали влияние на итоговые показатели. Возможность исключить подобные события из расчётов отсутствует. Согласно комментариям вендора, для этих целей следует использовать отдельный тестовый стенд. Поэтому мы вели дополнительно самостоятельный анализ результатов эксперимента.Отдельные сложности возникли на этапе обучения сотрудников. Завершить обучение в установленные сроки не удалось из-за человеческого фактора. Не все участники смогли своевременно пройти назначенные материалы, что потребовало увеличения периода обучения и дополнительного контроля за его прохождением.Впечатления от проекта команды «АМ Медиа»Проведение тестирования не вызвало негативной реакции со стороны сотрудников. Хотя фишинговые сообщения активно обсуждались внутри коллектива, жалоб руководству или недовольства вида «зачем вообще было устраивать такую проверку» не возникло. Основной интерес был сосредоточен вокруг самих писем и попыток понять, что именно происходит.Реакция сотрудниковОдним из самых любопытных наблюдений стала реакция сотрудников после первой волны первичного тестирования. Полученные фишинговые сообщения быстро стали предметом обсуждения: сотрудники пересылали их друг другу, задавали вопросы коллегам и пытались разобраться, что происходит.Некоторые пошли ещё дальше и вступали в переписку с отправителем, воспринимая фишинговые письма как реальные рабочие сообщения. Это наглядно показало не только убедительность используемых сценариев, но и то, что практическое столкновение с угрозой вовлекает сотрудников в тему ИБ гораздо сильнее, чем абстрактные примеры из учебных материалов. Во время повторного тестирования такой реакции уже не возникло.Реакция организаторовЕсли для большинства сотрудников тестирование выглядело как неожиданно появившиеся письма в почте, то для команды, которой было поручено тестирование Phishman 2.35 этот проект сопровождался совсем другими эмоциями. Подготовка сценариев, запуск атак и ожидание результатов вызывали ощутимое волнение. Оказалось, что смотреть на ситуацию глазами злоумышленника не так просто, как может показаться со стороны. Приходилось постоянно задавать себе вопросы: какой сценарий покажется правдоподобным, что привлечёт внимание сотрудника, а что, наоборот, вызовет подозрения.Самыми напряжёнными были дни первой волны тестирования. На этом этапе ещё не было понимания, как сотрудники отреагируют на рассылки, насколько убедительными окажутся сценарии и не вызовет ли проверка негативной реакции внутри коллектива. С каждой новой зафиксированной активностью интерес смешивался с тревогой, а результаты ожидались едва ли не с большим нетерпением, чем сам запуск кампании.После завершения эксперимента стало легче: всё задуманное удалось реализовать, результаты были получены и проанализированы. Тем не менее полностью избавиться от мыслей о проделанной работе не получилось. Время от времени возвращаешься к отдельным этапам и задаёшься вопросом: а стоило ли сделать именно так? Может быть, какой-то сценарий можно было построить иначе, а какие-то решения принять по-другому?Наверное, это естественная часть любого практического проекта. Когда работа заканчивается, появляется возможность посмотреть на неё со стороны и критически оценить собственные решения. Именно в такие моменты часто приходят идеи, которые помогают сделать следующие проекты лучше.Сотрудничество с вендоромВ ходе подготовки и проведения эксперимента иногда возникали вопросы, связанные с настройкой платформы, особенностями реализации отдельных сценариев и интерпретацией результатов. Для их решения использовались как переписка, так и рабочие созвоны. Запросы обрабатывались оперативно, что позволяло своевременно получать необходимую информацию и не допускать задержек в выполнении работ. Поддержка была доступна не только в рабочее время, но и в выходные дни.ВыводыПовторное тестирование показало, что тщательно подготовленные и персонализированные фишинговые атаки значительно эффективнее. При наличии качественной разведки злоумышленники способны подобрать убедительный сценарий практически для любого сотрудника. А если специалист может ошибиться, то сотруднику, который не занимается вопросами ИБ каждый день, сделать это ещё проще.Работа в сфере информационной безопасности или информационных технологий сама по себе не защищает человека от фишинга, социальной инженерии и других современных атак. Мы убедились в этом на собственном опыте: даже профильные знания не гарантируют, что человек не попадется на хорошо продуманную атаку. Злоумышленники постоянно меняют сценарии, поэтому знания, полученные однажды, быстро устаревают.При помощи эксперимента мы не только проверили, насколько сотрудники готовы распознавать атаки, но и поняли, как с помощью Phishman 2.35 можно сделать работу по развитию киберкультуры системной. Вместо отдельных курсов появился понятный цикл: смоделировать атаку, оценить реакцию, провести обучение и проверить, изменилось ли поведение участников. При необходимости — повторить или скорректировать процесс при помощи рекомендаций платформы. Результаты фиксируются автоматически, поэтому можно видеть, какие темы требуют больше внимания, и развивать киберкультуру на основе реальных данных, а не предположений.Читать далее
    • PR55.RP55
    • santy
      RP55, есть у тебя ТГ?
×