Тесты показали слабые места ChatGPT в научных заметках

Тесты показали слабые места ChatGPT в научных заметках

Тесты показали слабые места ChatGPT в научных заметках

Американская ассоциация содействия развитию науки (AAAS) решила проверить, может ли ChatGPT писать короткие научные заметки в стиле SciPak — это такие специальные брифы для журналистов, которые обычно готовит команда при журнале Science и сервисе EurekAlert.

Эксперимент длился целый год: с декабря 2023-го по декабрь 2024-го журналисты давали модели по одному–двум сложным научным исследованиям в неделю.

Задача была простая — пересказать их так, чтобы получилось удобно для коллег-журналистов: минимум терминов, чёткая структура и понятный контекст. В итоге ChatGPT обработал 64 работы.

Результат? В целом модель научилась «копировать» форму SciPak-заметки, но не дотянула по содержанию. По словам автора исследования, журналистки AAAS Абигейл Айзенштадт, тексты ChatGPT были слишком упрощёнными и часто неточными. Приходилось буквально перепроверять каждый факт, так что времени это отнимало не меньше, чем написать заметку с нуля.

 

Цифры тоже говорят сами за себя. Когда редакторов спросили, могли бы такие резюме затеряться среди настоящих SciPak-брифов, средняя оценка составила всего 2,26 балла из 5. «Увлекательность» текстов оценили ещё ниже — 2,14. И лишь одна работа за весь год получила от журналиста высший балл.

Чаще всего ChatGPT путал корреляцию и причинно-следственные связи, забывал упоминать важные ограничения исследований (например, что мягкие актуаторы работают очень медленно) и иногда слишком рассыпался в похвалах про «прорывы» и «новизну».

Авторы эксперимента подытожили: пока что ChatGPT не соответствует стандартам SciPak. Но полностью ставить крест на идее они не стали. AAAS отмечает, что к тестам можно вернуться, если модель серьёзно обновится. А в августе, напомним, как раз вышла GPT-5, в которой, к сожалению, нашли уязвимость.

Зарплаты ИБ-специалистов взлетели на 40% и достигли 400 тыс. рублей

Российские работодатели резко подняли ставки в борьбе за специалистов по информационной безопасности. В первом полугодии 2026 года среднее зарплатное предложение в отрасли достигло 115,6 тыс. рублей — на 40% больше, чем годом ранее, когда кандидатам предлагали 82,8 тыс. рублей.

По данным hh.ru, которые приводит «КоммерсантЪ», за шесть месяцев компании открыли 13,7 тыс. ИБ-вакансий.

В отдельных случаях работодатели готовы платить до 400 тыс. рублей, но для такого чека потребуются редкие компетенции и серьёзный опыт — одного умения вовремя поменять пароль недостаточно.

Наиболее востребованы специалисты по защите данных и ИТ-инфраструктуры: на них приходится 42% объявлений. Ещё 32% вакансий предназначены для руководителей в области ИБ. В пятёрку самых нужных кадров также вошли специалисты по DevSecOps и AppSec, архитекторы безопасности и разработчики защитных решений.

Особенно быстро дорожают DevSecOps- и AppSec-эксперты. За полгода предложения для них выросли на 20% и достигли 275 тыс. рублей. Бизнесу нужны люди, способные находить уязвимости ещё при разработке, а не после того, как инцидент уже попал в новости.

При этом ИТ-рынок в целом такой щедрости не показывает. Медианная зарплата ИТ-специалистов в первой половине года составила 191 тыс. рублей, увеличившись лишь на 4% к предыдущему полугодию. Компании сокращают бюджеты и осторожничают с наймом, однако на безопасности экономить получается всё хуже.

Количество ИБ-вакансий за год снизилось только на 5%, тогда как во всём ИТ-секторе падение достигло 20%. Число резюме в кибербезопасности выросло на 16%, но спрос остаётся устойчивым.

Эксперты связывают зарплатный скачок с новыми требованиями к защите критической инфраструктуры и усилением ответственности ИБ-руководителей.

RSS: Новости на портале Anti-Malware.ru