Яндекс несколько часов индексировал персональные данные в Google Docs

Яндекс несколько часов индексировал персональные данные в Google Docs

Яндекс несколько часов индексировал персональные данные в Google Docs

Пользователи сообщили, что в ночь на среду российская поисковая система «Яндекс» начала индексировать документы Google Docs, в которых, как полагают очевидцы, находились персональные данные.

Соответствующую информацию сначала публиковали отдельные каналы Telegram, а затем проверили журналисты.

Оказалось, что можно легко получить доступ к таким документам, задав область поиска docs.google.com.

Те текстовые файлы или электронные таблицы, которые удалось найти пользователям, содержали персональные данные — имена, фамилии, номера телефонов и адреса электронной почты. Если ввести в строку поиска «пароли», то можно было получить и их.

Спустя несколько часов, около 01:00 по Москве, поисковой гигант перестал индексировать чувствительную информацию.

Позже представители компании прокомментировали ситуацию следующим образом:

«”Яндекс” индексирует только открытую часть Сети — те страницы, которые доступны при переходе по ссылкам без ввода логина и пароля. Страницы, индексация которых запрещена администратором сайта в файле robots.txt, поисковая система не индексирует, даже если они находятся в открытой части интернета».

«В среду вечером в службу поддержки обратились пользователи с жалобами на проблему доступности файлов на docs.google.com. Наша служба безопасности связывается сейчас с коллегами из Google, чтобы обратить их внимание на то, что в этих файлах может оказаться приватная информация», — подытожили в пресс-службе компании.

По ту сторону ChatGPT: сотни подрядчиков читают реальные переписки

OpenAI привлекла сотни сторонних специалистов для ручного анализа диалогов пользователей с ChatGPT. Подрядчики видят реальные запросы и ответы, в которых могут встречаться личные, медицинские и другие конфиденциальные сведения.

По данным расследования 404 Media, работа проводится в рамках проекта Lily. Рецензенты кратко описывают запрос пользователя, сравнивают четыре варианта ответа модели и выставляют им оценки от одного до семи.

Отдельно они отмечают чрезмерную угодливость чат-бота, попытки очеловечить себя, неуместные эмодзи и другие особенности поведения.

Имена владельцев аккаунтов в интерфейсе скрываются, а переписки предварительно обрабатывает Privacy Filter. Однако OpenAI признала изданию, что система не всегда удаляет все персональные данные.

По утверждению журналистов, проверяющим также может показываться блок пользовательских воспоминаний с контекстом предыдущих разговоров и примерным местоположением.

Подрядчиков нанимают через внешние компании, включая Crossing Hurdles и Mercor. Некоторые специалисты получают более $50 в час. Подобный подход использует не только OpenAI: Anthropic также подтвердила 404 Media, что люди участвуют в оценке диалогов с Claude.

OpenAI официально указывает, что разговоры пользователей персональных тарифов могут применяться для улучшения моделей. Запретить использование новых чатов можно в разделе Settings → Data Controls, отключив параметр Improve the model for everyone.

Настройка действует на весь аккаунт, но не отменяет обработку данных, использованных ранее. Временные чаты не идут на обучение, хотя могут проверяться для выявления неправомерных действий.

RSS: Новости на портале Anti-Malware.ru