Лучшие LLM ошибаются с ядовитыми грибами в каждом девятом случае

Лучшие LLM ошибаются с ядовитыми грибами в каждом девятом случае

Лучшие LLM ошибаются с ядовитыми грибами в каждом девятом случае

Разработчик Пётр Мигдал проверил, можно ли доверить нейросети самый рискованный этап тихой охоты — определение грибов по фотографии. Короткий ответ: если очень хочется однажды поужинать дважды, то можно. В бенчмарк вошли 1040 фотографий 55 видов грибов, наиболее распространённых в Польше.

Изображения взяли из датасета FungiTastic, созданного на основе Atlas of Danish Fungi. Полная база содержит свыше 600 тыс. снимков с экспертной классификацией, а для части образцов вид подтверждён анализом ДНК.

Модели показывали каждую фотографию и просили назвать пять наиболее вероятных видов на латыни. Дополнительно их не обучали и специальные инструменты не подключали.


Лучше остальных справилась Gemini 3.8 Flash: правильный вид оказался на первом месте в 65% случаев и попал в пятёрку ответов в 85%. Немного отстали Gemini 3.6 Flash с результатами 64% и 85%, а также Gemini 3.7 Flash — 61% и 82%. Внизу таблицы расположились Qwen 3.8 27B, MiniMax-M3 и Qwen 3.8 Flash.


Но высокая точность закончилась там, где начался вопрос безопасности. Gemini 3.8 Flash и Gemini 3.6 Flash примерно в 11% случаев определяли ядовитые грибы как съедобные виды. У GPT-5.6 Sol доля опасных ошибок достигла 24%, у Claude Opus 5 — 29%, а у Qwen 3.8 27B — 36%. То есть последняя модель потенциально отправляла в корзину не тот гриб чаще чем в каждом третьем случае.

Есть важная оговорка: нейросети напрямую не спрашивали, можно ли есть находку. Они определяли вид, а затем исследователь сопоставлял ответы с таблицей съедобности. Некоторые модели и вовсе отказывались давать классификацию.

Android-смартфоны Xiaomi могут получить ИИ-защиту от мошеннических звонков

Google готовится расширить географию охоты на телефонных мошенников. В коде свежей бета-версии приложения Google Phone обнаружили признаки появления функции Scam Detection на смартфонах Xiaomi. Название китайского производителя добавили в список компаний, устройства которых могут поддерживать технологию.

Сейчас Scam Detection уже работает на смартфонах Pixel и серии Samsung Galaxy S26, а ранее упоминание функции нашли и для устройств vivo.

Scam Detection анализирует телефонный разговор с помощью ИИ непосредственно на смартфоне. Если собеседник начинает демонстрировать характерные признаки мошенничества — требует срочно перевести деньги, назвать код подтверждения или выполнить другое подозрительное действие, — система может предупредить пользователя прямо во время звонка.

Локальная обработка означает, что разговор не должен отправляться в облако ради проверки. По крайней мере, так задумано: смартфон самостоятельно слушает беседу и решает, не пахнет ли происходящее социальной инженерией.

Какие именно модели Xiaomi получат защиту, пока неизвестно. Одним из кандидатов мог бы стать складной Xiaomi 18 Fold, однако устройство пока заявлено только для китайского рынка. Вероятнее, Google начнёт с одного из глобальных флагманов бренда.

Официального анонса от Google или Xiaomi ещё не было. Упоминание обнаружили во время APK-разбора публичной бета-версии Google Phone 237.0.973536915, поэтому функция может измениться, задержаться или вообще не добраться до релиза.


Сама Scam Detection тоже остаётся бета-технологией и не всегда безошибочно распознаёт подозрительные разговоры.

RSS: Новости на портале Anti-Malware.ru