Сбер и Яндекс резко снизили цены на ИИ, но Китай всё равно дешевле

Сбер и Яндекс резко снизили цены на ИИ, но Китай всё равно дешевле

Сбер и Яндекс резко снизили цены на ИИ, но Китай всё равно дешевле

Российские разработчики заметно снизили стоимость генеративного ИИ. По оценке платформы Nodul, с октября 2025 года по август 2026-го цена тысячи токенов GigaChat Lite упала на 67,5% — с 0,20 до 0,065 рубля. У GigaChat Pro снижение почти такое же: с 1,50 до 0,50 рубля.

Яндекс оказался скромнее. Тысяча токенов YandexGPT Pro 5.1 стоит 0,80 рубля — на 33% меньше, чем у предыдущей версии YandexGPT 5 Pro. Тариф YandexGPT Lite не изменился и остался на уровне 0,20 рубля.

Токен — минимальная единица данных, которую обрабатывает языковая модель: слово, его часть, знак препинания или пробел. Обычно выходные токены, то есть ответ нейросети, стоят в три-четыре раза дороже входных. Российские сервисы до недавнего времени чаще устанавливали для них единую цену.

Несмотря на подешевевший отечественный ИИ, сопоставимые зарубежные модели, по подсчётам Nodul, могут обходиться до десяти раз дешевле. Особенно бодро демпингуют китайские разработчики: у DeepSeek V4 Flash тысяча входных токенов стоит около 0,0375 рубля, выходных — 0,112 рубля. Для GPT-5.4 mini показатели составляют 0,064 и 0,383 рубля, для Qwen 3.8 Max — 0,17 и 0,511 рубля соответственно.

«Сбер» и Яндекс с оценками аналитиков не согласились: компании утверждают, что на деле снизили цены ещё сильнее. Заодно разработчики считают прямое сравнение российских и зарубежных тарифов не вполне корректным — модели отличаются по качеству, условиям использования и схеме расчёта. Подробности приводит РБК.

Подпишитесь на новости

Поток ИИ-слопа вынудил arXiv ввести лимит на новые статьи

Научный конвейер притормозили: с 1 октября arXiv разрешает каждому пользователю отправлять только две новые статьи за календарный месяц. Лимит общий для всех категорий, а отклонённая работа тоже расходует попытку. Написать текст за пару минут теперь недостаточно, придётся выбирать, что отправлять.

В блоге arXiv команда объясняет решение перегрузкой. В сентябре 2026 года репозиторий получил около 40 тысяч статей — вдвое больше, чем двумя годами ранее. Число обращений к сотрудникам и модераторам за месяц приблизилось к 9 тысячам.

Одной из причин называют генеративный ИИ. Он помогает раздувать небольшой результат до полноценной статьи или нарезать одно исследование на несколько публикаций (ту самую тактику салями). Новых выводов немного, зато повторяющегося текста хоть отбавляй.


Использование нейросетей не запрещено: о существенном применении нужно сообщать модераторам, а ответственность остаётся на авторах. Лимит касается всех отправителей, независимо от того, кто набирал текст.


Мера временная, она должна дать модераторам-добровольцам передышку, пока площадка обновляет правила и инструменты. При этом arXiv не проводит полноценное научное рецензирование.

RSS: Новости на портале Anti-Malware.ru