В МФТИ подобрали работающие альтернативы GPU NVIDIA

В МФТИ подобрали работающие альтернативы GPU NVIDIA

В МФТИ подобрали работающие альтернативы GPU NVIDIA

Институт искусственного интеллекта МФТИ оценил возможности альтернативных графических процессоров (GPU) от китайских производителей. Параллельно в Физтехе был создан Центр компетенций, основной задачей которого стала помощь бизнесу в построении инфраструктуры для работы с искусственным интеллектом.

Российские компании столкнулись с увеличением сроков поставок, ограничениями на загрузку драйверов и отсутствием официальной поддержки оборудования NVIDIA, графические ускорители которой традиционно используются при построении ИИ-инфраструктуры.

В этих условиях бизнесу приходится пересматривать привычные подходы и искать альтернативные технологические решения.

Институт искусственного интеллекта МФТИ провёл комплексное исследование рынка альтернативных ускорителей, преимущественно китайского производства. В рамках работы специалисты изучали архитектурные особенности оборудования, состояние драйверов, совместимость с популярными фреймворками и поведение ускорителей под нагрузкой при выполнении различных задач — от работы с большими языковыми моделями и системами компьютерного зрения до распределённых вычислений.

По итогам испытаний наилучшие результаты показали видеокарты s4000 от Moore Threads и C500 от MetaX. Они продемонстрировали высокую производительность и стабильную работу во всех ключевых сценариях, включая длительную непрерывную нагрузку. В ряде тестов их производительность оказалась сопоставимой с NVIDIA A100, а в отдельных случаях — даже превосходила её.

«Мы оценивали скорость и воспроизводимость вычислений, устойчивость при росте нагрузки и стабильность поведения моделей на разных типах ускорителей. Эти параметры определяют пригодность систем для длительной эксплуатации. По итогам исследований мы сформировали программно-аппаратные конфигурации, обеспечивающие необходимую производительность языковых моделей на альтернативных платформах. Такой подход формирует предсказуемый жизненный цикл ИИ-решений и позволяет компаниям системно планировать эксплуатацию систем в собственных контурах», — рассказал научный директор Института искусственного интеллекта МФТИ Юрий Визильтер.

В МФТИ пообещали продолжить тестирование новых поколений ускорителей, а также подготовку практических рекомендаций по их использованию для решения типовых задач.

Потребление китайских LLM в России выросло более чем в 11 раз

Российские компании резко нарастили использование китайских больших языковых моделей. По данным MWS Cloud, за первое полугодие 2026 года бизнес израсходовал более 400 млрд токенов — в 11,3 раза больше, чем за весь 2025-й, когда показатель составлял 39,1 млрд.

Безоговорочным лидером осталось семейство Qwen. В 2025 году на него приходилось 20 млрд токенов и 51,1% потребления, а за первые шесть месяцев 2026-го — уже 261,1 млрд и 59,1%.

Второе место сохранила GLM: 91,2 млрд токенов и 20,7%. А вот DeepSeek, занимавшая годом ранее третью строчку, уступила её Kimi. Модели этого семейства набрали 81,4 млрд токенов и 18,4%. Китайская нейросетевая гонка идёт настолько бодро, что вчерашний фаворит сегодня уже ищет себя за пределами пьедестала.

Статистика основана на данных платформ MWS GPT Model Hub и MWS GPT. Их основными клиентами выступают крупные компании. Бизнес использует LLM для работы чат-ботов, персонализации рекламы, подготовки рассылок и описаний товаров, а также анализа отзывов и обращений клиентов. В общем, нейросетям поручают всё, что нужно делать круглосуточно, быстро и желательно без жалоб на понедельник.

По оценке MWS Cloud, весь российский рынок LLM в 2026 году вырастет на 35%, до 19,6 млрд рублей. Облачный сегмент, включающий доступ к моделям по SaaS и API, приблизится к 1,5 млрд рублей.

На фоне спроса MWS Cloud расширила каталог Model Hub почти вдвое — до 17 моделей. В него вошли GLM 5.2, Kimi K2.6, Qwen3.6, Gemma 4, GPT OSS, а также средства распознавания и синтеза речи и реранкеры для поисковых систем и RAG-конвейеров. Доступ предоставляется через единый OpenAI-совместимый API.

Судя по объёму токенов, российский бизнес уже не экспериментирует с китайскими LLM. Он кормит ими рабочие процессы — и аппетит растёт быстрее, чем успевает обновляться каталог моделей.

RSS: Новости на портале Anti-Malware.ru