Перейти к содержимому

Нейросети

DeepSeek переходит на чипы Huawei и учит модель на 2 трлн параметров

Основатель DeepSeek сказал сотрудникам, что компания будет активнее работать на китайских ускорителях. Первая партия новых чипов Huawei приедет в четвёртом квартале.

Иллюстрация к материалу «DeepSeek переходит на чипы Huawei и учит модель на 2 трлн параметров» — рубрика Нейросети
Содержание4 разделов

Коротко

  • По расчёту главы компании, там, где хватает пятидесяти тысяч GB300, китайских 950-х Ascend нужно вчетверо больше.
  • Сейчас в работе модель примерно на два триллиона параметров, следующая цель в четыре раза крупнее.

Пекин давно просит госкомпании пересаживаться на отечественное железо для ИИ. Частный сектор формально свободен в выборе, однако курс у него тот же. Издание The Information, а за ним тайваньская Commercial Times, пишут: Лян Вэньфэн, который основал DeepSeek и руководит ею, объявил команде, что доля железа от Huawei и прочих местных вендоров в работе компании вырастет.

Сколько ускорителей Ascend заменят карты Nvidia

Весной Лян поделился простой арифметикой. Обучение модели класса OpenAI требует порядка пятидесяти тысяч карт GB300 от Nvidia. На китайских 950-х Ascend для аналогичной задачи понадобится примерно двести тысяч штук, то есть вчетверо больше. Поэтому и оговорка: резко уйти с импортного оборудования у DeepSeek не получится.

В долгую Лян настроен оптимистично и считает, что в скорости Huawei сравняется с американцами в ближайшие годы. Мешают санкции. Без современных западных фабрик наладить выпуск ускорителей в больших объёмах сложно.

Когда в DeepSeek приедут новые чипы от Huawei

Свежую партию железа для тренировки моделей компания ждёт в последние три месяца года и окажется среди первых покупателей. Модель ускорителя в публикациях не названа. По датам совпадает версия 950DT: её выпуск Huawei обещала завершить к декабрю. На начало 2027-го намечена 960DT.

Какую нейросеть DeepSeek тренирует на китайском железе

Собеседники изданий говорят, что в работе сейчас сеть примерно на два триллиона параметров. Для сравнения, в текущей флагманской V4 их чуть меньше полутора триллионов. Следующая цель вчетверо крупнее. Получится ли, зависит от ускорителей, энергии и памяти, а всего этого игрокам в Китае сейчас недостаёт.

Что это значит для тех, кто пользуется DeepSeek

Обычному человеку тут интереснее другое: DeepSeek по-прежнему выкладывает модели в открытый доступ, их можно скачать и запустить без облака. Как такое устроить на домашнем компьютере, мы разбирали в отдельном гайде. А почему соперникам Nvidia вообще так непросто, хорошо видно из свежего прогноза Jon Peddie Research.

Пробовали нейросети DeepSeek? Сравнивали с тем, чем пользуетесь обычно?

Птичка messgo спрашивает, как вам материал

Как вам материал?

Поделиться

Читайте также

Комментарии

Написать комментарий

Без регистрации: имя и почта не нужны, мы подпишем вас случайным именем. Комментарий появится после проверки редакцией.