DeepSeek расширит вычислительные мощности новым дата-центром в Китае
Китайская компания DeepSeek планирует создать крупный центр обработки данных для искусственного интеллекта во Внутренней Монголии. Проект должен обеспечить разработчику дополнительные вычислительные мощности для обучения и работы новых ИИ-моделей.
О проекте сообщает Bloomberg со ссылкой на осведомлённые источники. Стоимость объекта, количество серверов, его вычислительная мощность и предполагаемые сроки запуска пока не раскрываются.
Планы DeepSeek подтверждают, что компания намерена расширять собственную инфраструктуру. В апреле она разместила вакансии инженера дата-центра и менеджера, который должен отвечать за запуск проекта, строительство объекта и его ввод в эксплуатацию во Внутренней Монголии. Это стало первым публичным указанием компании на расположение её вычислительной площадки.
Будущий инженер должен обслуживать и оптимизировать серверы и сетевое оборудование. Среди преимуществ для кандидатов компания указала опыт эксплуатации крупных кластеров ускорителей искусственного интеллекта в технологических корпорациях или исследовательских центрах.
Внутренняя Монголия считается привлекательным регионом для размещения дата-центров благодаря доступу к большим объёмам электроэнергии и сравнительно прохладному климату. Низкие температуры позволяют уменьшить расходы на охлаждение оборудования, которое потребляет значительную часть энергии вычислительных комплексов.
Строительство собственной инфраструктуры может снизить зависимость DeepSeek от сторонних поставщиков облачных мощностей. Это особенно важно при разработке крупных языковых моделей, для обучения и ежедневной работы которых необходимы тысячи специализированных процессоров.
Проект реализуется на фоне ограничений США на поставки в Китай наиболее производительных ускорителей искусственного интеллекта. В феврале представитель американской администрации заявил Reuters, что DeepSeek могла использовать процессоры Nvidia Blackwell, предположительно размещённые в дата-центре во Внутренней Монголии. Компания публично не подтверждала эту информацию, а источник Reuters не раскрыл, на чём основывалась оценка Вашингтона.
DeepSeek получила международную известность после выпуска моделей, которые показали высокие результаты при относительно небольших заявленных затратах на обучение. При создании DeepSeek-V3 компания использовала кластер из 2048 процессоров Nvidia H800 и применила архитектурные решения, позволяющие эффективнее расходовать вычислительные ресурсы.
Новый дата-центр указывает на переход DeepSeek к более капиталоёмкой модели развития. Собственные вычислительные мощности могут позволить компании чаще выпускать новые модели, увеличивать их масштаб и конкурировать с крупнейшими американскими и китайскими разработчиками искусственного интеллекта.