Китайська компанія DeepSeek планує створити великий центр обробки даних для штучного інтелекту у Внутрішній Монголії. Проєкт має забезпечити розробнику додаткові обчислювальні потужності для навчання та роботи нових ШІ-моделей. Про проєкт повідомляє Bloomberg з посиланням на поінформовані джерела.
Вартість об'єкта, кількість серверів, його обчислювальна потужність та орієнтовні терміни запуску поки що не розкриваються. Плани DeepSeek підтверджують, що компанія має намір розширювати власну інфраструктуру. У квітні вона розмістила вакансії інженера дата-центру та менеджера, який повинен відповідати за запуск проєкту, будівництво об'єкта та його введення в експлуатацію у Внутрішній Монголії.
Це стало першою публічною вказівкою компанії на розташування її обчислювального майданчика. Майбутній інженер повинен обслуговувати та оптимізувати сервери й мережеве обладнання. Серед переваг для кандидатів компанія вказала досвід експлуатації великих кластерів прискорювачів штучного інтелекту в технологічних корпораціях або дослідницьких центрах.
Внутрішня Монголія вважається привабливим регіоном для розміщення дата-центрів завдяки доступу до великих обсягів електроенергії та порівняно прохолодному клімату. Низькі температури дозволяють зменшити витрати на охолодження обладнання, яке споживає значну частину енергії обчислювальних комплексів. Будівництво власної інфраструктури може зменшити залежність DeepSeek від сторонніх постачальників хмарних потужностей.
Це особливо важливо при розробці великих мовних моделей, для навчання та щоденної роботи яких необхідні тисячі спеціалізованих процесорів. Проєкт реалізується на тлі обмежень США на постачання до Китаю найпродуктивніших прискорювачів штучного інтелекту. У лютому представник американської адміністрації заявив Reuters, що DeepSeek могла використовувати процесори Nvidia Blackwell, імовірно розміщені в дата-центрі у Внутрішній Монголії.
Компанія публічно не підтверджувала цю інформацію, а джерело Reuters не розкрило, на чому ґрунтувалася оцінка Вашингтона. DeepSeek здобула міжнародну популярність після випуску моделей, які показали високі результати при відносно невеликих заявлених витратах на навчання. При створенні DeepSeek-V3 компанія використовувала кластер із 2048 процесорів Nvidia H800 та застосувала архітектурні рішення, що дозволяють ефективніше витрачати обчислювальні ресурси.
Новий дата-центр вказує на перехід DeepSeek до більш капіталомісткої моделі розвитку. Власні обчислювальні потужності можуть дозволити компанії частіше випускати нові моделі, збільшувати їх масштаб та конкурувати з найбільшими американськими й китайськими розробниками штучного інтелекту.

