От периферийных вычислений до гипермасштабных кластеров на базе графических процессоров — готовые к установке, с жидкостным охлаждением, поставляемые по всему миру и готовые к эксплуатации в 120 дней.
Революция в области графических процессоров опередила традиционные подходы к проектированию центров обработки данных. Графические процессоры H100 и B200 требуют такой плотности мощности, которая выходит за рамки традиционных ограничений систем охлаждения, — а сроки строительства не успевают за темпами инноваций в области искусственного интеллекта.
Создание традиционных центров обработки данных занимает 24–36 месяцев — от этапа планирования до ввода в эксплуатацию. К моменту, когда ваш центр будет готов, архитектура ваших графических процессоров уже отстанет на одно поколение.
Принудительное воздушное охлаждение просто не способно отводить тепло достаточно быстро при нагрузке свыше 25 кВт на стойку. Кластеры NVIDIA H100 регулярно превышают 40 кВт, а B200 — даже 100 кВт. Воздушное охлаждение больше не является вариантом.
Традиционное строительство требует огромных первоначальных капиталовложений — приобретение земельного участка, получение разрешений, проведение строительно-монтажных работ, создание инженерных сетей — и все это до того, как будет установлен хотя бы один сервер. Это задерживает окупаемость инвестиций и на годы замораживает капитал.
Есть способ получше. ⬇
Каждый центр обработки данных Soeteck AI изготавливается на заводе в стандартных транспортных контейнерах по стандарту ISO. Модель 95% собирается на заводе, проходит тестирование, а затем отправляется по всему миру. Достаточно подключить питание, сеть и водоснабжение — и система готова к работе.
Технология «холодной пластины» с прямым контактом с микросхемой обеспечивает отвод тепла непосредственно у источника. Встроенные блоки распределения охлаждающей жидкости (CDU) способны справляться с тепловой нагрузкой до 1,5 МВт на каждый модуль. Коэффициент PUE — всего 1,08.
От распределительных устройств среднего напряжения до интеллектуальных PDU для стоек — рассчитанных на 40–120 кВт на стойку. Модульные литий-ионные ИБП, шинопровод на 800 А, измерение потребления на каждом розетке.
Отсутствие привязки к конкретному поставщику. Полная поддержка NVIDIA H100/H200/B200, AMD MI300X, Huawei Ascend 910B/C, а также Intel Gaudi. Выберите графический процессор, который подходит для ваших задач и бюджета.
Физика здесь проста: жидкие теплоносители обеспечивают более чем в 3 000 раз большую теплоотдачу на единицу объёма, чем воздух. Все гипермасштабируемые компании переходят на жидкостное охлаждение. Вопрос лишь в том, как быстро.
Система жидкостного охлаждения «Direct-to-chip» является основой современной инфраструктуры искусственного интеллекта. Холодные пластины устанавливаются непосредственно на радиаторы графических и центральных процессоров, обеспечивая циркуляцию диэлектрического охлаждающего вещества через микроканальные ребра для отвода тепла непосредственно у источника.
В системах с максимальной плотностью размещения в рамках однофазного погружного охлаждения целые серверы с графическими процессорами погружаются в диэлектрическую жидкость, которая поглощает тепло в 1 200 раз эффективнее, чем воздух.
Объёмная теплоемкость воздуха составляет ~1,2 кДж/м³·К. Жидкие теплоносители обладают теплоемкостью 3 500–4 200 кДж/м³·К — это более чем в 3 000 раз превышает способность отводить тепло на единицу объёма.
Графическим кластерам требуется не просто больше энергии — им нужен иной подход к её подаче. Наша интегрированная цепочка распределения энергии с самого начала разработана специально для высокоплотных, критически важных ИИ-рабочих нагрузок.
Литий-ионные аккумуляторы, резервирование по схеме N+1 или 2N, КПД 98% в эко-режиме. Масштабируемость от 100 кВт до 2 МВт на модуль. Аккумуляторные модули с возможностью «горячей» замены и встроенной системой управления аккумуляторной батареей (BMS).
Надпотолочная шинопроводная система на 160–800 А с отводными коробками через каждые 600 мм. Исключает сложности, связанные с прокладкой кабелей под полом. Отводы с возможностью «горячей» замены позволяют добавлять или перемещать стойки с графическими процессорами без остановки работы системы.
Измерение потребляемой мощности на каждом розетке (точность ±1%), дистанционное управление розетками, встроенные датчики окружающей среды (температура, влажность, контакт двери). SNMP v3 + REST API для интеграции с платформами DCIM и BMS.
Требования подтверждены. Выбор графического процессора окончательно утвержден. Проект системы питания одобрен.
Контейнер изготовлен. Встроенный охлаждающий агрегат. Система в полном объеме прошла испытания на нашем заводе.
Обеспечивается организация логистики от порта до места назначения. Таможенное оформление осуществляется нашими международными партнёрами по грузоперевозкам.
Подключение к источнику питания, сети и водопроводу. Приемочные испытания. Обучение операторов. Запуск вычислительной системы.
Центры обработки данных Soeteck AI специально разработаны для глобальной логистики. Они размещаются в стандартных транспортных контейнерах по стандарту ISO и перемещаются по существующей грузовой инфраструктуре — на контейнеровозах, грузовиках с платформой и грузовых самолетах.
Каждая единица проходит полные заводские приемочные испытания (FAT) перед тем, как покинуть наш завод. По прибытии на ваш объект оборудование будет готово к вводу в эксплуатацию — а не к сборке.
Индивидуально разработанный контейнерный центр обработки данных, обеспечивающий стабильную работу в режиме 24/7 в климатических условиях Ближнего Востока.
Аудит предприятия и крупный проект по созданию цифровой инфраструктуры в рамках модернизации государственного центра обработки данных.
Решение для мобильного контейнерного центра обработки данных OLT, обеспечивающее быстрое развертывание инфраструктуры 5G.
Оптимизация инфраструктуры охлаждения центров обработки данных, обеспечивающая повышение эффективности и надёжности.
Наши контейнеры с жидкостным охлаждением, обеспечивающие прямой охлаждающий поток к микросхемам, поддерживают до 120 кВт на стойку. Модули с погружным охлаждением обеспечивают мощность более 100 кВт на стойку без снижения номинальной мощности. Для менее интенсивных рабочих нагрузок доступны конфигурации с воздушным охлаждением мощностью до 25 кВт на стойку.
Наша инфраструктура — это Независимый от графического процессора по замыслу. Мы поддерживаем NVIDIA H100, H200, B200 (NVL72), AMD MI300X, Huawei Ascend 910B/C и Intel Gaudi 3. Модули питания и комплекты для монтажа холодных пластин адаптируются под выбранную вами платформу графических процессоров.
90–120 дней от момента размещения заказа до ввода в эксплуатацию для стандартных конфигураций мощностью до 5 МВт. Реализация индивидуальных конфигураций и развертывание решений AI-Flex гипермасштабного уровня может занять 120–180 дней. Для сравнения: строительство традиционного центра обработки данных занимает 24–36 месяцев.
Мы применяем подход «многоуровневой защиты»: (1) контуры охлаждения с отрицательным давлением (при любом нарушении герметичности жидкость всасывается обратно в систему), (2) кабели для обнаружения утечек «веревочного» типа, проложенные вдоль всех участков трубопровода, (3) поддоны из нержавеющей стали под всеми соединениями, (4) Датчики проводимости с круглосуточным мониторингом и автоматическими запорными клапанами, (5) непроводящая охлаждающая жидкость PG25 на основе пропиленгликоля, которая при контакте не повреждает электронные компоненты.
Жидкостное охлаждение непосредственно на микросхеме: PUE 1,08–1,15 в зависимости от климатических условий. Охлаждение погружением: Показатель PUE составляет всего 1,03. Оба показателя рассчитаны с учетом использования естественного охлаждения с помощью сухих охладителей там, где это позволяет климат.
Да. Наши контейнеры рассчитаны на работу при температуре окружающей среды от от -40 °C до +55 °C (от -40°F до +131°F). Мы успешно осуществляли развертывание в пустынных условиях Ближнего Востока (Саудовская Аравия, Катар, Египет) и в условиях тропических островов (Вануату). Каждое развертывание включает конфигурации систем охлаждения, адаптированные к конкретным климатическим условиям.
Да. Наш международная команда по вводу в эксплуатацию выезд на ваш объект для контроля за установкой, запуска системы, приемочных испытаний и обучения операторов. Мы также предлагаем дополнительные годовые договоры на техническое обслуживание, включающие удаленный мониторинг (круглосуточный центр управления сетью), профилактические визиты по техническому обслуживанию и соглашения об уровне обслуживания (SLA) в случае аварийных ситуаций.
Расскажите нам о ваших задачах в области искусственного интеллекта. Мы разработаем для вас инфраструктуру. Реализация за 120 дней. В любой точке мира.