人工智能数据中心基础设施

AI 数据中心基础设施 —
专为GPU时代打造

从边缘推理到超大规模 GPU 集群——预制、液冷、 全球发货,并在 120天.

配备液冷GPU机架的40英尺集装箱式AI数据中心——3D等角渲染图展示了内部剖面,可见蓝色冷却液管道和服务器机架

您的 AI 基础设施不应成为瓶颈

GPU革命的发展速度已超越了传统数据中心的设计能力。 H100和B200 GPU所需的功率密度已突破了传统散热的极限—— 而建设周期也无法跟上人工智能创新的速度。.

🏗️

建设周期为2–3年

传统数据中心从规划到投入运行通常需要 24 至 36 个月。 等到设施准备就绪时,您的 GPU 架构可能已经落后一代了。.

🌡️

25kW时,风冷技术遭遇瓶颈

当单机架功耗超过 25kW 时,强制风冷根本无法以足够快的速度散热。 NVIDIA H100 集群的功耗通常超过 40kW,而 B200 甚至突破了 100kW。. 空气冷却已不再是一种选择。.

💰

$50M+ 第一代GPU问世之前

传统建设模式需要巨额前期投入——包括土地收购、 许可证办理、土建工程、机电基础设施建设——而这一切都必须在部署第一台服务器之前完成。 这不仅延迟了投资回报,还会使资金被占用数年之久。.

还有更好的方法。⬇

Soeteck 人工智能基础设施平台

📦

预制与集装箱式

每座 Soeteck AI 数据中心均在标准 ISO 集装箱内工厂预制而成。 95% 机型在工厂完成预装和测试后,即可运往全球各地。 接通电源、网络和水源——计算即刻启动。.

❄️

集成液冷系统

直接芯片冷板技术可在热源处直接散热。 集成式冷却液分配单元(CDU)可处理 每个模块高达1.5MW的热负荷。. PUE 低至 1.08。.

高密度配电

从中压开关柜到智能机架式PDU——专为 每机架40–120kW而设计。模块化锂离子UPS、800A母线槽、每个插座独立计量。.

🔌

与GPU无关的架构

无供应商锁定。全面支持 NVIDIA H100/H200/B200, AMD MI300X, 华为 Ascend 910B/C, 以及英特尔Gaudi。请根据您的工作负载和预算选择合适的GPU。.

一个平台。三种配置。无限扩展。.

AI-Edge:用于边缘AI推理的20英尺集装箱式数据中心,功率80-200千瓦

AI-Edge — 边缘推理

  • 容器: 20英尺ISO标准
  • 功率: 总计 80–200 千瓦
  • GPU 容量: 8–16 个 GPU(L40S、A10、A100)
  • 冷却: 标配风冷,可选液冷
  • 机架密度: 每机架最高30千瓦
  • PUE: 1.15–1.25
  • 部署: 60–90天
  • 最适合 边缘AI推理、智能制造、电信5G边缘计算、零售AI
了解 AI-Edge →
AI-Core:用于GPU训练的40英尺集装箱式AI数据中心,功率300-600千瓦,液冷式

AI-Core — 训练与微调

  • 容器: 40英尺高箱 ISO标准
  • 功率: 总计 300–600 千瓦
  • GPU 容量: 32–64 个 GPU(H100、H200、B200、MI300X)
  • 冷却: 芯片直冷(集成CDU)
  • 机架密度: 每机架最高可达100千瓦
  • PUE: 1.08–1.15
  • 部署: 90–120天
  • 最适合 企业级大型语言模型(LLM)训练、AI模型微调、高校研究集群
了解 AI-Core →
AI-Flex:由8个相互连接的40英尺集装箱组成的模块化AI数据中心园区,可支持功率高达20兆瓦的超大规模GPU集群

AI-Flex — 超大规模集群

  • 配置: 4–20+个相互连接的40英尺模块
  • 功率: 总计 2–20 兆瓦
  • GPU 容量: 256–2,048+ 个 GPU
  • 冷却: 采用分布式CDU的集中式液冷系统 + 可选浸没式冷却模块
  • 机架密度: 每机架最高可达 120 千瓦
  • PUE: < 1.10(浸没时为 1.03)
  • 部署: 120–180天
  • 最适合 超大规模人工智能训练、人工智能云服务提供商、国家人工智能计算中心
了解 AI-Flex →

与GPU同步发展的散热技术

其物理原理很简单:液体冷却剂的单位体积散热能力比空气高出3,000倍以上。 每一家超大规模数据中心运营商都在向液体冷却转型。唯一的问题是转型速度有多快。.

直接连接芯片的冷板

直接芯片液冷是现代人工智能基础设施的中流砥柱。 冷板直接安装在 GPU 和 CPU 的散热片上,通过微通道鳍片循环 介电冷却液,从而在热源处进行散热。.

  • 在冷板处带走 85–90% 的 GPU 热量——风扇负责处理剩余的 10–15%
  • 支持最高达 120 千瓦 安装在标准的 42U 机柜中
  • 采用 PG25 丙二醇冷却液——不导电、无毒、防冻
  • 成熟技术:已应用于全球Top500超级计算机和超大规模AI集群
  • 可升级:现有风冷机架可在几乎不影响正常运行的情况下进行升级
  • 行级CDU:300千瓦/台 · 房间级CDU:800–1,500千瓦/台
  • 具有 SNMP/Modbus 远程监控功能的冗余泵配置(N+1 或 2N)

单相浸入式冷却

对于最高密度的部署,单相浸没冷却技术将 整个GPU服务器浸没在一种介电液体中,其吸热效率 比空气高出1,200倍。.

  • PUE 低至 1.03 — 目前最有效的冷却方法
  • 彻底淘汰所有服务器风扇——将服务器功耗降低10–15%
  • 所有组件均受均匀冷却——无热点
  • 静音运行——无风扇噪音
  • 介电液不具腐蚀性,使用寿命超过10年,无需更换
  • 作为AI-Flex平台中的专用沉浸式模块提供

为什么空气冷却效果不佳

空气的比热容约为 1.2 kJ/m³·K。液体冷却剂的比热容为 3,500–4,200 kJ/m³·K——单位体积的散热能力超过空气的 3,000 倍。.

  • 空气冷却:实用的天花板在 20–25 千瓦 每机架(带热通道封闭系统)
  • 直接喷射到芯片上的液体:在 60–120 千瓦 每机架
  • 浸没式冷却:能够 100+ 千瓦 每机架,无降额
  • GPU功耗演变轨迹:H100(700W)→ B200(1,000W)→ Rubin(1,500W+),这让决策变得一目了然
GPU处理器上直接接触芯片的液体冷却冷板的剖面技术图,附冷却液流动可视化效果 三种数据中心冷却方式的对比信息图:风冷 20-25kW、冷板液冷 60-120kW、浸没式冷却 100+kW

专为 GPU 密度设计的供电方案

GPU 集群不仅需要更大的功率,还需要以不同的方式供电。 我们的集成式配电链从零开始设计,专为 高密度、关键任务型 AI 工作负载而打造。.

AI数据中心配电流程:中压开关柜 → 变压器 → 低压配电盘 → 800A母线槽 → 机架PDU → GPU服务器

模块化 UPS

锂离子电池技术,N+1或2N冗余设计,节能模式下效率达98%。 单个模块功率可在100kW至2MW之间灵活扩展。电池模块支持热插拔,并 集成电池管理系统(BMS)。.

插接式母线槽

160A–800A 架空母线槽,每 600 毫米设置一个分接箱。消除了 地板下布线的复杂性。热插拔式分接设计允许在无需停机的情况下 添加或重新部署 GPU 机架。.

智能机架式PDU

每个插座的功率计量(精度为±1%)、远程插座控制、 集成环境传感器(温度、湿度、门磁)。 支持 SNMP v3 + REST API,可与 DCIM 和 BMS 平台集成。.

从订单到上线——仅用120天

第1个月

设计冻结

需求已确认。GPU选型已确定。电源设计已获批准。.

第2个月

工厂组装与工厂验收测试(FAT)

集装箱已制造完成。冷却中央处理单元(CDU)已集成。整个系统已在我们工厂完成测试。.

第3个月

海运

负责港口到目的地的物流管理。清关事宜由我们的全球货运合作伙伴负责办理。.

第4个月

委托与上线

接通电源、网络和水源。验收测试。操作员培训。计算系统启动。.

传统直流电路结构
24–36个月
Soeteck AI 数据中心部署
90–120天

中国制造。全球部署。.

Soeteck AI 数据中心专为全球物流而设计。 这些数据中心建在标准的 ISO 集装箱内,可借助现有的 货运基础设施——集装箱船、平板卡车和货运飞机——进行运输。.

每台设备都要经过 完整的工厂验收测试(FAT) 在 离开我方工厂之前。当设备运抵贵方现场时,即可直接投入运行——无需组装。.

  • 符合 ISO 668 标准的集装箱尺寸规格——适用于全球运输
  • 标准40英尺集装箱:12.2米 × 2.44米 × 2.9米(长×宽×高)
  • 重量:满载时18–25吨(在标准起重机限值范围内)
  • 海运:30–45天(亚洲 → 中东/欧洲/非洲)
  • 可提供空运服务,以满足紧急部署需求
  • 现场调试团队随设备一同前往,或先行抵达
  • 发货前已启用远程监控
🇸🇦 沙特阿拉伯 🇶🇦 卡塔尔 🇪🇬 埃及 🇳🇵 尼泊尔 🇻🇺 瓦努阿图 🇫🇷 法国
世界地图,展示了Soeteck AI在沙特阿拉伯、卡塔尔、埃及、尼泊尔、瓦努阿图和法国的数据中心部署情况,并标注了全球运输路线

深受全球企业、政府及电信运营商的信赖

AI 数据中心 — 常见问题解答

我们的直接芯片液冷容器最高支持 每机架120千瓦. 浸没式冷却模块支持每机架100+ kW的功率,且无需降额。 针对较轻的工作负载,可提供每机架最高25 kW的风冷配置。.

我们的基础设施是 与GPU无关 按设计。 我们支持 NVIDIA H100、H200、B200(NVL72)、AMD MI300X、华为 Ascend 910B/C 以及 英特尔 Gaudi 3。散热模块和冷板安装套件均可根据 您选择的 GPU 平台进行定制。.

90–120天 标准配置从下单到投入运行 最多5兆瓦。定制配置和超大规模AI-Flex部署可能需要 120–180天。相比之下,传统数据中心的建设周期为24–36个月。.

我们采取了多层次防御策略: (1) 负压 冷却液回路(一旦发生泄漏,流体就会被吸回系统),, (2) 沿所有管线铺设绳状泄漏检测电缆,, (3) 所有连接处下方均设有不锈钢滴水盘,, (4) 配备自动关闭阀的24/7全天候监测电导率传感器,, (5) 不导电的 PG25 丙二醇冷却液, 即使接触电子设备也不会造成损坏。.

芯片直冷液冷技术: PUE 为 1.08–1.15,具体数值取决于气候条件。. 浸没冷却: PUE 低至 1.03。这两个数值均假设在气候条件允许的情况下, 采用干式冷却器进行自然冷却。.

是的。我们的集装箱适用于环境温度范围为 -40°C 至 +55°C (-40°F 至 +131°F)。我们已在中东沙漠环境(沙特阿拉伯、卡塔尔、埃及) 和热带岛屿环境(瓦努阿图)成功部署了该系统。每次部署均包含 针对特定气候条件的冷却配置。.

是的。我们的 全球调试团队 将派专人前往贵方现场, 负责安装监督、系统调试、验收测试及操作人员培训。 我们还提供可选的年度维护合同,内容包括远程监控 (24/7 网络运营中心)、预防性维护访问以及应急响应服务水平协议(SLA)。.

准备好为您的AI基础设施提供动力了吗?

请告诉我们您的 AI 工作负载情况。我们将为您设计基础设施。 120 天内交付。全球任意地点均可。.