Search

AI Data Center Infrastructure – 中文



AI 数据中心基础设施

AI 数据中心基础设施——
为 GPU 时代而生

从边缘推理到超大规模 GPU 集群——预制化、液冷、全球交付,120 天内即可投入运营。


40 英尺集装箱式 AI 数据中心,配备液冷 GPU 机架——3D 等距渲染图,展示内部剖面:蓝色冷却液管道与服务器排布



您的 AI 基础设施不应成为瓶颈

GPU 革命已经超越了传统数据中心的设计水平。H100 和 B200 GPU 所需的功率密度突破了传统冷却的极限——而传统建设周期也跟不上 AI 创新的速度。

🏗️

建设周期长达 2–3 年

传统数据中心从规划到投产需要 24–36 个月。等您的设施建成时,GPU 架构早已落后了一代。

🌡️

风冷在 25kW 处撞墙

强制风冷在单机架功率超过 25kW 时,根本无法及时排出热量。NVIDIA H100 集群功率通常超过 40kW——B200 更是突破 100kW。
风冷已不再是选项。

💰

第一块 GPU 上架前就要投入 5000 万美元以上

传统建设需要大量前期资金——土地购置、审批许可、土建工程、机电基础设施——所有这些都发生在您上架第一台服务器之前。
这会推迟投资回报,并让资金被占用数年。

还有更好的方式。⬇



Soeteck AI 基础设施平台

📦

预制化 & 集装箱化

每一座 Soeteck AI 数据中心都在标准 ISO 集装箱内工厂预制。
95% 预组装,在工厂完成测试,然后运往全球各地。
接通电源、网络和水——计算即刻启动。

❄️

集成液冷

芯片直触冷板技术在热源处直接排热。
集成式冷却液分配单元(CDU)每个模块可处理高达 1.5MW 的热负荷。
PUE 最低可达 1.08。

高密度电力分配

从中压开关柜到智能机架 PDU——为单机架 40–120kW 而设计。
模块化锂离子 UPS、800A 母线槽、逐插座计量。

🔌

GPU 无关架构

无厂商锁定。全面支持 NVIDIA H100/H200/B200
AMD MI300X华为昇腾 910B/C
以及 Intel Gaudi。选择适合您工作负载与预算的 GPU。



一个平台,三种配置,无限扩展。


AI-Edge:20 英尺集装箱式数据中心,面向边缘 AI 推理,80–200kW

AI-Edge —— 边缘推理

  • 集装箱:20 英尺 ISO 标准
  • 电力:总计 80–200 kW
  • GPU 容量:8–16 颗 GPU(L40S、A10、A100)
  • 冷却:标准风冷,可选液冷
  • 机架密度:最高 30 kW/机架
  • PUE:1.15–1.25
  • 部署周期:60–90 天
  • 适用场景:边缘 AI 推理、智能制造、电信 5G 边缘、零售 AI

咨询 AI-Edge →


AI-Core:40 英尺集装箱式 AI 数据中心,面向 GPU 训练,300–600kW,液冷

AI-Core —— 训练与微调

  • 集装箱:40 英尺高柜 ISO 标准
  • 电力:总计 300–600 kW
  • GPU 容量:32–64 颗 GPU(H100、H200、B200、MI300X)
  • 冷却:芯片直触液冷(集成 CDU)
  • 机架密度:最高 100 kW/机架
  • PUE:1.08–1.15
  • 部署周期:90–120 天
  • 适用场景:企业级 LLM 训练、AI 模型微调、高校科研集群

咨询 AI-Core →


AI-Flex:模块化 AI 数据中心园区,由 8 个互联的 40 英尺集装箱组成,支持高达 20MW 的超大规模 GPU 集群

AI-Flex —— 超大规模集群

  • 配置:4–20+ 个互联 40 英尺模块
  • 电力:总计 2–20 MW
  • GPU 容量:256–2,048+ 颗 GPU
  • 冷却:集中式液冷 + 分布式 CDU,可选浸没式模块
  • 机架密度:最高 120 kW/机架
  • PUE:< 1.10(浸没式可达 1.03)
  • 部署周期:120–180 天
  • 适用场景:超大规模 AI 训练、AI 云服务商、国家级智算中心

咨询 AI-Flex →



与 GPU 同步进化的冷却方案

物理原理很简单:单位体积下,液体冷却剂的散热能力是空气的 3,000 倍以上。
每一家超大规模云厂商都在转向液冷。唯一的问题只是速度。



芯片直触冷板

芯片直触液冷是现代 AI 基础设施的中坚力量。
冷板直接安装在 GPU 和 CPU 的散热顶盖上,通过微通道翅片循环介电冷却液,在热源处直接排热。

  • 冷板可带走 GPU 85–90% 的热量——风扇只需处理剩余的 10–15%
  • 在标准 42U 机柜中支持高达 120 kW 的机架密度
  • 采用 PG25 丙二醇冷却液——不导电、无毒、防冻保护
  • 成熟技术:已部署于 Top500 超算和超大规模 AI 集群
  • 可改造:现有风冷机架可在极短停机时间内升级
  • 列间 CDU:300 kW/台 · 房间级 CDU:800–1,500 kW/台
  • 冗余泵配置(N+1 或 2N),支持 SNMP/Modbus 远程监控

单相浸没式冷却

对于最高密度的部署场景,单相浸没式冷却将整台 GPU 服务器浸入介电流体中,
其吸热效率是空气的 1,200 倍。

  • PUE 最低可达 1.03——现有最高效的冷却方式
  • 消除全部服务器风扇——服务器功耗降低 10–15%
  • 所有组件均匀冷却——无热点
  • 静音运行——无风扇噪音
  • 介电流体无腐蚀性,使用寿命 10 年以上,无需更换
  • 可作为 AI-Flex 平台中的专用浸没式模块提供

风冷为何力不从心

空气的体积热容约为 1.2 kJ/m³·K,而液体冷却剂可达 3,500–4,200 kJ/m³·K——
单位体积的散热能力高出 3,000 倍以上。

  • 风冷:采用热通道封闭时,单机架实际上限约为 20–25 kW
  • 芯片直触液冷:单机架 60–120 kW 轻松应对
  • 浸没式冷却:单机架可达 100+ kW,无需降额
  • GPU 功耗走势:H100(700W)→ B200(1,000W)→ Rubin(1,500W+),趋势不言自明


GPU 处理器上芯片直触液冷冷板的技术剖面图,带冷却液流动示意

三种数据中心冷却方式对比信息图:风冷 20–25kW、冷板液冷 60–120kW、浸没式 100+kW



为 GPU 高密度而生的电力输送

GPU 集群需要的不仅是更多电力——而是以不同的方式输送电力。
我们的集成配电链路从零开始为高密度、关键任务的 AI 工作负载而设计。

AI 数据中心配电流程:中压开关柜 → 变压器 → 低压配电柜 → 800A 母线槽 → 机架 PDU → GPU 服务器

模块化 UPS

锂离子电池技术,N+1 或 2N 冗余,节能模式下效率达 98%。
单模块可从 100kW 扩展至 2MW。电池模块支持热插拔,
内置电池管理系统(BMS)。

插接式母线槽

160A–800A 架空母线槽,每 600mm 设置一个插接箱。消除地板下布线的复杂性。
插接箱支持热插拔,可在不停机的情况下新增或迁移 GPU 机架。

智能机架 PDU

逐插座电力计量(精度 ±1%)、远程插座开关、
集成环境传感器(温度、湿度、门禁)。
支持 SNMP v3 + REST API,可与 DCIM 和 BMS 平台集成。



从下单到上线——只需 120 天

第 1 个月

设计冻结

需求确认。GPU 选型定稿。供电设计评审通过。

第 2 个月

工厂制造 & FAT

集装箱制造完成。冷却 CDU 集成。全系统在工厂完成测试。

第 3 个月

海运物流

港口到现场物流全程管理。报关清关由我们的全球货运合作伙伴处理。

第 4 个月

调试上线

接通电源、网络、水。验收测试。操作员培训。计算启动。

传统数据中心建设

24–36 个月

Soeteck AI 数据中心部署

90–120 天



中国智造,全球部署。

Soeteck AI 数据中心专为全球物流而设计。
它们集成于标准 ISO 集装箱内,借助现有货运基础设施运输——集装箱船、平板卡车和货机。

每台设备在离开工厂前都经过完整的工厂验收测试(FAT)
抵达您的现场时,即可调试投用——无需现场组装。

  • ISO 668 标准集装箱外形——兼容全球航运
  • 标准 40 英尺单元:12.2m × 2.44m × 2.9m(长×宽×高)
  • 重量:满载 18–25 吨(在标准吊装能力范围内)
  • 海运:30–45 天(亚洲 → 中东 / 欧洲 / 非洲)
  • 紧急部署可提供空运
  • 现场调试团队随设备同行或提前到达
  • 发货前即启用远程监控
🇸🇦 沙特阿拉伯
🇶🇦 卡塔尔
🇪🇬 埃及
🇳🇵 尼泊尔
🇻🇺 瓦努阿图
🇫🇷 法国


世界地图,展示 Soeteck AI 数据中心在沙特阿拉伯、卡塔尔、埃及、尼泊尔、瓦努阿图和法国的部署情况以及全球运输航线





AI 数据中心——常见问题

我们的芯片直触液冷集装箱支持高达 120 kW/机架
浸没式冷却模块支持 100+ kW/机架且无需降额。
针对较轻负载,还提供最高 25 kW/机架的风冷配置。

我们的基础设施在设计上与 GPU 无关。支持
NVIDIA H100、H200、B200(NVL72)、AMD MI300X、华为昇腾 910B/C 以及
Intel Gaudi 3。电源架和冷板安装套件可根据您选择的 GPU 平台定制。

标准配置(最高 5 MW)从下单到调试投用仅需 90–120 天
定制配置和超大规模 AI-Flex 部署可能需要 120–180 天。
而传统数据中心建设通常需要 24–36 个月。

我们采用纵深防御方案:(1)负压冷却液回路(发生任何泄漏时液体被抽回系统)、
(2)沿所有管路的绳式泄漏检测电缆、
(3)所有连接点下方的不锈钢接液盘、
(4)带自动切断阀的 24/7 电导率传感器、
(5)不导电的 PG25 丙二醇冷却液,接触时不会损坏电子设备。

芯片直触液冷:PUE 1.08–1.15,视气候而定。
浸没式冷却:PUE 最低可达 1.03。
两个数值均假设在气候允许的地区采用干冷器实现自然冷却。

可以。我们的集装箱可在 -40°C 至 +55°C(-40°F 至 +131°F)的环境温度下运行。
我们已在中东沙漠环境(沙特阿拉伯、卡塔尔、埃及)和热带岛屿环境(瓦努阿图)中成功部署。
每次部署都包含针对当地气候的冷却配置。

提供。我们的全球调试团队会前往您的现场,负责安装监督、系统启动、
验收测试和操作员培训。我们还提供可选的年度维护合同,
包括远程监控(24/7 NOC)、预防性维护巡检和应急响应 SLA。



准备好为您的 AI 基础设施供能了吗?

告诉我们您的 AI 工作负载,我们来设计基础设施。
120 天内交付,覆盖全球任何角落。


发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注