您的 AI 基础设施不应成为瓶颈
GPU 革命已经超越了传统数据中心的设计水平。H100 和 B200 GPU 所需的功率密度突破了传统冷却的极限——而传统建设周期也跟不上 AI 创新的速度。
建设周期长达 2–3 年
传统数据中心从规划到投产需要 24–36 个月。等您的设施建成时,GPU 架构早已落后了一代。
风冷在 25kW 处撞墙
强制风冷在单机架功率超过 25kW 时,根本无法及时排出热量。NVIDIA H100 集群功率通常超过 40kW——B200 更是突破 100kW。
风冷已不再是选项。
第一块 GPU 上架前就要投入 5000 万美元以上
传统建设需要大量前期资金——土地购置、审批许可、土建工程、机电基础设施——所有这些都发生在您上架第一台服务器之前。
这会推迟投资回报,并让资金被占用数年。
还有更好的方式。⬇
Soeteck AI 基础设施平台
预制化 & 集装箱化
每一座 Soeteck AI 数据中心都在标准 ISO 集装箱内工厂预制。
95% 预组装,在工厂完成测试,然后运往全球各地。
接通电源、网络和水——计算即刻启动。
集成液冷
芯片直触冷板技术在热源处直接排热。
集成式冷却液分配单元(CDU)每个模块可处理高达 1.5MW 的热负荷。
PUE 最低可达 1.08。
高密度电力分配
从中压开关柜到智能机架 PDU——为单机架 40–120kW 而设计。
模块化锂离子 UPS、800A 母线槽、逐插座计量。
GPU 无关架构
无厂商锁定。全面支持 NVIDIA H100/H200/B200、
AMD MI300X、华为昇腾 910B/C
以及 Intel Gaudi。选择适合您工作负载与预算的 GPU。
一个平台,三种配置,无限扩展。
AI-Edge —— 边缘推理
- 集装箱:20 英尺 ISO 标准
- 电力:总计 80–200 kW
- GPU 容量:8–16 颗 GPU(L40S、A10、A100)
- 冷却:标准风冷,可选液冷
- 机架密度:最高 30 kW/机架
- PUE:1.15–1.25
- 部署周期:60–90 天
- 适用场景:边缘 AI 推理、智能制造、电信 5G 边缘、零售 AI
AI-Core —— 训练与微调
- 集装箱:40 英尺高柜 ISO 标准
- 电力:总计 300–600 kW
- GPU 容量:32–64 颗 GPU(H100、H200、B200、MI300X)
- 冷却:芯片直触液冷(集成 CDU)
- 机架密度:最高 100 kW/机架
- PUE:1.08–1.15
- 部署周期:90–120 天
- 适用场景:企业级 LLM 训练、AI 模型微调、高校科研集群
AI-Flex —— 超大规模集群
- 配置:4–20+ 个互联 40 英尺模块
- 电力:总计 2–20 MW
- GPU 容量:256–2,048+ 颗 GPU
- 冷却:集中式液冷 + 分布式 CDU,可选浸没式模块
- 机架密度:最高 120 kW/机架
- PUE:< 1.10(浸没式可达 1.03)
- 部署周期:120–180 天
- 适用场景:超大规模 AI 训练、AI 云服务商、国家级智算中心
与 GPU 同步进化的冷却方案
物理原理很简单:单位体积下,液体冷却剂的散热能力是空气的 3,000 倍以上。
每一家超大规模云厂商都在转向液冷。唯一的问题只是速度。
芯片直触冷板
芯片直触液冷是现代 AI 基础设施的中坚力量。
冷板直接安装在 GPU 和 CPU 的散热顶盖上,通过微通道翅片循环介电冷却液,在热源处直接排热。
- 冷板可带走 GPU 85–90% 的热量——风扇只需处理剩余的 10–15%
- 在标准 42U 机柜中支持高达 120 kW 的机架密度
- 采用 PG25 丙二醇冷却液——不导电、无毒、防冻保护
- 成熟技术:已部署于 Top500 超算和超大规模 AI 集群
- 可改造:现有风冷机架可在极短停机时间内升级
- 列间 CDU:300 kW/台 · 房间级 CDU:800–1,500 kW/台
- 冗余泵配置(N+1 或 2N),支持 SNMP/Modbus 远程监控
单相浸没式冷却
对于最高密度的部署场景,单相浸没式冷却将整台 GPU 服务器浸入介电流体中,
其吸热效率是空气的 1,200 倍。
- PUE 最低可达 1.03——现有最高效的冷却方式
- 消除全部服务器风扇——服务器功耗降低 10–15%
- 所有组件均匀冷却——无热点
- 静音运行——无风扇噪音
- 介电流体无腐蚀性,使用寿命 10 年以上,无需更换
- 可作为 AI-Flex 平台中的专用浸没式模块提供
风冷为何力不从心
空气的体积热容约为 1.2 kJ/m³·K,而液体冷却剂可达 3,500–4,200 kJ/m³·K——
单位体积的散热能力高出 3,000 倍以上。
- 风冷:采用热通道封闭时,单机架实际上限约为 20–25 kW
- 芯片直触液冷:单机架 60–120 kW 轻松应对
- 浸没式冷却:单机架可达 100+ kW,无需降额
- GPU 功耗走势:H100(700W)→ B200(1,000W)→ Rubin(1,500W+),趋势不言自明

为 GPU 高密度而生的电力输送
GPU 集群需要的不仅是更多电力——而是以不同的方式输送电力。
我们的集成配电链路从零开始为高密度、关键任务的 AI 工作负载而设计。
模块化 UPS
锂离子电池技术,N+1 或 2N 冗余,节能模式下效率达 98%。
单模块可从 100kW 扩展至 2MW。电池模块支持热插拔,
内置电池管理系统(BMS)。
插接式母线槽
160A–800A 架空母线槽,每 600mm 设置一个插接箱。消除地板下布线的复杂性。
插接箱支持热插拔,可在不停机的情况下新增或迁移 GPU 机架。
智能机架 PDU
逐插座电力计量(精度 ±1%)、远程插座开关、
集成环境传感器(温度、湿度、门禁)。
支持 SNMP v3 + REST API,可与 DCIM 和 BMS 平台集成。
从下单到上线——只需 120 天
设计冻结
需求确认。GPU 选型定稿。供电设计评审通过。
工厂制造 & FAT
集装箱制造完成。冷却 CDU 集成。全系统在工厂完成测试。
海运物流
港口到现场物流全程管理。报关清关由我们的全球货运合作伙伴处理。
调试上线
接通电源、网络、水。验收测试。操作员培训。计算启动。
中国智造,全球部署。
Soeteck AI 数据中心专为全球物流而设计。
它们集成于标准 ISO 集装箱内,借助现有货运基础设施运输——集装箱船、平板卡车和货机。
每台设备在离开工厂前都经过完整的工厂验收测试(FAT)。
抵达您的现场时,即可调试投用——无需现场组装。
- ISO 668 标准集装箱外形——兼容全球航运
- 标准 40 英尺单元:12.2m × 2.44m × 2.9m(长×宽×高)
- 重量:满载 18–25 吨(在标准吊装能力范围内)
- 海运:30–45 天(亚洲 → 中东 / 欧洲 / 非洲)
- 紧急部署可提供空运
- 现场调试团队随设备同行或提前到达
- 发货前即启用远程监控
深受全球企业、政府和电信运营商信赖
卡塔尔 GRD
定制集装箱式数据中心,在中东气候条件下实现 24/7 稳定运行。
埃及政府
工厂审核及政府数据中心现代化改造重大数字基础设施项目。
沙特电信
移动 OLT 集装箱式数据中心解决方案,助力 5G 基础设施快速部署。
WebSat Media
数据中心冷却基础设施优化,显著提升效率与可靠性。
AI 数据中心——常见问题
我们的芯片直触液冷集装箱支持高达 120 kW/机架。
浸没式冷却模块支持 100+ kW/机架且无需降额。
针对较轻负载,还提供最高 25 kW/机架的风冷配置。
我们的基础设施在设计上与 GPU 无关。支持
NVIDIA H100、H200、B200(NVL72)、AMD MI300X、华为昇腾 910B/C 以及
Intel Gaudi 3。电源架和冷板安装套件可根据您选择的 GPU 平台定制。
标准配置(最高 5 MW)从下单到调试投用仅需 90–120 天。
定制配置和超大规模 AI-Flex 部署可能需要 120–180 天。
而传统数据中心建设通常需要 24–36 个月。
我们采用纵深防御方案:(1)负压冷却液回路(发生任何泄漏时液体被抽回系统)、
(2)沿所有管路的绳式泄漏检测电缆、
(3)所有连接点下方的不锈钢接液盘、
(4)带自动切断阀的 24/7 电导率传感器、
(5)不导电的 PG25 丙二醇冷却液,接触时不会损坏电子设备。
芯片直触液冷:PUE 1.08–1.15,视气候而定。
浸没式冷却:PUE 最低可达 1.03。
两个数值均假设在气候允许的地区采用干冷器实现自然冷却。
可以。我们的集装箱可在 -40°C 至 +55°C(-40°F 至 +131°F)的环境温度下运行。
我们已在中东沙漠环境(沙特阿拉伯、卡塔尔、埃及)和热带岛屿环境(瓦努阿图)中成功部署。
每次部署都包含针对当地气候的冷却配置。
提供。我们的全球调试团队会前往您的现场,负责安装监督、系统启动、
验收测试和操作员培训。我们还提供可选的年度维护合同,
包括远程监控(24/7 NOC)、预防性维护巡检和应急响应 SLA。



发表回复