IDC 業務與選型

AIDC 什麼意思:智算中心和傳統 IDC 差在哪

AIDC 是 AI Data Center 的縮寫,中文叫人工智慧資料中心,國內更常說智算中心:專門為 GPU 等加速卡叢集提供電力、製冷和高速網路,用來訓練和執行大模型。它和傳統 IDC 一樣是資料中心,但單櫃功率常是傳統機櫃的幾倍到十幾倍,規劃方式、合同、計費和維運重點都要重新設計。

作者 頂聯產品團隊發布於 7 分鐘閱讀

AIDC 什麼意思?在資料中心行業,AIDC 是 AI Data Center 的縮寫,中文叫人工智慧資料中心,政策檔案和媒體裡更常寫作“智算中心”或“智慧計算中心”:專門為 GPU 等加速卡組成的叢集提供電力、製冷和高速網路,用來訓練大模型和執行推理服務。它仍然是資料中心,有機櫃、配電、空調和網路,只是每一項都按 GPU 的功耗和通訊方式重新設計:一個機櫃幾十 kW,需要貼近機櫃的冷源或液冷,叢集內部有專門的計算網路。傳統 IDC(Internet Data Center,網際網路資料中心)賣的是機櫃、頻寬和伺服器,客戶拿去跑網站、App 和企業系統;AIDC 賣的是成規模的算力,以及讓 GPU 能長時間滿載執行的機房條件。

AIDC 的幾種含義:先看上下文

同樣四個字母,在不同行業指不同的東西:

語境 全稱 中文 說明
資料中心、算力、大模型 AI Data Center 人工智慧資料中心、智算中心 本文討論的含義
條碼、RFID、倉儲物流 Automatic Identification and Data Capture 自動識別與資料採集 指掃碼槍、條碼印表機、RFID 讀寫器等裝置和技術,與機房無關
運營商的業務和機構名稱 一般指 AI 資料中心業務 — 例如中國電信的 AIDC 業務與分公司,見下文

“IDC 什麼意思、AIDC 什麼意思”經常被放在一起問。IDC 強調把伺服器接入網際網路、對外提供服務;AIDC 在前面加了 AI,強調為人工智慧計算而建。兩者不是替代關係:一個園區裡可以同時有傳統 IDC 機房和 AIDC 機房,同一家服務商也可以兩種都經營。

中國電信的 AIDC 公司指什麼

搜尋“中國電信 AIDC 公司”,通常是想了解運營商把智算業務單獨組織起來的動作。中國電信較早在對外材料裡使用 AIDC 這個說法,例如 2023 年釋出過智算資料中心(AIDC)基礎設施技術方案白皮書,2024 年年度報告裡也寫到了 AIDC 產品服務能力。2026 年 8 月,有行業媒體報道中國電信在政企領域新設了一家 AIDC 分公司,專門負責算力業務。這屬於媒體報道,不是官方公告,機構名稱、職責和對外合作方式,以中國電信的官方資訊為準。

對中小 IDC 來說,這類調整的含義很直接:基礎電信運營商把算力當作主營業務來做,大型訓練叢集的資源和大客戶會更多集中到運營商和大型資料中心;中小服務商更現實的位置在推理節點、分銷和維運服務上,後文“四條路”會展開。

AIDC 和傳統 IDC 的區別:從運營方的角度看

單櫃功率、網路、計費單位這些差別,租戶看得到。對機房運營方,差別更多體現在怎麼規劃、怎麼簽約、怎麼維運:

維度 傳統 IDC AIDC
規劃單位 按機櫃數規劃:建了多少個櫃、賣了多少個櫃 按供電容量規劃:有多少 MW、能放多少張卡
單櫃功率 多為 3–8 kW 20–40 kW 起,整機櫃液冷方案可達上百 kW
負載特徵 伺服器平均功耗明顯低於額定值,整櫃同時係數低 訓練時 GPU 長時間接近滿載,實際功耗貼近額定值
每櫃配電 一路或兩路單相電 多路三相電,常用列頭櫃或母線槽配電
製冷 房間級精密空調,常配合冷熱通道封閉 行級空調、背板換熱,或冷板式、浸沒式液冷,需要冷卻水和冷量分配單元(CDU)
網路佈線 每台伺服器幾個網口接櫃頂交換器,再上聯出口 8 卡訓練伺服器常見為每張 GPU 配一個高速網口接計算網路,另有儲存網和管理網,光纖密度高
客戶 數量多、單個規模小:網站、遊戲、企業、代理商 數量少、單個規模大:大模型公司、網際網路企業、科研機構、政企智算平台
合同 月付、年付,標準化套餐 多年期、整包或定製,交付標準逐項談
收入結構 機櫃、頻寬、IP、伺服器租用、增值服務 按 kW 計的電力與機位、GPU 算力租賃、叢集維運服務
主要風險 上架率低、頻寬價格下行 依賴單一大客戶、GPU 換代快、供電或冷卻故障影響面大

“負載特徵”這一行最容易被忽略。普通伺服器的電源銘牌功率遠高於日常實際功耗,傳統機房敢按平均值配電、按櫃包電銷售;GPU 訓練任務會讓整機長時間跑在額定功率附近,配電只能按額定值規劃,定價也只能按實際用電走,按平均值定價就會虧電費。

用一個機房算一筆帳:傳統機房改 AIDC 卡在哪

假設一個已經建成的機房:300 個機櫃,按每櫃 5 kW 設計,IT 總容量 1,500 kW,變壓器、UPS 和柴油發電機都按這個容量配置。現在想改成放 8 卡 GPU 訓練伺服器,每台滿載按 10 kW 估算(以廠商規格為準),給網路和儲存裝置留 10% 的容量。以下數字都是假設,用來說明方法:

專案 計算 結果
可給 GPU 伺服器的 IT 容量 1,500 kW × 90% 1,350 kW
最多能放的 GPU 伺服器 1,350 ÷ 10 135 台,共 1,080 張卡
每櫃放 3 台時的單櫃功率 3 × 10 kW 30 kW
需要的機櫃數 135 ÷ 3 45 個
機櫃位置利用率 45 ÷ 300 15%

算完會看到三個問題:

  1. 空間不是瓶頸,電才是。 1,500 kW 只夠 45 個櫃,剩下 255 個機位空著也沒有電可用。想放更多卡,只能擴容變壓器、UPS 和柴發,這是供電工程,週期和投資都遠大於更換機櫃。
  2. 配電要重做。 原來每櫃一路單相 32A(長期約 5.3 kW)就夠;30 kW 的機櫃按長期負載不超過空開額定值 80% 計,一條三相 32A 迴路約 16 kW,每一路需要兩條。如果保留 A、B 兩路、每一路都能單獨帶滿整櫃,就是每櫃四條三相 32A 迴路,列頭櫃、電纜和 PDU 都要換。
  3. 散熱跟不上。 45 個櫃各 30 kW,超出了房間級精密空調能穩定處理的範圍,要上行級空調、背板換熱或液冷;液冷還需要把冷卻水管路引進機房,樓板承重也要請結構工程師重新核算。

再看計費。同一個 30 kW 機櫃,假設電價 ¥0.8/kWh、PUE 1.3,按每月 720 小時滿載計算電費:

30 kW × 720 h = 21,600 kWh(IT 用電)
21,600 kWh × 1.3 = 28,080 kWh(含製冷與供電損耗)
28,080 kWh × ¥0.8 = ¥22,464 / 月

如果沿用“按櫃包電”的思路,給高功率櫃報一個比普通櫃高一些的固定價,例如 ¥8,000/月,每個月光電費就虧 ¥14,464。所以 AIDC 的機櫃要按 kW 報價,或者機位與電費分開、按實測電量結算:假設按 ¥1,000/kW·月包電,30 kW 機櫃月收入 ¥30,000,扣掉電費剩 ¥7,536,還要覆蓋改造投資的折舊、維運人力和冷卻系統維護。按 kW 定價的前提,是每個機櫃的實際功率能被持續計量。

訓練型和推理型 AIDC:對機房的要求不一樣

同樣叫智算,訓練和推理對機房的要求差別很大,這決定了傳統 IDC 能參與到哪一步:

對比項 訓練叢集 推理服務
規模 幾百到上萬張卡,作為一個整體排程 從一兩台 GPU 伺服器到幾十台,可以分散部署
計算網路 必須有,InfiniBand 或 RoCE,按低收斂設計 模型能在單台伺服器內跑下時不需要;超大模型做多機分散式推理時,同樣要用 RDMA 網路
負載 任務期間持續滿載 隨使用者請求波動,有明顯峰谷
對出口頻寬和延遲 不敏感,主要是上傳資料、下載模型 敏感,直接面向終端使用者
選址 電力充足、電價低的地區 靠近使用者和網路樞紐
客戶與合同 少數大客戶,長期整包 客戶多而分散,按台、按月也常見

傳統 IDC 的優勢恰好在右邊一列:離使用者近,出口頻寬和線路成熟,習慣服務分散的中小客戶。把一兩排機櫃改成 20–30 kW 的高功率區,承接推理節點和小規模微調,比整體改造成訓練叢集現實得多。

對傳統 IDC 運營者意味著什麼:四條路

路徑 做什麼 前提條件 主要風險
區域性改造高功率區 把一排或一個模組改為 20–40 kW 的機櫃,託管客戶自購的 GPU 伺服器 變壓器和 UPS 有餘量,能增加三相迴路,冷源能延伸到機櫃旁 改造投資依賴少數客戶回收,空置時成本高
GPU 伺服器租用 自購少量 GPU 伺服器,按台或按卡月租 有懂驅動、故障診斷和換件的維運,有穩定的客戶來源 單價高、換代快,出租率低時難以回本
分銷上游算力 代銷上游智算中心或雲平台的 GPU 資源,賺差價或佣金 有客戶渠道,能做售前選型和售後對接 毛利薄,資源和價格受上游控制
做配套服務 為大型 AIDC 提供駐場維運、上下架、佈線、硬體更換 有成熟的現場團隊和服務流程 人力密集,規模受團隊限制

不跟進也是一種選擇。網站、遊戲、企業系統、CDN 節點這些業務不會因為 AI 而消失,它們依然需要出口頻寬好、線路穩定、價格合理的傳統機房。判斷要不要投入,先回答四個問題:

  1. 機房的變壓器和 UPS 還有多少 kW 餘量,能否申請擴容?
  2. 有沒有冷卻水條件,或者能否在機櫃旁邊增加冷源?
  3. 現有客戶裡,有多少人在問 GPU 伺服器和高功率機櫃?
  4. 資金能否承受 GPU 裝置按 3 年左右折舊,以及半年以上的空置期?

前兩個是工程問題,後兩個是生意問題。四個答案都不確定時,從分銷和推理節點開始試,投入和風險都小。

AIDC 運營要多管哪些資料

高功率機櫃讓機房的容錯空間變小:一個 30 kW 的機櫃超載、一路電斷開或冷卻出問題,影響的是高價值裝置和客戶正在跑的訓練任務。比起傳統機房,運營上要多盯三類資料:

  • 用電:每個機櫃、每一路配電實際用了多少,按 kW 計費需要它,判斷迴路是否接近上限也需要它;
  • 帶外狀態:GPU 伺服器同樣配有 BMC,當機、過熱、電源告警要能遠端看到,能遠端開關機和檢視控制檯;
  • 資源歸屬:哪台伺服器在哪個櫃、哪個 U 位,分給了哪個客戶,用了哪些 IP。

這三類資料可以先收攏到機房管理系統裡。在 Toplink DCIM 中,機櫃內的智慧 PDU 統一納管,首頁按機房彙總用電量和利用率,機櫃、U 位和裝置歸屬一併登記(見 機櫃與資產);伺服器基於通用 IPMI 標準納管、不限品牌,遠端開關機、控制檯和會話錄影都在瀏覽器裡完成(見 IPMI 遠端管理)。選擇分銷上游算力的,可以在 IDC 財務系統裡把上游資源作為供應商商品代銷,按加成規則定價、按週期對帳(見 分銷與分潤)。

常見問題

AIDC 需要單獨辦許可證嗎?

沒有叫“AIDC 許可證”的證照。對外出租 GPU 伺服器、機櫃或頻寬,仍屬於增值電信業務裡的網際網路資料中心業務,要持有 IDC 許可證;以雲平台方式按需提供算力的,許可證還要包含網際網路資源協作服務。具體業務形態拿不準時,以機房所在省通訊管理局的意見為準。

GPU 伺服器託管和普通伺服器託管,合同裡要多寫什麼?

至少寫清四項:按 kW 約定的電力配額和超額計費方式;配電路數與冗餘,是否 A、B 兩路都能單獨帶滿整櫃;製冷方式和液冷介面的責任劃分;GPU 或整機故障時機房提供哪些現場服務、回應時限多長。普通託管合同裡常見的“包電”“不限功率”條款,放到 GPU 伺服器上要逐條改掉。

智算中心裡只用英偉達 GPU 嗎?

不是。智算中心用的加速晶片統稱 AI 加速卡,除了英偉達 GPU,國內專案也大量採用華為昇騰等國產加速卡。對機房來說,差別主要體現在單機功率、散熱方式和組網要求上,規劃時以所選伺服器的廠商規格為準。

想看看在你的機房裡怎麼用?

從一次產品示範開始,梳理你的業務鏈路。

查看價格
服務熱線 400-112-2951

讓我們聊聊你的 IDC 業務

掃碼新增企業微信,預約產品示範或申請試用。

Toplink 企業微信二維碼

長按儲存或使用企業微信 / 微信掃描

也可致電
400-112-2951
Telegram
@TopLink88