公平、伦理与社会

训练的环境成本(the environmental cost of training)

/ the en-vy-run-MEN-tul kost of TRAY-ning /

训练一个大型AI模型,意味着让成千上万块专用芯片满负荷连转数周乃至数月,这要耗掉大量电力——而这些电力视其来源不同,可能意味着大量的碳排放。它还要耗水,其中很大一部分用来给数据中心降温,以及耗用稀有材料来制造硬件。「训练的环境成本」,就是为这份物理足迹算的一笔账:在你屏幕上感觉轻飘飘的那份能力背后,所耗的能源、碳、水与废弃物。

把两个阶段分开会有帮助。训练,是「一次性」地、密集地把一个模型造出来——其数字很抓眼球(单是一个大型模型的训练,排放的碳就可能抵得上好几辆汽车一生的排放)。而推理——也就是真正去使用这个模型,每一次查询、每一张生成的图,一天数十亿次——则随时间累积;对那些热门模型而言,其总量甚至可能远超训练的成本。这份足迹极大地取决于人们常常略去的细节:本地电网的能源构成(烧煤还是水电)、芯片与数据中心的能效,以及废热或废水是否被回收利用。

它为何重要:随着模型越做越大、用途越铺越广,AI在全球电力需求中所占的那一份,增长之快已让电网运营商不得不围着它做规划。诚实的图景是「喜忧参半」,而非「世界末日」:同样的AI也能帮着削减排放(优化电网、材料、物流);单位计算的能效在不断提升;而与交通或供暖相比,AI仍只占总能耗的一小部分。公允的批评不是「AI会把地球煮沸」——而是:这些成本是真实的、常常对用户隐而不见、分布不均(那些水和电是在某个具体的地方被消耗掉的),而且很少被诚实地披露。

一座位于炎热干旱地区的数据中心,全天候不停地训练着一个模型。芯片用的是本地电网的电——其中一部分是烧煤发的——而散热用的,是从本已紧张的当地供水中抽取、再蒸发掉的水。同一个模型,若改在寒冷地区、用水电、配以循环冷却来训练,其足迹可能只是前者的一个零头。同样的模型,成本却天差地别。

一个模型「在哪里、怎么训练」,与「它有多大」同样要紧——这份足迹不是一个固定的单一数字。

当心那些不带上下文、单拎出来吓人的数字。一个碳排放数据,离开了电网的能源构成便没多大意义;而单看训练成本,又忽略了推理在整个生命周期里往往更大的开销。公允的要点不是「AI格外具有破坏性」——而是:这些成本是真实的、与地点高度相关的,且远远太少被度量或披露。

又称
carbon footprint of AIAI energy useAI碳足迹训练的环境成本訓練的環境成本