机器学习工程与系统

模型注册表(model registry)

/ MOD-ul REJ-iss-tree /

模型注册表,是一份井井有条的、已训练模型的目录——一个唯一的「真相来源」,记录着每一个版本、它从何而来、以及它是否获准使用。把它想成图书馆的卡片目录,只不过是为模型而设:你不必再去猜「谁的笔记本上的哪个文件」才是真正的生产模型,而是查一下,便能看到它的版本、它的来龙去脉、它的状态。它是一个组织里那些模型的书架,也是借阅台。

对每一个模型版本,注册表存下的不只是文件,还有它的故事:是哪份数据和哪段代码产出了它、它在测试上得了多少分、谁批准的、以及它眼下是草稿、在预发布、在生产、还是已退役。这就把一堆乱七八糟、起着「model_final_v2_真的最终版.bin」之类名字的文件,变成了一套有纪律、可审计的系统。生产里一出岔子,你能确切看到哪个版本正在跑,并在片刻之间回滚到一个已知良好的早先版本。

为什么这很重要:一旦模型开始定期更新、并服务真实用户,你就得回答「眼下跑的是哪个版本,它信得过吗?」——而注册表让这个问题有了笃定的答案,而不必去做侦探。诚实的说法是:注册表是记账,而非智能。它并不让模型变得更好;它让模型变得可管理、可问责、可恢复。不用它,一切照常,直到某一天你急切地想知道「到底改了什么」却毫无记录——而那一刻,恰恰是它的缺席最伤人的时候。

一个新的推荐模型,第 7 版,被提升到了生产。两天后投诉激增。团队打开注册表,看到正是那时上了第 7 版,确认第 6 版在一项关键指标上分数更好,于是一键回滚到第 6 版——只因注册表把第 6 版备好且标注妥当地留着。

有版本、有标注——于是「现在跑的是哪个?」和「回滚」都成了麻利的事,而非手忙脚乱。

注册表给模型编目,却并不替它们把关。它会乐呵呵地把一个糟糕的模型,紧挨着一个出色的模型存起来。在提升一个版本之前去测试它、批准它的那份纪律,是另一桩单独的实践,注册表只是把结果记录下来而已。

又称
model catalogmodel versioning模型注册表模型仓库模型版本库