一種模型部署方法、裝置、設(shè)備及存儲介質(zhì)
基本信息

| 申請?zhí)?/td> | CN202210448435.7 | 申請日 | - |
| 公開(公告)號 | CN114721674A | 公開(公告)日 | 2022-07-08 |
| 申請公布號 | CN114721674A | 申請公布日 | 2022-07-08 |
| 分類號 | G06F8/61(2018.01)I;G06F8/71(2018.01)I;G06F9/50(2006.01)I | 分類 | 計算;推算;計數(shù); |
| 發(fā)明人 | 龔樂誠;馬興宇;康平 | 申請(專利權(quán))人 | 上海浦東發(fā)展銀行股份有限公司 |
| 代理機構(gòu) | 北京品源專利代理有限公司 | 代理人 | - |
| 地址 | 200000上海市黃浦區(qū)中山東一路12號 | ||
| 法律狀態(tài) | - | ||
摘要

| 摘要 | 本發(fā)明公開了一種模型部署方法、裝置、設(shè)備及存儲介質(zhì)。該方法包括:獲取模型配置信息、元數(shù)據(jù)和模型文件,其中,所述模型配置信息包括:環(huán)境鏡像信息;將所述模型文件和所述模型配置信息上傳至測試Kubernetes集群的本地,并將所述模型配置信息寫入后臺數(shù)據(jù)庫;根據(jù)所述模型配置信息生成第一yaml配置文件;接收測試指令,并將所述測試指令發(fā)送至所述測試Kubernetes集群,以使所述測試Kubernetes集群根據(jù)所述第一yaml配置文件部署模型,通過本發(fā)明的技術(shù)方案,解決了模型管理中的元數(shù)據(jù)信息缺失、缺乏模型評估結(jié)果、模型部署中的計算資源監(jiān)控缺失以及缺乏彈性擴容的問題。能夠簡化模型部署的過程,支持動態(tài)彈性擴容,可以隨時增加模型計算總資源。 |





