奥运星-日韩国产一区二区三区-汽车性能网评-日韩国产一区二区-提供个性化汽车资讯

首頁(yè) > 汽車生活 > 汽車生活 > 性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

發(fā)布時(shí)間:2024-10-12 22:05:29
談到大模型私有化部署,很多人會(huì)首先想到數(shù)據(jù)中心,以為動(dòng)輒就得使用很多臺(tái)服務(wù)來(lái)支撐。一些中小企業(yè)或者應(yīng)用部門,主要做知識(shí)庫(kù)和智能體方向的應(yīng)用,模型大小基本在70B以內(nèi)。只要搭配合理,用本地的專業(yè)工作站同樣可以訓(xùn)練推理,算得上極具性價(jià)比的方案了。
 
隨著OpenAI o1-preview的發(fā)布,大模型已經(jīng)越發(fā)成熟,距離走入企業(yè)生產(chǎn)應(yīng)用已經(jīng)很近了。但OpenAI提供訪問(wèn)的次數(shù)非常有限,這給企業(yè)用戶的AI應(yīng)用普及帶來(lái)了一定的費(fèi)用焦慮和困擾。為了應(yīng)對(duì)日益增長(zhǎng)的訪問(wèn)頻率需求,越來(lái)越多的企業(yè)用戶傾向于大模型的本地化部署。大模型本地部署可以極大地降低數(shù)據(jù)泄漏的風(fēng)險(xiǎn),而且系統(tǒng)響應(yīng)速度和實(shí)時(shí)性更強(qiáng),在一些需要快速反饋的場(chǎng)景里優(yōu)勢(shì)非常明顯,同時(shí)也能應(yīng)對(duì)企業(yè)個(gè)性化需求。
 
通過(guò)在傳統(tǒng)數(shù)據(jù)中心上進(jìn)行本地大模型部署的方法,會(huì)對(duì)IT設(shè)施帶來(lái)比較大的挑戰(zhàn),因?yàn)閺挠?jì)算資源來(lái)說(shuō),很多企業(yè)的數(shù)據(jù)中心計(jì)算資源很緊張,而且擴(kuò)展成本比較高,甚至有些中小企業(yè)還不具備搭建數(shù)據(jù)中心的能力。所幸的是,對(duì)于知識(shí)庫(kù)等企業(yè)級(jí)AI 應(yīng)用來(lái)說(shuō),完全可以用高配的AI工作站來(lái)應(yīng)對(duì)計(jì)算需求,以經(jīng)濟(jì)高效的方式減輕對(duì)數(shù)據(jù)中心計(jì)算資源的壓力,從而降低云服務(wù)的成本支出。
 
這次我們選用的是Dell Precision 7960 Tower,搭載了4張「NVIDIA RTX 5880 Ada 」顯卡,每張顯卡顯存48GB,相當(dāng)于在1臺(tái)工作站里就能最多有192GB顯存,完全可以部署Llama3.1 70B模型。
 
 
Dell Precision 7960 Tower
 
70B模型擁有700億參數(shù)量,在語(yǔ)言理解和生成方面具有顯著優(yōu)勢(shì),已經(jīng)能夠滿足常見的企業(yè)級(jí)AI應(yīng)用,比如知識(shí)庫(kù)應(yīng)用、對(duì)話問(wèn)答等,同時(shí)多任務(wù)處理能力也很強(qiáng),可以支持企業(yè)在一個(gè)統(tǒng)一的平臺(tái)上運(yùn)行多種AI 應(yīng)用。同時(shí),開源大模型70B的開放和靈活使得它在市場(chǎng)上具有廣泛的適用性,大大降低企業(yè)的使用成本。而且量化后的70B模型僅占70G的顯存,非常適合部署在工作站上,降低計(jì)算資源方面的成本。
 
購(gòu)置機(jī)器前我們做了相對(duì)完整的測(cè)試和驗(yàn)證,包括推理、訓(xùn)練和噪音測(cè)試,下面給大家分享一些數(shù)據(jù)。
 
一、測(cè)試環(huán)境
硬件配置:
硬件平臺(tái):Dell Precision 7960 Tower
 
CPU: Intel(R) Xeon(R) w5-3433
 
內(nèi)存:64G DDR5 * 8
 
GPU: NVIDIA RTX 5880 ada * 4
 
軟件平臺(tái)環(huán)境:
操作系統(tǒng):ubuntu22.04
 
Driver Version: 550.107.02
 
CUDA: 12.1
 
軟件包:conda python3.10 torch2.4 vllm0.6.1
 
測(cè)試模型:
這次我們分別測(cè)試了單GPU、雙GPU以及四卡GPU的表現(xiàn)情況。并在不同的模型下進(jìn)行測(cè)試,模型參數(shù)分別為8B/13B/32B/70B,具體模型名稱如下:
 
Meta-Llama-3.1-8B-Instruct
 
Baichuan2-13B-Chat
 
Qwen1.5-32B-Chat
 
Meta-Llama-3.1-70B-Instruct
 
說(shuō)明:接下來(lái)的推理測(cè)試,會(huì)使用FP16或FP8格式進(jìn)行測(cè)試。在模型名稱的后綴,如果有FP8字樣,則使用的是FP8格式,否則使用的是FP16格式。
 
FP8是NVIDIA、Arm、Intel聯(lián)合推出的8位浮點(diǎn)數(shù)據(jù)格式,用于加速深度學(xué)習(xí)訓(xùn)練和推理。相對(duì)于常用的半精度FP16而言,F(xiàn)P8在不損失多少精度的情況下,將顯存的占用大小減少了一半,特別適合于將大模型部署于工作站上。FP8訓(xùn)練利用E5M2/E4M3格式,具備與FP16相當(dāng)?shù)膭?dòng)態(tài)范圍,適用于反向傳播與前向傳播。FP8訓(xùn)練在相同加速平臺(tái)上的峰值性能顯著超越FP16/BF16,并且模型參數(shù)越大,訓(xùn)練加速效果越好,且其與16-bits訓(xùn)練在收斂性和下游任務(wù)表現(xiàn)上無(wú)顯著差異。
 
推理框架:
vllm推理引擎來(lái)進(jìn)行測(cè)試,為最大程度利用GPU顯存,將其GPU utilization參數(shù)設(shè)置為0.99。
 
述語(yǔ)說(shuō)明:
Batch size: 推理或訓(xùn)練時(shí)輸入的數(shù)據(jù)批量數(shù)量,為1表示單個(gè)輸入,例如一段文字,為2表明同時(shí)進(jìn)行兩段文字的生成,以此類推。它代表的是用戶并發(fā)數(shù)量。
 
token/s:推理或訓(xùn)練的速度,每秒生成的數(shù)量。一個(gè)token是代表一個(gè)單詞或詞根,如果是中文的話,可能是一個(gè)字或一個(gè)詞。
 
AI 應(yīng)用場(chǎng)景測(cè)試列表

 

汽車生活更多>>

2025年山東大學(xué)齊魯醫(yī)院事業(yè)編招聘啟事 2024年遵義醫(yī)科大學(xué)第二附屬醫(yī)院招聘(非編制)工作人員方案 2024年海口市美蘭區(qū)和平南街道辦事處關(guān)于擬招聘公益性崗位工作人員的公告(2人) 2024年湖北鐵道運(yùn)輸職業(yè)學(xué)院(武漢鐵路技師學(xué)院)專項(xiàng)招聘工作人員公告(4人) 2024年中國(guó)中醫(yī)科學(xué)院廣安門醫(yī)院招聘公告 價(jià)格下探至25萬(wàn)元以內(nèi)?比亞迪夏前景展望 7月豪華中級(jí)車終端銷量:奔馳C級(jí)月銷13838輛領(lǐng)跑 官方一口價(jià)低至7.99萬(wàn)元起 途岳新銳要和新能源搶市場(chǎng) 并入上汽大眾銷售網(wǎng)絡(luò) 斯柯達(dá)在中國(guó)還有希望嗎 10.99萬(wàn)元起,全系518km續(xù)航,東風(fēng)風(fēng)神L7 EV有點(diǎn)給力! 預(yù)售11.98萬(wàn)元起,最高650km續(xù)航+激光雷達(dá),AION RT來(lái)了 評(píng)凱迪拉克全新XT5:價(jià)格殺紅眼的同時(shí),還不忘“玩豪華”? 主打就是聽勸!2025款比亞迪漢全面升級(jí),僅售16.58萬(wàn)元起 2024年鷹潭市月湖區(qū)部分區(qū)直事業(yè)單位選調(diào)工作人員公告 2024年撫州市資溪縣事業(yè)單位引進(jìn)高素質(zhì)人才公告 2024年南昌市第一醫(yī)院臨床護(hù)士及部分技師崗位招聘公告 2024年南昌市勞動(dòng)保障事務(wù)代理中心招聘工作人員公告 2024年吉安市青原區(qū)人民醫(yī)院(總醫(yī)院) 招聘公告 2024年南昌經(jīng)濟(jì)技術(shù)開區(qū)人民醫(yī)院耳鼻喉科醫(yī)生招聘公告 2024年江西中醫(yī)藥大學(xué)高層次人才招聘公告 2024年吉安市永豐縣某單位招聘派遣員工公告 增程車型升級(jí)智慧新藍(lán)鯨3.0,長(zhǎng)安啟源全新A07真心版將于18日上市 10月18日上市!增程/純電可選,配置升級(jí),長(zhǎng)安啟源A07真香版 車長(zhǎng)4988毫米,配2.0T+8AT,降至14.78萬(wàn),家用可以看這款B級(jí)車 配33英寸中控屏,237馬力,降至21.97萬(wàn),家用可看這款豪華B級(jí)車 奧運(yùn)選手黃雅瓊成問(wèn)界新M7 Pro車主,新車究竟有何吸引力? 配置升級(jí)價(jià)格更香 2025款深藍(lán)SL03上市 售11.99-14.69萬(wàn) 無(wú)懼國(guó)境線復(fù)雜路況考驗(yàn) 問(wèn)界新M7國(guó)慶期間持續(xù)熱銷 奇瑞艾瑞澤8高能版新車上市 12.99萬(wàn)起 新增瑪瑙紅配色 雷克薩斯 RX 銷量大跌,低至 33 萬(wàn)且新增 2.0T+8AT,是否值的入?
主站蜘蛛池模板: 太阳能发电系统-太阳能逆变器,控制器-河北沐天太阳能科技首页 | 除甲醛公司-甲醛检测-广西雅居环境科技有限公司 | 体检车_移动CT车_CT检查车_CT车_深圳市艾克瑞电气有限公司移动CT体检车厂家-深圳市艾克瑞电气有限公司 | 桌上式超净工作台-水平送风超净工作台-上海康路仪器设备有限公司 | 超声骨密度仪,双能X射线骨密度仪【起草单位】,骨密度检测仪厂家 - 品源医疗(江苏)有限公司 | 骨密度检测仪_骨密度分析仪_骨密度仪_动脉硬化检测仪专业生产厂家【品源医疗】 | 奇酷教育-Python培训|UI培训|WEB大前端培训|Unity3D培训|HTML5培训|人工智能培训|JAVA开发的教育品牌 | 液压油缸-液压站生产厂家-洛阳泰诺液压科技有限公司 | 杭州网络公司_百度SEO优化-外贸网络推广_抖音小程序开发-杭州乐软科技有限公司 | 沧州友城管业有限公司-内外涂塑钢管-大口径螺旋钢管-涂塑螺旋管-保温钢管生产厂家 | 岩石钻裂机-液压凿岩机-劈裂机-挖改钻_湖南烈岩科技有限公司 | 营养师网,营养师考试时间,报名入口—网站首页 | 膏方加工_丸剂贴牌_膏滋代加工_湖北康瑞生物科技有限公司 | 没斑啦-专业的祛斑美白嫩肤知识网站-去斑经验分享 | 医用酒精_84消毒液_碘伏消毒液等医用消毒液-漓峰消毒官网 | PC阳光板-PC耐力板-阳光板雨棚-耐力板雨棚,厂家定制[优尼科板材] | 空气能暖气片,暖气片厂家,山东暖气片,临沂暖气片-临沂永超暖通设备有限公司 | 河南橡胶接头厂家,河南波纹补偿器厂家,河南可曲挠橡胶软连接,河南套筒补偿器厂家-河南正大阀门 | 航拍_专业的无人机航拍摄影门户社区网站_航拍网 | 成都珞石机械 - 模温机、油温机、油加热器生产厂家 | 卓能JOINTLEAN端子连接器厂家-专业提供PCB接线端子|轨道式端子|重载连接器|欧式连接器等电气连接产品和服务 | 制丸机,小型中药制丸机,全自动制丸机价格-甘肃恒跃制药设备有限公司 | 风化石头制砂机_方解石制砂机_瓷砖石子制砂机_华盛铭厂家 | 昆明化妆培训-纹绣美甲-美容美牙培训-昆明博澜培训学校 | 基本型顶空进样器-全自动热脱附解吸仪价格-AutoHS全模式-成都科林分析技术有限公司 | 合肥地磅_合肥数控切割机_安徽地磅厂家_合肥世佳电工设备有限公司 | 网站seo优化_seo云优化_搜索引擎seo_启新网络服务中心 | 1000帧高速摄像机|工业高速相机厂家|科天健光电技术 | 免费B2B信息推广发布平台 - 推发网| 盘式曝气器-微孔曝气器-管式曝气器-曝气盘-斜管填料 | 郑州市前程水处理有限公司 | 板式换热器_板式换热器价格_管式换热器厂家-青岛康景辉 | 衬氟旋塞阀-卡套旋塞阀-中升阀门首页 | 英语词典_成语词典_日语词典_法语词典_在线词典网 | 重庆私家花园设计-别墅花园-庭院-景观设计-重庆彩木园林建设有限公司 | 广州工业氧气-工业氩气-工业氮气-二氧化碳-广州市番禺区得力气体经营部 | 广东恩亿梯电源有限公司【官网】_UPS不间断电源|EPS应急电源|模块化机房|电动汽车充电桩_UPS电源厂家(恩亿梯UPS电源,UPS不间断电源,不间断电源UPS) | 涂层测厚仪_漆膜仪_光学透过率仪_十大创新厂家-果欧电子科技公司 | 永嘉县奥阳陶瓷阀门有限公司 | 精密模具加工制造 - 富东懿 | 基业箱_环网柜_配电柜厂家_开关柜厂家_开关断路器-东莞基业电气设备有限公司 | 高铝矾土熟料_细粉_骨料_消失模_铸造用铝矾土_铝酸钙粉—嵩峰厂家 |