久久99精品久久久野外观看,亚洲成人一区在线观看,岛国精品一区,99成人在线

首頁(yè) > 新車(chē)生活 > 新車(chē)生活 > 性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

發(fā)布時(shí)間:2024-10-12 22:05:29
談到大模型私有化部署,很多人會(huì)首先想到數(shù)據(jù)中心,以為動(dòng)輒就得使用很多臺(tái)服務(wù)來(lái)支撐。一些中小企業(yè)或者應(yīng)用部門(mén),主要做知識(shí)庫(kù)和智能體方向的應(yīng)用,模型大小基本在70B以?xún)?nèi)。只要搭配合理,用本地的專(zhuān)業(yè)工作站同樣可以訓(xùn)練推理,算得上極具性?xún)r(jià)比的方案了。
 
隨著OpenAI o1-preview的發(fā)布,大模型已經(jīng)越發(fā)成熟,距離走入企業(yè)生產(chǎn)應(yīng)用已經(jīng)很近了。但OpenAI提供訪(fǎng)問(wèn)的次數(shù)非常有限,這給企業(yè)用戶(hù)的AI應(yīng)用普及帶來(lái)了一定的費(fèi)用焦慮和困擾。為了應(yīng)對(duì)日益增長(zhǎng)的訪(fǎng)問(wèn)頻率需求,越來(lái)越多的企業(yè)用戶(hù)傾向于大模型的本地化部署。大模型本地部署可以極大地降低數(shù)據(jù)泄漏的風(fēng)險(xiǎn),而且系統(tǒng)響應(yīng)速度和實(shí)時(shí)性更強(qiáng),在一些需要快速反饋的場(chǎng)景里優(yōu)勢(shì)非常明顯,同時(shí)也能應(yīng)對(duì)企業(yè)個(gè)性化需求。
 
通過(guò)在傳統(tǒng)數(shù)據(jù)中心上進(jìn)行本地大模型部署的方法,會(huì)對(duì)IT設(shè)施帶來(lái)比較大的挑戰(zhàn),因?yàn)閺挠?jì)算資源來(lái)說(shuō),很多企業(yè)的數(shù)據(jù)中心計(jì)算資源很緊張,而且擴(kuò)展成本比較高,甚至有些中小企業(yè)還不具備搭建數(shù)據(jù)中心的能力。所幸的是,對(duì)于知識(shí)庫(kù)等企業(yè)級(jí)AI 應(yīng)用來(lái)說(shuō),完全可以用高配的AI工作站來(lái)應(yīng)對(duì)計(jì)算需求,以經(jīng)濟(jì)高效的方式減輕對(duì)數(shù)據(jù)中心計(jì)算資源的壓力,從而降低云服務(wù)的成本支出。
 
這次我們選用的是Dell Precision 7960 Tower,搭載了4張「NVIDIA RTX 5880 Ada 」顯卡,每張顯卡顯存48GB,相當(dāng)于在1臺(tái)工作站里就能最多有192GB顯存,完全可以部署Llama3.1 70B模型。
 
 
Dell Precision 7960 Tower
 
70B模型擁有700億參數(shù)量,在語(yǔ)言理解和生成方面具有顯著優(yōu)勢(shì),已經(jīng)能夠滿(mǎn)足常見(jiàn)的企業(yè)級(jí)AI應(yīng)用,比如知識(shí)庫(kù)應(yīng)用、對(duì)話(huà)問(wèn)答等,同時(shí)多任務(wù)處理能力也很強(qiáng),可以支持企業(yè)在一個(gè)統(tǒng)一的平臺(tái)上運(yùn)行多種AI 應(yīng)用。同時(shí),開(kāi)源大模型70B的開(kāi)放和靈活使得它在市場(chǎng)上具有廣泛的適用性,大大降低企業(yè)的使用成本。而且量化后的70B模型僅占70G的顯存,非常適合部署在工作站上,降低計(jì)算資源方面的成本。
 
購(gòu)置機(jī)器前我們做了相對(duì)完整的測(cè)試和驗(yàn)證,包括推理、訓(xùn)練和噪音測(cè)試,下面給大家分享一些數(shù)據(jù)。
 
一、測(cè)試環(huán)境
硬件配置:
硬件平臺(tái):Dell Precision 7960 Tower
 
CPU: Intel(R) Xeon(R) w5-3433
 
內(nèi)存:64G DDR5 * 8
 
GPU: NVIDIA RTX 5880 ada * 4
 
軟件平臺(tái)環(huán)境:
操作系統(tǒng):ubuntu22.04
 
Driver Version: 550.107.02
 
CUDA: 12.1
 
軟件包:conda python3.10 torch2.4 vllm0.6.1
 
測(cè)試模型:
這次我們分別測(cè)試了單GPU、雙GPU以及四卡GPU的表現(xiàn)情況。并在不同的模型下進(jìn)行測(cè)試,模型參數(shù)分別為8B/13B/32B/70B,具體模型名稱(chēng)如下:
 
Meta-Llama-3.1-8B-Instruct
 
Baichuan2-13B-Chat
 
Qwen1.5-32B-Chat
 
Meta-Llama-3.1-70B-Instruct
 
說(shuō)明:接下來(lái)的推理測(cè)試,會(huì)使用FP16或FP8格式進(jìn)行測(cè)試。在模型名稱(chēng)的后綴,如果有FP8字樣,則使用的是FP8格式,否則使用的是FP16格式。
 
FP8是NVIDIA、Arm、Intel聯(lián)合推出的8位浮點(diǎn)數(shù)據(jù)格式,用于加速深度學(xué)習(xí)訓(xùn)練和推理。相對(duì)于常用的半精度FP16而言,F(xiàn)P8在不損失多少精度的情況下,將顯存的占用大小減少了一半,特別適合于將大模型部署于工作站上。FP8訓(xùn)練利用E5M2/E4M3格式,具備與FP16相當(dāng)?shù)膭?dòng)態(tài)范圍,適用于反向傳播與前向傳播。FP8訓(xùn)練在相同加速平臺(tái)上的峰值性能顯著超越FP16/BF16,并且模型參數(shù)越大,訓(xùn)練加速效果越好,且其與16-bits訓(xùn)練在收斂性和下游任務(wù)表現(xiàn)上無(wú)顯著差異。
 
推理框架:
vllm推理引擎來(lái)進(jìn)行測(cè)試,為最大程度利用GPU顯存,將其GPU utilization參數(shù)設(shè)置為0.99。
 
述語(yǔ)說(shuō)明:
Batch size: 推理或訓(xùn)練時(shí)輸入的數(shù)據(jù)批量數(shù)量,為1表示單個(gè)輸入,例如一段文字,為2表明同時(shí)進(jìn)行兩段文字的生成,以此類(lèi)推。它代表的是用戶(hù)并發(fā)數(shù)量。
 
token/s:推理或訓(xùn)練的速度,每秒生成的數(shù)量。一個(gè)token是代表一個(gè)單詞或詞根,如果是中文的話(huà),可能是一個(gè)字或一個(gè)詞。
 
AI 應(yīng)用場(chǎng)景測(cè)試列表

 

新車(chē)生活更多>>

谷歌Gemini賦能!iPhone將迎來(lái)超10項(xiàng)智能新功能 追覓科技與央視春晚官宣戰(zhàn)略合作!追覓洗地機(jī)將與全球觀眾共賀新春 國(guó)產(chǎn)HDMI2.1協(xié)議分析儀交付華為!軟硬件完全自主知識(shí)產(chǎn)權(quán) 17系列挑大梁Air疲軟 蘋(píng)果Q4國(guó)內(nèi)出貨暴增28% 6.32英寸小鋼炮來(lái)襲:一加15T入網(wǎng)搭載驍龍8 Elite Gen5,3月見(jiàn) 騰訊音樂(lè)“守城”,汽水音樂(lè)“改道” 消息稱(chēng)阿里旗下芯片公司平頭哥擬獨(dú)立上市,阿里未作回應(yīng) 探訪(fǎng)鄭州具身智能機(jī)器人實(shí)驗(yàn)室 AMD也要減少GPU供應(yīng)!重點(diǎn)轉(zhuǎn)向RX 9070 XT:價(jià)格更好調(diào)整 Setapp Mobile iOS應(yīng)用商店將于2月16日關(guān)閉 為直播間賣(mài)食品“劃紅線(xiàn)、立規(guī)矩”(政策問(wèn)答·回應(yīng)關(guān)切) 機(jī)器人終于能用明白洗碗機(jī)了|UC伯克利新研究 押寶哪吒,國(guó)潮又殺出第一股 SK海力士、三星加速HBF商業(yè)化進(jìn)程 “HBM之父”:最快明年用于英偉達(dá)產(chǎn)品 谷歌Pixel 10a手機(jī)渲染圖及規(guī)格曝光,起售價(jià)500歐元 iPhone 18系列與Air2屏幕配置曝光,Pro型號(hào)將引入屏下Face ID技術(shù) 2025年蘇州年人均使用快遞量超600件 端到端智駕新SOTA|KnowVal:懂法律道德、有價(jià)值觀的智能駕駛系統(tǒng) 榮耀Magic8系列入選“年度科技創(chuàng)新--AI智能體先鋒案例” 2026年新機(jī)“Turbo大戰(zhàn)”?一加、Redmi、iQOO誰(shuí)能笑到最后 摩托羅拉首款大折疊手機(jī)Razr Fold渲染圖曝光,支持手寫(xiě)筆 2026年實(shí)測(cè):iPhone 14 Pro Max憑什么還是\"釘子戶(hù)神機(jī)\"? 現(xiàn)在算華為想國(guó)內(nèi)手機(jī)銷(xiāo)量過(guò)六千萬(wàn),暢享和nova需要占一半才行? 背靠上汽好乘涼?智己2025銷(xiāo)量解讀:技術(shù)換銷(xiāo)量,盈利換未來(lái) 老車(chē)主破防 搶先試駕2026款嵐圖夢(mèng)想家 沃爾沃冰封40天,硬核挑戰(zhàn)“沃標(biāo)” 全新雷克薩斯LM KUHL版官圖發(fā)布 姿態(tài)迷人 霸氣十足 裝車(chē)了!紅旗的全固態(tài)電池研發(fā)進(jìn)展明確領(lǐng)先一個(gè)身位 豐田“自砍一刀”,B級(jí)車(chē)從16.98萬(wàn)降到9.38萬(wàn),能打過(guò)國(guó)產(chǎn)車(chē)? 新車(chē)到店,純電210km,比亞迪秦L 、秦PLUS DM-i長(zhǎng)續(xù)航版正式上市
久久99精品久久久野外观看,亚洲成人一区在线观看,岛国精品一区,99成人在线
日韩高清国产一区在线| 亚洲一区成人| 激情欧美一区二区三区| 国产极品久久久久久久久波多结野 | 另类中文字幕国产精品| 欧美日韩在线精品一区二区三区激情综合| 成人羞羞在线观看网站| 国产精品久久久久av蜜臀| 亚洲一二av| 国产午夜久久| 国产精品久久久久蜜臀| 国产精品一区二区精品视频观看| 亚州精品视频| 在线免费观看亚洲| 久久av一区| 美日韩精品视频| 三级精品视频| 亚洲性视频h| 亚洲欧美日韩专区| 国产亚洲一区在线| 一区二区三区网站| 亚洲天堂免费| 日韩欧美中文在线观看| 91成人在线网站| 精品深夜福利视频| 国产精品99久久久久久董美香| 国产麻豆精品| 首页国产精品| 久久国产中文字幕| 久久久久久久久久久妇女| 欧美不卡高清一区二区三区| 成人羞羞视频播放网站| 尹人成人综合网| 亚洲我射av| 精品视频亚洲| 尹人成人综合网| 日韩在线观看一区二区三区| 麻豆一区二区三| 成人啊v在线| 香蕉人人精品| 老色鬼久久亚洲一区二区| 石原莉奈在线亚洲二区| 国产精品v一区二区三区| 久久五月天小说| 日本午夜精品一区二区三区电影| 成人在线视频免费看| 波多野结衣一区| 久久av免费看| 麻豆亚洲精品| 亚洲黄色免费av| 欧美视频久久| 最新国产拍偷乱拍精品| 麻豆成人91精品二区三区| 日韩精品久久久久久久电影99爱| 亚洲一区欧美| 首页国产精品| 欧美性www| 一区二区三区四区在线观看国产日韩| 久久精品国产成人一区二区三区| 激情五月色综合国产精品| 激情91久久| 国产伦久视频在线观看| 日韩精选在线| 美女日韩在线中文字幕| 日韩欧美综合| 九九99久久精品在免费线bt| 亚洲aⅴ网站| 国产盗摄——sm在线视频| 91精品一区| 久久国产亚洲| 亚洲精品a级片| 在线视频免费在线观看一区二区| 欧美aa在线视频| 国产麻豆一区二区三区精品视频| 亚洲精品日韩久久| 蜜臀精品久久久久久蜜臀| 欧美日韩一二三四| 成人羞羞视频播放网站| 卡一卡二国产精品| 国产精品一区毛片| 国产精品欧美在线观看| 欧美黄色一区二区| 精品久久不卡| 欧美三级网址| 91精品精品| 欧美午夜精品一区二区三区电影| 精品中文字幕一区二区三区av| 亚洲激情黄色| 日韩av在线免费观看不卡| 国产三级一区| 欧美激情另类| 亚洲深爱激情| 国产欧美啪啪| 日韩大片免费观看| 一本一道久久a久久精品蜜桃| 欧美中文日韩| 国产精久久一区二区| 亚洲女同av| 亚洲深深色噜噜狠狠爱网站| 日本一不卡视频| 国产福利一区二区三区在线播放| 吉吉日韩欧美| 日韩精品中文字幕一区二区| 99久久精品网站| 久久伊人国产| 欧美久久精品| 亚洲a成人v| 亚洲一区二区三区久久久| 久久久蜜桃一区二区人| 精品三区视频| 国产精品国产三级在线观看| 亚洲精品一二三**| 亚洲综合专区| 亚洲综合中文| 亚洲色图国产| 欧美特黄一级| 精品日韩毛片| 不卡中文字幕| 亚洲无线一线二线三线区别av| 亚洲天堂av影院| 极品av在线| 成人精品天堂一区二区三区| 亚洲黄色网址| 日韩一区二区三区在线免费观看| 麻豆成全视频免费观看在线看| 精品一区二区三区的国产在线观看 | 日韩1区2区3区| 亚州av日韩av| 国产伦精品一区二区三区在线播放| 7777精品| 粉嫩av一区二区三区四区五区| 国产一区调教| 亚洲国产专区| 日韩专区在线视频| 欧美精品影院| 97国产成人高清在线观看| 国产亚洲一区二区手机在线观看 | 日韩高清一区在线| 日韩 欧美一区二区三区| 国产一级成人av| 色爱综合网欧美| 欧美成人日韩| 中文字幕日韩高清在线 | 麻豆91精品91久久久的内涵| 国产一区二区精品福利地址| 日韩伦理在线一区| 日韩专区欧美专区| 欧美激情99| 一区在线免费| 精品免费av| 亚洲女同一区| 国产精品日本一区二区三区在线| 色黄视频在线观看| 日韩一区二区三区精品| se01亚洲视频 | 999国产精品999久久久久久| 日本欧洲一区二区| 国产精品久久观看| 日本不卡高清| 日韩精品永久网址| www.com.cn成人| 一区二区不卡| 欧美一级久久| 婷婷亚洲综合| 日产午夜精品一线二线三线| 亚洲精品国产精品粉嫩| 亚洲1234区| 美女视频一区在线观看| 亚洲尤物av| 亚洲特色特黄| 国产aⅴ精品一区二区四区| 亚洲一区二区成人| 久久精品青草| 水蜜桃久久夜色精品一区| 欧美精品国产| 亚洲精选成人| 日本韩国欧美超级黄在线观看| 亚洲专区视频| 水野朝阳av一区二区三区| 亚洲午夜视频| 99tv成人| 亚洲高清二区| 欧美理论视频| 国产亚洲在线| 亚洲综合日韩| 男女男精品视频网| 久久亚洲一区| 免费在线观看视频一区| 亚洲主播在线| 中文字幕日韩亚洲| 最新国产拍偷乱拍精品| 7m精品国产导航在线| 久久av一区二区三区| 六月天综合网| 日本亚洲最大的色成网站www | 99国产精品免费视频观看| 欧美韩日一区| 欧美日韩国产在线观看网站 | 国产视频一区欧美| 欧美日韩国产一区二区三区不卡|