a级毛毛片_亚洲99_魔兽1~6集在线观看_黑白配在线观看_天天操日日操_四虎免费网站

首頁 > 知識分享 > 知識分享 > 性能與成本雙贏:實測戴爾AI工作站支撐企業大模型的本地部署與訓練

性能與成本雙贏:實測戴爾AI工作站支撐企業大模型的本地部署與訓練

發布時間:2024-10-12 22:05:29
談到大模型私有化部署,很多人會首先想到數據中心,以為動輒就得使用很多臺服務來支撐。一些中小企業或者應用部門,主要做知識庫和智能體方向的應用,模型大小基本在70B以內。只要搭配合理,用本地的專業工作站同樣可以訓練推理,算得上極具性價比的方案了。
 
隨著OpenAI o1-preview的發布,大模型已經越發成熟,距離走入企業生產應用已經很近了。但OpenAI提供訪問的次數非常有限,這給企業用戶的AI應用普及帶來了一定的費用焦慮和困擾。為了應對日益增長的訪問頻率需求,越來越多的企業用戶傾向于大模型的本地化部署。大模型本地部署可以極大地降低數據泄漏的風險,而且系統響應速度和實時性更強,在一些需要快速反饋的場景里優勢非常明顯,同時也能應對企業個性化需求。
 
通過在傳統數據中心上進行本地大模型部署的方法,會對IT設施帶來比較大的挑戰,因為從計算資源來說,很多企業的數據中心計算資源很緊張,而且擴展成本比較高,甚至有些中小企業還不具備搭建數據中心的能力。所幸的是,對于知識庫等企業級AI 應用來說,完全可以用高配的AI工作站來應對計算需求,以經濟高效的方式減輕對數據中心計算資源的壓力,從而降低云服務的成本支出。
 
這次我們選用的是Dell Precision 7960 Tower,搭載了4張「NVIDIA RTX 5880 Ada 」顯卡,每張顯卡顯存48GB,相當于在1臺工作站里就能最多有192GB顯存,完全可以部署Llama3.1 70B模型。
 
 
Dell Precision 7960 Tower
 
70B模型擁有700億參數量,在語言理解和生成方面具有顯著優勢,已經能夠滿足常見的企業級AI應用,比如知識庫應用、對話問答等,同時多任務處理能力也很強,可以支持企業在一個統一的平臺上運行多種AI 應用。同時,開源大模型70B的開放和靈活使得它在市場上具有廣泛的適用性,大大降低企業的使用成本。而且量化后的70B模型僅占70G的顯存,非常適合部署在工作站上,降低計算資源方面的成本。
 
購置機器前我們做了相對完整的測試和驗證,包括推理、訓練和噪音測試,下面給大家分享一些數據。
 
一、測試環境
硬件配置:
硬件平臺:Dell Precision 7960 Tower
 
CPU: Intel(R) Xeon(R) w5-3433
 
內存:64G DDR5 * 8
 
GPU: NVIDIA RTX 5880 ada * 4
 
軟件平臺環境:
操作系統:ubuntu22.04
 
Driver Version: 550.107.02
 
CUDA: 12.1
 
軟件包:conda python3.10 torch2.4 vllm0.6.1
 
測試模型:
這次我們分別測試了單GPU、雙GPU以及四卡GPU的表現情況。并在不同的模型下進行測試,模型參數分別為8B/13B/32B/70B,具體模型名稱如下:
 
Meta-Llama-3.1-8B-Instruct
 
Baichuan2-13B-Chat
 
Qwen1.5-32B-Chat
 
Meta-Llama-3.1-70B-Instruct
 
說明:接下來的推理測試,會使用FP16或FP8格式進行測試。在模型名稱的后綴,如果有FP8字樣,則使用的是FP8格式,否則使用的是FP16格式。
 
FP8是NVIDIA、Arm、Intel聯合推出的8位浮點數據格式,用于加速深度學習訓練和推理。相對于常用的半精度FP16而言,FP8在不損失多少精度的情況下,將顯存的占用大小減少了一半,特別適合于將大模型部署于工作站上。FP8訓練利用E5M2/E4M3格式,具備與FP16相當的動態范圍,適用于反向傳播與前向傳播。FP8訓練在相同加速平臺上的峰值性能顯著超越FP16/BF16,并且模型參數越大,訓練加速效果越好,且其與16-bits訓練在收斂性和下游任務表現上無顯著差異。
 
推理框架:
vllm推理引擎來進行測試,為最大程度利用GPU顯存,將其GPU utilization參數設置為0.99。
 
述語說明:
Batch size: 推理或訓練時輸入的數據批量數量,為1表示單個輸入,例如一段文字,為2表明同時進行兩段文字的生成,以此類推。它代表的是用戶并發數量。
 
token/s:推理或訓練的速度,每秒生成的數量。一個token是代表一個單詞或詞根,如果是中文的話,可能是一個字或一個詞。
 
AI 應用場景測試列表

 

知識分享更多>>

全新Q5L上市、全新A6L首秀!越過千萬輛之巔的奧迪,再度啟航 現代帕里斯帝獲得北美年度汽車! 一份年度成績單,再證CR-V“全維度”哲學 上汽大眾首款9系旗艦ID. ERA 9X亮相:一款車,一場轉型的宣言 極狐喬心昱:北汽新能源自動駕駛技術全覆蓋 L3級至L4級全貫通 50萬內實用標桿?廣汽本田新款飛度正式上市 煥新價6.68萬元 央視鏡頭直擊-21℃極寒戰場!東風睿立達完成中汽冬測,破解物流凍阻難題 本田汽車近日官宣品牌標識煥新計劃,沿用多年的經典\"H\"標將升級為全新設計版本,新標識定于2027年正式啟用 星動紀元與順豐科技簽約,推動具身智能機器人在供應鏈落地 德系豪華三強,連續兩年失守中國市場 萬能的《甄嬛傳》,在迅雷反腐這兒就失靈了? 沃爾沃EX60純電SUV將搭載谷歌Gemini AI,配大尺寸豎屏 聯發科發布天璣9500s:3nm工藝,支持硬件級光線追蹤技術 消息稱鴻蒙智行1月20日前后分批推送華為乾崑智駕ADS 4.1 美運營商Verizon服務中斷十小時:波及數十萬人,官方承諾補償 金融時報:蘋果避開AI燒錢大戰,卻成為谷歌與OpenAI的“造王者” 李小龍透露華為手表市場份額超手機,國內超30%使用非華為手機 賈國龍確認:西貝將關閉102家門店 “酸菜魚之王”賣不動了? 太二親手拆招牌,轉戰川菜賽道 日本霸占20年的汽車銷量第一寶座,2026年被中國掀翻了? 為何中國茶業跑不出一個「茅臺」? 房企聚焦核心城市“掐尖”,北上杭三城2025年土地出讓收入均超千億元 順豐同城元旦同城配送單量同比增55%,攜手敦煌美術研究所神馬IP共啟新年 AMD預告MI500處理器,性能提升千倍!還首秀了商用人形機器人 京東數字人上線“直播間復刻”功能 阿里Qoder升級補全功能,AI代碼采納率提升65% 3.2億元新訂單!佑駕創新智能座艙方案獲全球知名車企定點 FF任命企業家及私募股權投資人Shahryar Oveissi擔任戰略顧問 特斯拉將考慮自建芯片工廠;馬斯克萬億美元薪酬方案獲批;日產汽車上季度營業利潤轉正 馬斯克:特斯拉擬自建芯片工廠,并考慮與英特爾合作
主站蜘蛛池模板: 亚洲欧洲久久 | 国产四区在线观看 | 中文在线www | 综合狠狠| 亚洲激情在线观看 | 性猛交xxxx| 欧美日a| 久久国产麻豆 | 成年人在线观看视频网站 | 成人欧美一区二区三区黑人孕妇 | 天堂精品视频 | 亚洲天堂中文字幕在线观看 | 亚洲人在线| 日韩三级av在线 | 黄色大片黄色大片 | 成人激情小视频 | 中文字幕视频网 | 色一区二区 | 久久久777 | 色男人的天堂 | 久久精品一区 | 婷婷狠狠爱| 日韩激情啪啪 | 亚洲拍拍拍 | 一二区视频 | 超碰一区二区三区 | 一区二区三区国产精品 | 亚洲美女一区二区三区 | va婷婷在线免费观看 | 999久久久精品 | 亚洲高清成人 | 欧美大胆性生活 | 亚洲国产第一 | www,av| 久久久久久免费 | 蜜桃传媒一区二区 | 青娱乐成人 | 91亚洲国产成人久久精品网站 | 国内三级视频 | 91人人视频 | 日韩在线不卡 |