亚洲国产综合精品一区,综合伊人久久在,久久高清内射无套,天堂√在线中文官网在线,亚洲—本道中文字幕东京热,亚洲高清专区日韩精品,超碰免费公开,国内免费久久久久久久久
歡迎訪問深圳市中小企業(yè)公共服務(wù)平臺(tái)電子信息窗口

Arm 計(jì)算平臺(tái)加持,全新 Llama 3.2 LLM實(shí)現(xiàn)AI 推理的全面加速和擴(kuò)展

2024-09-27 來源:Arm
4905

關(guān)鍵詞: Arm Meta Llama 3.2 AI 邊緣側(cè) 合作 開源 小型模型 云端 Kleidi PyTorch CPU 設(shè)備 未來

新聞重點(diǎn):
在 Arm CPU 上運(yùn)行 Meta 最新 Llama 3.2 版本,其云端到邊緣側(cè)的性能均得到顯著提升,這為未來 AI 工作負(fù)載提供了強(qiáng)大支持
Meta 與 Arm 的合作加快了用例的創(chuàng)新速度,例如個(gè)性化的端側(cè)推薦以及日常任務(wù)自動(dòng)化等
Arm 十年來始終積極投資AI領(lǐng)域,并廣泛開展開源合作,為 1B 至 90B 的 LLM 實(shí)現(xiàn)在 Arm 計(jì)算平臺(tái)上無縫運(yùn)行
 
人工智能 (AI) 的迅猛發(fā)展意味著大語言模型 (LLM) 的新版本不斷推陳出新。要充分發(fā)揮 AI 的潛力并抓住其帶來的機(jī)遇,需要實(shí)現(xiàn) LLM 從云端到邊緣側(cè)的廣泛部署,而這也伴隨著對(duì)計(jì)算和能源需求的大幅增長(zhǎng)。整個(gè)生態(tài)系統(tǒng)正攜手尋找應(yīng)對(duì)這一挑戰(zhàn)的解決方案,不斷推出新的更加高效的開源 LLM,以便大規(guī)模實(shí)現(xiàn)各種 AI 推理工作負(fù)載,加快為用戶帶來全新、快速的 AI 體驗(yàn)。

為此,Arm與Meta 展開緊密合作,在 Arm CPU 上啟用新的Llama 3.2 LLM,集成開源創(chuàng)新與 Arm 計(jì)算平臺(tái)的優(yōu)勢(shì),顯著推進(jìn)了解決AI挑戰(zhàn)的進(jìn)程。得益于Arm 的持續(xù)投資及與新型LLM 的合作, Arm CPU運(yùn)行 AI 的優(yōu)勢(shì)在生態(tài)系統(tǒng)中脫穎而出,使Arm成為 AI 推理開發(fā)者的首選平臺(tái)。

加速云到邊緣側(cè)的 AI 性能

小型 LLM(如 Llama 3.2 1B 和 3B)能夠支持基于文本的基礎(chǔ)生成式 AI 工作負(fù)載,對(duì)于大規(guī)模 AI 推理的實(shí)現(xiàn)至關(guān)重要。通過 Arm CPU 優(yōu)化內(nèi)核在 Arm 技術(shù)驅(qū)動(dòng)的移動(dòng)設(shè)備上運(yùn)行新的 Llama 3.2 3B LLM,可讓提示詞處理速度提高五倍,詞元 (token) 生成速度提高三倍,在生成階段實(shí)現(xiàn)每秒 19.92 個(gè)詞元。這將直接減少了在設(shè)備上處理 AI 工作負(fù)載的延遲,大大提升了用戶整體體驗(yàn)。此外,當(dāng)邊緣側(cè)能處理的 AI 工作負(fù)載越多,往返云端傳輸數(shù)據(jù)所節(jié)省的電量就越多,進(jìn)而節(jié)省了能源和成本。
 
除了在邊緣側(cè)運(yùn)行小型模型,Arm CPU同樣支持在云端運(yùn)行更大的模型(如 Llama 3.2 11B 和 90B)。11B 和 90B 的模型非常適合云端基于 CPU 的推理工作負(fù)載,可生成文本和圖像,其中,在 Arm Neoverse V2 上的測(cè)試結(jié)果展現(xiàn)出了更大的性能提升。在基于 Arm 架構(gòu)的 AWS Graviton4 上運(yùn)行 11B 的圖像和文本模型,可以在生成階段實(shí)現(xiàn)每秒 29.3 個(gè)詞元的表現(xiàn),遠(yuǎn)遠(yuǎn)超出了人類大約每秒閱讀五個(gè)詞元的速度。
 
AI 將通過開源創(chuàng)新和生態(tài)系統(tǒng)協(xié)作迅速擴(kuò)展

能公開獲取新的 LLMs(如Llama 3.2)至關(guān)重要。開源創(chuàng)新正以迅猛速度發(fā)展,在之前的版本中,開源社區(qū)在不到 24 小時(shí)的時(shí)間內(nèi)便能在 Arm 上部署并運(yùn)行新的 LLM。
 
Arm將通過 Arm Kleidi 進(jìn)一步支持軟件社區(qū),讓整個(gè) AI 技術(shù)棧能夠充分發(fā)揮這一優(yōu)化的 CPU 性能。Kleidi 可在任何 AI 框架上解鎖 Arm Cortex 和 Neoverse CPU 的 AI 功能和性能,無需應(yīng)用程序開發(fā)者進(jìn)行額外的集成工作。
 
通過最近的 Kleidi 與 PyTorch 集成以及正在推進(jìn)的與 ExecuTorch 集成,Arm正在為基于 Arm CPU的開發(fā)者提供從云端到邊緣側(cè)的無縫 AI 性能。得益于Kleidi 與 PyTorch 的集成,在基于 Arm 架構(gòu)的 AWS Graviton 處理器上運(yùn)行 Llama 3 LLM 的詞元首次響應(yīng)時(shí)間加快了 2.5 倍。

同時(shí),在端側(cè),與參考實(shí)現(xiàn)相比,在 KleidiAI 庫的加持下,使用 llama.cpp庫在新的 Arm Cortex-X925 CPU 上運(yùn)行 Llama 3 的詞元首次響應(yīng)時(shí)間加快了 190%。
 
構(gòu)建 AI 的未來

Arm 與 Meta 的合作成為了行業(yè)合作的新標(biāo)桿,匯聚了 Arm 計(jì)算平臺(tái)的靈活性、普及性和 AI 功能,以及 Meta 等行業(yè)巨頭的技術(shù)專長(zhǎng),共同解鎖AI 廣泛應(yīng)用的新機(jī)遇。無論是利用端側(cè) LLM 滿足用戶的個(gè)性化需求,如根據(jù)用戶所處的位置、日程和偏好來執(zhí)行任務(wù),還是通過企業(yè)級(jí)應(yīng)用來優(yōu)化工作效率,讓用戶能夠更專注于戰(zhàn)略性任務(wù),Arm 技術(shù)的集成都為未來奠定了基礎(chǔ)。未來,設(shè)備不再只是命令和控制工具,更是能在提升用戶整體體驗(yàn)方面扮演積極的作用。
 
在 Arm CPU 上運(yùn)行 Meta 最新 Llama 3.2 版本,其AI 性能實(shí)現(xiàn)了顯著提升。這類開放式合作是實(shí)現(xiàn)無處不在的 AI 創(chuàng)新、促進(jìn) AI 可持續(xù)發(fā)展的最佳途徑。通過新的 LLM、開源社區(qū)和 Arm 的計(jì)算平臺(tái),Arm 正在構(gòu)建 AI 的未來, 到 2025 年,將有 1000 多億臺(tái)基于 Arm 架構(gòu)的設(shè)備支持 AI。

關(guān)于 Arm

Arm 作為業(yè)界性能最強(qiáng)、能效最高的計(jì)算平臺(tái),以無可比擬的規(guī)模,覆蓋全球 100% 的聯(lián)網(wǎng)人群。Arm 提供先進(jìn)的解決方案以滿足對(duì)計(jì)算永無止盡的需求,進(jìn)而賦能全球領(lǐng)先的科技公司釋放前所未有的人工智能體驗(yàn)和性能。Arm 攜手全球最廣泛的計(jì)算生態(tài)系統(tǒng)和 2,000 萬軟件開發(fā)者,共同在 Arm 平臺(tái)上構(gòu)建人工智能的未來。



主站蜘蛛池模板: 天天做天天爱夜夜爽女人爽| 欧美人成视频在线视频| 精品无人区乱码1区2区3区在线| 亚洲全国最大的人成网站| 国产精品久久国产精品99 gif| 中文有码vs无码人妻| 亚洲依依成人综合网址| 国产欧美国日产在线播放| 亚洲国产精品高清在线第1页| 久久久喷潮一区二区三区| 中文字幕日韩人妻不卡一区| 欧美日韩视频无码一区二区三| 精品国产乱码久久久久久浪潮小说| 少妇被粗大的猛进69视频 | 99久久久无码国产麻豆| 九九精品无码专区免费| 亚洲国产精品久久艾草纯爱| 初尝黑人嗷嗷叫中文字幕| 7777精品伊久久久大香线蕉| 色五月丁香五月综合五月4438| 国产精品日日做人人爱| 欧美乱妇高清无乱码| 国偷自产一区二区免费视频| 男男车车的车车网站w98免费| 天天狠天天透天干天天| 无码纯肉动漫在线观看| 国产精品无卡毛片视频| 国产国语熟妇视频在线观看| 午夜福利院电影| 一本色道久久综合亚洲精品| 国产精品麻豆va在线播放| 夜鲁鲁鲁夜夜综合视频欧美 | .精品久久久麻豆国产精品| 人妻去按摩店被黑人按中出| 亚洲女同一区二区| 狠狠婷婷色五月中文字幕| 人妻无码系列一区二区三区| 国产精品制服| 色诱久久久久综合网ywww| 国产自在自线午夜精品| 亚洲女同一区二区|