運用BF16與NHWC技術實現進階版LLM微調訓練最佳化
本文要來介紹如何利用BF16半精度浮點數以及將影像資料設為NHWC格式兩項技術,來最佳化大型AI模型的訓練速度與記憶體節省,並延續以
【創業小聚】想做AI美圖只需複製指令,Civitai一年突破300萬用戶成AI圖片專用平台
特別是AI產圖,厲害的專家總是可以產出一張張美麗的圖片,自己使用起來卻始終不得要領。AI圖片生成社群平台Civitai試圖解決這個問題:使用者可以直接利用其他創作者生成AI圖片的指令,生成出自己想要的圖片。
【創業小聚】別再寄罐頭信!新創Nureply用AI產生「破冰句」,提升2.4倍開信率
土耳其新創Nureply利用生成式AI推出客製化陌生開發信撰寫軟體,大幅提升2.4倍開信率,並減少額外的時間、人力成本在郵件撰寫的支出。
如何利用低位元量化技術進一步提升大模型推論性能
相比運算量的增加,大模型推論速度更容易受到記憶體頻寬的影響,導致算力資源無法得到充分發揮,進而影響性能;低位元量化技術是讓大語言模型(LLM)在部署過程中實現性能需求的最佳方案之一,本文將探討低位元量化技術如何幫助LLM提升性能,以及新版OpenVINO對於低位元量化技術的支援。
活用IPEX和Intel GPU加速大型語言模型訓練效率
以IPEX (Intel-Extension-for-PyTorch)搭配Intel硬體產品,可提供最佳化功能大幅提升運作效能。例如透過PyTorch的