yandex
ankara seo
ankara web tasarım
27.07.2024 -

Ankara Son Dakika Haber

Yandex, GPU Kaynaklarında %20’ye Kadar Tasarruf Sağlayan LLM Eğitim Aracını Açık Kaynak Olarak Kullanıma Sundu

YaFSDP’nin kesin sürat artışı %26’ya ulaşıyor. GPU kullanımında sağlanan optimizasyon, geliştiricilerin ve şirketlerin potansiyel olarak ayda yüz binlerce dolar tasarruf etmesini sağlıyor.

Yandex, GPU Kaynaklarında %20’ye Kadar Tasarruf Sağlayan LLM Eğitim Aracını Açık Kaynak Olarak Kullanıma Sundu


Global teknoloji şirketi Yandex, büyük lisan modellerinin (Large Language Model-LLM) eğitimi için yeni ve açık kaynaklı bir formül olan YaFSDP’yi tanıttı. YaFSDP şu anda GPU irtibatını geliştirmek ve LLM eğitiminde bellek kullanımını azaltmak için halka açık en tesirli metodu simgeliyor. Sistem, mimariye ve parametre sayısına bağlı olarak FSDP’ye kıyasla %26’ya varan hızlanma sunuyor. YaFSDP kullanımıyla LLM’lerin eğitim müddetinin azaltılması, GPU kaynaklarında %20’ye varan tasarruf sağlama potansiyeline sahip oluyor.

Küresel yapay zeka topluluğunun gelişimine manalı bir katkı sunma emeliyle Yandex, YaFSDP’yi dünya çapındaki LLM geliştiricilerinin ve yapay zeka meraklılarının kullanımına açtı.

Yandex’te kıdemli geliştirici olarak vazife yapan ve YaFSDP’nin ardındaki grubun modülü olan Mikhail Khruschev, şunları söyledi: “Şu anda YaFSDP’nin çok taraflılığını genişletmek için çeşitli model mimarileri ve parametre boyutları üzerinde faal olarak deneyler yapıyoruz. LLM eğitimindeki gelişmelerimizi global ML topluluğuyla paylaşmaktan, dünya genelindeki araştırmacılar ve geliştiriciler için erişilebilirliğin ve verimliliğin artmasına katkıda bulunmaktan heyecan duyuyoruz.”

YaFSDP’nin Türkiye’deki Lisan Modeli Geliştirme Projelerine Katkıları 

Türkiye’de yer alan çeşitli teknoloji ve finans kuruluşları, Türkçe lisan modelleri geliştirerek bu alanda dünya çapında değerli projelere imza atıyor. Türkiye’de geliştirilen bu büyük lisan modelleri, Yandex’in sunduğu YaFSDP yolu ile kıymetli avantajlar elde edebilir. YaFSDP’nin sunduğu GPU tasarrufları ve eğitim hızlandırmaları, bu projelerin daha verimli ve maliyet aktif bir halde gerçekleştirilmesine katkıda bulunabilir. Bilhassa, lisan modeli eğitimi sırasında GPU kaynaklarında %20’ye varan tasarruf sağlanması ve %26’ya kadar hızlanma elde edilmesi, bu projelerin hem ekonomik hem de operasyonel açıdan daha sürdürülebilir olmasını sağlayabilir.

Neden YaFSDP tercih edilmeli

LLM’lerin eğitimi vakit alıcı ve ağır kaynak gerektiren bir süreç oluyor. Kendi LLM’lerini geliştirmek isteyen makine tahsili mühendisleri ve şirketler, bu modellerin eğitimi için kıymetli ölçüde vakit ve GPU kaynağı, münasebetiyle para harcamak zorunda kalıyor. Model ne kadar büyükse, eğitimi için gereken vakit ve masraf da o kadar artıyor.

Yandex YaFSDP, GPU bağlantısındaki verimsizliği ortadan kaldırarak GPU etkileşimlerini kesintisiz hale getiriyor ve eğitimin sadece gerektiği kadar süreç belleği kullanmasını sağlıyor.

YaFSDP, öğrenme suratını ve performansını optimize ederek dünya çapındaki yapay zeka geliştiricilerinin modellerini eğitirken daha az bilgi süreç gücü ve GPU kaynağı kullanmalarına yardımcı oluyor. Örneğin, 70 milyar parametreli bir modeli içeren ön eğitim senaryosunda, YaFSDP kullanmak yaklaşık 150 GPU kaynağına denk tasarruf sağlama potansiyeline sahip bulunuyor. Bu da sanal GPU sağlayıcısına yahut platformuna bağlı olarak ayda kabaca 500 bin ila 1,5 milyon dolar tasarruf anlamına geliyor.

YaFSDP eğitim verimliliği

FSDP’nin geliştirilmiş bir versiyonu olan YaFSDP, ön eğitim, hizalama ve ince ayar üzere LLM eğitiminin bağlantı yüklü kademelerinde FSDP sistemine kıyasla daha güzel performans gösteriyor. YaFSDP’nin Llama 2 ve Llama 3 üzerinde gösterdiği son hızlanma, Llama 2 70B ve Llama 3 70B üzerinde sırasıyla %21 ve %26’ya ulaşarak eğitim suratında kıymetli gelişmeler olduğunu ortaya koyuyor.

Mikhail Khruschev, “YaFSDP, 13 ila 70 milyar parametre ortasında değişen modellerde etkileyici sonuçlar gösterdi ve bilhassa 30 ila 70 milyar aralığında güçlü bir performans sergiledi. YaFSDP, şu an LLaMA mimarisine dayalı yaygın olarak kullanılan açık kaynaklı modeller ortasında en uygun olanıdır” diyor.

YaFSDP, Yandex’in sunduğu birinci açık kaynaklı araç değil. Şirket daha evvel ML topluluğu ortasında tanınan hale gelen öbür araçlar da paylaşmıştı:

  • CatBoost, karar ağaçlarında gradyan artırma için yüksek performanslı kütüphane.
  • YTsaurus, dağıtık depolama ve sürece için büyük bilgi platformu.
  • AQLM, Yandex Araştırma, HSE Üniversitesi, Skoltech, IST Avusturya ve NeuralMagic tarafından ortaklaşa geliştirilen büyük lisan modellerinin çok sıkıştırılması için en gelişmiş niceleme algoritması.
  • Petals, Yandex Research, HSE University, University of Washington, Hugging Face, ENS Paris-Saclay ve Yandex School of Veri Analysis işbirliğiyle geliştirilen, LLM’lerin eğitim ve ince ayar sürecini kolaylaştırmak için tasarlanmış kütüphane.

Kaynak: (BYZHA) Beyaz Haber Ajansı

author avatar
Ankara Gündem Haber
BU KONUYU SOSYAL MEDYA HESAPLARINDA PAYLAŞ
ZİYARETÇİ YORUMLARI

Henüz yorum yapılmamış. İlk yorumu aşağıdaki form aracılığıyla siz yapabilirsiniz.

BİR YORUM YAZ