Local LLM Dil Çevirisi Benchmark'ı

Ben de bu modeli denedim, LMStudio ile ayarlar doğru mu, hız falan olması gerektiği gibi mi? @Utku92 45.85 tok/sec galiba




 
GPU offload fullediniz mi?

Lm Studio'yu ben sadece huggingface de model aramak için kullanıyorum. Pratik diye.
Evet, GPU Offload 64 katman Full MAX olarak seçili, modelin tamamı VRAM'de

Görev Yöneticisi'nde kartın 16 GB belleğinin 13,5 GB'ı dolu ve sistem Shared GPU Memory yok 0,2 GB

 
Evet, GPU offload 64 katman Full Max olarak seçili, modelin tamamı VRAM'de.

Görev Yöneticisi'nde kartın 16 GB belleğinin 13,5 GB'ı dolu ve sistem shared GPU Memory yok 0,2 GB.

Eki Görüntüle 284122

CPU da fulleyin. Ollamada daha iyi çalışır aslında.

Modelfiledaki değerleri aynısını girin bulabildiğinizi.
 
Bu siteyi kullanmak için çerezler gereklidir. Siteyi kullanmaya devam etmek için çerezleri kabul etmelisiniz. Daha Fazlasını Öğren.…