Local LLM için model önerisi


Yeni yeni local modellerle ilgileniyorum da bu Uncensored derken tam olarak ne oluyor, farkı nedir tam olarak?
Şu an qwen3.8:27b kullanıyorum güzel cevap veriyor gibi , lakin uzun kullanma şansım olmadı.
Dediğiniz versiyonu kurmalı mıyım?
 

Qwen 3.8 27b'de 5070'le ortalama 7-8 dakikada cevap alan gordum ben. Sizdeki kartla mumkun degil. Local LLM calistirmak cok ciddi donanim isteyen bir sey.


Uncensored'de etik degerlere takilmiyor nasil meth yapabilecegini bile anlatiyor.
 
Qwen 3.8 27b'de 5070'le ortalama 7-8 dakikada cevap alan gordum ben. Sizdeki kartla mumkun degil. Local LLM calistirmak cok ciddi donanim isteyen bir sey.



Uncensored'de etik degerlere takilmiyor nasil meth yapabilecegini bile anlatiyor.
Benim amacım daha çok kod yazma kalitesi yüksek olsun , çok gerekli değil gibi.
 
Bu sisteme bonsai mantıklı gibi bir arkadaş yazmış, ona katılıyorum. Gemma 12B olabilir belki. Bu arada abliterated uncensored heretic modeller çok bozuk oluyor, tam dengeyi tutturamıyorlar; halüsinasyon ve zeka geriliği oluyor. Onun için de yüksek bitleri seçilebilir. Gene de esas modeli gibi olmaz.

Ek bilgi olarak bu adamın ekstra UD uzantılı sıkıştırma yöntemi var, her modele ekliyor. Mesela normal sıkıştırma ile 4 bit bilgisayar kaldırırken, bu modellerde 5 bit yükleme şansı olabiliyor. Ben de Ollama kullanıyorum; ancak Hugging Face'den bu adamın quant modellerine bakarım, uygunsa ondan indiririm. En son Qwen 3.8 27B'yi 5 bit yükledim, baya memnunum.

 
Son düzenleme:
Bu siteyi kullanmak için çerezler gereklidir. Siteyi kullanmaya devam etmek için çerezleri kabul etmelisiniz. Daha Fazlasını Öğren.…