Local LLM için model önerisi


Yeni yeni local modellerle ilgileniyorum da bu Uncensored derken tam olarak ne oluyor, farkı nedir tam olarak?
Şu an qwen3.8:27b kullanıyorum güzel cevap veriyor gibi , lakin uzun kullanma şansım olmadı.
Dediğiniz versiyonu kurmalı mıyım?
 

Qwen 3.8 27b'de 5070'le ortalama 7-8 dakikada cevap alan gordum ben. Sizdeki kartla mumkun degil. Local LLM calistirmak cok ciddi donanim isteyen bir sey.


Uncensored'de etik degerlere takilmiyor nasil meth yapabilecegini bile anlatiyor.
 
Qwen 3.8 27b'de 5070'le ortalama 7-8 dakikada cevap alan gordum ben. Sizdeki kartla mumkun degil. Local LLM calistirmak cok ciddi donanim isteyen bir sey.



Uncensored'de etik degerlere takilmiyor nasil meth yapabilecegini bile anlatiyor.
Benim amacım daha çok kod yazma kalitesi yüksek olsun , çok gerekli değil gibi.
 
Bu sisteme bonsai mantıklı gibi bir arkadaş yazmış, ona katılıyorum. Gemma 12B olabilir belki. Bu arada abliterated uncensored heretic modeller çok bozuk oluyor, tam dengeyi tutturamıyorlar; halüsinasyon ve zeka geriliği oluyor. Onun için de yüksek bitleri seçilebilir. Gene de esas modeli gibi olmaz.

Ek bilgi olarak bu adamın ekstra UD uzantılı sıkıştırma yöntemi var, her modele ekliyor. Mesela normal sıkıştırma ile 4 bit bilgisayar kaldırırken, bu modellerde 5 bit yükleme şansı olabiliyor. Ben de Ollama kullanıyorum; ancak Hugging Face'den bu adamın quant modellerine bakarım, uygunsa ondan indiririm. En son Qwen 3.8 27B'yi 5 bit yükledim, baya memnunum.

 
Son düzenleme:
Qwen 3.8 27b'de 5070'le ortalama 7-8 dakikada cevap alan gordum ben. Sizdeki kartla mumkun degil. Local LLM calistirmak cok ciddi donanim isteyen bir sey.



Uncensored'de etik degerlere takilmiyor nasil meth yapabilecegini bile anlatiyor.
12GB kart beklenti yüksek olmamalı. Think ve 32 GB ram birleşince yine iyi performans vermiş. En az 24GB gpu kullanmalı. Aynı sorunları bende yaşıyorum.
 
Bu siteyi kullanmak için çerezler gereklidir. Siteyi kullanmaya devam etmek için çerezleri kabul etmelisiniz. Daha Fazlasını Öğren.…