Katılım
22 Aralık 2023
Mesajlar
4.017
Makaleler
4
Çözümler
22
Beğeniler
6.464
Aşağıdaki sistemde hangi model daha verimli çalışır? Genel kullanım ve görsel oluşturma için ayrı ayrı modeller önerirseniz sevinirim. Bir de hangi platform kullanılmalı?

Sistem:
  • Ryzen 7 5700X.
  • 32 GB RAM.
  • Axle 2070 ITX (2060 Super gücünde sayabilirsiniz).
  • 1 TB SSD.
 
Ollamadaki modelleri incelebilirsiniz. Ben zamanla agentım için local LLM kullanmıştım ama şu anda Groq (Grok değil) kullanıyorum.
 
Son düzenleyen: Moderatör:
Şu anda frontier diyebileceğimiz modeller Gemma 4 ve Qwen 3.8. Bunlardan birini indirebilirsiniz. LLM'lerde resim yapma yeteneği yok, ayrıca model indirmeniz lazım ona. Onda da FLUX 2 ve Qwen Image şu anda localde en iyileri.
 
Gücü RAM'den alacak o yüzden güçlü modeller pek çalıştıramayabilir lm Studio önerebilirim ilk bunlarla uğraşmak için uygun yeni çıkmış olan bonsai adında yapay zekâ var küçük ama 1bit 27b parametre sahip iyidir ama kodlama düşünüyorsan qwen3.8 27b iyidir bunlar maksimum senin sistem bunun üstüne hiç açmaz düşüt bit modellere yönel.
 
Anladığım kadarıyla Qwen 3.8 27B çalıştırabileceğim maksimum seviye. LM Studio üzerinden Qwen 3.8 ve GitHub üzerinden Comfy UI yükleyeceğim gibi duruyor.

Bu sistemle local llm calistirmak zor onu bastan diyeyim. Cok verim almazsin yani.

Sistem benim değil, kuzenimin. NVIDIA kartı olduğundan onun sistemi üzerinde denemek istedim.
 
Son düzenleyen: Moderatör:
Gemma 4'un E2B olaninin LM Studio'da calisabilmesi lazim o GPU ile. Tabii Gemma 4 26B gibi seylere kiyasla cok daha ''salak''.

Gorsel olusturma isi bambaska bir kol ancak LLM kullanimi icin bir seyler ariyorsaniz, ne tarz bir sey icin aradiginizi (roleplay, brainstorming vs.) soylerseniz ona gore model onerilir. LM Studio'da ''Explore'' sekmesinde modellere bakarken program size sigip, sigmayacagini soyluyor zaten.
 
Gemma 4'un e2b olaninin lm Studio'da calisabilmesi lazim o GPU ile. Tabii gemma 4 26b gibi seylere kiyasla cok daha "salak".

Gorsel olusturma isi bambaska bir kol ancak llm kullanimi icin bir seyler ariyorsaniz, ne tarz bir şey icin aradiginizi (roleplay, brainstorming vs.) Soylerseniz ona gore model onerilir. Lm Studio'da "explore" sekmesinde modellere bakarken program size sigip, sigmayacagini soyluyor zaten.

Deneme amaçlı genel bir yapay zekâ arıyorum.
 
Anladığım kadarı ile Qwen 3.8 27b çalıştırabileceğim maksimum seviye.
1787247124319.webp


En hafif varyantinda bile 16 GB VRAM ve 32 GB RAM'li bir sistemde ''partial GPU offload'' gosteriyor, sizin bilgisayarda dusunemiyorum. Model calisir muhtemelen calismasina ancak saniye basi token degeriniz cok dusuk olacaktir muhtemelen.

Uncensored model olmasi (her seye tamam abi ceken bir model) bozmayacaksa HauhauCS abimizin Uncensored Qwen 3.6-27B-A3B modeli var, onun Q2 K P varyanti guzel, dusunebilirsiniz. Tabii bu model de VRAM'e sigmayacagi icin RAM'e vuracaktir, yapabilecek bir sey yok.

Tamamen 8GB VRAM'e sigabilecek bir Qwen modeli oldugunu sanmiyorum.