oğuz sasi

Bilgin
Katılım
7 Ağustos 2024
Mesajlar
2.191
Çözümler
8
Beğeniler
999
Yer
çılgın_kurye34
Ekran kartım RX 9070 XT. Fakat sistem RAM'im düşük, 16 GB. Orta - ağır kodlama senaryolarında hangi AI'yi önerirsiniz? MCP ve web search yeteneklerini kazandırmak için Claude Desktop ile kullanacağım.
 
Son düzenleyen: Moderatör:
Vallahi qwen 3.8 yaklaşık 8 token veriyor 9070XT ile hatta 10k karakterli lorem IPS'um oluşturmasını isteyip değeri atayım.

Thinking açık
1791328436136.webp


Thinking kapalı
1791328644252.webp


qwen3 coder next, qwen3 coder 30b,

Şu arkadaşı övenler gördüm indirmeye ekledim sabah denerim.
 
Son düzenleme:
Denediniz mi hocam? Ek olarak tokenden memnun musunuz rahatsız edici düzeyde yavaş mı? Sistem RAM'iniz kaç GB bir de merak ettim.

16 GB RAM var sistemde. :D vaktizamanında abimden tanesi 650₺'den 4x8 32 GB ışıklı HyperX'leri almam lazımdı.
Thinking açık.

1791386760047.webp


Thinking kapalı.

1791386869096.webp


Yani Qwen'e göre çok daha seri sonuçlar veriyor, hani direkt kod yazdırmak için bakamadım pek bilgisayar başına oturamadığımdan ancak 1 saat içinde ufak tefek bir HTML sayfa yazdırıp test edip Astra'ya hangisinin daha iyi yazdırdığını sorarak ve inceleyerek bir geri dönüş sağlarım.

Yani sonuçlar birazcık geç gelecek ama olsun. Ollama ile ölme eşeğim ölme en ufak çıktı bile 10 dakikayı buluyordu. Bende koboldcpp ile VS Code continue bağlantısı kurarak koboltcpp üzerinden cevap süresini bayağı bir kısalttım.

Qwen3-coder ile 7/8dk kadar bir sürede bir site örneği oluşturdu. Oluşturdu ancak qwen3.8 ve huhui ile birlikte maalesef ki 500 token sınıra takılıp düzgün bir çıktı alamadım. Özellikle qwen3.8'de zaten düşünme'yi iptal edemediğimden sebep 5000 tokenden 2000 kadarı düşünmeye gidiyordu onu da zar zor çıktı olarak verebiliyordu.

Şimdi 16k Token'e çıkardım huhui çalışıyor yetmezse 32K'ye çıkarırım çalıştırırım bakalım... Ancak maalesef ki 9070XT AI ile çalışmak için pek değil hiç uyumlu bir kart değil...
 
Son düzenleme:
16 GB RAM var sistemde. :D vaktizamanında abimden tanesi 650₺'den 4x8 32 GB ışıklı HyperX'leri almam lazımdı.
Thinking açık.

Eki Görüntüle 284043

Thinking kapalı.

Eki Görüntüle 284046

Yani Qwen'e göre çok daha seri sonuçlar veriyor, hani direkt kod yazdırmak için bakamadım pek bilgisayar başına oturamadığımdan ancak 1 saat içinde ufak tefek bir HTML sayfa yazdırıp test edip Astra'ya hangisinin daha iyi yazdırdığını sorarak ve inceleyerek bir geri dönüş sağlarım.

Yani sonuçlar birazcık geç gelecek ama olsun. Ollama ile ölme eşeğim ölme en ufak çıktı bile 10 dakikayı buluyordu. Bende koboldcpp ile VS Code continue bağlantısı kurarak koboltcpp üzerinden cevap süresini bayağı bir kısalttım.

Qwen3-coder ile 7/8dk kadar bir sürede bir site örneği oluşturdu. Oluşturdu ancak qwen3.8 ve huhui ile birlikte maalesef ki 500 token sınıra takılıp düzgün bir çıktı alamadım. Özellikle qwen3.8'de zaten düşünme'yi iptal edemediğimden sebep 5000 tokenden 2000 kadarı düşünmeye gidiyordu onu da zar zor çıktı olarak verebiliyordu.

Şimdi 16k Token'e çıkardım huhui çalışıyor yetmezse 32K'ye çıkarırım çalıştırırım bakalım... Ancak maalesef ki 9070XT AI ile çalışmak için pek değil hiç uyumlu bir kart değil...
1791445314502.webp


Gönül isterdi ki 3x 3090 ile bu testleri yapmak... Ama yine de bu karta göre bence kafi değerler. Çok bir şey beklememek lazım ya.