reacin

Uzman
Katılım
25 Ağustos 2024
Mesajlar
5
Beğeniler
18
Birçoğunuz kumru.ai hakkında haklı olarak kötü düşüncelere sahipsiniz; ve evet, kumru. AI gerçekten şu anda kullanılamaz halde.
Peki, neden? Kumru'nun sıkıntısı ne?

Az çok bu işlere meraklı birisi olarak, araştırdım. Aslında pek araştırmaya gerek yok çünkü geliştiricileri sitenin en altında "Hakkında / SSS" kısmında belirtmişler.
Öncelikle, kumru.ai ile ilgili hiçbir BAĞIM yok, lütfen geliştiricilerinden biriymişim de; iyiye çıkarıyormuşum gibi bir izlenim oluşmasını istemem.
En çok karşılaşan problemlerden başlayayım; yanlış bilgi / matematik yapamama ve Recep Tayyip Erdoğan taraftarlığı(?)

1) Matematik
Bu sorun zaten ChatGPT ilk çıktığında onda da yaşanıyordu. Kumru şu anda yalnızca text-generation yapabiliyor, yani sadece YAZI üretebiliyor. Telefonunuzun klavye kısmının üst barındaki öneri kısmı kadar basit bir düzeyde.

GPT ise kullanıcının isteklerini anlar, ve ona göre bir işlem yürütür arka planda.

Şu anda GPT'de, ona bir matematik sorusu sorduğunuzda şu yaşanıyor:
Kullanıcı matematik problemi sorar > GPT bunu analiz eder, ve kullanıcının matematik sorusu sorduğunu anlar > arkada bir hesap makinesi çalıştırır, ve sonucu kullanıcıya süslü püslü bir şekilde iletir.

Kumru'da ise, şöyle çalışıyor:
Kullanıcı matematik problemi sorar > Kumru hiç düşünmeden direkt olarak cevap verir, saçmalar.

Çünkü arka planda çalışan bir analiz işlemi yok, sadece yazı üretebiliyor. Bu yüzden, problem çözme gibi bir yeteneği yok.
Ki, GPT'nin arkasında çalışan işlemin en büyük kanıtı da "Daha iyi bir cevap için düşünülüyor" kısmı. Bir matematik problemi attığınızda otomatik olarak bu moda geçer.

2) Yanlış Bilgi
Bunu, kumru.ai'nin web sitesinde direkt olarak belirtmişler.
"Yapay Zeka modellerine dair çözülmesi en zorlu problemlerden biri hatalı bilgi vermesi, yani halüsinasyonlar. Yapay zeka eğitilirken farklı aşamalardan geçiyor ve son aşama olan pekiştirmeli öğrenme (reinforcement learning from human feedback) ile bu halüsinasyonlar en aza indirgeniyor. OpenAI'ın ChatGPT'den önce 2022 başında sunduğu DaVinci-001 modeli de pekiştirmeli öğrenme aşamasından henüz geçmemişti ve bu yüzden bol miktarda halüsinasyon görüyordu. Kumru da, aynı DaVinci-001 modeli gibi, henüz pekiştirmeli öğrenme aşamasından geçmediği için hatalı bilgiler verebiliyor."

Açıkçası burası hakkında pek bir bilgim yok, o yüzden pek üstüne durmayacağım. Ama sosyal medyada gördüğünüz çoğu komik durum bunun yüzünden oluşuyor.

3) Siyasi Taraftarcılık
Kumru. AI geliştiricileri şöyle belirtmiş:
"Bunun alternatifi; LLaMA, Gemma, Qwen gibi aynı anda pek çok dilde eğitilmiş modelleri alıp istenen dilde ya da alanda bir miktar daha eğitmek ve ince ayar yapmak. Bu da hazır bir binayı alıp renove etmeye benzetilebilir, ancak bunun da dezavantajları var ve biz de bu sebeple ilkini seçtik."

Yani; sıfırdan Türkçe kaynaklar ile eğitmişler. Tabii ki bunun hakkında kesin bir şey söyleyemem; tahminlere dayalı ama muhtemelen kullandıkları kaynaklar biraz daha taraf tutan kaynaklar olmuş. Yapay zeka dil modelleri eğitildikleri şeyi değiştirip size sunarlar. Buna çok büyük örnek olarak, X'in Grok AI'sinin, sürekli Furkan Bölükbaşı'na hakaret etmesi verilebilir. Kullanıcılar X üzerinde Furkan Bölükbaşı'na çok fazla hakaret ediyordu. Grok ise X'den aldığı verilerle eğitildi, yani işin sonucunda "aa evet, herkes bu adama hakaret ediyorsa doğru olan budur, ben de yapmalıyım." diye düşündü; ve iş çığırından çıktı.

Şu anda Kumru, geliştirme sürecinin çok başında. Ancak Türkçe LLM geliştirme adına atılmış en büyük adımlardan biri olması açısından değerli.
Yani; anlayacağınız, iş tamamen "haha kumru ne kadar da salak asdasd Türkler yaparsa böyle olur" demekten ibaret değil. Destek olunacak yerde köstek olmanın hiçbir anlamı yok. İyi Sosyaller, okuduğunuz için teşekkür ederim. Bir yanlışım varsa düzeltin lütfen.
 
Bizim millet kendisi hiçbir şeyden anlamasa bile bilmiş gibi yapıp, sırf içinde bulunduğu cenahtan onay almak için başkasının kapısına tükürmeye bayılır. Çünkü toplumun sıkıntısı aşağılık psikolojisi. Hiçbirisinin bir şey yapabileceğine inanıp eline bir şey vermemişler ya da onaylamamışlar. Şimdi babadan anadan gördüğü muameleyi başkasına çekiyorlar.

Sürüm numarası 0.21. Beta bile değil Alpha. Feedback kasmak için öyle salmışlar ortalığa hemen Yerli ve Milli denince sağ cenah GPT'nin babası geldi, sol cenah da biz yapamayız yapamadık yapmayalım moduna girdiler ki adamların iktidarla falan da alakaları olmamasına rağmen Türkiye yüyzılı falan yorumları yapanlar oldu. Partizanlıktan beyinleri küflenmiş iki tarafın da. BTC Türk destekli kendi çapında bir girişim. Llama üzerinde çalışıyor, Türkçe ile beslenmiş ve bitmemiş, bir vaadi yok bu kadar.

9.10'mu 9.9'mu büyük sorusuna senelerdir 9.10 cevabı verirken geliştiricilere akıllarınca ChatGPT'ye feedback veren adamlar bugün matematik yapamayan halüsinasyondan önünü göremeyen bitmemiş bir modeli aşağılayarak kendi egolarını tatmin ediyorlar. Bu yüzden yurt dışına gittim ve işlerimi burada yapıyorum. Anadolu'da okul görmemiş köylü yüzünden değil, dedesi köylü kendisi sözde şehirli ukala çokbilmiş yarı cahiller her yaptığın işe bir kulp takıp minik beyniyle dalgaya alıyor seni. Sonra da Aziz Nesinden klişe alıntılar falan yaparlar kafayı yersin.
 
Yerli ve Milli denilince akla her zaman kötü Türk icatları, ve Recep Tayyip Erdoğan'ın yaptığı şeyler geliyor. Kumru.AI şu anda deneme aşamasında bunun uyarısı zaten yapıldı. Günümüzün ChatGPT'si ilk çıktığında böyle harika değildi. KumruAI de zamanla düzelecek inşallah. Şimdiden hemen atlamayın.
 
Kesinlikle takdir ediyorum bu girişimi ama henüz hiçbir işe yaramayıp ve hatalarla doluyken kullanıma sunmak bana hala biraz yanlış geliyor.
 
Kesinlikle takdir ediyorum bu girişimi ama henüz hiçbir işe yaramayıp ve hatalarla doluyken kullanıma sunmak bana hala biraz yanlış geliyor.
Basit bir dil modeli olarak huggingface'de yayınlanması güzel. Ama şu anda sırf basit bir text generation modeli için ayrı bir site açıp, bir de buna GPU harcatıp insanlara bu şekilde sunmak kesinlikle başlangıç için çok kötü bir fikir.

Basit bir dil modeli olarak huggingface'de yayınlanması güzel. Ama şu anda sırf basit bir text generation modeli için ayrı bir site açıp, bir de buna GPU harcatıp insanlara bu şekilde sunmak kesinlikle başlangıç için çok kötü bir fikir.
Yazıda eksik belirtmişim. Hakkında/SSS kısmında şöyle yazmışlar:

"Daha önce hiçbir veriye maruz kalmamış bir yapay zeka modelinin sıfırdan inşa edilip tüm eğitim süreçlerinden geçirilip eğitilmesi anlamına geliyor. Yani boş bir arsa alıp üstüne kaba mimari planı olan bir binayı, istediğiniz malzemeyi kullanarak, detay tasarım kararlarını vererek sıfırdan inşa etmeye benziyor.

Bunun alternatifi; LLaMA, Gemma, Qwen gibi aynı anda pek çok dilde eğitilmiş modelleri alıp istenen dilde ya da alanda bir miktar daha eğitmek ve ince ayar yapmak. Bu da hazır bir binayı alıp renove etmeye benzetilebilir, ancak bunun da dezavantajları var ve biz de bu sebeple ilkini seçtik."


Yani LLaMA altyapısı kullanılmamış, sıfırdan eğitilmiş.
 
Son düzenleme:
İnternetten indirip lm Studio ile kullandığınız 5 GB llama versiyonu bile daha iyi çalışıyor. Aynı altyapıyı kullanıp bu kadar yanlış eğitebilmek gerçekten takdire şayan.

Birçoğunuz kumru. AI hakkında haklı olarak kötü düşüncelere sahipsiniz; ve evet, kumru. AI gerçekten şu anda kullanılamaz halde.
Peki, neden? Kumru'nun sıkıntısı ne?

Az çok bu işlere meraklı birisi olarak, araştırdım. Aslında pek araştırmaya gerek yok çünkü geliştiricileri sitenin en altında "hakkında / SSS" kısmında belirtmişler.
Öncelikle, kumru. AI ile ilgili hiçbir bağım yok, lütfen geliştiricilerinden biriymişim de; iyiye çıkarıyormuşum gibi bir izlenim oluşmasını istemem.
En çok karşılaşan problemlerden başlayayım; yanlış bilgi / matematik yapamama ve Recep tayyip Erdoğan taraftarlığı(?)

1) matematik
Bu sorun zaten ChatGPT ilk çıktığında onda da yaşanıyordu. Kumru şu anda yalnızca text-generation yapabiliyor, yani sadece yazı üretebiliyor. Telefonunuzun klavye kısmının üst barındaki öneri kısmı kadar basit bir düzeyde.

GPT ise kullanıcının isteklerini anlar, ve ona göre bir işlem yürütür arka planda.

Şu anda GPT'de, ona bir matematik sorusu sorduğunuzda şu yaşanıyor:
kullanıcı matematik problemi sorar > GPT bunu analiz eder, ve kullanıcının matematik sorusu sorduğunu anlar > arkada bir hesap makinesi çalıştırır, ve sonucu kullanıcıya süslü püslü bir şekilde iletir.

Kumru'da ise, şöyle çalışıyor:
kullanıcı matematik problemi sorar > kumru hiç düşünmeden direkt olarak cevap verir, saçmalar.

Çünkü arka planda çalışan bir analiz işlemi yok, sadece yazı üretebiliyor. Bu yüzden, problem çözme gibi bir yeteneği yok.
Ki, GPT'nin arkasında çalışan işlemin en büyük kanıtı da "daha iyi bir cevap için düşünülüyor" kısmı. Bir matematik problemi attığınızda otomatik olarak bu moda geçer.

2) yanlış bilgi
Bunu, kumru. AI'nin web sitesinde direkt olarak belirtmişler.
"yapay zeka modellerine dair çözülmesi en zorlu problemlerden biri hatalı bilgi vermesi, yani halüsinasyonlar. Yapay zeka eğitilirken farklı aşamalardan geçiyor ve son aşama olan pekiştirmeli öğrenme (reinforcement learning from human feedback) ile bu halüsinasyonlar en aza indirgeniyor. OpenAI'ın ChatGPT'den önce 2022 başında sunduğu DaVinci-001 modeli de pekiştirmeli öğrenme aşamasından henüz geçmemişti ve bu yüzden bol miktarda halüsinasyon görüyordu. Kumru da, aynı DaVinci-001 modeli gibi, henüz pekiştirmeli öğrenme aşamasından geçmediği için hatalı bilgiler verebiliyor."

Açıkçası burası hakkında pek bir bilgim yok, o yüzden pek üstüne durmayacağım. Ama sosyal medyada gördüğünüz çoğu komik durum bunun yüzünden oluşuyor.

3) siyasi taraftarcılık
Kumru. AI geliştiricileri şöyle belirtmiş:
"bunun alternatifi; llama, gemma, qwen gibi aynı anda pek çok dilde eğitilmiş modelleri alıp istenen dilde ya da alanda bir miktar daha eğitmek ve ince ayar yapmak. Bu da hazır bir binayı alıp renove etmeye benzetilebilir, ancak bunun da dezavantajları var ve biz de bu sebeple ilkini seçtik."

Yani; sıfırdan Türkçe kaynaklar ile eğitmişler. Tabii ki bunun hakkında kesin bir şey söyleyemem; tahminlere dayalı ama muhtemelen kullandıkları kaynaklar biraz daha taraf tutan kaynaklar olmuş. Yapay zeka dil modelleri eğitildikleri şeyi değiştirip size sunarlar. Buna çok büyük örnek olarak, X'in Grok AI'sinin, sürekli Furkan bölükbaşı'na hakaret etmesi verilebilir. Kullanıcılar X üzerinde Furkan bölükbaşı'na çok fazla hakaret ediyordu. Grok ise X'den aldığı verilerle eğitildi, yani işin sonucunda "AA evet, herkes bu adama hakaret ediyorsa doğru olan budur, ben de yapmalıyım." diye düşündü; ve iş çığırından çıktı.

Şu anda kumru, geliştirme sürecinin çok başında. Ancak Türkçe llm geliştirme adına atılmış en büyük adımlardan biri olması açısından değerli.
Yani; anlayacağınız, iş tamamen "haha kumru ne kadar da salak asdasd türkler yaparsa böyle olur" demekten ibaret değil. destek olunacak yerde köstek olmanın hiçbir anlamı yok. İyi sosyaller, okuduğunuz için teşekkür ederim. Bir yanlışım varsa düzeltin lütfen.

Türkçe kaynak kullanma gibi bir hata yapmaları da cabası. Bilim evrenseldir her ülke katkı sağlar. Zamanında ChatGPT eğitilirken milyonlarca farklı dillerde makaleler kullanıldı. Üstelik bunların çoğunun telif hakkı tarzı korumaları olmasına rağmen izinsiz şekilde yapıldı. OpenAI bu konuda dava bile edildi.
Türkiye'de bilgiye ulaşım ve doğruluğu konusunda ne kadar problemler var herkes farkında. Acaba kocaman kumru geliştirici ekibinde kimsenin aklına gelmedi mi? Bile bile lades bu. Hatta kasıtlı yapıldığını düşünüyorum.
 
Son düzenleme:
T3AI'ın Chat versiyonunun açılmasını bekliyorum ben. Şu an NSosyal'de kullanılabiliyor ve iyi çalışıyor.
 
Biz bu işleri beceremiyoruz Siyasi tarafı olduğu için en büyük sebebi uyduruk sebeplerle Grok'yaasklamaya kalk Sonra daha iyisini yaparım diye ortalığı atıl yok öyle hikaye Bizde bu işler hep göz boyama için yapılıyor gelişmek için değil .
 
Kendi istedikleri şeylere direkt doğru cevap veriyor, üstünde oynaşırsan salaklaşıyor.

1760434324908.webp