OCR ve LLM oyun çevirisinde OCR hataları ve gramer filtresinin saçmalaması

Silco 63

Üstün
Katılım
6 Mayıs 2024
Mesajlar
605
Çözümler
2
Beğeniler
442
Selam, Python tabanlı OCR ve Ollama (Qwen 3.5:9b) kullanarak hazırlamaya çalıştığım anlık oyun çeviri sisteminde konsolda gördüğüm iki büyük sıkıntı var. Benzer bir sistem kuranlar buna nasıl bir çözüm buldu, merak ediyorum. Gramer kontrolü aşaması, ilk çeviriden %30'dan fazla farklı bir çıktı üretmediği sürece Ollama'nın çevirisine karışmıyor.

 
Görüntüde sorun sadece OCR değil. “You really screwed yourself” düzgün okunmuş ama “kendini yedirdin” diye çevrilmiş. Bağlama göre “başını fena belaya soktun” daha uygun. Gramer aşaması da anlam hatasını düzeltmeden cümleyi değiştiriyor.

%30 filtresi metin benzerliğine bakıyorsa doğru düzeltmeyi de reddedebilir. Kontrol aşamasına İngilizce kaynağı ve önceki birkaç repliği verip anlamı koruyarak düzeltmesini istemeyi deneyebilirsin.
 
%30 filtresi _review_is_safe fonksiyonunun içinde
max_allowed_changes = max(2, round(len(a_words) * 0.3))
if changed_words > max_allowed_changes:
return False
 
O modelle olmaz. Gemma4 12b veya 26b kullanman daha iyi olur. Daha düşük olanı da var e4b onu da kullanabilirsin. Ancak bit seviyesini düşürme saçmalamaya başlar.
 
O modelle olmaz. Gemma4 12b veya 26b kullanman daha iyi olur. Daha düşük olanı da var e4b onu da kullanabilirsin. Ancak bit seviyesini düşürme saçmalamaya başlar.

Gemma 4 12B deneyeceğim, teşekkürler.
 
Son düzenleyen: Moderatör:
Bu siteyi kullanmak için çerezler gereklidir. Siteyi kullanmaya devam etmek için çerezleri kabul etmelisiniz. Daha Fazlasını Öğren.…