Son kullanma tarihi geçmiş, bayatlamış bir tarayıcı kullanıyorsanız, Mercedes kullanmak yerine tosbağaya binmek gibi... Web sitelerini düzgün görüntüleyemiyorsanız eh, bi' zahmet tarayıcınızı güncelleyiniz. Modern Web standartlarını karşılayan bir tarayıcı alternatifine göz atın.
Ollama modelleri artık doğrudan ChatGPT Desktop'ta kullanılabiliyor. Böylece açık modelleri çalıştırırken mevcut iş akışınızı kullanmaya devam edebilirsiniz. Kurulum macOS'taki Ollama uygulaması üzerinden yapılabilir.
İyileştirmeler
Apple Silicon'da yapılandırılmış çıktı performansı iyileştirildi.
OpenAI uyumlu istemciler için araç arama desteği eklendi.
Geliştiriciler artık Claude Desktop'ı Ollama ile üçüncü taraf ağ geçidi sağlayıcısı olarak sorunsuz çalışacak şekilde kolayca yapılandırabilir.
Önbellekleme İyileştirmeleri
Uzun prefill işlemlerini iptal eden agent istemcilerinde oluşan takılma düzeltildi.
Prefill geri yükleme noktaları artık tasarım gereği güvenilir. İptal edilen bir prefill, geçtiği tüm geri yükleme noktalarını koruyor; böylece yeniden denemeler sıfırdan başlamak yerine durduğu yerden devam ediyor.
Devam ettirilen prefill işlemleri artık kapsadığını belirttiği içeriği gerçekte kapsamayan geri yükleme noktaları kaydetmiyor. Tekrarlayan katmanlara sahip modellerde bu durum daha önce 47 bin tokenın 46 binini eşleştiren bir isteğin sıfırdan yeniden işlenmesine neden oluyordu.
Claude Code'un "tokens left" token geri sayım sistem mesajı devre dışı bırakıldı. Ollama bu mesajı istemin başına taşıdığı için her istekte KV önbelleğinin bozulmasına neden oluyordu.
Diğer İyileştirmeler
DeepSeek Harness başlatıcısı, global npm kurulumu başarısız olduğunda artık npx'e geri dönüyor ve Windows komut shim desteği sunuyor.
MLX bağımlılığı güncellendi.
macOS'e özgü varsayımların Linux ve Windows derlemelerini etkilemesi nedeniyle bozulan varsayılan paketleme düzeltildi.
İlk başlatmada yeni masaüstü başlangıç deneyimi eklendi.
İyileştirmeler
Çözümlenen model meta verileri istekler arasında önbelleğe alınarak ilk token'a ulaşma süresi yaklaşık yarıya indirildi (benchmark'larda TTFT yaklaşık 995 ms'den 524 ms'ye düştü).
Qwen 3.8 sistem mesajları artık normalize ediliyor; böylece başta yer almayan sistem mesajları tutarlı şekilde işleniyor.
MLX ve llama.cpp bağımlılıkları güncellendi.
Hata Düzeltmeleri
Akış sırasında oluşan bir ayrıştırıcı hatasından sonra chat ve generate işlemlerinin takılı kalmasına neden olan hata düzeltildi.
Her zaman etkin ajanların yürütme katmanı için geliştirilen, 3 milyar etkin parametreye sahip açık bir 30 milyar parametreli Mixture-of-Experts (MoE) modeli olan NVIDIA Nemotron 3.5 Lightning eklendi. Model, OpenClaw ve Hermes Agent gibi sistemler için tasarlanmıştır ve her zaman etkin yapay zekâ ajanlarını çalıştırmaya yönelik NVIDIA NemoClaw açık kaynak güvenlik ve yönetim yığını tarafından desteklenir.
Nemotron 3 mimarisi eklendi.
Hata Düzeltmeleri
Muse Glimmer function calling ayrıştırıcısındaki sınır koşulu ele alındı.
Not: Muse Glimmer şu anda Apple Silicon'da Ollama'nın MLX motoru üzerinden ilk destekle kullanılabilir. Apple Silicon, NVIDIA, AMD ve diğer platformlar için ek destek ve optimizasyonlar önümüzdeki günlerde sunulacak.
Meta'nın en yeni açık modeli ve Meta Superintelligence Labs tarafından yayımlanan ilk model olan Muse Glimmer artık Ollama'da kullanılabilir. Yerel olarak çalışan agent iş yükleri için özel olarak geliştirilmiş 30B parametreli multimodal bir modeldir.
Ollama ile Muse Glimmer; Claude Code, Codex, Pi ve benzeri kodlama agent uygulamalarının yanı sıra OpenClaw ve Hermes gibi uzun süre çalışan kişisel asistanlarda kullanılabilir.
Ollama'nın MLX motoru, bu model için Apple Silicon'da son teknoloji performans sunarken DFlash ve görüntü girdisi desteği de sağlar.
Muse Glimmer'ı yerel olarak indirmek ve çalıştırmak mümkündür.
Muse Glimmer'ı Apple Silicon'da Claude Code ile kullanmak için Ollama'yı indirip çalıştırabilirsiniz.
Daha hafif bir kodlama agent'ı için Pi kullanılabilir.
OpenClaw ve Hermes gibi kişisel asistan framework'leriyle kullanılabilir.
Apple GPU'larında Qwen3.5 daha hızlı çalışıyor. MLX motoru artık speculative decoding için modelin MTP head'ini otomatik olarak kullanıyor.
/v1/chat/completions akışı artık OpenAI'nin wire formatıyla uyumlu. role yalnızca ilk parçada, finish_reason kendi ayrı parçasında ve usage bilgisi ise stream_options.include_usage ile ayrı bir parçada gönderiliyor.
Kesilen OpenAI yanıtları artık finish_reason olarak "tool_calls" yerine "length" bildiriyor.
Artık varsayılan etiketi bulunmayan yalnızca bulut tabanlı modeller için ollama run kimi-k3 komutu hata vermek yerine kimi-k3:cloud seçeneğini sunuyor.
TUI iyileştirildi. Dikey çizgiyle ayrılmış düz metin artık tablo olarak işlenmiyor, Enter tuşu seçili @ dosya tamamlamasını kabul ediyor ve /prompt kaydırması artık gecikmeye neden olmuyor.
MLX ve llama.cpp motorları güncellendi.
Değişiklikler
Deneysel görüntü oluşturma özelliği geçici olarak kaldırıldı. Görüntü oluşturma desteği için 0.32.5 sürümü kullanılmaya devam edilebilir.