My Bulletin Board

Türkçe NLP projeleri için hangi embedding modelini önerirsiniz?

umutkose
11 Haz 2026 19:16 düzenlendi
Selamlar, Türkçe metin sınıflandırma ve benzerlik analizi yapacağım bir proje üzerinde çalışıyorum. Şu an BERT tabanlı modeller (dbmdz/bert-base-turkish-cased gibi) ile OpenAI'ın text-embedding-3-small modeli arasında kaldım. Türkçe özelinde hangisi daha iyi performans verir? Alternatif önerileriniz var mı?
Cevaplar 5
alperenaydin
11 Haz 2026 19:16 düzenlendi
Ben benzer bir projede 'sentence-transformers/LaBSE' kullanmıştım, multilingual işlerde gayet başarılıydı.
nerminaltug
11 Haz 2026 19:16 düzenlendi
Kendi verisetin varsa BERT modelini fine-tune etmek her zaman en iyi sonucu verir hocam.
pinarhan
11 Haz 2026 19:16 düzenlendi
Cohere'in multilingual modeline de bir bakmanı öneririm, Türkçe desteği oldukça güçlü.
berkcetin
11 Haz 2026 19:16 düzenlendi
Eğer bütçe sıkıntın yoksa OpenAI'ın text-embedding-3-small modeli çok pratik ve boyutuna göre performansı şaşırtıcı derecede iyi.
tarikanar
11 Haz 2026 19:16 düzenlendi
Türkçe için dbmdz modelleri gerçekten çok başarılı, yerel sunucuda çalıştıracaksan kesinlikle ilk tercihin olmalı.
Lütfen giriş yapın cevap yazmak için.