My Bulletin Board

Türkçe NLP projeleri için hangi embedding modelini önerirsiniz?

tugcenur
11 Haz 2026 19:18 düzenlendi
Arkadaşlar merhaba, Türkçe metin sınıflandırma ve benzerlik analizi yapacağım bir proje üzerinde çalışıyorum. OpenAI'ın text-embedding-3-small modelini mi kullanmalıyım yoksa HuggingFace üzerindeki Türkçe BERT tabanlı modeller (dbmdz/bert-base-turkish-cased vb.) daha mı iyi sonuç verir? Deneyimi olanlar paylaşabilir mi?
Cevaplar 5
serdargun
11 Haz 2026 19:18 düzenlendi
Cohere'in multilingual embedding modelleri de Türkçe için çok başarılı sonuçlar veriyor, alternatif olarak aklınızda bulunsun.
cenkkara
11 Haz 2026 19:18 düzenlendi
OpenAI API maliyetli olabilir, projenin ölçeğine göre lokal bir BERT modeli eğitmek veya fine-tune etmek uzun vadede daha mantıklı.
orhangunes
11 Haz 2026 19:18 düzenlendi
Benzerlik araması (semantic search) yapacaksanız sentence-transformers modellerine de bakmanızı öneririm. SBERT Türkçe modelleri işinizi kolaylaştırır.
ufukacar
11 Haz 2026 19:18 düzenlendi
Yerel çalışmak istiyorsan HuggingFace'teki 'dbmdz' modelleri Türkçe için adeta bir standart. Kesinlikle tavsiye ederim.
alpercelik
11 Haz 2026 19:18 düzenlendi
Eğer bütçe sorunun yoksa OpenAI text-embedding-3-large veya small oldukça başarılı, Türkçe desteği de fena değil.
Lütfen giriş yapın cevap yazmak için.