Hemen Başla
Tüm yazılar
Araştırma

Simit-TR: Kendi Türkçe Modelimize Giden Yol

Açık ağırlıklı bir temel modeli, izinli ve anonimleştirilmiş Türkçe veriyle kendi donanımımızda ince ayarlayarak Türkiye'ye özel bir model geliştiriyoruz.

Simit-TR, Simit GPT'nin uzun vadeli kalbi olacak yerel modelimizin çalışma adıdır. Hedefimiz, genel amaçlı büyük modellerin yerini almak değil; Türkçe ve Türkiye'ye özgü işlerde onlardan daha iyi, daha hızlı ve daha ekonomik bir uzman model yetiştirmek.

Yaklaşım

  1. Temel model seçimi: Lisansı ticari kullanıma uygun, çok dilli, açık ağırlıklı bir model ailesiyle başlıyoruz.
  2. İnce ayar (fine-tuning): Tek bir RTX 3090 (24 GB) üzerinde LoRA/QLoRA gibi verimli yöntemlerle eğitim.
  3. Veri: Yalnızca açık lisanslı kaynaklar, kendi ürettiğimiz içerik ve kullanıcıların açıkça izin verdiği, anonimleştirilmiş ve insan tarafından onaylanmış örnekler. Ayrıntılar: Sorumlu Veri.
  4. Değerlendirme: Türkçe dil bilgisi, Türkiye bilgisi, talimat takibi ve güvenlik için kendi değerlendirme setimizi oluşturuyoruz. Sonuçları, ölçtüğümüzde ve yalnızca ölçtüğümüz kadarıyla paylaşacağız.

Nasıl sunulacak?

Simit-TR, OpenAI uyumlu bir sunucu üzerinden (ör. vLLM veya llama.cpp) çalışacak ve internete doğrudan açılmayacak. Simit sunucusu modele yalnızca özel bir VPN tüneli üzerinden ulaşacak.

Durum

Simit-TR şu anda planlama ve veri hazırlama aşamasında. Simit GPT'nin altyapısı, model hazır olduğunda tek bir yapılandırma değişikliğiyle onu kullanabilecek şekilde tasarlandı.