Türkiye'nin Yerli ve Özgün Yapay Zeka Teknolojisi
Olgu AI, Türkiye'de kurulan ve Türkçeye özel büyük dil modelleri geliştiren bir yapay zeka şirketidir.
Hikayemiz
Mevcut büyük dil modelleri Türkçeyi genellikle ikinci sınıf bir dil olarak ele alır — İngilizce ve az sayıda büyük dilde etkileyici sonuçlar verirken, Türkçede sık sık daha zayıf ve daha az doğal yanıtlar üretirler. Olgu AI, 84 milyondan fazla insanın konuştuğu ana dilimizin yapay zeka çağında hak ettiği yetkinliğe ulaşması gerektiği inancıyla doğdu; bu farkı kapatmak için sıfırdan bir Türkçe mimarisi inşa ediyoruz.
Misyonumuz
Bireylerden kurumlara ve kamuya kadar; Türk kültürünü ve dilin inceliklerini gerçekten anlayan modeller geliştiriyoruz. Sıfırdan eğittiğimiz Türkçeye özel tokenizer sayesinde daha verimli çalışan bu modeller, hem kurumlar için daha düşük maliyet hem de bireyler için daha erişilebilir fiyatlar sunuyor — verileriniz ise her zaman ülke sınırları içinde kalıyor.
Kimler için çalışıyoruz?
Olgu AI, geniş bir yelpazede fayda sağlamayı hedefliyor.
Bireyler
Günlük işlerinizde, derslerinizde, ödevlerinizde veya sohbetlerinizde yanınızda olan bir yapay zeka. Türkçenin nüanslarını ve kültürümüzü eşsiz bir doğal dille anlayan modellerimiz, verimli tokenizer mimarimiz sayesinde küresel alternatiflere kıyasla çok daha erişilebilir maliyetlerle kullanım sunar.
Kurumlar ve Kamu
Özel sektör şirketleri ve kamu kurumları için iki farklı yol sunuyoruz: kuruma özel, alanına göre ultra verimli mini modeller (SLM) tasarlıyoruz — verileriniz kurum bünyesinde kalır — ya da model ailemize doğrudan API üzerinden hızlıca entegre olabilirsiniz.
Ulusal Güvenlik
Kritik kurumlar ve savunma sanayii için tamamen yerli, bağımsız ve denetlenebilir bir yapay zeka altyapısı. Dışa bağımlılığı ortadan kaldıran stratejik bir teknoloji tabanı sunuyoruz.
Rakamlarla Olgu AI
İlk modelimizi geliştirirken ölçtüğümüz ve doğruladığımız temel göstergeler.
%54,7
Daha verimli tokenizasyon
Sıfırdan eğittiğimiz Türkçeye özel tokenizer, aynı Türkçe metni LLaMA tabanlı açık kaynaklı modellere kıyasla %54,7 daha verimli şekilde temsil ediyor.
2,21×
Kelime başına daha az token
Aynı donanımda daha düşük işletim maliyeti ve daha geniş bir bağlam penceresi demek. Pratikte, aynı bütçeyle benzer büyüklükte yabancı bir modele kıyasla yaklaşık %121 daha fazla sohbet geçmişini işleyebiliyoruz.
1 Milyar
Parametreli ilk modelimiz
Sıfırdan eğittiğimiz ilk modelimiz — yalnızca tokenizer verimliliğini değil, veri toplamadan eğitime kadar tüm yaklaşımımızı uçtan uca sınayan ilk tam çalıştırmamız, ve önümüzdeki daha büyük modellerin temeli.
%100
Açık ve Dürüst Kıyaslama
Modelimizi diğer Türkçe dil modelleriyle karşılaştırırken yalnızca öne çıktığımız değil, geride kaldığımız noktaları da olduğu gibi paylaşıyoruz.
Neden bir ulusal dil modeli?
Çoğu büyük dil modeli İngilizceye göre optimize edilir; Türkçe gibi diller genellikle ikinci planda kalır. Biz bu tabloyu tersine çeviriyoruz.
Veri Egemenliği ve Güvenlik: Yurt dışına çıkmayan, KVKK uyumlu ve yerli sunucularda işlenen veri altyapısı.
Maliyet ve Bağlam Avantajı: Türkçeye özel tokenizer sayesinde %54,7 daha düşük işlem maliyeti.
Ana Dil Doğallığı: İngilizce merkezli modellerin aksine, Türkçe gramer ve kültür inceliklerine tam uyum.
Sektöre Özel Mini Modeller: Herhangi bir yerel iş kolu veya kamu kurumu için, o alana özel verilerle eğitilmiş süper verimli mini Türkçe modeller tasarlıyoruz — yabancı veya sonradan ince ayar yapılan alternatiflere kıyasla kat kat daha düşük maliyetle çok daha başarılı performans sunuyoruz.
Dışa Bağımlılığın Ortadan Kalkması: Yapay zeka altyapınız, başka ülkelerin API'lerini açık tutmasına veya modellerini kamuya açık yayımlamasına bağlı kalmaz — hiçbir ülke böylesi bir dışa bağımlılık üzerine kritik bir sanayi inşa edemez.
Savunma Sanayiine Entegrasyon Potansiyeli: Yurt dışı kaynaklı yapay zeka teknolojileri güvenlik ve egemenlik gerekçeleriyle savunma sanayiinde etkin biçimde kullanılamaz; tamamen yerli modellerimiz bu alana entegre olabilecek bir konumda.
2,21×
Kelime Başına Daha Az Token
%121 Daha Fazla Sohbet GeçmişiYaklaşımımız
Var olan bir modeli Türkçeye uyarlamak yerine, sıfırdan Türkçe merkezli bir süreç izliyoruz.
Veri toplama ve temizleme
Türkçe metin verisini titizlikle bir araya getiriyoruz; MinHash tabanlı yakın-kopya tespiti ve örneklem bazlı doğrulamayla veri kalitesini güvence altına alıyoruz.
Türkçeye özel tokenizer
Sıfırdan eğittiğimiz tokenizer, Türkçe metni LLaMA tabanlı açık kaynak modellere göre %54,7 daha verimli, kelime başına 2,21 kat daha az tokenle temsil ediyor.
Sıfırdan eğitim
Var olan bir modeli Türkçeye sonradan uyarlamak yerine, Türkçe dil yapısını merkeze alan mimariyi baştan eğitiyoruz.
Türkçe NLP'ye Katkımız
Sadece model üretmekle kalmıyor, öğrendiklerimizi Türkçe doğal dil işleme alanına geri kazandırmayı hedefliyoruz.
Teknik Raporlar ve Makaleler
Tokenizer tasarımından eğitim süreçlerine kadar yöntemlerimizi ve bulgularımızı düzenli olarak yayımlayacağız.
Açık Deneyler ve Öğrenimler
Yalnızca başarılarımızı değil, denediğimiz ve işe yaramayan yaklaşımları da paylaşarak alanın topluca ilerlemesine katkıda bulunuyoruz.
Akademi ve Toplulukla İş Birliği
Türkçe NLP alanındaki araştırmacılar, üniversiteler ve açık kaynak topluluğuyla iş birliğine açığız.
Değerlerimiz
Şeffaflık
Ne yaptığımızı ve nasıl yaptığımızı açıkça paylaşırız; model yeteneklerini ve sınırlarını olduğu gibi anlatırız. Bu şeffaflığın bir parçası olarak, Türkçe NLP alanına katkı sunmak için öğrendiklerimizi teknik raporlar ve araştırmalarla düzenli olarak paylaşıyoruz.
Sorumluluk
Kullanıcı verisine ve KVKK uyumuna en üst düzeyde önem veririz; verileriniz üzerindeki kontrol sizde kalır. Yürüttüğümüz tüm girişimler, mevcut kanun ve yönetmeliklere uygun, toplumun yararına, insanlara fayda sağlayan ve kimsenin hakkını ihlal etmeyen bir çerçevede şekilleniyor.
Veri egemenliği
Kritik kurumların ve kamu kurumlarının verileri, yurt dışına çıkmadan Türkiye sınırları içinde işlenir ve saklanır.
Erişilebilirlik
Yapay zeka herkes için kolay erişilebilir olmalı — teknik bilgi gerektirmeden, sade bir deneyimle.
Ulusal Güvenliğe Katkı
Yapay zeka teknolojisi, ulusal güvenlik açısından giderek daha kritik bir alan haline geliyor. Tamamen yerli ve denetlenebilir bir teknoloji tabanı olarak, uzun vadede savunma ve ulusal güvenlik alanındaki kurumlara katkı sağlayabilecek bir konumda olmayı hedefliyoruz.
Adil ve Yerel Fiyatlandırma
İnsanların, uluslararası şirketler tarafından yüksek fiyatlarla sömürülmeden, kendi ihtiyaçlarına tam yönelik ve son derece etkili modellere yerel olarak karşılayabilecekleri adil fiyatlarla erişebilmesini sağlıyoruz — yerli teknoloji üzerine inşa edilen bağımsız bir özel sektörü mümkün kılan bir strateji.
Yol haritamız
Türkiye'nin özgün yapay zeka ekosistemini inşa etme yolculuğumuz.
İlk Model: Saha Doğrulaması
1B Parametre Sınıfı1 milyar parametreli ilk modelimizi sıfırdan geliştirdik ve Türkçe'ye özel tokenizer'ımızın verimlilik avantajını sahada doğruladık. Bu çalışma, yüksek ölçekli modellerimizin mimari temelini oluşturuyor.
Ölçeği Büyütmek
32B – 64B Parametre SınıfıModelimizi sınır öncesi (frontier-adjacent) 32B–64B parametre ölçeğine taşıyarak, karmaşık akıl yürütme ve gerçek dünya kurumsal senaryolarında yüksek performans hedefliyoruz.
Ulusal Ölçek ve Temel Altyapı
100B+ Parametre SınıfıTürkiye'nin fiili (de facto) yerli yapay zeka sağlayıcısı olarak; yerel sanayiyi, kamu projelerini, girişimleri ve Türkiye'deki tüm kullanıcıların günlük üretkenliğini destekleyen bağımsız bir teknoloji altyapısı sunmak.
Bize katılın
Sorularınız veya iş birliği fikirleriniz mi var? Sizden haber almak isteriz.
İletişime geçin →