olgu.aiOlgu AI
Hakkımızda

Türkiye'nin Yerli ve Özgün Yapay Zeka Teknolojisi

Olgu AI, Türkiye'de kurulan ve Türkçeye özel büyük dil modelleri geliştiren bir yapay zeka şirketidir.

Hikayemiz

Mevcut büyük dil modelleri Türkçeyi genellikle ikinci sınıf bir dil olarak ele alır — İngilizce ve az sayıda büyük dilde etkileyici sonuçlar verirken, Türkçede sık sık daha zayıf ve daha az doğal yanıtlar üretirler. Olgu AI, 84 milyondan fazla insanın konuştuğu ana dilimizin yapay zeka çağında hak ettiği yetkinliğe ulaşması gerektiği inancıyla doğdu; bu farkı kapatmak için sıfırdan bir Türkçe mimarisi inşa ediyoruz.

[ Sıfırdan Türkçe Mimarisi ]

Misyonumuz

Bireylerden kurumlara ve kamuya kadar; Türk kültürünü ve dilin inceliklerini gerçekten anlayan modeller geliştiriyoruz. Sıfırdan eğittiğimiz Türkçeye özel tokenizer sayesinde daha verimli çalışan bu modeller, hem kurumlar için daha düşük maliyet hem de bireyler için daha erişilebilir fiyatlar sunuyor — verileriniz ise her zaman ülke sınırları içinde kalıyor.

[ Veri Egemenliği ve Erişilebilirlik ]

Kimler için çalışıyoruz?

Olgu AI, geniş bir yelpazede fayda sağlamayı hedefliyor.

Erişilebilir ve Özgün

Bireyler

Günlük işlerinizde, derslerinizde, ödevlerinizde veya sohbetlerinizde yanınızda olan bir yapay zeka. Türkçenin nüanslarını ve kültürümüzü eşsiz bir doğal dille anlayan modellerimiz, verimli tokenizer mimarimiz sayesinde küresel alternatiflere kıyasla çok daha erişilebilir maliyetlerle kullanım sunar.

Erişilebilir FiyatEşsiz Dil ve Kültür DesteğiGünlük Üretkenlik
Esnek Erişim Seçenekleri

Kurumlar ve Kamu

Özel sektör şirketleri ve kamu kurumları için iki farklı yol sunuyoruz: kuruma özel, alanına göre ultra verimli mini modeller (SLM) tasarlıyoruz — verileriniz kurum bünyesinde kalır — ya da model ailemize doğrudan API üzerinden hızlıca entegre olabilirsiniz.

Özelleştirilmiş Mini ModellerAPI ErişimiMaksimum VerimlilikSınırsız Veri Egemenliği
Kritik Altyapı

Ulusal Güvenlik

Kritik kurumlar ve savunma sanayii için tamamen yerli, bağımsız ve denetlenebilir bir yapay zeka altyapısı. Dışa bağımlılığı ortadan kaldıran stratejik bir teknoloji tabanı sunuyoruz.

Tam Yerli MimariDenetlenebilir AltyapıStratejik Bağımsızlık

Rakamlarla Olgu AI

İlk modelimizi geliştirirken ölçtüğümüz ve doğruladığımız temel göstergeler.

LLaMA - Olgu AI Token Verimliliği

%54,7

Daha verimli tokenizasyon

Sıfırdan eğittiğimiz Türkçeye özel tokenizer, aynı Türkçe metni LLaMA tabanlı açık kaynaklı modellere kıyasla %54,7 daha verimli şekilde temsil ediyor.

2,21×

Kelime başına daha az token

Aynı donanımda daha düşük işletim maliyeti ve daha geniş bir bağlam penceresi demek. Pratikte, aynı bütçeyle benzer büyüklükte yabancı bir modele kıyasla yaklaşık %121 daha fazla sohbet geçmişini işleyebiliyoruz.

1 Milyar

Parametreli ilk modelimiz

Sıfırdan eğittiğimiz ilk modelimiz — yalnızca tokenizer verimliliğini değil, veri toplamadan eğitime kadar tüm yaklaşımımızı uçtan uca sınayan ilk tam çalıştırmamız, ve önümüzdeki daha büyük modellerin temeli.

%100

Açık ve Dürüst Kıyaslama

Modelimizi diğer Türkçe dil modelleriyle karşılaştırırken yalnızca öne çıktığımız değil, geride kaldığımız noktaları da olduğu gibi paylaşıyoruz.

Neden bir ulusal dil modeli?

Çoğu büyük dil modeli İngilizceye göre optimize edilir; Türkçe gibi diller genellikle ikinci planda kalır. Biz bu tabloyu tersine çeviriyoruz.

Veri Egemenliği ve Güvenlik: Yurt dışına çıkmayan, KVKK uyumlu ve yerli sunucularda işlenen veri altyapısı.

Maliyet ve Bağlam Avantajı: Türkçeye özel tokenizer sayesinde %54,7 daha düşük işlem maliyeti.

Ana Dil Doğallığı: İngilizce merkezli modellerin aksine, Türkçe gramer ve kültür inceliklerine tam uyum.

Sektöre Özel Mini Modeller: Herhangi bir yerel iş kolu veya kamu kurumu için, o alana özel verilerle eğitilmiş süper verimli mini Türkçe modeller tasarlıyoruz — yabancı veya sonradan ince ayar yapılan alternatiflere kıyasla kat kat daha düşük maliyetle çok daha başarılı performans sunuyoruz.

Dışa Bağımlılığın Ortadan Kalkması: Yapay zeka altyapınız, başka ülkelerin API'lerini açık tutmasına veya modellerini kamuya açık yayımlamasına bağlı kalmaz — hiçbir ülke böylesi bir dışa bağımlılık üzerine kritik bir sanayi inşa edemez.

Savunma Sanayiine Entegrasyon Potansiyeli: Yurt dışı kaynaklı yapay zeka teknolojileri güvenlik ve egemenlik gerekçeleriyle savunma sanayiinde etkin biçimde kullanılamaz; tamamen yerli modellerimiz bu alana entegre olabilecek bir konumda.

2,21×

Kelime Başına Daha Az Token

%121 Daha Fazla Sohbet Geçmişi
Daha verimli tokenizasyon%54,7
Parametreli ilk modelimiz1 Milyar
Açık ve Dürüst Kıyaslama%100

Yaklaşımımız

Var olan bir modeli Türkçeye uyarlamak yerine, sıfırdan Türkçe merkezli bir süreç izliyoruz.

[ Adım 01 ]

Veri toplama ve temizleme

Türkçe metin verisini titizlikle bir araya getiriyoruz; MinHash tabanlı yakın-kopya tespiti ve örneklem bazlı doğrulamayla veri kalitesini güvence altına alıyoruz.

MinHash DeduplikasyonKalite Doğrulama
[ Adım 02 ]

Türkçeye özel tokenizer

Sıfırdan eğittiğimiz tokenizer, Türkçe metni LLaMA tabanlı açık kaynak modellere göre %54,7 daha verimli, kelime başına 2,21 kat daha az tokenle temsil ediyor.

2,21x VerimlilikKök-Ek Ayrıştırıcı
[ Adım 03 ]

Sıfırdan eğitim

Var olan bir modeli Türkçeye sonradan uyarlamak yerine, Türkçe dil yapısını merkeze alan mimariyi baştan eğitiyoruz.

Sıfırdan MimariTam Yerlilik

Türkçe NLP'ye Katkımız

Sadece model üretmekle kalmıyor, öğrendiklerimizi Türkçe doğal dil işleme alanına geri kazandırmayı hedefliyoruz.

Teknik Raporlar ve Makaleler

Tokenizer tasarımından eğitim süreçlerine kadar yöntemlerimizi ve bulgularımızı düzenli olarak yayımlayacağız.

Açık Deneyler ve Öğrenimler

Yalnızca başarılarımızı değil, denediğimiz ve işe yaramayan yaklaşımları da paylaşarak alanın topluca ilerlemesine katkıda bulunuyoruz.

Akademi ve Toplulukla İş Birliği

Türkçe NLP alanındaki araştırmacılar, üniversiteler ve açık kaynak topluluğuyla iş birliğine açığız.

Değerlerimiz

Açık Metrikler ve Benchmarklar

Şeffaflık

Ne yaptığımızı ve nasıl yaptığımızı açıkça paylaşırız; model yeteneklerini ve sınırlarını olduğu gibi anlatırız. Bu şeffaflığın bir parçası olarak, Türkçe NLP alanına katkı sunmak için öğrendiklerimizi teknik raporlar ve araştırmalarla düzenli olarak paylaşıyoruz.

KVKK ve Veri Güvenliği

Sorumluluk

Kullanıcı verisine ve KVKK uyumuna en üst düzeyde önem veririz; verileriniz üzerindeki kontrol sizde kalır. Yürüttüğümüz tüm girişimler, mevcut kanun ve yönetmeliklere uygun, toplumun yararına, insanlara fayda sağlayan ve kimsenin hakkını ihlal etmeyen bir çerçevede şekilleniyor.

Yurt Dışına Çıkmayan Altyapı

Veri egemenliği

Kritik kurumların ve kamu kurumlarının verileri, yurt dışına çıkmadan Türkiye sınırları içinde işlenir ve saklanır.

Sade Arayüz ve Entegrasyon

Erişilebilirlik

Yapay zeka herkes için kolay erişilebilir olmalı — teknik bilgi gerektirmeden, sade bir deneyimle.

Kritik Teknoloji Alanı

Ulusal Güvenliğe Katkı

Yapay zeka teknolojisi, ulusal güvenlik açısından giderek daha kritik bir alan haline geliyor. Tamamen yerli ve denetlenebilir bir teknoloji tabanı olarak, uzun vadede savunma ve ulusal güvenlik alanındaki kurumlara katkı sağlayabilecek bir konumda olmayı hedefliyoruz.

Bağımsız Yerli Ekosistem

Adil ve Yerel Fiyatlandırma

İnsanların, uluslararası şirketler tarafından yüksek fiyatlarla sömürülmeden, kendi ihtiyaçlarına tam yönelik ve son derece etkili modellere yerel olarak karşılayabilecekleri adil fiyatlarla erişebilmesini sağlıyoruz — yerli teknoloji üzerine inşa edilen bağımsız bir özel sektörü mümkün kılan bir strateji.

Yol haritamız

Türkiye'nin özgün yapay zeka ekosistemini inşa etme yolculuğumuz.

Şimdi● Tamamlandı

İlk Model: Saha Doğrulaması

1B Parametre Sınıfı

1 milyar parametreli ilk modelimizi sıfırdan geliştirdik ve Türkçe'ye özel tokenizer'ımızın verimlilik avantajını sahada doğruladık. Bu çalışma, yüksek ölçekli modellerimizin mimari temelini oluşturuyor.

Yakın gelecek● Geliştiriliyor

Ölçeği Büyütmek

32B – 64B Parametre Sınıfı

Modelimizi sınır öncesi (frontier-adjacent) 32B–64B parametre ölçeğine taşıyarak, karmaşık akıl yürütme ve gerçek dünya kurumsal senaryolarında yüksek performans hedefliyoruz.

Uzun vadede○ Planlanan

Ulusal Ölçek ve Temel Altyapı

100B+ Parametre Sınıfı

Türkiye'nin fiili (de facto) yerli yapay zeka sağlayıcısı olarak; yerel sanayiyi, kamu projelerini, girişimleri ve Türkiye'deki tüm kullanıcıların günlük üretkenliğini destekleyen bağımsız bir teknoloji altyapısı sunmak.

İletişime Geçin

Bize katılın

Sorularınız veya iş birliği fikirleriniz mi var? Sizden haber almak isteriz.

İletişime geçin →