Çin merkezli yapay zeka girişimi DeepSeek, R1 adlı akıl yürütme modelinin güncellenmiş sürümünü resmi bir açıklama yapmaksızın sessiz bir şekilde yayımladı. Yeni model, açık kaynak platformu Hugging Face üzerinden kullanıma sunularak, küresel yapay zeka topluluğunda dikkat çekici bir ilgi topladı.
Yüksek performanslı bu yeni sürüm, özellikle akıl yürütme ve kodlama alanlarında kayda değer gelişmeler sergiliyor. DeepSeek-R1-0528 kodlu model, yapılan testlerde OpenAI’nin o4-mini modeli ve Grok-3-mini gibi rakiplerini geride bırakırken, doğal dil üretimi ve uzun süreli düşünme yetkinliğiyle de öne çıkıyor. Model, 685 milyar parametre ile çalışmakta ve ticari kullanım için de uygun şekilde tasarlanmış durumda.
Güncellenmiş R1 modeli, yapay zeka sistemlerinin kıyaslandığı LiveCodeBench platformunda OpenAI’nin gelişmiş modellerinin hemen arkasında yer aldı. Bu konum, DeepSeek’in teknolojik yetkinliğini uluslararası düzeyde yeniden kanıtlamış oldu. Ayrıca modelin, bilgi tabanlı görevlerde Claude-3.5 Sonnet gibi önde gelen modellere yaklaştığı ifade ediliyor.
DeepSeek’in bu atağı, Çin menşeli yapay zeka şirketlerinin ABD’nin uyguladığı teknoloji ve çip kısıtlamalarına rağmen gelişimini sürdürdüğünü göstermesi açısından önem taşıyor. Şirketin kısa sürede geliştirdiği düşük maliyetli ve yüksek kapasiteli modeller, sektörün önde gelen isimleri Meta ve OpenAI ile doğrudan rekabet edebilecek seviyeye ulaşmış durumda.
Yapay zeka gündeminde Eylül ayının ilk günlerine büyük model duyuruları damga vurdu. OpenAI, Anthropic ve…
TRAI Yapay Zeka Gündemi #2: Haftanın En Önemli 10 Yapay Zeka Gelişmesi Yapay zeka sistemleri…
İki şirket düşünün. Aynı sektör, aynı pazar, aynı rekabet ortamı. İkisi de yapay zekaya yatırım…
Yapay zeka dünyasında gündem her hafta biraz daha hızlanıyor. Yeni modeller ve ürünlerin ötesinde; çip…
TRAI Meet-Up #108’de Yapay Zeka ile ROI’nin Dönüşümü Ele Alındı
Dağınık Belgelerden Hazır Poliçe Talebine: Yapay Zeka ile Otomasyon