DeepSeek, 552 milyar parametreli yeni modelini duyurdu
DeepSeek, bellek verimliliği ve düşük operasyonel maliyet odaklı 552 milyar parametreli yeni yapay zeka modelini tanıttı.
Atlas Newsdesk ·

DeepSeek, 552 milyar parametre kapasitesine ve 1 milyon token bağlam penceresine sahip DeepSeek-V4.1-Flash modelini kullanıma sundu. Yeni mimari, KV-önbellek gereksinimini dökat, kalıcı depolama ihtiyacını ise sekiz kat azaltarak operasyonel maliyetleri düşürüyor.
Sistem, Causal Encoder-Decoder yapısı ve FP4 veri formatı ile donanım kaynaklarını optimize ediyor. SWA Bounded Replay yöntemi, ara verileri yeniden hesaplayarak bellek üzerindeki yükü minimize ediyor ve büyük veri kümeleriyle çalışan ajanların yanıt sürelerini hızlandırıyor.
45 trilyon tokenlık veri setiyle eğitilen model, önceki nesil Pro sürümleriyle rekabet edebilecek performans sergiliyor. 4 bin tokenden 1 milyon tokene geçişte işlem gücü gereksinimindeki artışın yüzde 25 ile sınırlı kalması, yüksek hacimli projelerin maliyet verimliliğini artırıyor.