DeepSeek, yeni nesil mimari ailesinin en küçük üyesi olarak tanımladığı DeepSeek-V4.1-Flash modelini kullanıma sundu. Şirket, önceki sürümlere kıyasla daha yüksek performans, daha hızlı çıktı üretimi ve daha düşük maliyet sunduğunu belirttiği modeli, çok modlu yetenekleri doğrudan temel mimarisine entegre edecek şekilde geliştirdi. Böylece model, metin ve görsel girdilerini yerel olarak destekliyor.
Lansmanın en dikkat çekici gelişmesi ise DeepSeek'in daha büyük amiral gemisi modeli V4 Pro'ya yönelik kararı oldu. Şirket, gerçekleştirdiği iç ve dış testlerde V4.1 Flash'ın performans, maliyet, hız ve toplam işlem süresi açısından V4 Pro'dan daha iyi sonuç verdiğini açıkladı. Bu nedenle V4.1 Pro yayınlanana kadar V4 Pro'ya gönderilen tüm istekler otomatik olarak V4.1 Flash'a yönlendirilecek ve kullanıcılar daha düşük olan V4.1 Flash fiyatlandırması üzerinden ücretlendirilecek.
V4.1 Flash için belirlenen yeni fiyatlar 10 Eylül itibarıyla yürürlüğe girdi. Yoğun olmayan saatlerde önbellekten okunan girdiler için milyon token başına 0.003 dolar, önbellekte bulunmayan girdiler için 0.15 dolar ve çıktı token'ları için 0.6 dolar ücret alınacak. Yoğun saatlerde ise bu fiyatlar iki katına çıkacak.
Modelin resmi lansmanından önce DeepSeek, 8 Eylül'de sınırlı bir beta süreci başlattı. Geliştiriciler, geçici model kimliği üzerinden API erişimi sağlayabilirken test sürecinde hesap başına en fazla 20 eşzamanlı isteğe izin verildi. Üretim ortamında bu sınırın 2 bin 500'e çıkması, beta sürecinin daha çok teknik doğrulama amacıyla yürütüldüğünü gösterdi. Şirket ayrıca geliştiricilere yönelik anonim bir anket düzenleyerek V4.1 Flash'ın V4 Pro'nun yerini alabilecek kadar olgun olup olmadığını değerlendirmeye açtı.
Yeni model için bağımsız kıyaslama platformları henüz resmi skorlar yayınlamış değil. DeepSeek'in lansman belgelerinde de teknik rapor veya kapsamlı sayısal karşılaştırmalar yer almıyor. Buna karşın geliştirici topluluğundan paylaşılan ilk ölçümler, V4.1 Flash'ın saniyede 427 token üretebildiğini ve ilk token'a 178 milisaniyede ulaştığını gösteriyor. Aynı testlerde V4 Pro'nun saniyede 63 token üretim hızında ve 766 milisaniye ilk token süresinde kaldığı belirtiliyor. Ancak bu veriler DeepSeek tarafından resmi olarak doğrulanmış değil.
Önceki nesilde V4 Pro'nun toplam 1.6 trilyon parametreye sahip olduğu ve bunların 49 milyarını aktif olarak kullandığı belirtilirken, V4 Flash 284 milyar toplam ve 13 milyar aktif parametreyle çalışıyordu. V4.1 Flash'ın görsel girdileri doğrudan desteklemesi ise şirketin daha önce deneysel V4 Flash Vision modeliyle başlattığı çok modlu yapay zeka çalışmalarının devamı olarak görülüyor.
DeepSeek'in Şanghay STAR piyasasında halka arz için CITIC Securities ile çalıştığı da bu hafta gündeme geldi.





Popüler İçerikler