RADAR ·
DeepSeek'in V4.1-Flash modeli bağlam önbelleğini selefinin dörtte birine indiriyor
DeepSeek, 552 milyar parametreli çok modlu modeli V4.1-Flash'ı yayımladı. Şirketin teknik raporuna göre modelin hızlı GPU belleğinde tuttuğu bağlam önbelleği, selefi V4-Flash'ın yaklaşık dörtte biri kadar yer kaplıyor; diske aktarılan bölüm sekizde bire iniyor. Model, girdi okurken token başına 8 milyar, metin üretirken 16 milyar parametre etkinleştiriyor; bağlam sınırı bir milyon token. Önbellek FP8 yerine FP4 tutuluyor. Yazılım testi DeepSWE v1.1'de %74,2 ile Anthropic'in Opus 5 ve OpenAI'ın GPT-5.6 Sol modellerinin biraz önünde yer alıyor; karmaşık bilimsel görevlerde ve görüntü okumada geride kalıyor. Dosyalar Hugging Face'te MIT lisansıyla yayında ve model, selefiyle aynı API fiyatlarından sunuluyor.
Kaynak: The Decoder