Geleneksel üretken modellerden farklı olarak yanıtları tek işlemde oluşturan bu modeller; metin, görüntü ve ses verilerini analiz ederek gerçek zamanlı kararlar verebiliyor. d1-3B, NVIDIA RTX 4090 üzerinde yalnızca 8 milisaniyede yanıt üretirken her iki model de Hugging Face üzerinden indirilebiliyor.
