Modelli IA che questa macchina esegue

Eseguiti in locale, interamente nella memoria della scheda video: nessun servizio esterno, nessun dato che esce.

34B
Codellama 34Bin locale · 4 bit
78modelli
ModelloParametriQuant.OccupaMargineContesto max
Mixtral 8X7B56 BQ4_029,5 GB2,5 GB26k
Codellama 34B34 BQ4_K_M21,7 GB10,3 GB
Llava 34B34 BQ4_020,8 GB11,2 GB
Codellama 34B34 BQ4_020,4 GB11,6 GB
Qwen2.5 32B32 BQ4_023,6 GB8,4 GB32k
Qwen2.5-coder 32B32 BQ4_023,6 GB8,4 GB32k
Qwq 32B32 BQ4_023,6 GB8,4 GB38k
Deepseek-r1 32B32 BQ4_023,6 GB8,4 GB38k
Gemma2 27B27 BQ8_031,0 GB1,0 GB
Gemma3 27B27 BQ4_018,6 GB13,4 GB
Gemma2 27B27 BQ4_K_M17,8 GB14,2 GB
Gemma2 27B27 BQ4_016,7 GB15,3 GB
Mistral-small 24B24 BQ4_016,8 GB15,2 GB32k
Mistral-small 22B22 BQ4_013,5 GB18,5 GB
Qwen2.5-coder 14B14 BFP1631,6 GB0,4 GB
Qwen2.5 14B14 BQ8_018,5 GB13,5 GB32k
Qwen2.5-coder 14B14 BQ8_016,8 GB15,2 GB
Phi4 14B14 BQ4_09,7 GB22,3 GB
Qwen2.5 14B14 BQ4_011,4 GB20,6 GB32k
Qwen2.5-coder 14B14 BQ4_09,6 GB22,4 GB
Deepseek-r1 14B14 BQ4_011,4 GB20,6 GB106k
Codellama 13B13 BFP1627,9 GB4,1 GB
Codellama 13B13 BQ8_014,8 GB17,2 GB
Codellama 13B13 BQ4_K_M8,4 GB23,6 GB
Codellama 13B13 BQ4_07,9 GB24,1 GB
Llava 13B13 BQ4_07,9 GB24,1 GB
Gemma3 12B12 BQ4_08,7 GB23,3 GB
Gemma2 9B9 BFP1619,8 GB12,2 GB
Gemma2 9B9 BQ8_010,5 GB21,5 GB
Gemma2 9B9 BQ4_K_M6,2 GB25,8 GB
Gemma2 9B9 BQ4_05,8 GB26,2 GB
Llama3.1 8B8 BFP1617,2 GB14,8 GB
Llama3.1 8B8 BQ8_09,1 GB22,9 GB
Deepseek-r1 8B8 BQ4_05,6 GB26,4 GB
Llama3.1 8B8 BQ4_05,3 GB26,7 GB
Qwen2.5 7B7 BFP1616,8 GB15,2 GB32k
Qwen2.5-coder 7B7 BFP1616,8 GB15,2 GB32k
Mistral 7B7 BFP1616,7 GB15,3 GB32k
Codellama 7B7 BFP1614,4 GB17,6 GB
Qwen2.5 7B7 BQ8_09,2 GB22,8 GB32k
Qwen2.5-coder 7B7 BQ8_09,2 GB22,8 GB32k
Mistral 7B7 BQ8_09,4 GB22,6 GB32k
Codellama 7B7 BQ8_07,7 GB24,3 GB
Qwen2.5 7B7 BQ4_05,5 GB26,5 GB32k
Qwen2.5-coder 7B7 BQ4_05,5 GB26,5 GB32k
Deepseek-r1 7B7 BQ4_05,5 GB26,5 GB128k
Mistral 7B7 BQ4_05,8 GB26,2 GB32k
Mistral 7B7 BQ4_K_M5,8 GB26,2 GB32k
Llava 7B7 BQ4_04,4 GB27,6 GB
Codellama 7B7 BQ4_K_M4,4 GB27,6 GB
Starcoder2 7B7 BQ4_04,3 GB27,7 GB
Codellama 7B7 BQ4_04,1 GB27,9 GB
Gemma3 4B4 BQ4_03,6 GB28,4 GB
Llama3.2 3B3 BFP166,9 GB25,1 GB
Qwen2.5 3B3 BFP166,9 GB25,1 GB32k
Qwen2.5-coder 3B3 BFP166,6 GB25,4 GB
Llama3.2 3B3 BQ8_03,7 GB28,3 GB
Qwen2.5 3B3 BQ8_03,8 GB28,2 GB32k
Qwen2.5-coder 3B3 BQ8_03,5 GB28,5 GB
Llama3.2 3B3 BQ4_02,2 GB29,8 GB
Qwen2.5 3B3 BQ4_02,4 GB29,6 GB32k
Qwen2.5-coder 3B3 BQ4_02,1 GB29,9 GB
Starcoder2 3B3 BQ4_01,8 GB30,2 GB
Gemma2 2B2 BFP165,6 GB26,4 GB
Gemma2 2B2 BQ8_03,0 GB29,0 GB
Gemma2 2B2 BQ4_K_M1,8 GB30,2 GB
Gemma2 2B2 BQ4_01,7 GB30,3 GB
Qwen2.5 1.5B1,5 BFP163,3 GB28,7 GB
Qwen2.5-coder 1.5B1,5 BFP163,3 GB28,7 GB
Qwen2.5 1.5B1,5 BQ8_01,8 GB30,2 GB
Qwen2.5-coder 1.5B1,5 BQ8_01,8 GB30,2 GB
Deepseek-r1 1.5B1,5 BQ4_01,2 GB30,8 GB
Qwen2.5 1.5B1,5 BQ4_01,1 GB30,9 GB
Qwen2.5-coder 1.5B1,5 BQ4_01,1 GB30,9 GB
Llama3.2 1B1 BFP162,7 GB29,3 GB
Llama3.2 1B1 BQ4_01,4 GB30,6 GB
Gemma3 1B1 BQ4_00,9 GB31,1 GB
Llama3.2 1B1 BQ4_K_M0,9 GB31,1 GB

Occupazione calcolata con un margine del 15% per attivazioni e frammentazione, su una finestra di contesto di 8.192 token. Contesti più lunghi richiedono memoria aggiuntiva; modelli più grandi possono girare appoggiandosi alla RAM di sistema, ma molto più lentamente.

La Drako PRO Prime AI Workstation è una workstation full tower di fascia alta progettata per ricercatori, sviluppatori ML, creator e professionisti che necessitano di potenza di calcolo elevata per prototipazione, fine-tuning e inferenza su modelli di intelligenza artificiale, oltre che per rendering e content creation. Al suo cuore batte l'AMD Ryzen 9 9950X3D2 Dual Edition, il primo processore desktop al mondo con doppia 3D V-Cache di seconda generazione su entrambi i CCD, abbinato a 128GB di memoria DDR5 e a una GPU NVIDIA GeForce RTX 5090 con 32GB di VRAM GDDR7 in versione ASUS ROG Astral OC. Una configurazione no-compromise per i carichi di lavoro AI più impegnativi.

Ogni sistema viene configurato, assemblato e validato a mano nei laboratori Drako prima della spedizione, con l'intero software stack AI già installato e operativo — PyTorch, TensorFlow, Docker, CUDA, cuDNN, vLLM, Hugging Face, DeepSpeed e altri framework sono pronti fin dal primo avvio. Questo approccio «ship-ready» consente di iniziare a lavorare dal giorno uno, senza perdere tempo in configurazioni manuali o in conflitti di versione tra driver, CUDA e librerie.

La RTX 5090, con 32GB di GDDR7 e Tensor Core di quinta generazione con supporto nativo FP4, consente di eseguire localmente LLM fino a ~30 miliardi di parametri con piena fluidità e modelli fino a 70B tramite quantizzazione a 4-bit, oltre al fine-tuning con tecniche LoRA e QLoRA. La doppia 3D V-Cache della CPU (208MB di cache totale) elimina l'asimmetria delle generazioni precedenti, offrendo a tutti i 16 core lo stesso accesso alla cache ad alta velocità: un vantaggio concreto nei carichi multi-thread come compilazione, simulazioni e data preprocessing. La Drako PRO Prime AI Workstation è la macchina ideale per chi vuole sviluppare, addestrare e mettere in produzione soluzioni AI on-premises in un form factor da scrivania, mantenendo dati e modelli sotto il proprio controllo.

  • Software stack preinstallato: PyTorch, TensorFlow, Docker, CUDA, cuDNN, vLLM, Hugging Face, DeepSpeed, Triton Inference Server, ONNX Runtime, Jupyter, RAPIDS, NGC Containers (ambiente Linux completo via WSL2)
  • Casi d'uso principali: Fine-tuning (LoRA, QLoRA)
    Inferenza e model serving on-premises
    RAG e AI assistant deployment
    NLP e LLM locali (fino a ~30B fluidi, fino a 70B con quantizzazione 4-bit)
    Computer Vision (classificazione, object detection, segmentazione)
    Rendering, 3D e content creation
    Ricerca e prototipazione
  • Configurazione: Personalizzabile (CPU, memoria, storage, GPU) su richiesta
  • Validazione: Sistema assemblato, configurato e testato presso Drako prima della spedizione

Le specifiche tecniche, le descrizioni e le immagini dei prodotti sono fornite dai rispettivi produttori e riportate a titolo informativo. Tali dati possono contenere errori involontari o essere soggetti a variazioni e aggiornamenti da parte del produttore senza preavviso. Le immagini sono da considerarsi indicative e potrebbero non corrispondere esattamente al prodotto consegnato.

In caso di discrepanza, fanno fede le specifiche ufficiali pubblicate dal produttore. I diritti del consumatore previsti dal D.Lgs. 206/2005 restano impregiudicati. Per chiarimenti, contattaci.

Recensioni

Non ci sono recensioni dei clienti in questo momento.

Lascia una recensione ›
Drako's Bundle

Drako PRO Prime AI Workstation - 9950X3D2, 128GB DDR5, RTX 5090, SSD 4TB NVMe

Workstation AI full tower con AMD Ryzen 9 9950X3D2, fino a 2x GPU, 128 GB DDR5

Cod. Drako: 033-838SKU: N/AEAN: N/A
€ 13.270,00
IVA inclusa, escluse spese di spedizione
finanziamento da € 203,30/mese in 48 rate
TAN 9,45% fisso · TAEG 11,10% ·
Pagamento sicuro
Spedizione rapida
Reso entro 14 giorni
Hai domande su questo prodotto?