Puoi usarlo tu?
Solo se fai girare modelli sulle tue GPU NVIDIA da data center. DeepGEMM serve a chi addestra o serve modelli, non a chi ci chatta. Ti servono:
- Una GPU NVIDIA Hopper (SM90, come la H100 o H800) o Blackwell (SM100).
- CUDA Toolkit 12.9 o successivo, PyTorch 2.3 o successivo, Python 3.8 o successivo.
- Un compilatore C++20. CUTLASS 4.0 o successivo entra come sottomodulo Git.
Nel terminaleClona e installa DeepGEMM
git clone --recursive https://github.com/deepseek-ai/DeepGEMM.git
cd DeepGEMM
./install.sh
Poi fai nel tuo progetto Python. I kernel si compilano al primo utilizzo, quindi non c'è una compilazione lunga da aspettare.
Se sei in Italia
Non cambia niente dal punto di vista tecnico: DeepGEMM gira ovunque ci sia la GPU giusta. Il punto è che queste GPU (H100, H800) costano migliaia di euro e stanno nei data center, non sotto la scrivania. Se non gestisci infrastruttura di questo tipo, la sezione qui sotto è quella che ti riguarda.