Python
Comment accélérer les réseaux neuronaux locaux sur Apple Silicon de deux fois avec MTPLX
MTPLX exploite les têtes MTP intégrées dans les modèles modernes comme Qwen 3.5-3.8 pour atteindre une accélération jusqu'à 2,24x sur Apple Silicon sans nécessiter de modèle draft séparé.