Skip to content

Latest commit

 

History

History
385 lines (310 loc) · 23.2 KB

File metadata and controls

385 lines (310 loc) · 23.2 KB
AMD YES ! 🚀

Open Source · Piloté par la communauté · Rendre l'écosystème IA d'AMD plus accessible

English 简体中文 繁體中文 日本語 Español Français 한국어 العربية Tiếng_Việt Deutsch

AMD University Program      AMD ROCm

  Depuis ROCm 7.10.0 (publiée le 11 décembre 2025), ROCm peut être installé de manière transparente dans des environnements virtuels Python, un peu comme CUDA, avec un support officiel pour Linux et Windows. C'est un grand pas en avant pour AMD dans le domaine de l'IA : les apprenants et les passionnés de LLM ne sont plus limités au matériel NVIDIA — les GPU AMD sont un choix solide et pratique.

  Cependant, abaisser la barrière matérielle ne clarifie pas automatiquement le parcours d'apprentissage. Pour les apprenants qui ont déjà des bases en LLM et souhaitent les mettre en pratique sur des GPU AMD, les vrais défis ne font que commencer : Comment déployer un modèle sur GPU AMD ? Comment effectuer du fine-tuning et de l'entraînement sur cette base ? Comment comprendre le système de programmation GPU de ROCm et réaliser la migration de CUDA vers ROCm ? Et finalement, comment rassembler toutes ces capacités dans une application IA réelle et fonctionnelle ?

  hello-rocm est né précisément pour ce parcours. Ce projet couvre systématiquement la chaîne d'utilisation complète des grands modèles sur la plateforme AMD ROCm, vous emmenant depuis l'exécution de votre premier modèle jusqu'à la construction d'applications IA réelles sur GPU AMD, en passant par chaque étape clé incluant le fine-tuning, l'entraînement et la programmation GPU, faisant du GPU AMD non pas seulement une carte graphique, mais votre véritable point de départ dans le monde du développement IA.

  Ce projet est principalement un ensemble de tutoriels afin que les étudiants et les futurs praticiens puissent apprendre AMD ROCm de manière structurée. Toute personne est la bienvenue pour ouvrir des issues ou soumettre des pull requests afin de développer et maintenir le projet ensemble.

  Parcours d'apprentissage : Commencez par 00-Environnement (ROCm + PyTorch + uv), puis le déploiement et le fine-tuning, et enfin l'optimisation d'opérateurs et la programmation GPU. Une fois votre environnement opérationnel, LM Studio ou vLLM est un bon point de départ.

hello-rocm Skill : utiliser ce projet dans votre assistant IA

  Si vous utilisez un outil de codage IA compatible avec Skills, Rules ou une configuration Agent, vous pouvez utiliser le hello-rocm Skill intégré. Il s’appuie sur la structure du dépôt, l’index des références, la table d’architecture GPU, les tutoriels de déploiement et la liste de dépannage pour vous orienter vers le bon document et le bon lien officiel.

Use src/hello-rocm-skill in the current repository as the hello-rocm Skill. If your tool supports Skills, Rules, or Agent configuration, install or load it in the appropriate place, such as .claude/skills, .cursor/skills, or .agents/skills, then use that Skill to help me learn, deploy, and troubleshoot AMD ROCm.

  Essayez de demander : Mon GPU AMD supporte-t-il ROCm ? Quel est le chemin le plus rapide pour exécuter mon premier LLM local ? Comment installer vLLM/Ollama/llama.cpp sur ROCm ? Comment déboguer quand torch.cuda.is_available() renvoie False ? Voir le guide hello-rocm Skill.

Dernières mises à jour

Modèles et tutoriels pris en charge

✨ LLM grand public : environnement · inférence multi-cadres · fine-tuning ✨
Configuration ROCm unifiée (Windows / Ubuntu) + ROCm 7+ · tutoriels par modèle (en croissance)
00 — Configuration de l'environnement

Qwen3
LM Studio
vLLM
Ollama
llama.cpp
Qwen3-0.6B LoRA + SwanLab
Qwen3-8B LoRA (Notebook)
Qwen3.5
LM Studio
vLLM
Ollama
llama.cpp
Qwen3.5-4B LoRA + SwanLab
Qwen3.5-4B LoRA (Notebook)
Gemma4
Présentation du modèle Gemma 4
LM Studio
vLLM
Ollama
llama.cpp
Fine-tuning LoRA de Gemma4 E4B (TRL, Notebook)
MiniCPM5
llama.cpp
MiniCPM-V 4.6
llama.cpp
vLLM
MiniCPM-o 4.5
Présentation du modèle MiniCPM-o 4.5
Déploiement llama.cpp-omni (voix + vision + TTS)
Déploiement Web Demo full-duplex
Politiques d'intelligence incarnée (ACT / SmolVLA / Pi0 / Pi0.5)
Every Embodied — Réplication de politiques d'intelligence incarnée ROCm
Notebook d'entraînement ACT ROCm
Notebook d'entraînement SmolVLA ROCm
Notebook d'entraînement Pi0 ROCm
Notebook de diagnostic strict de bout en bout Pi0
Notebook d'entraînement Pi0.5 EEF-delta

Pourquoi ce projet

  Qu'est-ce que ROCm ?

ROCm (Radeon Open Compute) est la pile de calcul GPU ouverte d'AMD pour le HPC et l'apprentissage automatique. Elle permet d'exécuter des charges de travail parallèles sur les GPU AMD et constitue la principale alternative à CUDA sur le matériel AMD.

  Les LLM ouverts sont partout, mais la plupart des tutoriels et des outils supposent l'utilisation de la pile NVIDIA CUDA. Les développeurs qui choisissent AMD manquent souvent de matériel d'apprentissage complet et natif ROCm.   À partir de ROCm 7.10.0 (11 décembre 2025), le projet TheRock d’AMD dissocie l’environnement d’exécution de calcul du système d’exploitation, de sorte que les mêmes interfaces ROCm fonctionnent sous Linux et Windows, et que ROCm puisse être installé dans des environnements Python de la même manière que CUDA. ROCm n’est plus une « simple tuyauterie Linux » — c’est une plateforme de calcul IA multiplateforme. hello-rocm rassemble des guides pratiques pour permettre à davantage de personnes d’utiliser les GPU AMD pour l’entraînement et l’inférence.

  Nous espérons être un pont entre les GPU AMD et les constructeurs du quotidien — ouvert, inclusif et tourné vers un avenir de l’IA plus large.

À qui s’adresse ce projet

  Ce projet peut vous être utile si vous :

  • Possédez un GPU AMD et souhaitez exécuter des LLM localement ;
  • Souhaitez construire sur AMD mais manquez d’un cursus ROCm structuré ;
  • Vous intéressez au déploiement et à l’inférence économiques ;
  • Êtes curieux à propos de ROCm et préférez l’apprentissage pratique.

Feuille de route et structure

  Le dépôt suit le workflow complet ROCm pour les LLM : base unifiée (00-Environment), déploiement, fine-tuning et sujets de type Infra :

Organisation du dépôt

hello-rocm/
├── docs/                   # Source de documentation VitePress
│   ├── zh/                 # Documentation en chinois
│   │   ├── 00-environment/ # Installation et configuration de base ROCm
│   │   ├── 01-deploy/      # Déploiement de LLM sur ROCm
│   │   ├── 02-fine-tune/   # Fine-tuning de LLM sur ROCm
│   │   ├── 03-infra/       # Optimisation d'opérateurs et programmation GPU
│   │   ├── 04-references/  # Références ROCm sélectionnées
│   │   └── 05-amd-yes/     # Projets communautaires AMD
│   └── en/                 # Documentation en anglais
├── src/                    # Code source et scripts
└── assets/                 # Ressources partagées

00. Environnement — Base ROCm

🛠️ Installation et configuration de l’environnement ROCm
Base unique · ROCm 7.12.0 · Windows / Ubuntu · uv + PyTorch
📖 Démarrer avec l’environnement ROCm

Tableau des architectures GPU et correspondance pip
• Windows 11 : pilotes, prérequis de sécurité, procédure d’installation
• Ubuntu 24.04 : installation basée sur uv et script d’installation unifié optionnel
• Vérification, désinstallation et changement de cible GPU

01. Déploiement — Déploiement de LLM sur ROCm

🚀 Déploiement de LLM sur ROCm
Du zéro à un modèle en fonctionnement sur GPU AMD
📖 Démarrer avec le déploiement ROCm

• LM Studio à partir de zéro
• vLLM à partir de zéro
• Ollama à partir de zéro
• llama.cpp à partir de zéro
• ATOM à partir de zéro

02. Fine-tuning — Fine-tuning de LLM sur ROCm

🔧 Fine-tuning de LLM sur ROCm
Fine-tuning efficace sur GPU AMD
📖 Démarrer avec le fine-tuning ROCm

• Tutoriels de fine-tuning à partir de zéro
• Scripts de fine-tuning sur machine unique
• Fine-tuning multi-nœuds et multi-GPU

03. Infra — Optimisation d’opérateurs et programmation GPU

⚙️ Optimisation d’opérateurs ROCm et programmation GPU
Du panorama matériel AMD AI aux opérateurs HIP et à l’analyse de performances
📖 Démarrer avec l’optimisation d’opérateurs ROCm

• Panorama matériel AMD AI et écosystème ROCm
• Analyse approfondie de la pile logicielle GPU et de l’architecture matérielle
• Introduction à la programmation HIP et pratique de noyaux écrits à la main
• Opérateurs PyTorch personnalisés et intégration Autograd

04. Références

📚 Références ROCm
Ressources officielles et communautaires
📖 Références ROCm

Documentation officielle ROCm
AMD sur GitHub
Notes de version ROCm
Livres blancs sur l’architecture GPU AMD (CDNA / RDNA)
Liens rapides d’installation ROCm pour frameworks et services d’inférence
• Actualités connexes

05. AMD-YES — Vitrines communautaires

✨ Vitrines de projets AMD
Exemples pilotés par la communauté sur GPU AMD
📖 Démarrer avec AMD-YES sur ROCm

• toy-cli — assistant LLM léger en terminal
• Minesweeper Agent — jouer au démineur avec un LLM local (pratique boucle Agent)
• « Jump Jump » de WeChat avec YOLOv10 — IA de jeu en action (Entraîner et utiliser yolov10 sous ROCm)
• Chat-甄嬛 — modèle de dialogue de style historique
• Planificateur de voyage — démo d'agent HelloAgents
• Torch-RecHub — systèmes de recommandation (CTR, rappel, multi-tâches, export ONNX)
• happy-llm — apprentissage distribué de LLM
Every Embodied — Réplication de politiques d'intelligence incarnée ROCm

Contribution

  Nous accueillons toutes sortes de contributions :

  • Améliorer ou ajouter des tutoriels
  • Corriger des erreurs et des bugs
  • Partager vos projets AMD
  • Suggérer des idées et des orientations

  Veuillez lire le Content Guide (structure, nommage, images — aligné sur les tutoriels comme Qwen3), puis CONTRIBUTING_en.md (issues, PRs et conventions par répertoire de modèle).

  Si vous rencontrez des questions de dépannage ou de FAQ en utilisant ROCm, en déployant des modèles ou en lisant les tutoriels, vous pouvez aussi rejoindre la discussion communautaire afin de partager vos retours, signaler des problèmes et améliorer les tutoriels avec la communauté.

  Si vous souhaitez aider à maintenir le dépôt à long terme, contactez-nous — nous pouvons vous ajouter en tant que mainteneur.

Remerciements

Contributeurs principaux

D’autres contributeurs sont toujours les bienvenus.

Autres

  • Les idées et retours sont les bienvenus — veuillez ouvrir des issues.
  • Merci à tous ceux qui ont contribué aux tutoriels.
  • Merci au Programme universitaire AMD pour son soutien à ce projet.

Licence

Licence MIT


Construisons ensemble l’avenir de l’IA AMD. 💪

Fait avec ❤️ par la communauté hello-rocm