How to finetune LLMs on custom data domains (CPT tutorial with Unsloth)

How to finetune LLMs on custom data domains (CPT tutorial with Unsloth)

🎙 Neural Breakdown with AVB 👥 34K 📅 29 mars 2026 ⏱ 24 min 👁 10K 📄 tutoriel 🧭 2026-08-15
Disponible en : Français (actuel) English

Mots-clés

CPTfine-tuningUnslothLoRAévaluation

Résumé

Cette vidéo est un tutoriel pratique sur le continued pre-training (CPT) de modèles de langage de petite taille sur des domaines de données spécifiques. L’auteur utilise le modèle SmolLM-135M et un jeu de données composé d’articles arXiv récents sur le deep learning. Il détaille les étapes clés : préparation des données (troncature, packing), choix entre full fine-tuning et LoRA, et mise en place d’un harnais d’évaluation avec des métriques comme la cross-entropy, ROUGE, BLEU et BERTScore. Il compare les deux approches et constate que LoRA est beaucoup plus efficace en termes de coût et de vitesse. Il explore ensuite l’impact de la taille du jeu de données, du nettoyage des données (suppression des références) et de l’utilisation de RS-LoRA pour améliorer les performances. Il conclut en soulignant l’importance de l’itération expérimentale et en recommandant les notebooks Unsloth pour démarrer.

139 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La vidéo offre une valeur pratique considérable pour toute personne souhaitant fine-tuner des LLM sur des données personnalisées. L’auteur présente une méthodologie expérimentale complète, depuis la collecte des données jusqu’à l’évaluation, en passant par le choix des hyperparamètres. L’argumentation est solide : chaque décision est justifiée par des considérations théoriques (complexité quadratique de l’attention, stabilité de l’entraînement, overfitting) et par des résultats expérimentaux concrets. La comparaison entre full fine-tuning et LoRA est particulièrement éclairante, montrant clairement les avantages de la seconde approche en termes de coût et de vitesse. L’auteur ne se contente pas de donner des recettes, il explique le ‘pourquoi’ derrière chaque choix, ce qui permet au spectateur de généraliser les concepts à d’autres situations.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est bonne : l’auteur suit une démarche expérimentale structurée, avec une séparation train/validation, une évaluation multi-métriques et une attention à l’overfitting. Les sources citées sont pertinentes : le dépôt GitHub du projet, la documentation Unsloth, le modèle SmolLM-135M sur Hugging Face, et les vidéos complémentaires de la série. Le titre est parfaitement adéquat au contenu. Aucune publicité n’est présente dans la vidéo, mais l’auteur mentionne son Patreon et Paper Breakdown, ce qui est une forme de promotion, sans impact sur la qualité scientifique.

218 mots

Adéquation titre / contenu

Le titre correspond parfaitement au contenu : il s'agit bien d'un tutoriel sur le fine-tuning de LLM sur des domaines de données personnalisés, avec une mise en pratique utilisant Unsloth.

Qualité & fiabilité

8/10

Le contenu est un tutoriel pratique détaillé, présentant une méthodologie expérimentale claire et reproductible. Les explications sont précises et s'appuient sur des bibliothèques reconnues (Unsloth, Hugging Face). Les sources citées sont pertinentes et directement liées au contenu. La démarche expérimentale est rigoureuse, avec une évaluation multi-métriques et une attention portée à l'overfitting. Quelques points restent implicites (détails de nettoyage, choix des hyperparamètres), mais l'ensemble est fiable.

Moments clés

Sources citées

Sources concordantes

Références externes

Apport & nouveautés

La vidéo apporte une approche pratique et méthodique du continued pre-training, en mettant l’accent sur la préparation des données et l’évaluation, souvent négligées dans les tutoriels. Elle compare concrètement full fine-tuning et LoRA, et introduit l’utilisation de RS-LoRA pour améliorer les performances. L’accent mis sur l’itération expérimentale et l’importance de la qualité des données est un apport précieux.

Pour aller plus loin :

134 mots

Profil radar

Le profil radar montre une vidéo équilibrée avec des scores élevés dans toutes les dimensions, reflétant un contenu dense, technique et fiable. La quantité d'information est importante, la qualité est bonne, le niveau technique est élevé et la fiabilité est solide, ce qui en fait une ressource précieuse pour un public averti.

Fiabilité 8/10

💬 Sur les 0 commentaires analysés, aucune tendance n'a pu être dégagée.