diff --git a/chapters/fr/chapter2/5.mdx b/chapters/fr/chapter2/5.mdx index 4154b8663..85d351af0 100644 --- a/chapters/fr/chapter2/5.mdx +++ b/chapters/fr/chapter2/5.mdx @@ -34,10 +34,10 @@ Dans la section précédente, nous avons exploré le cas d'utilisation le plus simple : faire une inférence sur une seule séquence de petite longueur. Cependant, certaines questions émergent déjà : -- comment gérer de plusieurs séquences ? -- comment gérer de plusieurs séquences *de longueurs différentes* ? +- comment gérer plusieurs séquences ? +- comment gérer plusieurs séquences *de longueurs différentes* ? - les indices du vocabulaire sont-ils les seules entrées qui permettent à un modèle de bien fonctionner ? -- existe-t-il une séquence trop longue ? +- une séquence peut-elle être trop longue ? Voyons quels types de problèmes ces questions posent et comment nous pouvons les résoudre en utilisant l'API 🤗 *Transformers*. @@ -92,9 +92,9 @@ InvalidArgumentError: Input to reshape is a tensor with 14 values, but the reque ``` {/if} -Pourquoi cela a échoué ? Nous avons suivi les étapes du pipeline de la section 2. +Pourquoi cela a-t-il échoué ? Nous avons suivi les étapes du pipeline de la section 2. -Le problème est que nous avons envoyé une seule séquence au modèle, alors que les modèles de l’API 🤗 *Transformers* attendent plusieurs phrases par défaut. Ici, nous avons essayé de faire ce que le *tokenizer* fait en coulisses lorsque nous l'avons appliqué à une `séquence`. Cependant si vous regardez de près, vous verrez qu'il n'a pas seulement converti la liste des identifiants d'entrée en un tenseur mais aussi ajouté une dimension par-dessus : +Le problème est que nous avons envoyé une seule séquence au modèle, alors que les modèles de l’API 🤗 *Transformers* attendent plusieurs phrases par défaut. Ici, nous avons essayé de faire ce que le *tokenizer* fait en coulisses lorsque nous l'avons appliqué à une `sequence`. Cependant si vous regardez de près, vous verrez qu'il n'a pas seulement converti la liste des identifiants d'entrée en un tenseur mais aussi ajouté une dimension par-dessus : {#if fw === 'pt'} @@ -337,7 +337,7 @@ Remarquez comment la dernière valeur de la deuxième séquence est un identifia ## Séquences plus longues -Les *transformers* acceptent en entrée que des séquences d’une longueur limitée. La plupart des modèles traitent des séquences allant jusqu'à 512 ou 1024 *tokens* et plantent lorsqu'on leur demande de traiter des séquences plus longues. Il existe deux solutions à ce problème : +Les *transformers* n'acceptent en entrée que des séquences d’une longueur limitée. La plupart des modèles traitent des séquences allant jusqu'à 512 ou 1024 *tokens* et plantent lorsqu'on leur demande de traiter des séquences plus longues. Il existe deux solutions à ce problème : - utiliser un modèle avec une longueur de séquence supportée plus longue, - tronquer les séquences.