CELPIP Speaking Task 3 : décrire une scène (réponses modèles + langue à employer)
Le Task 3 vous demande de décrire une image à quelqu'un qui ne la voit pas. Voici le minutage, la structure gagnante, le vocabulaire spatial exact, et trois réponses modèles par niveau de bande à recopier.

1En quoi consiste le CELPIP Speaking Task 3
Le Task 3 du test CELPIP Speaking, c'est « Describing a Scene » (décrire une scène). Une image apparaît à l'écran, et votre rôle est de la décrire en détail à quelqu'un qui ne peut pas la voir. Imaginez que vous êtes au téléphone avec un ami et que vous peignez l'image uniquement avec des mots — il ne peut pas jeter un coup d'œil à l'image, donc chaque détail que vous voulez lui faire connaître doit sortir de votre bouche.
Ce simple cadrage — décrire à quelqu'un qui ne voit pas — est tout l'enjeu de la tâche, et il change tout dans la manière dont vous devez parler. Vous n'étiquetez pas des objets pour un examinateur voyant ; vous construisez une image mentale pour un auditeur aveugle. Cela signifie que vous couvrez trois choses : ce qui se passe, où les choses sont situées, et à quoi elles ressemblent.
L'objectif n'est pas une description poétique. C'est une description claire, organisée et détaillée. Une bonne réponse au Task 3 progresse à travers l'image dans un ordre logique, emploie beaucoup de présent continu pour décrire l'action en cours, et ancre chaque élément dans l'espace afin que l'auditeur sache toujours où « regarder ».
Le Task 3 n'est pas un test de vocabulaire portant sur des objets. C'est un test qui vérifie si vous savez décrire l'action en cours, l'agencement spatial et le détail visuel assez clairement pour qu'une personne qui ne voit pas l'image puisse la dessiner à partir de vos mots.
2Minutage et format
Le Task 3 suit le même rythme serré que le reste du CELPIP Speaking : une brève fenêtre de préparation, puis une fenêtre de prise de parole fixe. Vous disposez de 30 secondes pour préparer et de 60 secondes pour parler.
Trente secondes de préparation suffisent pour balayer l'image et décider d'un ordre — pas pour écrire un script. Servez-vous-en pour repérer le sujet principal, le premier plan, l'arrière-plan, et deux ou trois détails que vous voulez absolument mentionner. Dès que l'enregistrement commence, vous avez 60 secondes, et vous devriez continuer à parler pendant la quasi-totalité de ce temps.
Soixante secondes paraissent courtes une fois que vous commencez. Le défi, c'est la couverture : vous devez décrire toute l'image, pas seulement la partie la plus facile à nommer. Si vous passez 40 secondes sur la personne au centre et ne mentionnez jamais l'arrière-plan, vous avez laissé la moitié de la scène invisible pour votre auditeur. Réglez votre rythme pour avancer régulièrement à travers l'image entière.
Pendant vos 30 secondes de préparation, n'écrivez pas de phrases — choisissez simplement votre ordre de balayage. Un plan simple comme « vue d'ensemble → centre → gauche → droite → arrière-plan → ambiance » suffit, et il garantit que vous couvrez toute l'image au lieu de rester coincé sur un seul coin.
3Comment le Task 3 est noté
Chaque tâche du CELPIP Speaking est notée sur les quatre mêmes dimensions : Content/Coherence, Vocabulary, Listenability et Task Fulfillment. Ce qui change, c'est la façon dont ces dimensions s'appliquent à une description.
La compétence la plus spécifique à cette tâche, c'est le présent continu exact. Le Task 3 est rempli d'actions en cours — des gens qui achètent, des enfants qui courent, un musicien qui joue — et le temps anglais naturel pour cela est « is/are + -ing ». Bien le maîtriser est un contributeur discret mais lourd à vos scores de Vocabulary et de Listenability.
4La structure gagnante pour le Task 3
Vous n'avez pas besoin d'une réponse créative ; vous avez besoin d'une réponse organisée. La même structure fiable fonctionne pour presque n'importe quelle image. Suivez ces étapes et vous couvrirez toute la scène d'une manière que l'examinateur peut facilement suivre.
Mémorisez ce squelette — vue d'ensemble, premier plan, arrière-plan, une direction, ambiance — et vous ne resterez jamais bloqué. Avec n'importe quelle image qu'on vous remet, vous connaissez déjà votre première phrase et votre dernière phrase avant même d'avoir regardé les détails.
5Langue spatiale et descriptive
Le Task 3 se joue sur deux systèmes de langue : les mots qui situent les choses dans l'espace, et les mots qui décrivent l'action en cours et le détail visuel. Constituez une petite réserve de chacun et vous aurez toujours quelque chose d'exact à dire. Voici les quatre familles à maîtriser.
Ce sont l'ossature d'une description destinée à quelqu'un qui ne voit pas. Employez « in the foreground » et « in the background » pour la profondeur ; « on the left » et « on the right » pour les côtés ; « in the middle » / « in the centre » pour le point central ; et « next to », « behind », « in front of » et « between » pour relier les choses entre elles. Chaque objet que vous mentionnez doit être ancré : pas seulement « a musician », mais « on the right, a musician is playing ».
Une image saisit une action en cours, donc le temps naturel est « is/are + -ing ». « A woman is buying vegetables. » « Children are running between the stalls. » « A man is handing over some money. » Ce temps est le marqueur le plus clair d'une bonne réponse au Task 3 — il rend la scène vivante et en mouvement.
Employez « there is » / « there are » pour introduire ce qui existe, et des mots de quantité pour donner une idée de l'échelle : « There are several stalls », « a few children », « lots of people », « a couple of tables ». Ils vous permettent de décrire une scène animée sans énumérer chaque personne une par une.
Les adjectifs transforment une liste d'objets en une véritable image. Couleur (« a bright red awning », « green vegetables »), taille (« a large crowd », « a small wooden stall ») et ambiance (« a cheerful atmosphere », « a relaxed Saturday morning »). Un ou deux adjectifs forts par élément suffisent — et c'est exactement ce qui rehausse votre score de Vocabulary.
Les mots spatiaux sont le vocabulaire à plus forte valeur dans cette tâche. Un apprenant qui dit « in the foreground, on the left, a vendor is weighing fruit » paraît bien plus avancé que celui qui dit « there's a man and he has fruit » — même s'ils décrivent la même chose.
6Réponse modèle au CLB 7
Voici une solide réponse de niveau CLB 7 à la consigne « Describe this scene: a busy farmers' market on a sunny weekend morning — vendors at stalls, families shopping, children with balloons, a musician playing. » Elle emploie un présent continu correct, des mots spatiaux de base, et couvre clairement tous les éléments principaux — ce qui correspond exactement à ce à quoi ressemble le CLB 7.
This picture shows a farmers' market. It is a sunny morning, and there are a lot of people. In the front, I can see some stalls with fruit and vegetables. A woman is buying vegetables, and a man is giving her some money. There are green vegetables and red apples on the table. On the left, a family is shopping together. Two children are holding balloons, and they look happy. The balloons are red and blue. On the right side, there is a musician. He is playing a guitar, and some people are listening. In the background, there are more stalls and a lot of people walking. The sky is blue and the weather is nice. Everyone is busy, and the market is very crowded. It looks like a fun and happy place.
Pourquoi c'est du CLB 7 : chaque phrase est claire et le présent continu est correct (« is buying », « is playing », « are holding »). La langue spatiale est exacte mais basique — « in the front », « on the left », « on the right », « in the background ». Le vocabulaire est simple et un peu répétitif (« a lot of people » deux fois, « happy » / « fun »). La réponse couvre toute l'image dans l'ordre, ce qui est bien, mais les adjectifs restent ordinaires. Cela communique la scène pleinement et correctement — cela ne montre simplement pas encore d'étendue.
7Réponse modèle au CLB 9
Maintenant, la même scène au CLB 9. Remarquez les adjectifs plus riches, l'organisation spatiale plus fluide et les détails supplémentaires. La structure est la même, mais la langue porte plus d'information par phrase et s'écoule plus naturellement.
This is a lively farmers' market on a bright, sunny weekend morning. In the foreground, several wooden stalls are lined up, piled high with fresh fruit and vegetables. A vendor in a green apron is weighing some tomatoes, while a customer is reaching into her bag for money. To the left, a young family is wandering between the stalls, carrying cloth shopping bags. Two small children are skipping ahead of their parents, each clutching a brightly coloured balloon — one red, one yellow. On the right side of the picture, a street musician is playing the guitar, and a small crowd has gathered around him to listen. In the background, you can see rows of colourful awnings and dozens of shoppers strolling in the sunshine. The whole scene feels warm, busy, and cheerful — a typical Saturday morning where the whole town has come out to enjoy the good weather.
Pourquoi c'est du CLB 9 : le vocabulaire est nettement plus riche — « piled high », « weighing », « clutching », « strolling », « awnings ». Les transitions spatiales sont plus fluides (« in the foreground », « to the left », « on the right side », « in the background ») et la réponse s'écoule comme une description liée plutôt que comme des faits séparés. Il y a plus de détails précis (le tablier vert, les sacs en tissu, les couleurs des ballons). La réponse suit toujours l'ordre clair de la vue d'ensemble vers l'arrière-plan, mais chaque élément est décrit avec précision et la clôture nomme l'ambiance de façon naturelle.
8Réponse modèle au CLB 11
Au CLB 11, la description devient vivante et précise, avec un débit naturel et un véritable sens de l'atmosphère. Le locuteur ne se contente pas de rapporter ce qui se trouve dans l'image — il recrée l'expérience d'être debout au marché. La maîtrise de la langue est sans effort.
This image captures a bustling farmers' market on a glorious, sun-drenched weekend morning. Dominating the foreground is a row of rustic wooden stalls, their tables overflowing with vibrant produce — crimson tomatoes, leafy greens, and baskets of glossy apples. A cheerful vendor in a green apron is carefully weighing a handful of tomatoes while a customer rummages through her purse for change. Just to the left, a young family meanders through the crowd, the parents chatting as their two children dart ahead, each gripping a balloon that bobs above the crowd — one a bright red, the other a sunny yellow. Over on the right, a street musician strums his guitar, and a handful of passers-by have paused to listen, tapping their feet. Further back, a sea of striped awnings stretches into the distance, with shoppers drifting lazily between them. The whole scene radiates warmth and easy contentment — the unmistakable buzz of a community savouring a perfect Saturday morning.
Pourquoi c'est du CLB 11 : la langue est vivante et précise sans jamais paraître forcée — « sun-drenched », « overflowing », « meanders », « darts », « a sea of striped awnings ». L'organisation spatiale est sans couture et tissée dans la description plutôt qu'énoncée mécaniquement. Il y a un détail riche et précis et un véritable sens de l'atmosphère dans la clôture (« the unmistakable buzz of a community savouring a perfect Saturday morning »). Le débit est naturel et assuré, le genre de maîtrise sans effort qui définit la bande supérieure.
9Erreurs courantes au Task 3
La plupart des points perdus au Task 3 proviennent d'une poignée d'erreurs prévisibles. Reconnaissez-les dès maintenant, et vous pourrez vous en débarrasser à l'entraînement avant le jour du test.
10Comment s'entraîner au Task 3
Le Task 3 est l'une des parties les plus faciles à entraîner de tout le test, parce que vous pouvez vous y exercer avec n'importe quelle photo. Adoptez l'habitude ci-dessous et la structure devient automatique.
Les plus grands progrès viennent de l'enregistrement et de la réécoute. La plupart des apprenants trouvent que leur réponse était correcte et n'entendent jamais les glissements répétés vers le présent simple ni le coin de l'image qu'ils ont sauté. Deux minutes de réécoute honnête par jour valent plus qu'une heure de pratique silencieuse.
11Comment FlexiLingo vous aide à maîtriser le CELPIP Speaking
Décrire une scène avec aisance sous un chronomètre de 60 secondes demande une vraie pratique répétée avec retours — pas seulement de la lecture sur le sujet. FlexiLingo est conçu pour vous offrir exactement cela, sur du contenu canadien authentique et des consignes de style CELPIP.
Entraînez-vous au Task 3 avec des consignes illustrées qui reflètent le vrai test, en enregistrant votre description dans les mêmes limites de 30 secondes de préparation et de 60 secondes de prise de parole, pour que le minutage devienne une seconde nature.
Obtenez un retour immédiat sur votre réponse — votre emploi des temps, votre langue spatiale, votre couverture de l'image, et les endroits où vous pourriez être plus clair — afin de savoir exactement quoi corriger avant votre prochaine tentative.
Découvrez à quoi ressemblent réellement une réponse au CLB 7, au CLB 9 et au CLB 11 à la même consigne, pour entendre l'écart entre votre niveau et le suivant et recopier les gestes qui le comblent.
Enregistrez les phrases spatiales et les mots descriptifs que vous rencontrez — « in the foreground », « piled high with », « a lively atmosphere » — avec leur phrase d'exemple complète, pour apprendre comment chaque phrase est réellement utilisée.
Le vocabulaire de description que vous enregistrez revient pour révision au moment optimal, afin que les phrases dont vous aurez besoin le jour du test soient ancrées bien avant de passer l'examen.
Questions fréquentes
Surtout le présent continu — « is/are + -ing ». Une image montre une action qui se déroule en ce moment même, donc l'anglais naturel est « A woman is buying vegetables », « Children are running », « A man is playing the guitar ». Vous emploierez aussi le présent simple pour les faits permanents (« The sky is blue », « There are several stalls ») et « there is / there are » pour introduire des choses. Mais l'action que vous décrivez doit être au présent continu — bien le maîtriser est l'un des signes les plus clairs d'une bonne réponse.
Ne vous figez pas et ne restez pas silencieux — décrivez-le à la place. Si vous ne connaissez pas « awning », dites « a colourful cover over the stall ». Si vous ne connaissez pas « vendor », dites « the person who is selling the fruit ». La paraphrase est une compétence que les examinateurs valorisent réellement, car elle montre que vous savez continuer à communiquer sous la pression. Ne gaspillez jamais vos 60 secondes à chercher le mot parfait quand une simple description fait passer le sens.
Assez détaillé pour couvrir toute l'image, mais pas au point de rester coincé sur une seule partie. Une bonne règle : un ou deux éléments précis par élément — ce qu'il fait, plus une couleur, une taille ou une position — puis on passe au suivant. Visez à mentionner la vue d'ensemble, le premier plan, deux ou trois sujets principaux, l'arrière-plan et l'ambiance globale. Si vous décrivez un coin en grande profondeur sans jamais atteindre le reste, vous avez laissé la scène à moitié invisible pour votre auditeur.
Oui — et c'est important. Dans le test CELPIP Speaking, le Task 4 (Making Predictions) vous montre généralement la même scène que le Task 3 et vous demande ce qui va se passer ensuite. Ainsi, au Task 3, vous décrivez ce qui se passe maintenant (présent continu), et au Task 4, vous prédisez ce qui est sur le point de se produire (formes du futur comme « is going to » et « will »). Les étudier ensemble est efficace : vous décrivez l'image, puis vous prédisez immédiatement son moment suivant.
Dépassez la description correcte de base pour aller vers une langue plus riche et un débit plus fluide. Trois changements vous font passer du CLB 7 au CLB 9 : ajoutez des adjectifs plus forts et plus précis (pas « a man with fruit » mais « a vendor arranging bright red apples ») ; employez un éventail plus large de verbes spatiaux et d'action (weighing, reaching, strolling, gathering) ; et reliez vos phrases en une description fluide plutôt qu'en faits séparés. Couvrez toute l'image dans un ordre clair, nommez l'ambiance à la fin, et gardez votre présent continu exact d'un bout à l'autre.
Entraînez-vous au CELPIP Speaking Task 3 avec un retour instantané
Utilisez FlexiLingo pour décrire de vraies consignes illustrées sous le chronomètre de 30 secondes de préparation et de 60 secondes de prise de parole, obtenez un retour instantané, et comparez votre réponse à des réponses modèles par bande.