CELPIP Speaking — Task 3

CELPIP Speaking Task 3 : décrire une scène (réponses modèles + langue à employer)

Le Task 3 vous demande de décrire une image à quelqu'un qui ne la voit pas. Voici le minutage, la structure gagnante, le vocabulaire spatial exact, et trois réponses modèles par niveau de bande à recopier.

Équipe FlexiLingo
10 juillet 2026
15 min de lecture

1En quoi consiste le CELPIP Speaking Task 3

Le Task 3 du test CELPIP Speaking, c'est « Describing a Scene » (décrire une scène). Une image apparaît à l'écran, et votre rôle est de la décrire en détail à quelqu'un qui ne peut pas la voir. Imaginez que vous êtes au téléphone avec un ami et que vous peignez l'image uniquement avec des mots — il ne peut pas jeter un coup d'œil à l'image, donc chaque détail que vous voulez lui faire connaître doit sortir de votre bouche.

Ce simple cadrage — décrire à quelqu'un qui ne voit pas — est tout l'enjeu de la tâche, et il change tout dans la manière dont vous devez parler. Vous n'étiquetez pas des objets pour un examinateur voyant ; vous construisez une image mentale pour un auditeur aveugle. Cela signifie que vous couvrez trois choses : ce qui se passe, où les choses sont situées, et à quoi elles ressemblent.

L'objectif n'est pas une description poétique. C'est une description claire, organisée et détaillée. Une bonne réponse au Task 3 progresse à travers l'image dans un ordre logique, emploie beaucoup de présent continu pour décrire l'action en cours, et ancre chaque élément dans l'espace afin que l'auditeur sache toujours où « regarder ».

Le Task 3 n'est pas un test de vocabulaire portant sur des objets. C'est un test qui vérifie si vous savez décrire l'action en cours, l'agencement spatial et le détail visuel assez clairement pour qu'une personne qui ne voit pas l'image puisse la dessiner à partir de vos mots.

2Minutage et format

Le Task 3 suit le même rythme serré que le reste du CELPIP Speaking : une brève fenêtre de préparation, puis une fenêtre de prise de parole fixe. Vous disposez de 30 secondes pour préparer et de 60 secondes pour parler.

Trente secondes de préparation suffisent pour balayer l'image et décider d'un ordre — pas pour écrire un script. Servez-vous-en pour repérer le sujet principal, le premier plan, l'arrière-plan, et deux ou trois détails que vous voulez absolument mentionner. Dès que l'enregistrement commence, vous avez 60 secondes, et vous devriez continuer à parler pendant la quasi-totalité de ce temps.

Soixante secondes paraissent courtes une fois que vous commencez. Le défi, c'est la couverture : vous devez décrire toute l'image, pas seulement la partie la plus facile à nommer. Si vous passez 40 secondes sur la personne au centre et ne mentionnez jamais l'arrière-plan, vous avez laissé la moitié de la scène invisible pour votre auditeur. Réglez votre rythme pour avancer régulièrement à travers l'image entière.

Pendant vos 30 secondes de préparation, n'écrivez pas de phrases — choisissez simplement votre ordre de balayage. Un plan simple comme « vue d'ensemble → centre → gauche → droite → arrière-plan → ambiance » suffit, et il garantit que vous couvrez toute l'image au lieu de rester coincé sur un seul coin.

3Comment le Task 3 est noté

Chaque tâche du CELPIP Speaking est notée sur les quatre mêmes dimensions : Content/Coherence, Vocabulary, Listenability et Task Fulfillment. Ce qui change, c'est la façon dont ces dimensions s'appliquent à une description.

Content & Coherence — Avez-vous couvert toute l'image dans un ordre logique ? Sauter au hasard d'un objet à l'autre vous pénalise ; un parcours clair à travers la scène (vue d'ensemble, puis premier plan, puis arrière-plan) vous aide.
Vocabulary — Avez-vous employé des mots descriptifs précis et une langue spatiale exacte ? « A woman in a red apron » vaut mieux que « a woman », et « in the foreground » vaut mieux que « here ».
Listenability — Votre discours était-il fluide et facile à suivre, avec un rythme naturel et un présent continu correct ? Les redémarrages constants et les temps erronés font baisser ce score.
Task Fulfillment — Avez-vous réellement décrit la scène pour quelqu'un qui ne peut pas la voir, avec assez de détails pour se la représenter ? Nommer trois objets puis s'arrêter ne remplit pas la tâche.

La compétence la plus spécifique à cette tâche, c'est le présent continu exact. Le Task 3 est rempli d'actions en cours — des gens qui achètent, des enfants qui courent, un musicien qui joue — et le temps anglais naturel pour cela est « is/are + -ing ». Bien le maîtriser est un contributeur discret mais lourd à vos scores de Vocabulary et de Listenability.

4La structure gagnante pour le Task 3

Vous n'avez pas besoin d'une réponse créative ; vous avez besoin d'une réponse organisée. La même structure fiable fonctionne pour presque n'importe quelle image. Suivez ces étapes et vous couvrirez toute la scène d'une manière que l'examinateur peut facilement suivre.

Étape 1 — Donnez d'abord une vue d'ensemble générale. Ouvrez avec une phrase qui nomme la scène entière : où elle se situe, quand elle se situe, et la situation globale. Cela indique à votre auditeur quel type d'image commencer à construire avant que vous n'ajoutiez du détail.
Étape 2 — Décrivez le premier plan et les sujets principaux. Passez à la personne ou à la chose la plus proche et la plus importante. Employez le présent continu pour dire ce qu'elle fait, et ajoutez à quoi elle ressemble.
Étape 3 — Passez à l'arrière-plan et aux détails secondaires. Une fois l'action principale claire, complétez ce qui se passe plus loin et sur les bords pour que l'image semble complète, et non vide.
Étape 4 — Adoptez un ordre cohérent — de gauche à droite ou du proche au lointain. Ne sautez pas dans tous les sens. Choisissez une direction et balayez l'image afin que votre auditeur puisse suivre votre « regard » sans se perdre.
Étape 5 — Terminez par l'humeur ou l'atmosphère. Concluez en nommant le sentiment global — animé, joyeux, détendu, ensoleillé — ce qui relie tout entre eux et donne une fin naturelle et assurée à vos 60 secondes.

Mémorisez ce squelette — vue d'ensemble, premier plan, arrière-plan, une direction, ambiance — et vous ne resterez jamais bloqué. Avec n'importe quelle image qu'on vous remet, vous connaissez déjà votre première phrase et votre dernière phrase avant même d'avoir regardé les détails.

5Langue spatiale et descriptive

Le Task 3 se joue sur deux systèmes de langue : les mots qui situent les choses dans l'espace, et les mots qui décrivent l'action en cours et le détail visuel. Constituez une petite réserve de chacun et vous aurez toujours quelque chose d'exact à dire. Voici les quatre familles à maîtriser.

Location phrases — placez chaque élément dans l'espace

Ce sont l'ossature d'une description destinée à quelqu'un qui ne voit pas. Employez « in the foreground » et « in the background » pour la profondeur ; « on the left » et « on the right » pour les côtés ; « in the middle » / « in the centre » pour le point central ; et « next to », « behind », « in front of » et « between » pour relier les choses entre elles. Chaque objet que vous mentionnez doit être ancré : pas seulement « a musician », mais « on the right, a musician is playing ».

Present continuous — décrivez ce qui se passe maintenant

Une image saisit une action en cours, donc le temps naturel est « is/are + -ing ». « A woman is buying vegetables. » « Children are running between the stalls. » « A man is handing over some money. » Ce temps est le marqueur le plus clair d'une bonne réponse au Task 3 — il rend la scène vivante et en mouvement.

Quantity & existence — dites combien et en quelle quantité

Employez « there is » / « there are » pour introduire ce qui existe, et des mots de quantité pour donner une idée de l'échelle : « There are several stalls », « a few children », « lots of people », « a couple of tables ». Ils vous permettent de décrire une scène animée sans énumérer chaque personne une par une.

Descriptive detail — adjectifs de couleur, de taille et d'ambiance

Les adjectifs transforment une liste d'objets en une véritable image. Couleur (« a bright red awning », « green vegetables »), taille (« a large crowd », « a small wooden stall ») et ambiance (« a cheerful atmosphere », « a relaxed Saturday morning »). Un ou deux adjectifs forts par élément suffisent — et c'est exactement ce qui rehausse votre score de Vocabulary.

Les mots spatiaux sont le vocabulaire à plus forte valeur dans cette tâche. Un apprenant qui dit « in the foreground, on the left, a vendor is weighing fruit » paraît bien plus avancé que celui qui dit « there's a man and he has fruit » — même s'ils décrivent la même chose.

6Réponse modèle au CLB 7

Voici une solide réponse de niveau CLB 7 à la consigne « Describe this scene: a busy farmers' market on a sunny weekend morning — vendors at stalls, families shopping, children with balloons, a musician playing. » Elle emploie un présent continu correct, des mots spatiaux de base, et couvre clairement tous les éléments principaux — ce qui correspond exactement à ce à quoi ressemble le CLB 7.

This picture shows a farmers' market. It is a sunny morning, and there are a lot of people. In the front, I can see some stalls with fruit and vegetables. A woman is buying vegetables, and a man is giving her some money. There are green vegetables and red apples on the table. On the left, a family is shopping together. Two children are holding balloons, and they look happy. The balloons are red and blue. On the right side, there is a musician. He is playing a guitar, and some people are listening. In the background, there are more stalls and a lot of people walking. The sky is blue and the weather is nice. Everyone is busy, and the market is very crowded. It looks like a fun and happy place.

Pourquoi c'est du CLB 7 : chaque phrase est claire et le présent continu est correct (« is buying », « is playing », « are holding »). La langue spatiale est exacte mais basique — « in the front », « on the left », « on the right », « in the background ». Le vocabulaire est simple et un peu répétitif (« a lot of people » deux fois, « happy » / « fun »). La réponse couvre toute l'image dans l'ordre, ce qui est bien, mais les adjectifs restent ordinaires. Cela communique la scène pleinement et correctement — cela ne montre simplement pas encore d'étendue.

7Réponse modèle au CLB 9

Maintenant, la même scène au CLB 9. Remarquez les adjectifs plus riches, l'organisation spatiale plus fluide et les détails supplémentaires. La structure est la même, mais la langue porte plus d'information par phrase et s'écoule plus naturellement.

This is a lively farmers' market on a bright, sunny weekend morning. In the foreground, several wooden stalls are lined up, piled high with fresh fruit and vegetables. A vendor in a green apron is weighing some tomatoes, while a customer is reaching into her bag for money. To the left, a young family is wandering between the stalls, carrying cloth shopping bags. Two small children are skipping ahead of their parents, each clutching a brightly coloured balloon — one red, one yellow. On the right side of the picture, a street musician is playing the guitar, and a small crowd has gathered around him to listen. In the background, you can see rows of colourful awnings and dozens of shoppers strolling in the sunshine. The whole scene feels warm, busy, and cheerful — a typical Saturday morning where the whole town has come out to enjoy the good weather.

Pourquoi c'est du CLB 9 : le vocabulaire est nettement plus riche — « piled high », « weighing », « clutching », « strolling », « awnings ». Les transitions spatiales sont plus fluides (« in the foreground », « to the left », « on the right side », « in the background ») et la réponse s'écoule comme une description liée plutôt que comme des faits séparés. Il y a plus de détails précis (le tablier vert, les sacs en tissu, les couleurs des ballons). La réponse suit toujours l'ordre clair de la vue d'ensemble vers l'arrière-plan, mais chaque élément est décrit avec précision et la clôture nomme l'ambiance de façon naturelle.

8Réponse modèle au CLB 11

Au CLB 11, la description devient vivante et précise, avec un débit naturel et un véritable sens de l'atmosphère. Le locuteur ne se contente pas de rapporter ce qui se trouve dans l'image — il recrée l'expérience d'être debout au marché. La maîtrise de la langue est sans effort.

This image captures a bustling farmers' market on a glorious, sun-drenched weekend morning. Dominating the foreground is a row of rustic wooden stalls, their tables overflowing with vibrant produce — crimson tomatoes, leafy greens, and baskets of glossy apples. A cheerful vendor in a green apron is carefully weighing a handful of tomatoes while a customer rummages through her purse for change. Just to the left, a young family meanders through the crowd, the parents chatting as their two children dart ahead, each gripping a balloon that bobs above the crowd — one a bright red, the other a sunny yellow. Over on the right, a street musician strums his guitar, and a handful of passers-by have paused to listen, tapping their feet. Further back, a sea of striped awnings stretches into the distance, with shoppers drifting lazily between them. The whole scene radiates warmth and easy contentment — the unmistakable buzz of a community savouring a perfect Saturday morning.

Pourquoi c'est du CLB 11 : la langue est vivante et précise sans jamais paraître forcée — « sun-drenched », « overflowing », « meanders », « darts », « a sea of striped awnings ». L'organisation spatiale est sans couture et tissée dans la description plutôt qu'énoncée mécaniquement. Il y a un détail riche et précis et un véritable sens de l'atmosphère dans la clôture (« the unmistakable buzz of a community savouring a perfect Saturday morning »). Le débit est naturel et assuré, le genre de maîtrise sans effort qui définit la bande supérieure.

9Erreurs courantes au Task 3

La plupart des points perdus au Task 3 proviennent d'une poignée d'erreurs prévisibles. Reconnaissez-les dès maintenant, et vous pourrez vous en débarrasser à l'entraînement avant le jour du test.

Employer le présent simple au lieu du présent continu. Dire « A woman buys vegetables » au lieu de « A woman is buying vegetables ». L'image montre une action en cours, donc la forme en -ing est le choix naturel et correct — et le temps erroné est l'un des signes les plus courants d'une réponse plus faible.
Sauter dans tous les sens sans aucun ordre. Décrire le musicien, puis un ballon, puis les légumes, puis revenir au musicien. Sans un parcours cohérent à travers l'image, votre auditeur ne peut pas suivre, et votre score de Coherence en pâtit.
Ne décrire qu'une seule partie et tomber à court de choses à dire. Passer la totalité des 60 secondes sur la figure centrale et n'atteindre jamais l'arrière-plan. Vous devez couvrir toute la scène, pas seulement le coin le plus facile.
Nommer des objets sans le moindre détail. « There is a man. There is a table. There is fruit. » Une simple liste n'est pas une description. Ajoutez de l'action et des adjectifs : « In front, a man is arranging bright red fruit on a wooden table. »
Oublier que c'est destiné à quelqu'un qui ne voit pas. Dire des choses vagues comme « over here » ou « that one » qui n'ont de sens que si l'auditeur peut voir l'écran. Ancrez tout en mots : « on the left », « in the foreground », « behind the stalls ».

10Comment s'entraîner au Task 3

Le Task 3 est l'une des parties les plus faciles à entraîner de tout le test, parce que vous pouvez vous y exercer avec n'importe quelle photo. Adoptez l'habitude ci-dessous et la structure devient automatique.

Étape 1 — Décrivez des photos au hasard chaque jour. Ouvrez n'importe quelle photo sur votre téléphone, dans un magazine ou sur un site de banque d'images, et décrivez-la à voix haute. La variété vous force à chercher un nouveau vocabulaire au lieu de réciter une description mémorisée.
Étape 2 — Chronométrez-vous toujours à 30 et 60 secondes. Accordez-vous exactement 30 secondes pour balayer et 60 pour parler. La vraie pression du test, c'est le chronomètre, alors entraînez-vous sous sa contrainte dès le premier jour.
Étape 3 — Forcez-vous à employer le présent continu. À chaque photo, narrez consciemment l'action avec « is/are + -ing ». La répétition rend le bon temps automatique pour que vous ne glissiez pas vers le présent simple sous la pression.
Étape 4 — Utilisez un ordre de balayage fixe. Entraînez le même parcours à chaque fois — vue d'ensemble, premier plan, de gauche à droite, arrière-plan, ambiance. Quand l'ordre est une habitude, vous libérez toute votre attention pour la langue.
Étape 5 — Enregistrez-vous et réécoutez. Réécoutez-vous et vérifiez trois choses : chaque temps était-il au présent continu, avez-vous couvert toute l'image, et avez-vous ancré chaque élément dans l'espace ? Notez une correction et appliquez-la la fois suivante.
Étape 6 — Constituez une banque de phrases spatiales. Tenez une liste évolutive de phrases de localisation et de description — « in the foreground », « piled high with », « a small crowd has gathered », « the scene feels lively ». Révisez-la jusqu'à ce que les phrases sortent sans réfléchir.

Les plus grands progrès viennent de l'enregistrement et de la réécoute. La plupart des apprenants trouvent que leur réponse était correcte et n'entendent jamais les glissements répétés vers le présent simple ni le coin de l'image qu'ils ont sauté. Deux minutes de réécoute honnête par jour valent plus qu'une heure de pratique silencieuse.

11Comment FlexiLingo vous aide à maîtriser le CELPIP Speaking

Décrire une scène avec aisance sous un chronomètre de 60 secondes demande une vraie pratique répétée avec retours — pas seulement de la lecture sur le sujet. FlexiLingo est conçu pour vous offrir exactement cela, sur du contenu canadien authentique et des consignes de style CELPIP.

Pratique de Speaking assistée par IA sur des consignes de style CELPIP

Entraînez-vous au Task 3 avec des consignes illustrées qui reflètent le vrai test, en enregistrant votre description dans les mêmes limites de 30 secondes de préparation et de 60 secondes de prise de parole, pour que le minutage devienne une seconde nature.

Retour instantané sur votre réponse

Obtenez un retour immédiat sur votre réponse — votre emploi des temps, votre langue spatiale, votre couverture de l'image, et les endroits où vous pourriez être plus clair — afin de savoir exactement quoi corriger avant votre prochaine tentative.

Réponses modèles par bande

Découvrez à quoi ressemblent réellement une réponse au CLB 7, au CLB 9 et au CLB 11 à la même consigne, pour entendre l'écart entre votre niveau et le suivant et recopier les gestes qui le comblent.

Vocabulaire en contexte

Enregistrez les phrases spatiales et les mots descriptifs que vous rencontrez — « in the foreground », « piled high with », « a lively atmosphere » — avec leur phrase d'exemple complète, pour apprendre comment chaque phrase est réellement utilisée.

Révision par répétition espacée

Le vocabulaire de description que vous enregistrez revient pour révision au moment optimal, afin que les phrases dont vous aurez besoin le jour du test soient ancrées bien avant de passer l'examen.

Questions fréquentes

Quel temps dois-je employer pour le Task 3 ?

Surtout le présent continu — « is/are + -ing ». Une image montre une action qui se déroule en ce moment même, donc l'anglais naturel est « A woman is buying vegetables », « Children are running », « A man is playing the guitar ». Vous emploierez aussi le présent simple pour les faits permanents (« The sky is blue », « There are several stalls ») et « there is / there are » pour introduire des choses. Mais l'action que vous décrivez doit être au présent continu — bien le maîtriser est l'un des signes les plus clairs d'une bonne réponse.

Que faire si je ne connais pas le mot pour quelque chose sur l'image ?

Ne vous figez pas et ne restez pas silencieux — décrivez-le à la place. Si vous ne connaissez pas « awning », dites « a colourful cover over the stall ». Si vous ne connaissez pas « vendor », dites « the person who is selling the fruit ». La paraphrase est une compétence que les examinateurs valorisent réellement, car elle montre que vous savez continuer à communiquer sous la pression. Ne gaspillez jamais vos 60 secondes à chercher le mot parfait quand une simple description fait passer le sens.

Jusqu'à quel point dois-je être détaillé en 60 secondes ?

Assez détaillé pour couvrir toute l'image, mais pas au point de rester coincé sur une seule partie. Une bonne règle : un ou deux éléments précis par élément — ce qu'il fait, plus une couleur, une taille ou une position — puis on passe au suivant. Visez à mentionner la vue d'ensemble, le premier plan, deux ou trois sujets principaux, l'arrière-plan et l'ambiance globale. Si vous décrivez un coin en grande profondeur sans jamais atteindre le reste, vous avez laissé la scène à moitié invisible pour votre auditeur.

Le Task 3 est-il lié au Task 4 ?

Oui — et c'est important. Dans le test CELPIP Speaking, le Task 4 (Making Predictions) vous montre généralement la même scène que le Task 3 et vous demande ce qui va se passer ensuite. Ainsi, au Task 3, vous décrivez ce qui se passe maintenant (présent continu), et au Task 4, vous prédisez ce qui est sur le point de se produire (formes du futur comme « is going to » et « will »). Les étudier ensemble est efficace : vous décrivez l'image, puis vous prédisez immédiatement son moment suivant.

Comment atteindre le CLB 9 au Task 3 ?

Dépassez la description correcte de base pour aller vers une langue plus riche et un débit plus fluide. Trois changements vous font passer du CLB 7 au CLB 9 : ajoutez des adjectifs plus forts et plus précis (pas « a man with fruit » mais « a vendor arranging bright red apples ») ; employez un éventail plus large de verbes spatiaux et d'action (weighing, reaching, strolling, gathering) ; et reliez vos phrases en une description fluide plutôt qu'en faits séparés. Couvrez toute l'image dans un ordre clair, nommez l'ambiance à la fin, et gardez votre présent continu exact d'un bout à l'autre.

10 juillet 2026
FL
Équipe FlexiLingo
Nous aidons les candidats à se préparer au CELPIP, à l'IELTS et au TOEFL grâce à des guides pratiques et prêts pour l'examen — et grâce à une vraie pratique sur du contenu canadien authentique.

Entraînez-vous au CELPIP Speaking Task 3 avec un retour instantané

Utilisez FlexiLingo pour décrire de vraies consignes illustrées sous le chronomètre de 30 secondes de préparation et de 60 secondes de prise de parole, obtenez un retour instantané, et comparez votre réponse à des réponses modèles par bande.