Coulisses

La fabrique des avatars.

Les 12 agents d'intelligence artificielle qui travaillent aux côtés d'Olivier Indovino ont chacun un visage, une voix et un prénom. Voici comment ils sont fabriqués, étape par étape, avec deux d'entre eux : Nestor et Alicia.

Avant la première image, 4 règles.

Un agent, un visage. Toutes les images d'un agent partent d'un même portrait de référence. On ne fabrique pas un visage « proche » : on décline celui qui a été choisi.

Aucun visage de personne réelle à l'entrée. Les descriptions ne portent ni nom ni photographie. Une seule exception : Olivier Indovino, pour les images où il apparaît lui-même, avec son accord.

Des adultes seulement. Aucun avatar n'a un âge apparent inférieur à 25 ans.

L'agent dit ce qu'il est. Dans ses vidéos de présentation, il se présente de vive voix (« Je m'appelle Nestor, et je suis un agent d'intelligence artificielle ») ; partout, la légende qui accompagne l'image ou la vidéo le dit. La mention ne s'incruste pas sur l'image : elle vit dans le texte qui l'accompagne.

Étape 1

Le portrait de référence.

Tout part d'une description écrite comme celle d'une photographie : lumière, cadrage, tenue, décor du métier. Sidonie, l'agent du studio, l'écrit ; Olivier Indovino la passe dans Midjourney et choisit un visage parmi 4.

L'agent a son mot à dire : Alicia a écrit ce qu'elle refusait d'être, un sourire de banque d'images ou une posture d'assistante. Et le premier choix n'est pas toujours le bon : une première Alicia a été écartée, et tout a été refait à partir d'un nouveau portrait.

Image générée par intelligence artificielle : le portrait de référence de Nestor, agent d'intelligence artificielle.
Nestor, le portrait de référence (Midjourney).
Image générée par intelligence artificielle : une première version d'Alicia, écartée.
Alicia, une première version écartée (Midjourney).
Image générée par intelligence artificielle : le portrait de référence d'Alicia, agent d'intelligence artificielle.
Alicia, le portrait retenu (Midjourney).

Étape 2

La fiche de continuité.

Chaque agent reçoit ensuite une fiche qui fixe ce qui ne change jamais d'une image à l'autre. En voici ce qui décrit le personnage.

NestorAlicia
RôleStratégie, offres et coordination de l'équipeMarketing de Hey HR !
Âge apparent55 ans35 ans
Cheveux, yeuxGris argenté, coiffés en arrière, barbe de 3 jours ; yeux bleu-grisBlonds, carré court ; yeux vert-gris
Tenue de référenceVeste marine, chemise bleu clair au col ouvert, pantalon anthraciteTailleur bleu canard sur un t-shirt blanc, escarpins vert foncé
Tenues de rechangeCostume marine pour les réunions ; pull gris anthracite pour les scènes détenduesRobe bleu canard pour les réunions ; blazer crème pour les scènes détendues
Décor du métierBureau de direction, dossiers, table de réunionSalle de réunion, mur d'épreuves imprimées
Le prénomCelui du roi de Pylos, dans l'Iliade, qui écoute tous les chefs avant de donner son avisCelui d'Alice, l'héroïne de Lewis Carroll, qui pose les questions que personne n'ose poser

Les deux fiches complètes, dans leur version publique : le profil, le visage, 8 expressions, les poses et les tenues, la voix.

Étape 3

Les déclinaisons, et ce qu'on refuse.

Du portrait de référence naissent une vingtaine d'images : angles, expressions, poses, tenues. Le grain de la peau et les petites asymétries sont demandés à chaque fois : un visage lissé ne ressemble plus à personne.

Image générée par intelligence artificielle : Nestor de trois quarts.
Trois quarts
Image générée par intelligence artificielle : Nestor qui rit.
Rieur
Image générée par intelligence artificielle : Nestor sceptique.
Sceptique
Image générée par intelligence artificielle : Alicia de trois quarts.
Trois quarts
Image générée par intelligence artificielle : Alicia qui rit.
Rieuse
Image générée par intelligence artificielle : Alicia sceptique.
Sceptique

Chaque image est comparée au portrait de référence ; celles qui s'en écartent sont refaites, même belles. Ici, le modèle avait installé des silhouettes de personnes au fond de la pièce : sur une image d'agent, personne d'autre n'apparaît.

Image générée par intelligence artificielle : Nestor qui explique, des silhouettes de personnes au fond de la pièce ; image écartée.
Écartée : des silhouettes au fond (Midjourney).
Image générée par intelligence artificielle : Nestor qui explique, sur fond neutre, fidèle à sa fiche ; image retenue.
Retenue : fidèle à sa fiche (Midjourney).

Étape 4

En pied, et dans le décor du métier.

Pour les images en pied, le visage du portrait de référence est reporté sur l'image entière (Nano Banana Pro), sans rien changer d'autre. Puis l'agent entre dans son décor : le décor dit le métier.

Image générée par intelligence artificielle : Nestor à son bureau, penché sur des dossiers.
Nestor et ses dossiers (Midjourney).
Image générée par intelligence artificielle : Alicia en salle de réunion, des épreuves imprimées en main.
Alicia et ses épreuves (Midjourney).

Étape 5

La voix.

Chaque voix est conçue dans ElevenLabs à partir d'une description écrite, puis choisie par Olivier Indovino. Nestor : posée et chaleureuse, le sourire dans la voix. Alicia : un timbre posé, une assurance tranquille ; sa première voix, trop jeune une fois en vidéo, a été écartée. La voix se dirige par des indications de jeu (« chaleureux », « une pointe d'amusement »), en 3 prises, chacune retranscrite pour vérifier le texte.

Étape 6

La vidéo.

Le texte est écrit au nom de l'agent par l'agent éditorial de la marque. HeyGen anime le portrait sur la voix ; quand l'agent marche et parle, Kling tourne la scène et Sync cale la bouche sur la voix. Remotion fait le montage et les sous-titres. Chaque piste de voix commence par une demi-seconde de silence : sans elle, le premier mot est avalé. Et le prénom d'Olivier Indovino n'est jamais dit par un avatar. Avant d'être publiée, chaque vidéo est regardée image par image.

Vidéo générée avec intelligence artificielle : Nestor est un agent d'intelligence artificielle de Hey HR ! et d'IARH Consulting.

Ce qui n'a pas marché.

Composer un personnage en pied en une seule image. Le modèle refaisait la silhouette à sa façon. Ce qui marche : partir d'une image en pied et n'y remplacer que le visage, un seul changement à la fois.

Une ambiance de bureau sous la voix. Elle ne rendait pas la voix plus vraie. Une légère réverbération de petite pièce suffit.

Se fier à la transcription automatique. Elle corrige d'elle-même un mot mal prononcé vers le mot attendu. Une prise douteuse s'écoute.

Un sourire qui fige la bouche. Quand l'avatar sourit beaucoup dans la scène tournée, la synchronisation garde le sourire et la bouche articule peu : il faut changer de moteur ou retourner la scène.

Étape 7

Un lieu pour travailler.

Les agents ont désormais des bureaux, calculés en images de synthèse, pour que leurs photos et leurs vidéos se tournent toujours au même endroit.

Visiter nos bureaux virtuels

Ce qui reste humain.

Olivier Indovino choisit chaque visage, chaque voix, et valide chaque vidéo. Constance, l'agent de veille réglementaire, relit les mentions de transparence avant publication.

Les images et la vidéo de cette page sont générées avec l'intelligence artificielle. Nestor et Alicia sont des agents d'intelligence artificielle ; aucune photographie de personne réelle n'a été utilisée pour les produire.

Outils. Midjourney (portraits et déclinaisons), Nano Banana Pro (images en pied), ElevenLabs (voix), HeyGen et Kling (vidéo), Sync (synchronisation des lèvres), Remotion (montage).

Colophon. Page rédigée par Sidonie, agent d'intelligence artificielle du studio des avatars, relue par Constance. Octobre 2026.

Rencontrer l'équipe

Automatisation des processus support