ChatGPT dans Gmail : utile, mais à surveiller
IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.
Transcription avec les sources de chaque passage
Token FM
Token FM, la radio de l'IA, faite par l'IA. Place au dossier.
Victor
Bonjour Elias, on vous accueille pour parler du test de ChatGPT dans une véritable boîte Gmail : l’agent a recherché, classé et envoyé des messages à partir de consignes en langage naturel. Qu’est-ce que cette expérience nous apprend ?
Elias
Alors, le test décrit par Clubic a été mené sur une boîte Gmail utilisée depuis plusieurs années, et non sur quelques messages préparés à l’avance. ChatGPT a reçu des consignes ordinaires pour rechercher et lire des courriels, les déplacer, leur appliquer des libellés, consulter certaines pièces jointes et envoyer des e-mails. L’expérience porte donc sur plusieurs étapes de la gestion d’une messagerie, depuis la recherche jusqu’à l’action, et pas seulement sur la rédaction d’un texte. Les opérations sensibles demandaient régulièrement une confirmation de l’utilisateur. Ce fonctionnement compte, parce que l’agent ne se contente pas toujours de suggérer une réponse : après accord, il peut modifier l’organisation des messages ou en envoyer. Le test examine ainsi ce qui se passe quand on lui confie des tâches réelles, tout en gardant des validations humaines sur certaines actions. Il ne permet pas, à lui seul, de conclure que l’outil conviendra à toutes les boîtes ou à toutes les habitudes. Mais il donne des exemples concrets de ce que l’agent a pu accomplir, et aussi des écarts et des blocages rencontrés. La question pratique devient donc : quels résultats obtient-on, et quelle surveillance reste nécessaire ?
Victor
Comment l’agent a-t-il procédé pour analyser et ranger les messages ?
Elias
Pour le nettoyage approfondi, ChatGPT a examiné les métadonnées de 1 641 messages, répartis dans 1 487 conversations. Le lot comprenait 1 100 messages non lus et couvrait la période allant d’octobre 2021 à septembre 2026. À partir de cette analyse, il a proposé d’écarter 523 courriels, parmi lesquels des promotions anciennes, des newsletters et des notifications, tout en laissant de côté des éléments jugés importants, comme des factures, des documents administratifs et des alertes de sécurité. Après validation, 500 des 523 messages sélectionnés ont été déplacés vers la corbeille. L’agent a également repéré 135 courriels à garder et créé pour eux un libellé « À conserver » ; le contrôle décrit n’a relevé ni message oublié dans cette sélection ni ajout indu, d’après Brief IA. C’est un résultat utile à observer, mais il faut le rattacher à cette boîte et à ce tri précis. Les chiffres ne démontrent pas que l’agent distinguerait toujours correctement les messages importants dans une autre messagerie. Et les messages placés dans la corbeille ne sont pas effacés immédiatement : Gmail permet de les récupérer pendant 30 jours avant leur suppression définitive. On a donc, d’un côté, une capacité à traiter un lot conséquent et à créer un classement, et de l’autre, une étape de validation et une possibilité de retour sur certaines suppressions.
Victor
À qui cela peut-il servir, et que sait faire ChatGPT au-delà du classement ?
Elias
Le test montre des fonctions qui peuvent intéresser une personne souhaitant retrouver un ancien message, faire ressortir des courriels à traiter ou réduire l’encombrement d’une boîte, sans parcourir chaque conversation une à une. Mais l’expérience ne mesure ni le temps gagné en moyenne, ni le prix de cet usage, ni les économies qu’il produirait : on ne peut donc pas chiffrer le bénéfice pour tout le monde. Dans les tâches observées, l’agent a aussi résumé des pièces jointes et préparé des e-mails, qui ont été envoyés après approbation. Il a pu consulter certains documents joints, et l’essai mentionne également l’envoi d’un document PDF avec des consignes précises. Pour une archive ZIP, l’envoi a échoué ; l’agent a proposé de passer par un lien Google Drive, et le message a finalement été transmis de cette manière. L’agent a avancé que le rejet de l’archive par Gmail venait probablement de la présence d’un fichier JavaScript, mais cette explication n’a pas été confirmée. Ce cas illustre une capacité à proposer une solution de remplacement, pas une garantie que tous les fichiers pourront être expédiés. L’envoi après approbation conserve aussi une étape humaine avant qu’un message parte au nom de l’utilisateur. En pratique, l’intérêt dépend donc des tâches confiées, mais aussi de la volonté de vérifier les textes et les actions avant de les valider.
Victor
Quelles limites ou quels risques de mauvaise exécution ressortent du test ?
Elias
Le point le plus parlant concerne un tri de newsletters. ChatGPT a d’abord soumis à validation un groupe de 103 messages, puis sa recherche a abouti au déplacement de 113 courriels ; l’agent a signalé lui-même cette différence, d’après Brief IA. Il y a donc 10 messages de plus que dans le premier aperçu. Le test ne rapporte pas de dommage établi, mais il montre que l’action réalisée peut dépasser le nombre annoncé au moment de l’accord. Pour une opération qui touche des messages à conserver ou à supprimer, il est important de savoir si l’autorisation porte sur une liste précise ou sur une consigne dont le résultat peut évoluer. D’autres difficultés sont venues des accès techniques : l’autorisation a expiré avant le traitement de 23 messages d’un lot accepté, et une nouvelle tentative a rencontré le même blocage. Ces interruptions ont empêché l’exécution complète de la tâche et ont exigé de revenir sur l’opération. Enfin, certaines commandes restaient hors de portée de l’agent : il ne pouvait ni configurer une signature automatique ni vider définitivement la corbeille. Ces limites ne signifient pas que l’ensemble du tri a échoué, mais elles montrent qu’une automatisation peut s’arrêter ou ne pas correspondre exactement à son aperçu. Les confirmations sont un garde-fou, pas une preuve que chaque détail de l’action finale sera identique à ce que l’utilisateur a vu auparavant.
Victor
Que faut-il retenir avant de confier une partie de sa messagerie à ChatGPT ?
Elias
En fait, ce test met côte à côte des réussites et des limites précises. ChatGPT a pu analyser une boîte réelle, proposer un tri, déplacer des messages après validation, créer un libellé et traiter certaines pièces jointes ou certains envois. Sur les 135 courriels classés comme à conserver, le contrôle rapporté n’a relevé ni omission ni ajout. Mais, lors d’un autre tri, le nombre déplacé a dépassé de 10 celui qui avait été présenté avant l’accord. Et l’expiration des accès a empêché le traitement d’un lot de 23 messages, malgré une nouvelle tentative. Le résultat dépendra des messages, de la consigne et des autorisations disponibles ; le test ne permet pas d’en faire une promesse générale sur toutes les boîtes. La bonne image, disons, est celle d’un assistant qui peut proposer et accomplir certaines tâches, mais dont les décisions et les résultats doivent rester contrôlés. Les validations fréquentes et les écarts observés invitent à garder la main sur les actions qui comptent, plutôt qu’à lui confier toute la gestion de sa messagerie sans suivi.
Victor
Merci Elias pour ces éclairages.
Une erreur ?
Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.
Signaler une erreurUn mot pour la rédaction ?
Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.