De la réponse orale à l’action outillée
Jusqu’ici, beaucoup d’utilisateurs abordaient la voix comme une façon de poser une question et d’entendre une réponse. La note de version officielle du 23 septembre annonce un pas supplémentaire : pendant une conversation Live, ChatGPT peut employer les plugins et applications connectées déjà disponibles pour le compte. L’utilisateur peut donc demander une information ou une opération liée à un service connecté sans quitter la conversation vocale pour tout reformuler au clavier.
L’expression « déjà disponibles » est déterminante. La mise à jour ne donne pas accès par défaut à tous les services du catalogue, ni à toutes leurs actions. Le plugin doit être proposé pour le compte, éventuellement connecté, et ses permissions habituelles restent applicables. La documentation Voice d’OpenAI précise aussi que les restrictions propres à un espace de travail continuent de s’appliquer.
Dans un usage simple, on peut imaginer demander oralement un résumé d’informations présentes dans une application déjà autorisée, puis suivre la réponse écrite à l’écran pendant qu’elle est prononcée. Si la demande nécessite une action qui requiert l’accord de l’utilisateur, celui-ci doit pouvoir l’examiner à l’écran : selon la documentation d’OpenAI, l’approbation simplement prononcée n’est pas prise en charge pour ces actions sur le Web et mobile. L’assistant vocal n’est donc pas un moyen de contourner la confirmation d’une opération sensible. Source : aide officielle Voice.
Voice arrive aussi dans Work
OpenAI indique que Voice est désormais disponible dans Work sur le Web et sur mobile pour les utilisateurs ayant accès aux deux expériences. Dans Work, une consigne orale peut lancer la création d’un document, d’une présentation ou d’une feuille de calcul, utiliser des applications connectées, ou effectuer une recherche dans le navigateur selon les capacités du compte. Si l’appel se termine avant la fin de la tâche, le travail peut continuer en mode texte. Source : notes de version.
La différence avec une simple dictée mérite d’être soulignée. Une dictée transforme la parole en texte que l’on peut corriger avant l’envoi. Ici, Voice est une conversation en temps réel dans laquelle l’assistant peut travailler pendant que l’utilisateur parle, demande une précision ou change d’avis. La fiche d’aide d’OpenAI distingue explicitement Voice de la fonction de transcription ponctuelle. Pour des tâches longues, la possibilité de passer de l’oral à l’écrit évite de perdre le fil lorsque la conversation prend fin.
Cette capacité ne signifie pas que tout résultat sera instantané ni que toutes les demandes seront autorisées. Les connexions disponibles, les limites de l’abonnement, les règles de l’espace de travail et les confirmations peuvent ralentir ou empêcher une action. Le bénéfice principal est une interface supplémentaire pour piloter des outils déjà accessibles, particulièrement utile quand les mains sont occupées ou pour clarifier une tâche à voix haute.
Qui peut en profiter ?
La note de version mentionne les utilisateurs Free et Go pour Voice dans Chat, dans les limites des plugins pris en charge par leur formule. L’accès à Voice dans Work exige, lui, l’accès à Voice et à Work. Sur les autres formules, les fonctions disponibles peuvent varier selon le plan, les paramètres du compte, l’organisation et la région. La documentation détaillée précise que Live fonctionne sur Web, iOS et Android et décrit séparément l’expérience vocale de l’application de bureau.
Il faut aussi distinguer les modes vocaux. OpenAI décrit Live comme l’expérience qui permet l’emploi des plugins et des applications connectées. D’autres options vocales peuvent être affichées dans les réglages selon le compte ; elles ne doivent pas être supposées équivalentes. Les utilisateurs devront vérifier le mode choisi et la disponibilité du plugin concerné avant de construire un processus de travail autour de la nouvelle fonction. Source : guide Voice.
Permissions, confidentialité et contrôle humain
L’arrivée des plugins dans la voix pose une question pratique : que transmet-on à une application externe lorsqu’on formule une demande à l’oral ? OpenAI précise que les autorisations des applications connectées ne changent pas avec cette mise à jour. Cela donne un repère : une conversation vocale ne doit pas étendre, par elle-même, les droits d’un service connecté. Les utilisateurs gagnent toutefois à vérifier quelles applications sont reliées au compte et à écouter ou relire la demande avant d’autoriser une action. Source : notes de version et aide Voice.
La parole a ses propres limites. Une phrase peut être mal entendue dans le bruit, une date peut être interprétée dans le mauvais fuseau horaire et une réponse peut contenir une erreur. La documentation recommande de vérifier les informations importantes, particulièrement lorsqu’elles dépendent d’une date, d’une heure ou d’un lieu. Elle indique aussi que la transcription conservée après une conversation Live n’est pas nécessairement un verbatim exact. Pour un rendez-vous, une dépense ou un document destiné à être partagé, le contrôle de la version écrite reste donc indispensable. Source : aide officielle.
La même documentation expose les règles de conservation des clips audio et les commandes de partage de données. Ces paramètres dépendent du type de compte et des choix de l’utilisateur ; il serait trompeur d’affirmer que toutes les conversations sont conservées ou utilisées de la même façon. Avant d’employer Voice avec des contenus professionnels ou personnels, la bonne démarche consiste à consulter les contrôles de données du compte et les règles de l’organisation. Source : section « Data controls ».
Ce que cette nouveauté change réellement
La mise à jour rapproche trois interfaces auparavant plus séparées : la parole, les services connectés et les tâches longues. Un utilisateur peut commencer par expliquer à voix haute ce qu’il veut, corriger le cap pendant l’échange puis reprendre le résultat sous forme écrite. Pour une entreprise, cela peut rendre certains processus plus accessibles ; pour un particulier, réduire le nombre d’étapes nécessaires à une recherche ou à une création de contenu.
Le critère décisif ne sera pourtant pas la fluidité de la démonstration. Il sera de savoir si Voice choisit le bon outil, comprend correctement la demande, signale ses incertitudes et laisse à l’utilisateur un contrôle clair sur les actions. OpenAI annonce une extension de l’interface, pas une garantie de réussite sur toutes les tâches. Le meilleur usage reste celui où l’on peut vérifier ce qui a été compris et exécuté.
Sources principales : notes de version ChatGPT du 23 septembre 2026 ; guide officiel ChatGPT Voice. Les exemples d’usage sont illustratifs et ne constituent pas une liste de plugins garantis pour chaque compte.

