
Avec l’Apple Watch Series 12 et l’Apple Watch Ultra 4, Apple inaugure Audio Intelligence, un ensemble de fonctions s’appuyant sur les microphones de la montre, Apple silicon et des modèles d’IA exécutés sur l’appareil comme dans le cloud. Dans son document Audio Intelligence Privacy Overview, Apple présente cette approche comme un moyen de détecter des sons, identifier de la musique et rester attentif à son environnement tout en protégeant les données audio.
La première version regroupe quatre fonctions : Sound Recognition, la reconnaissance automatique de musique avec Shazam, Live Rewind et Siri Recap. Apple indique que chacune nécessite une activation volontaire. Live Rewind et Siri Recap arriveront plus tard dans l’année en bêta, initialement avec la prise en charge de l’anglais.
Live Rewind, une écoute déclenchée à la demande
Live Rewind ne se lance qu’après un double-appui délibéré sur la Digital Crown. La fonction affiche alors sur l’écran un extrait textuel des quinze dernières secondes de parole. Apple précise que la montre ne poursuit pas la transcription en arrière-plan et que le texte n’est pas conservé, sauf si l’utilisateur demande à Siri d’exploiter le contenu ou de l’enregistrer dans l’app Siri.
La fonction se règle dans l’app Watch sur iPhone, via le menu Siri puis l’option « Double Click Digital Crown ». Apple ajoute que Live Rewind avertit les personnes proches au moyen d’un signal sonore et d’indicateurs visuels. Côté matériel, l’audio du microphone est placé dans un tampon protégé sur la puce S11 : les données les plus anciennes sont continuellement remplacées, sans accumulation de son, et l’audio brut reste isolé de l’extérieur de ce tampon.

Siri Recap s’adapte à un horaire ou à un lieu
Siri Recap se configure également depuis l’app Watch. L’utilisateur peut définir un planning selon l’heure et/ou un lieu — par exemple au travail ou jamais la nuit — ou l’activer manuellement. Un contrôle reste aussi accessible à tout moment depuis le Centre de contrôle.
Selon Apple, un modèle d’IA léger de la puce S11 détecte d’abord la présence de parole à proximité, sans transcrire ni enregistrer à ce stade. Lorsqu’une conversation est détectée, l’audio est envoyé vers un tampon protégé matériellement, inaccessible à l’utilisateur, au système d’exploitation, aux apps et à Apple. Audio Intelligence n’attribue par ailleurs pas les propos à des interlocuteurs précis ; Siri Recap est conçu pour écarter les contenus potentiellement nuisibles et les informations sensibles.
Ce que ça change
Cette conception cherche à limiter l’écoute continue aux seuls scénarios choisis par l’utilisateur, en distinguant détection de parole, mise en tampon et transcription ponctuelle. Les réglages par horaire, lieu et accès direct depuis le Centre de contrôle donnent aussi à l’utilisateur des leviers concrets pour adapter Siri Recap à son quotidien.
La promesse repose toutefois sur une interaction explicite pour Live Rewind et sur des barrières matérielles autour de l’audio pour Siri Recap. Les versions bêta attendues plus tard dans l’année permettront de juger l’intégration de ces commandes dans l’usage réel de l’Apple Watch.
À lire aussi
Source : Apple — Audio Intelligence Privacy Overview (document de confidentialité)
Rédigé avec l'assistance d'outils d'IA, vérifié et validé par la rédaction.