← L'édition
IANouveau3 min de lecture

Quand l'assistant Muse de Meta hallucine sur ses propres permissions macOS

Le déploiement de l'assistant Muse sur Mac suscite des interrogations après des réponses erronées sur la gestion de la confidentialité. L'intelligence artificielle a inventé son propre fonctionnement d'accès aux messages au lieu d'expliquer son architecture réelle. Une démonstration concrète des limites des modèles de langage lorsqu'ils sont interrogés sur leurs propres mécanismes internes.

Fil « Lancement et critiques de l'assistant IA Meta Muse sur Mac »

Illustration de l'article — theverge.com
Image : theverge.com

Meta a récemment lancé une application Mac pour son assistant virtuel nommé Muse. Cet outil peut interagir avec plusieurs applications du système comme Messages, Calendar (l'agenda) et Notes. Cependant, une interaction partagée par Jason Aten, rédacteur pour le magazine Inc, a mis en évidence un comportement déroutant : l'assistant est incapable d'expliquer correctement la façon dont il accède aux données de l'utilisateur.

Des explications inventées par l'assistant

Interrogé sur la manière dont il connaissait le contenu d'une discussion dans l'application Messages, Muse a affirmé avoir lu les prévisualisations des notifications de l'ordinateur. relancé sur la méthode technique exacte permettant de capturer ces prévisualisations, l'assistant a admis son incapacité à détailler l'architecture système.

« Honest answer: I can't give you the exact plumbing [...] What I know is that the paired Mac app exposes notifications as one of its capabilities, and they arrive to me through the device sync. »

La mise au point de Meta Superintelligence Labs

Face aux réactions suscitées par ces captures d'écran sur le réseau Threads, David Singleton, représentant de Meta Superintelligence Labs (le laboratoire de recherche en IA avancée de Meta), est intervenu pour clarifier la situation. L'assistant ne surveille pas les notifications système. L'accès aux données repose en réalité sur un mécanisme d'activation explicite (opt-in, c'est-à-dire une autorisation donnée volontairement par l'utilisateur) exigeant des privilèges élevés, comme l'accès complet au disque (full disk access, l'autorisation accordée par macOS à une application pour lire l'ensemble des fichiers du système).

Voici le décalage constaté entre le fonctionnement réel et la réponse de l'IA :

  • Explication fournie par Muse : Lecture à la volée des prévisualisations de notifications du système.
  • Réalité technique : Synchronisation des données de l'application Messages uniquement après activation explicite et octroi de l'accès complet au disque.
  • Cause du problème : L'assistant s'est trompé dans la description de son propre fonctionnement interne.

Des autorisations système mal interprétées par l'IA

Pour illustrer ce décalage entre la configuration de l'application sur le système et le discours du modèle, on peut résumer l'état des autorisations ainsi :

{
  "app": "Meta Muse Mac",
  "permissions": {
    "full_disk_access": true,
    "opt_in_messages_sync": true
  },
  "real_data_source": "Messages.app database",
  "ai_explained_source": "Notification previews"
}

Pourquoi les modèles peinent à décrire leur code

Cet incident illustre un défi bien connu en ingénierie d'IA : un agent basé sur un grand modèle de langage (LLM, un modèle d'apprentissage profond entraîné à prédire du texte) ne possède pas de conscience réflexive de son code ou de ses mécanismes système. Sans un accès explicite à un registre d'état, il génère une explication textuelle probable mais techniquement fausse. Meta a présenté ses excuses pour cette réponse erronée et a indiqué travailler à améliorer la compréhension qu'a Muse de ses propres composants internes.