Analyse actuelle · Harness Engineering
Meta Muse Sentinel : un agent IA peut-il en superviser un autre ?
Meta Muse place un second agent, Sentinel, entre l’assistant et les services externes. Muse propose ; Sentinel autorise, bloque ou interroge l’utilisateur. Ce schéma de Harness Engineering est important, mais une IA jugeant une autre ne suffit pas : politique déterministe, moindre privilège, journaux protégés et exécution fail-closed doivent rester hors des deux modèles.

Evidence classification: CONFIRMÉ : lancement le 8 septembre 2026 et architecture décrite par Meta. RAPPORTÉ : Reuters a décrit des défaillances de tests internes. NON PROUVÉ : élimination de toute injection ou action non autorisée. ANALYSE : supervision réelle entre agents.
Ce que Meta a lancé
Muse s’exécute dans une Secure VM et peut utiliser e-mail, agenda, achats et paiements. Chaque connecteur transforme une décision en effet réel.
La frontière de confiance
Meta présente Sentinel comme un agent séparé et l’unique autorité des connecteurs et sorties réseau. Les approbations sensibles ne transitent pas par Muse.
Ce que prouvent les éléments
Reuters a rapporté exposition de données, mauvais routage des garde-fous et pannes de fiabilité pendant les tests. Meta n’a pas commenté ces incidents précis.
Conséquences pour le Harness Engineering
Le harness détermine ce que l’agent peut observer, mémoriser, appeler, exécuter, conserver, récupérer et escalader. La politique déterministe doit garder le dernier mot.
- Capacités étroites et révocables.
- Approbation liée à l’action exacte.
- Sentinel hors du contrôle de Muse.
- Journal de la proposition au résultat.
- Blocage sûr en cas de doute.
- Tests d’injection et de reprise.
À surveiller
Il faut tester les contenus hostiles, les changements de politique et l’écart entre action approuvée et exécutée. Il ne s’agit pas d’un crime documenté.
Sources
FAQ
Qu’est-ce que Meta Muse Sentinel ?
Un agent séparé contrôlant les connecteurs et la sortie réseau selon Meta.
Une IA peut-elle en superviser une autre ?
Oui comme couche contextuelle, mais le code déterministe doit imposer les limites.
Un crime a-t-il eu lieu ?
Non. Cette analyse ne présente pas le lancement comme un crime.