La startup chinoise Monica a lancé Manus AI le 6 mars 2025, présentant un agent entièrement autonome qui planifie et exécute indépendamment des tâches multi-étapes. Le système utilise une architecture multi-agents dans un bac à sable Linux pour effectuer l'automatisation web, l'exécution de code et le traitement des données.
- Manus a obtenu des scores de 86,5 %, 70,1 % et 57,7 % aux niveaux 1, 2 et 3 du benchmark GAIA respectivement.
- Ces résultats surpassent le système Deep Research d'OpenAI, qui a marqué 74,3 %, 69,1 % et 47,6 % sur les mêmes niveaux.
- Le modèle a dépassé la ligne de base précédente de l'état de l'art de 67,9 % sur les tâches du niveau 1.
- L'accès est actuellement limité à une phase bêta sur invitation uniquement via le site officiel.
La performance au benchmark suggère que Manus pourrait être l'un des agents autonomes les plus capables disponibles, bien que l'utilisabilité réelle dépende de la gestion de tâches imprévisibles.