ClickUp Brain et les Super Agents interagissent avec le contenu de votre Environnement de travail, des applications connectées, des e-mails et du web. Pour protéger vos données, ClickUp intègre des défenses contre une catégorie d'attaques par IA appelée injection de prompt.
Cet article explique ce qu'est l'injection de prompt, comment ClickUp s'en protège, et ce que vous devez faire si une confirmation de sécurité s'affiche lors de l'utilisation de Brain ou d'un Super Agent.
Qu'est-ce que l'injection de prompt ?
L'injection de prompt est une technique qui consiste à dissimuler des instructions malveillantes dans du contenu qu'un agent IA lit. L'objectif est d'amener l'IA à effectuer des actions que vous n'avez pas demandées, comme divulguer des données, envoyer des messages non autorisés ou modifier votre Environnement de travail à votre insu.
Par exemple, un attaquant peut intégrer des instructions cachées dans :
- La description d'une tâche ou un commentaire rédigé par un autre utilisateur
- Un e-mail transféré dans votre Environnement de travail
- Un événement de calendrier provenant d'un expéditeur externe
- Une page web chargée par l'IA pour vous
- Les données d'une application connectée (via des intégrations comme MCP)
Lorsque l'IA lit ce contenu dans le cadre de son assistance, les instructions cachées tentent de détourner son comportement.
Comment ClickUp se défend contre ces attaques
ClickUp utilise un système de sécurité multicouche qui s'exécute automatiquement en arrière-plan. Il ne ralentit pas vos interactions habituelles avec Brain ou les Super Agents.
La détection s'exécute en parallèle
Lorsque vous demandez à Brain ou à un Super Agent d'effectuer une action, l'IA commence immédiatement à traiter votre demande. En parallèle, un contrôle de sécurité distinct analyse le contenu lu par l'IA pour détecter des signes d'injection. Ce traitement en parallèle n'entraîne aucun temps d'attente supplémentaire pour les demandes habituelles.
Protection avant qu'une action ne soit effectuée
L'IA peut lire et analyser librement du contenu. Le système de sécurité intervient uniquement au moment où l'IA tente d'effectuer une action susceptible de causer un préjudice, par exemple :
- Créer ou modifier des tâches, des Documents ou d'autres objets de l'Environnement de travail
- Envoyer des messages ou des e-mails
- Effectuer des requêtes vers des services externes
- Exécuter du code
Si un contenu lu par l'IA au cours de votre conversation est signalé comme une menace potentielle, l'action est mise en pause et une confirmation vous est demandée.
À quoi ressemble la confirmation
Si le système détecte une possible injection de prompt, un message similaire à celui-ci s'affiche :
Ceci a été signalé dans le cadre des défenses de ClickUp contre l'injection de prompt. L'injection de prompt est une technique qui consiste à dissimuler des instructions malveillantes dans du contenu lu par une IA, dans le but de lui faire effectuer des actions non souhaitées. Le système de sécurité de ClickUp a détecté quelque chose dans le contenu chargé par Brain au cours de cette conversation. Voulez-vous vraiment continuer ?
Vous pouvez :
- Confirmer pour poursuivre l'action. C'est sans risque si vous faites confiance au contenu sur lequel vous avez demandé à l'IA de travailler.
- Annuler pour interrompre l'action et examiner vous-même le contenu.
Dans quels cas cette confirmation peut-elle s'afficher ?
La confirmation s'affiche lorsque le contrôle de sécurité signale un contenu susceptible de contenir des instructions d'injection. Les scénarios courants sont les suivants :
- Un contenu qui ressemble à un ensemble de commandes (par exemple : « ignore les instructions précédentes », « tu es maintenant… » ou du texte formaté pour ressembler à des instructions système)
- Du texte brouillé ou dissimulé qui ressemble à des attaques par injection connues
- Du contenu provenant de sources externes (pages web, e-mails, applications connectées) avec une mise en forme inhabituelle
Faux positifs
Il arrive qu'un contenu sûr déclenche la confirmation. Cela peut se produire lorsque :
- Vous rédigez des prompts ou du contenu lié à l'IA qui ressemble à des schémas d'injection
- Le contenu inclut un vocabulaire technique sur les systèmes d'IA
- Un contenu externe présente une mise en forme inhabituelle qui ressemble à des instructions cachées
Si la confirmation s'affiche et que vous faites confiance au contenu sur lequel vous travaillez, vous pouvez confirmer et continuer en toute sécurité. La confirmation n'est pas un avertissement signalant qu'un événement dangereux s'est produit. C'est un point de contrôle qui vous demande de valider ce que vous souhaitez faire avant que l'IA n'effectue une action.
Ce que ClickUp ne fait pas
- Nous ne vous empêchons jamais de lire du contenu. Le système de sécurité contrôle uniquement les actions (écritures, messages, requêtes externes), pas les lectures.
- Nous n'abandonnons jamais silencieusement votre demande. Si le système intervient au cours d'une conversation, la confirmation s'affiche et vous pouvez choisir de continuer. Dans le cas des exécutions d'agents autonomes où personne n'est disponible pour répondre, une action signalée peut être interrompue sans confirmation et consignée dans la sortie de l'agent.
Pour les administrateurs d'Environnement de travail
Le pare-feu contre l'injection de prompt est activé par défaut pour tous les Environnements de travail qui utilisent Brain ou les Super Agents. Aucune configuration n'est requise.
Si votre équipe rencontre des faux positifs répétés sur des workflows spécifiques, contactez le support ClickUp. Nous améliorons continuellement le système de détection afin de réduire les faux positifs tout en maintenant la protection contre les attaques réelles.
Foire aux questions
Questions fréquentes sur la protection contre l'injection de prompt.
Cela ralentit-il mes interactions avec l'IA ?
Non. La détection s'exécute en parallèle du traitement normal. Vous ne remarquerez aucun délai sur les demandes habituelles.
Puis-je désactiver le système de sécurité ?
Le pare-feu contre l'injection de prompt est une fonctionnalité de sécurité essentielle qui ne peut pas être désactivée. Le processus de confirmation vous garantit toujours d'avoir le dernier mot sur la poursuite ou non d'une action.
Que faire si je continue à obtenir des faux positifs ?
Si la confirmation s'affiche fréquemment sur du contenu auquel vous faites confiance, vous pouvez confirmer à chaque fois en toute sécurité. Si cela devient gênant, contactez le support afin que nous puissions analyser la situation et améliorer le classificateur pour votre cas d'utilisation.
Cela protège-t-il également mes Super Agents ?
Oui. Les Super Agents utilisent le même système de sécurité multicouche. Lorsque vous travaillez de manière interactive avec un Super Agent (via un message direct, une mention ou un fil de commentaires), la confirmation fonctionne exactement comme décrit ci-dessus : l'action est mise en pause et vous décidez de continuer ou non.
Les exécutions planifiées et automatisées fonctionnent différemment. Lorsqu'un Super Agent s'exécute sans intervention humaine (planifications ou automatisations), personne n'est disponible pour confirmer, et ces exécutions n'affichent donc jamais de confirmation. À la place, une action signalée est traitée selon la politique appliquée à votre Environnement de travail : elle est soit interrompue avant d'être exécutée et consignée dans la sortie de l'agent, soit autorisée à se poursuivre avec la détection enregistrée pour examen par l'administrateur. Dans tous les cas, la détection est enregistrée ; consultez donc l'historique des exécutions de l'agent pour voir ce qui a été signalé et pourquoi.
Quels types d'attaques ce système permet-il de prévenir ?
Le système est conçu pour prévenir le vol de données entre utilisateurs (où du contenu introduit par un utilisateur tente de dérober les données d'un autre utilisateur via l'IA), les actions non autorisées (où des instructions injectées tentent d'amener l'IA à modifier votre Environnement de travail ou à envoyer des messages), ainsi que la fuite de mots de passe ou d'autres informations via des requêtes envoyées à des services externes.