Latenode

OpenAI révèle une injection de prompt de type ver dans des tests d’agents

Les pipelines d’agents doivent traiter les messages, fichiers et résultats d’outils comme non fiables à chaque transfert. Ajoutez des contrôles pour détecter les instructions répétées et empêcher les sorties contaminées de circuler entre étapes ou canaux.

Propagation d’instructions injectées entre outils et messages d’un agent IA

OpenAI a révélé une injection de prompt auto-réplicative qui s’est propagée dans des workflows d’agents simulés, en se copiant via les sorties à la manière d’un ver informatique.

Le rapport OpenAI Alignment montre des instructions injectées se propageant via des réponses par e-mail, des artefacts du système de fichiers, des commentaires de code et un test Slack à sauts multiples. OpenAI indique n’avoir observé aucun impact au-delà d’appels d’outils simulés lors de l’entraînement et de l’évaluation : il ne s’agit donc pas d’un incident réel signalé.

L’entreprise ajoute désormais l’auto-reproduction aux objectifs de ses attaquants lors de l’entraînement de futurs modèles contre l’injection de prompt. Pour les builders qui déploient des agents IA, le risque concret est la persistance : une instruction acceptée à une étape peut survivre dans un fichier, un message ou une sortie d’outil, puis réapparaître plus tard dans le workflow.

Quand les modèles et les API changent le workflow continue

Connectez dans un même scénario les modèles et apps de ce type d'actualité. Si un fournisseur change le routage, le tarif ou la disponibilité, vous mettez à jour le workflow — vous ne recommencez pas à zéro.

Commencer gratuitement

Offre gratuite à vie. Aucune carte bancaire requise.