On ne garantira jamais la sécurité d’un système d’IA générative par des prompts, rappelle le développeur canadien Graeme Fawcett.
« Le prompt n’est qu’une série de jetons supplémentaires noyés dans la même soupe probabiliste que le reste. Il n’existe aucun canal privilégié, aucun mode noyau ni aucune couche de contrôle s’interposant entre vos règles et le jeton suivant pour garantir l’alignement. On ne peut pas renforcer une distribution de probabilités en y ajoutant simplement du texte. Si la sécurité repose uniquement sur le fait que le modèle a « lu » les règles, vous vous assurez simplement d’une chose : le jour où il supprimera l’environnement de production, vous recevrez un rapport post-mortem très soigné, dans lequel le modèle listera méticuleusement toutes les « règles » qu’il a enfreintes en chemin. »
Stream "Punchlines"
- ↪ La surveillance ou le progrès social
- ↪ Avec les manutentionnaires de robotaxis
- ↪ La technologie n’explique pas la montée des inégalités : la corruption, oui !
- ↪ Quels travailleurs détestent le plus l’IA ?
- ↪ Quelles formations recherchez-vous ? La réponse dépend toujours de là où vous habitez
- ↪ La transcription automatique en ses limites
- ↪ Les nettoyeurs de résultats d’IA
- ↪ RAMageddon
- ↪ La gauche doit-elle céder au chant de l’IA générative ? Non !
- ↪ Le panoptique du soin : la bienveillance de la surveillance