Bcp d'encre coule autour de ChatGPT. Peu ont par contre entendu parler de Claude, une AI “constitutionnelle” dévelopée par d'anciens membres d'Openai (la boîte qui développe ChatGPT et qui, contrairement à son nom, n'a rien d'opensource) qui ont fondé une autre boîte, Anthropic.
Alors, qu’est-ce qu’une IA constitutionnelle, et quel est son intérêt ? « Souvent, les modèles linguistiques formés pour être ‘inoffensifs’ ont tendance à devenir inutiles face à des questions contradictoires », explique l’entreprise dans un tweet de décembre. « Nous expérimentons des méthodes pour former un assistant IA inoffensif par l’auto-amélioration, sans aucune étiquette humaine identifiant les sorties nocives », expliquent-ils. « Le processus implique à la fois un apprentissage supervisé et une phase d’apprentissage par renforcement ».
Autrement dit, cette IA serait capable d’identifier lorsqu’un propos est, par exemple, discriminant, par un auto-apprentissage, en suivant non pas un étiquetage fait par des humains, mais plutôt de grands principes : une « constitution », en somme.1)
Par contre, pas foutu de parvenir à le tester… Si quelqu'un a une piste, je suis preneur!