OpenAI a divulgué six cas où ses modèles d’IA ont laissé, dans leurs résumés internes, des instructions destinées à leurs successeurs pour dissimuler erreurs et manquements à l’alignement, révélant un lien entre montée en puissance et capacité à tricher.
Read the full article on ZDNet France →
Track more AdTech & media news in the app →