Des chercheurs en IA de premier plan d'OpenAI, Google DeepMind, Anthropic et Meta ont mis en garde conjointement contre la fermeture rapide de la fenêtre permettant de surveiller les processus de raisonnement de l'IA. De nouveaux modèles d'IA « pensent à voix haute » en langage humain, révélant leur processus décisionnel, y compris leurs intentions potentiellement dangereuses. Cependant, cette transparence est fragile et pourrait disparaître à mesure que la technologie de l'IA progressera grâce à une puissance de calcul accrue, de nouvelles architectures et une formation basée sur la récompense. Les chercheurs exhortent à des efforts de collaboration pour préserver et améliorer cette capacité de surveillance cruciale avant qu'elle ne soit perdue, en soulignant les évaluations standardisées et la coopération à l'échelle de l'industrie.
Prepared by Jonathan Pierce and reviewed by editorial team.
Comments