Securite Des Modeles
2 article(s)
→

Le nouveau modèle d'IA Astra d'OpenAI, utilisant une technique de raisonnement appelée « profondeur récurrente », inquiète les experts en sécurité IA
📖 Lire sur Vigie24Le nouveau modèle Astra d'OpenAI utilise une technique de « profondeur récurrente » pour son raisonnement interne. Cette méthode inquiète les experts en sécurité car elle réduit la visibilité des traces de réflexion, rendant la surveillance du comportement du modèle plus difficile.
Notez :👁 1
Anthropic montre comment une IA peut désormais améliorer d'autres IA
📖 Lire sur Vigie24Anthropic a démontré que son modèle Claude est capable de concevoir et de tester des méthodes pour corriger les failles d'alignement d'autres IA. Les résultats obtenus surpassent ceux de chercheurs humains expérimentés dans ce domaine.
Notez :👁 1