Anthropic ouvre son J-Lens et laisse la communauté fouiller dans le raisonnement caché des modèles
Anthropic publie sur Neuronpedia un outil qui permet d'explorer à la main les 25 concepts latents censés porter le raisonnement de ses modèles. Une…
Tous nos articles et analyses sur interprétabilité — 3 publications.
Anthropic publie sur Neuronpedia un outil qui permet d'explorer à la main les 25 concepts latents censés porter le raisonnement de ses modèles. Une…
Un panel scientifique mandaté par l'ONU documente une réalité inconfortable : les systèmes d'IA gagnent en autonomie plus vite qu'on ne parvient à…
Anthropic dit avoir localisé, grâce à une technique mathématique, un espace interne où Claude raisonne sans que ce travail se reflète directement…