Lo que un modelo de inteligencia artificial hace por dentro no siempre coincide con lo que dice que hace.
Esta semana Anthropic publicó una investigación que lo enseña casi literalmente: han encontrado dentro de Claude un rincón — lo llaman "J-space"— donde el modelo baraja palabras que nunca pronuncia. Ideas que el propio modelo piensa en silencio.
Ocupa menos del 10% de su actividad. Y emergió solo, sin que nadie lo programara. Además, este método de análisis permite pillar al modelo, por ejemplo, fabricando datos a propósito.
Suena a ciencia ficción. Por eso conviene mirarlo con distancia: es una sola empresa hablando de su propia tecnología, y ya hay quien avisa del riesgo de mitificarlo.
#IA #InteligenciaArtificial #Podcast #RTVE #Tecnología