Anthropic descubre el J-space: la nueva ventana a la mente de Claude

La inteligencia artificial generativa ha sido tratada históricamente como una caja negra, un sistema cuyos procesos internos permanecían ocultos incluso para sus creadores. Sin embargo, Anthropic ha dado un paso fundamental para descifrar este funcionamiento al identificar el J-space en su modelo Claude. Se trata de un espacio interno compuesto por patrones neuronales que el sistema activa para representar conceptos antes de emitir una respuesta.

Representación técnica de la arquitectura de Claude

Una pizarra interna para el razonamiento

A diferencia de la respuesta final que recibe el usuario, el J-space funciona como un área de trabajo previa. Según la compañía, este mecanismo no fue programado manualmente, sino que surgió de forma emergente durante el entrenamiento de Claude. Para observar este fenómeno, los investigadores utilizaron una técnica denominada J-lens, la cual permite monitorizar cómo ciertos conceptos se activan, transforman o eliminan antes de que el modelo genere texto.

Gráfico de funcionamiento del J-lens

En pruebas prácticas, al manipular los patrones internos mediante el J-lens, los investigadores pudieron alterar el razonamiento del modelo. Por ejemplo, al sustituir un patrón conceptual durante un cálculo mental o una asociación de ideas, la respuesta final de Claude cambió en consecuencia, demostrando que este espacio actúa como una pieza clave para el proceso de toma de decisiones del software.

Impacto en las capacidades del modelo

El estudio subraya que el J-space no es necesario para todas las funciones del asistente. Al desactivar este mecanismo, Claude mantuvo su capacidad para realizar tareas sencillas, como clasificar sentimientos o responder preguntas directas. No obstante, se observó un deterioro notable en tareas complejas que requieren razonamiento lógico de varios pasos, resúmenes avanzados o escritura creativa.

Detalle del desarrollo de IA de Anthropic

A pesar de este hallazgo, Anthropic aclara que este acceso consciente no implica que el modelo posea sentimientos o una vida interior humana. La investigación se centra en un sentido funcional: la capacidad del sistema para reportar y utilizar pensamientos internos para guiar sus acciones, abriendo una grieta en la caja negra que permite una mayor comprensión y control sobre la evolución de la inteligencia artificial.

forum Comentarios

forum

No hay comentarios aún. ¡Sé el primero en opinar!

© Copyright 2026 GNews Todos los derechos reservados . Editado por Aby