La inteligencia artificial generativa ha sido tratada históricamente como una caja negra, un sistema cuyos procesos internos permanecían ocultos incluso para sus creadores. Sin embargo, Anthropic ha dado un paso fundamental para descifrar este funcionamiento al identificar el J-space en su modelo Claude. Se trata de un espacio interno compuesto por patrones neuronales que el sistema activa para representar conceptos antes de emitir una respuesta.

Una pizarra interna para el razonamiento
A diferencia de la respuesta final que recibe el usuario, el J-space funciona como un área de trabajo previa. Según la compañía, este mecanismo no fue programado manualmente, sino que surgió de forma emergente durante el entrenamiento de Claude. Para observar este fenómeno, los investigadores utilizaron una técnica denominada J-lens, la cual permite monitorizar cómo ciertos conceptos se activan, transforman o eliminan antes de que el modelo genere texto.

En pruebas prácticas, al manipular los patrones internos mediante el J-lens, los investigadores pudieron alterar el razonamiento del modelo. Por ejemplo, al sustituir un patrón conceptual durante un cálculo mental o una asociación de ideas, la respuesta final de Claude cambió en consecuencia, demostrando que este espacio actúa como una pieza clave para el proceso de toma de decisiones del software.
Impacto en las capacidades del modelo
El estudio subraya que el J-space no es necesario para todas las funciones del asistente. Al desactivar este mecanismo, Claude mantuvo su capacidad para realizar tareas sencillas, como clasificar sentimientos o responder preguntas directas. No obstante, se observó un deterioro notable en tareas complejas que requieren razonamiento lógico de varios pasos, resúmenes avanzados o escritura creativa.

A pesar de este hallazgo, Anthropic aclara que este acceso consciente no implica que el modelo posea sentimientos o una vida interior humana. La investigación se centra en un sentido funcional: la capacidad del sistema para reportar y utilizar pensamientos internos para guiar sus acciones, abriendo una grieta en la caja negra que permite una mayor comprensión y control sobre la evolución de la inteligencia artificial.



!Advertencia! Tenemos problemas...
Debes iniciar sesión para poder comentar.. Iniciar sesión o Registrarme