Anthropic ha anunciado el desarrollo de un nuevo concepto denominado J-space, que se refiere a un espacio interno en su modelo de inteligencia artificial, Claude. Este espacio está formado por patrones neuronales que el modelo puede activar para representar conceptos antes de generarlos en sus respuestas, incluso sin que estos aparezcan en la respuesta final.
La compañía sostiene que el J-space no fue diseñado intencionadamente, sino que emergió durante el proceso de entrenamiento de Claude. Esto implica que la organización interna del modelo se desarrolló de manera autónoma mientras aprendía a predecir y responder como asistente.
Anthropic ha implementado una técnica llamada J-lens para observar los patrones internos ligados a palabras que el modelo podría utilizar en sus respuestas. En uno de los experimentos, Claude pensó en silencio en un deporte y el J-lens mostró la palabra “Soccer”. Al sustituir este patrón por “Rugby”, el modelo terminó respondiendo rugby. En otro caso, al cambiar “spider” por “ant”, la respuesta sobre el número de patas del animal cambió de 8 a 6.
Además, se realizaron pruebas que simulan situaciones cotidianas, como pensar en una cosa mientras se realiza otra. En un experimento, Claude copió una frase sobre una pintura mientras se concentraba en frutas cítricas, y aunque la salida solo contenía la frase copiada, el J-space mostró las palabras “orange” y “fruits”. En otro caso, al resolver mentalmente una operación matemática durante la misma tarea, el J-lens mostró primero “nine” y luego “seven”.
A pesar de estas capacidades, Anthropic aclara que el J-space no es responsable de todas las funciones de Claude. Cuando se impidió al modelo utilizar este espacio, Claude continuó operando con fluidez en tareas simples, aunque se vio afectado en tareas más complejas, como el razonamiento de varios pasos o la escritura de poesía.
La compañía enfatiza que sus experimentos no demuestran que Claude tenga experiencias o sentimientos como los humanos, y que el acceso consciente se entiende en un sentido funcional, como pensamientos que el modelo puede reportar y utilizar para razonar. Aunque el J-space ofrece una nueva forma de observar el funcionamiento interno de Claude, no resuelve el debate sobre la conciencia en la inteligencia artificial.





