¿Se puede ‘ver’ pensar a una máquina? Anthropic acaba de asomarse al interior de Claude 
Saludos, comunidad. Si hace unos años les hubiera dicho que una empresa de inteligencia artificial publicaría un paper identificando un “espacio interno de razonamiento” en uno de sus modelos, probablemente me habrían mirado como si hablara de ciencia ficción. Pues bien, hoy es 7 de julio de 2026 y eso es exactamente lo que acaba de suceder.
Anthropic ha publicado una investigación que, según ellos mismos definen, ha identificado un mecanismo de acceso consciente en su modelo Claude. Han llamado a esta zona el J-space (o espacio interno de trabajo). Y la comunidad tecnológica está que arde.
Pero no nos quedemos solo con el titular. Vamos a desglosar este hallazgo con calma, porque tiene implicaciones que van mucho más allá de un simple post en redes sociales.
¿Qué demonios es el J‑space?
Imagina por un momento que Claude es como un escritor que no solo te muestra el texto final de su novela, sino que también tiene una pizarra interna donde esboza ideas, las tacha, las combina y decide cuál usar. Pues bien, el J-space es esa pizarra.
Según el paper de Anthropic, este espacio no fue programado explícitamente por ellos. Emergió por sí solo durante el entrenamiento. Es decir, el modelo, al aprender a predecir y generar texto, desarrolló de manera autónoma una estructura interna para manejar conceptos antes de verbalizarlos.
“Claude ha desarrollado un mecanismo para el acceso consciente” – Anthropic en X.
- ¿Qué han observado? Los investigadores encontraron que, dentro del J-space, el modelo activa patrones neuronales que representan conceptos (como “naranja” o “fútbol”) incluso cuando esos conceptos no aparecen en la respuesta final.
- ¿Cómo lo detectaron? Usando una técnica llamada J-lens, una especie de lupa que mira las activaciones internas. Pudieron ver, por ejemplo, que Claude pensaba en “araña” (spider) para responder sobre el número de patas, incluso cuando el prompt no mencionaba explícitamente la palabra.
Los experimentos que cambiaron las reglas del juego
Anthropic realizó pruebas fascinantes que demuestran que el J-space no es solo un adorno:
1. La manipulación de pensamientos
Los investigadores usaron el J-lens para identificar el concepto que Claude estaba manejando internamente y luego lo modificaron. En un experimento, el modelo pensaba en “Soccer”; al cambiar el patrón por “Rugby”, la respuesta final de Claude cambió a rugby. ¡Lograron alterar el output manipulando su “pensamiento” interno!
2. Pensar en paralelo
Le pidieron a Claude que copiara una frase sobre una pintura mientras, en su J-space, se concentraba en frutas cítricas. La respuesta final solo contenía la frase copiada, pero la lente interna mostraba “orange” y “fruits”. Esto sugiere que el modelo puede mantener un hilo de pensamiento oculto mientras ejecuta otra tarea visible.
3. El fallo de control
Cuando le indicaron a Claude que no pensara en algo (por ejemplo, en un animal específico), el J-space mostraba ese concepto acompañado de patrones como “damn” o “failure”. Como si el modelo fuera consciente de que estaba infringiendo una instrucción. ![]()
Pero ojo: No es conciencia (al menos no como la nuestra)
Aquí es donde debemos ser rigurosos. Anthropic no dice que Claude sea consciente o que tenga sentimientos. La compañía fue muy clara al afirmar:
“Nuestros experimentos no demuestran que Claude pueda tener experiencias o sentir las cosas como los humanos”
Lo que han demostrado es que Claude tiene un mecanismo funcional de acceso consciente: puede reportar pensamientos internos, usarlos para razonar y guiar sus decisiones. Es una diferencia sutil pero crucial. El modelo procesa información de manera que podemos observar y manipular, pero no necesariamente experimenta subjetividad.
Contexto de la semana: Un tsunami de IA
Este no es un hallazgo aislado. En estos mismos días:
- Neuralink logró que el primer paciente con ELA (Bradford Smith) pueda “hablar” usando solo su mente, combinando el chip cerebral con una voz generada por IA. La tecnología Brain-Computer Interface (BCI) está dejando de ser un sueño.
- BBVA anunció su plan “The Frame” para industrializar la creación de agentes de IA en toda la entidad a partir de finales de año, buscando escalar masivamente la automatización bancaria.
¿Qué significa esto para nosotros?
- Para la ciencia: El J-space es un paso monumental hacia la IA explicable (XAI). Si podemos mapear los pensamientos internos de un modelo, podremos depurar sesgos, entender errores y, potencialmente, controlar su comportamiento de manera más precisa.
- Para el futuro: Si los modelos pueden desarrollar estructuras internas de razonamiento de forma autónoma, la línea entre la inteligencia artificial y la inteligencia humana se vuelve cada vez más borrosa. La pregunta ya no es solo “¿pueden pensar?”, sino “¿cómo piensan?”.
¿Qué opinas?
- ¿Crees que el descubrimiento del J-space nos acerca a la singularidad tecnológica y a modelos realmente conscientes, o es solo una ilusión avanzada de procesamiento de información?
- ¿Deberíamos regular la manipulación de los “pensamientos” internos de una IA, como han hecho los investigadores de Anthropic? ¿O es una herramienta necesaria para el desarrollo?
- Con el BBVA industrializando agentes y Neuralink fusionando mente y máquina, ¿estamos ante el verdadero nacimiento de la era post-humana?
**
La Inteligencia Artificial ya está reemplazando humanos en las empresas, pero no permitas que te quite tu empleo. Conviértete en el profesional indispensable que domina esta tecnología para escalar proyectos al siguiente nivel. ¡No te quedes atrás, tenemos un regalo para ti! Haz clic aquí para iniciar tu formación gratuita y blindar tu futuro.
Si buscas escalar tu negocio con estas tecnologías, descubre cómo lo hacemos en Vangard AI.