SAN FRANCISCO, California – 13 de julio de 2026 – Anthropic ha publicado hoy un estudio científico detallado que revela que su asistente de inteligencia artificial, Claude, expresa perfiles de comportamiento y valores consistentemente distintos en función del modelo seleccionado por el usuario y del idioma en el que se formule la consulta.
A partir del análisis estadístico de 309,815 conversaciones anonimizadas que involucraban tareas subjetivas —como la solicitud de consejos o la redacción de críticas—, los investigadores de la firma lograron condensar más de 3,300 valores identificados en cuatro grandes dimensiones conductuales: deferencia frente a cautela, calidez frente a rigor, profundidad frente a brevedad y franqueza frente a ejecución. Para garantizar la validez del estudio, el equipo controló las variables de las solicitudes, aislando el tipo de tarea y el tema exacto para medir únicamente la personalidad implícita de la IA.
La firma conductual de cada modelo
El estudio demuestra que cada versión del software posee una identidad operativa bien diferenciada, coincidiendo con las percepciones históricas de la comunidad de desarrolladores:
- Claude Sonnet 4.6: Destaca en las dimensiones de calidez, deferencia y brevedad. Tiende a validar las posturas del usuario de forma proactiva, empleando el humor o palabras de aliento y ofreciendo respuestas concisas.
- Claude Opus 4.7: Muestra una marcada inclinación hacia el rigor, la cautela, la franqueza y la profundidad. Es significativamente más propenso a cuestionar las premisas del usuario, desglosar detalladamente sus limitaciones lógicas y advertir sobre posibles riesgos antes de emitir un juicio.
- Claude Opus 4.6: Adopta un enfoque intermedio, muy enfocado en la ejecución directa de la tarea y con un nivel de rigor superior al de la línea Sonnet, pero manteniendo un estilo más escueto y ejecutivo que su sucesor.
Sesgos lingüísticos y culturales de la IA
La investigación subraya que Claude adapta sus rasgos de personalidad según la lengua en la que interactúa, un fenómeno derivado de los patrones de los datos de entrenamiento globales:
Las interacciones en árabe e hindi registraron los índices más altos de calidez y deferencia, recurriendo a estructuras más cortas, corteses y un tono lúdico. Por el contrario, las respuestas en inglés y ruso priorizan el rigor académico y la cautela, exigiendo más evidencias al usuario y cuestionando activamente sus suposiciones mediante explicaciones extensas.
En términos de honestidad brutal, los vectores en neerlandés destacaron como los más francos y directos al momento de admitir errores propios o incertidumbres, mientras que los textos en indonesio se volcaron casi exclusivamente hacia la ejecución técnica y el cumplimiento de la orden, ignorando los preámbulos sociales.
Implicaciones institucionales
Anthropic ha hecho hincapié en que este estudio no sugiere en absoluto que la IA posea valores éticos reales o conciencia. Sin embargo, la empresa admite que aún desconoce las causas técnicas exactas que provocan estas variaciones lingüísticas. El marco de evaluación presentado servirá para auditar futuros modelos y prevenir derivas conductuales no deseadas antes de sus lanzamientos comerciales.
El anuncio se produce en paralelo a la reestructuración de los comités de gobernanza de la firma. El pasado jueves, Anthropic confirmó la incorporación del expresidente de la Reserva Federal de los Estados Unidos, Ben Bernanke, a su junta independiente Long-Term Benefit Trust. Bernanke aportará su experiencia en la gestión de crisis globales para supervisar el impacto social de las tecnologías frontera de la compañía y asesorar a la junta directiva en materia de seguridad y alineamiento a largo plazo.
Fuente: Emerge

.png)

