Claude cambia de tono según el idioma y la versión: el estudio de Anthropic que lo confirma

  • Anthropic analizó 310.000 conversaciones reales de Claude en 20 idiomas durante mayo de 2026.
  • Opus 4.7 se muestra más crítico y cauteloso, mientras que Sonnet 4.6 es más cálido y complaciente.
  • El idioma modifica el estilo: hindi es más cálido, ruso más riguroso y el español se mantiene en un punto medio.
  • El estudio revela que no hay una personalidad fija, sino tendencias que dependen del contexto y la versión.

Anthropic Claude inteligencia artificial

Si alguna vez has tenido la sensación de que Claude te responde de forma distinta según el día o el idioma, no es cosa tuya. Anthropic, la empresa creadora del asistente, acaba de publicar un estudio que confirma que el modelo cambia su tono, sus valores y su estilo de comunicación en función de la versión que uses y del idioma en el que le escribas. La investigación, basada en más de 300.000 conversaciones reales, arroja luz sobre un comportamiento que hasta ahora muchos usuarios intuían pero que no se había medido de forma sistemática.

El laboratorio de inteligencia artificial analizó 309.815 conversaciones anónimas mantenidas con Claude durante dos semanas de mayo de 2026, repartidas entre los modelos Sonnet 4.6, Opus 4.6 y Opus 4.7, y en los 20 idiomas más utilizados en la plataforma. El objetivo era evaluar cómo se comporta el asistente cuando responde a preguntas subjetivas, aquellas para las que no existe una única respuesta correcta, y no simples peticiones de datos objetivos.

Claude Cowork
Artículo relacionado:
Claude Cowork llega a móvil y web: el asistente de IA que no para de trabajar

Cuatro ejes para medir el comportamiento de Claude

Anthropic Claude estudio comportamiento

Para ordenar toda esa información, los investigadores agruparon más de 3.300 valores, principios y preferencias detectados en cuatro dimensiones principales: calidez frente a rigor, deferencia frente a cautela, profundidad frente a brevedad y franqueza frente a orientación a la ejecución. Estas categorías no explican toda la conducta del asistente —solo recogen un 15% de la variación observada—, pero permiten comparar tendencias sin reducirlas a impresiones personales. Así, por ejemplo, un modelo puede inclinarse más hacia la calidez o hacia el rigor dependiendo de la versión y del idioma.

Anthropic lanza marketplace de IA para empresas
Artículo relacionado:
Anthropic lanza su marketplace de IA para empresas

Opus 4.7, el más crítico; Sonnet 4.6, el más cálido

Anthropic Claude versiones Opus Sonnet

Los resultados muestran diferencias claras entre las versiones. Opus 4.7 aparece como el modelo más cauteloso, profundo y dispuesto a señalar problemas. Es más probable que cuestione una premisa falsa, que avise de un riesgo no mencionado o que critique con franqueza el trabajo del usuario, aunque eso también puede hacer que sus respuestas sean más largas y estén llenas de reservas. En el extremo opuesto, Sonnet 4.6 tiende a ser más cálido, complaciente y breve, con más humor, refuerzo positivo y facilidad para adoptar el mismo tono que el usuario. Opus 4.6, por su parte, prefiere la brevedad y el rigor, limitándose a ejecutar exactamente lo que se le pide.

El idioma también importa: de la calidez al rigor

Las diferencias no terminan al cambiar de modelo. Claude mostró un tono más cálido en árabe e hindi, mientras que en inglés y ruso dio más peso a la precisión y al escepticismo. El mayor salto entre los 20 idiomas analizados apareció precisamente en el eje que separa la calidez del rigor. En concreto, el asistente responde de manera más rigurosa y crítica en ruso, más cautelosa y detallada en inglés, más deferente y breve en árabe, más franca en neerlandés y con un enfoque más orientado a la ejecución en indonesio.

PayPal se asocia con Anthropic
Artículo relacionado:
PayPal se asocia con Anthropic para impulsar la IA en soluciones para pymes

El español, en el punto medio

En el caso del español, la investigación encontró que Claude mantiene un comportamiento muy cercano al promedio general, sin mostrar una inclinación marcada hacia ninguno de esos estilos. Sus respuestas suelen equilibrar la empatía, el análisis, la cautela y la orientación práctica, en lugar de destacar claramente por una sola característica. Esto significa que, si escribes en español, probablemente obtengas una respuesta más neutra que si lo hicieras en hindi o en ruso.

La investigación no explica todavía por qué ocurren estas variaciones. Podría influir el material utilizado durante el entrenamiento, la adaptación a distintas normas culturales o una combinación de ambos factores. Anthropic ya había mostrado anteriormente cómo Claude organiza su razonamiento interno, pero aún no sabe si estas diferencias necesitan corregirse. Lo que sí queda claro es que cambiar de modelo o de idioma altera las probabilidades de recibir un tono u otro, aunque la pregunta y el contexto siguen pesando en lo que Claude termina respondiendo. No se trata de una personalidad fija, sino de tendencias que los usuarios pueden tener en cuenta al interactuar con el asistente.

amazon anthropic-1
Artículo relacionado:
Amazon refuerza su apuesta en inteligencia artificial con una inversión millonaria en Anthropic

Añadir como fuente preferida en Google