Volver a la portada
Investigación

Anthropic mide la capacidad persuasiva de Claude

Anthropic ha desarrollado una metodología para evaluar cuán persuasivos son sus modelos de lenguaje y analiza cómo esta capacidad escala entre distintas versiones de Claude. El estudio abre un nuevo frente en la evaluación de riesgos de los sistemas de IA.

Anthropic mide la capacidad persuasiva de Claude

Anthropic ha publicado una investigación sobre cómo medir y monitorizar la capacidad persuasiva de los modelos de lenguaje, incluyendo las diferentes versiones de Claude. El trabajo responde a una preocupación creciente en el sector: entender hasta qué punto los sistemas de IA pueden influir en las decisiones de los usuarios y cómo controlar este comportamiento conforme los modelos se hacen más capaces.

Qué hay detrás

La persuasión es un atributo inherente a cualquier sistema conversacional. Cuando un modelo genera texto convincente y bien argumentado, naturalmente influye en quienes lo leen. Pero medir cuánta persuasión ejerce y en qué contextos es un problema sin resolver. Hasta ahora, no existía un marco estandarizado para cuantificar este fenómeno.

Anthropíc ha optado por desarrollar métodos propios de evaluación que permitan:

  • Cuantificar la persuasión: crear pruebas que midan con rigor estadístico cuándo un modelo es más persuasivo que otro.
  • Rastrear la escala: comparar cómo evoluciona esta capacidad entre generaciones de Claude (desde versiones anteriores hasta las más recientes).
  • Identificar patrones: entender en qué tipos de argumentos o contextos los modelos resultan más influyentes.

Este enfoque se alinea con la estrategia más amplia de Anthropic en materia de seguridad de IA: anticipar riesgos antes de que se materialicen, en lugar de reaccionar ante ellos. Otras capacidades emergentes como el razonamiento o la coordinación entre agentes también han sido estudiadas bajo esta óptica de evaluación preventiva.

Por qué te importa si trabajas con SAP

Para arquitectos y desarrolladores SAP, esto tiene implicaciones directas en cómo integrar Claude en sistemas de soporte a la decisión. Si usas Claude a través de APIs para asistencia en configuración S/4HANA, generación de código ABAP o consultoría en procesos de negocio, es relevante saber qué tan persuasivo es el modelo cuando recomienda una solución.

Cuando Claude se integra en Joule (el copiloto de SAP) o en soluciones personalizadas, los usuarios confían en sus respuestas. Entender los límites de esa influencia ayuda a diseñar guardrails más efectivos: confirmaciones de usuario antes de cambios críticos, explicaciones sobre alternativas descartadas, o incluso auditorías de las recomendaciones que el modelo genera. Anthropic está creando las herramientas para que confíes en Claude sin confiar ciegamente en él.

Leer artículo completo

¿Te ha resultado útil esta noticia?

Sé el primero en valorar
¿Le sirve a alguien de tu equipo?Compartir en LinkedIn

Seguir leyendo

¿Te ha servido? Recíbelo cada lunes

Un correo semanal con lo más relevante de Claude y SAP, en español y sin ruido. Suscríbete aquí abajo →