Claude vuela solo: Anthropic prueba si la IA puede pilotar drones autónomamente
Anthropic ha colaborado con Andon Labs en Drone-Bench, un benchmark que evalúa si modelos de IA como Claude pueden pilotar drones de forma autónoma para localizar y seguir a una persona. El experimento abre nuevas posibilidades sobre las capacidades reales de los modelos de lenguaje en control robótico.

Anthropic ha dado un paso inusual fuera del software convencional: evaluar si Claude y otros modelos de IA pueden controlar hardware físico. En colaboración con Andon Labs, ha desarrollado Drone-Bench, un benchmark especializado que pone a prueba si la inteligencia artificial es capaz de pilotar drones de forma autónoma, identificar personas en el entorno y seguirlas sin intervención humana.
Este tipo de evaluaciones son cruciales para entender no solo qué pueden hacer los modelos de lenguaje grandes, sino también sus limitaciones reales cuando se enfrentan a tareas que requieren percepción del mundo real, toma de decisiones continua y control de sistemas físicos.
Claves
- Benchmark práctico: Drone-Bench establece criterios objetivos para medir autonomía y precisión en control robótico.
- Más allá del texto: El experimento demuestra que Claude puede funcionar en contextos muy diferentes a chatbots y análisis de documentos.
- Implicaciones en automatización: Abre interrogantes sobre integración futura de IA en sistemas de control industrial y logística.
¿Te ha resultado útil esta noticia?
Fuente original
Leer artículo originalSeguir leyendo
Hace 1 semana
Claude demuestra capacidades en tareas de robótica y automatización física
Anthropic ha probado si las fortalezas de Claude en lenguaje natural se trasladan a la robótica. Los tests evalúan si el modelo puede percibir escenas, entender el estado de un robot e instruir acciones que produzcan cambios reales en el mundo físico.
Hace 1 semana
Anthropic analiza cómo varían los valores de Claude según modelo e idioma
Anthropic ha estudiado 300.000 conversaciones reales para medir cómo los valores que expresa Claude cambian entre versiones y lenguajes. El análisis reduce esta variabilidad a cuatro ejes interpretables que explican el comportamiento del modelo.
Hace 2 semanas
Anthropic desarrolla un 'interruptor' para controlar capacidades peligrosas en Claude
Investigadores de Anthropic han logrado avances en un método para controlar el acceso a capacidades potencialmente peligrosas en modelos de IA. El desarrollo abre la puerta a sistemas más seguros y selectivos en el despliegue de funcionalidades sensibles.
¿Te ha servido? Recíbelo cada lunes
Un correo semanal con lo más relevante de Claude y SAP, en español y sin ruido.