Claude vuela solo: Anthropic prueba si la IA puede pilotar drones autónomamente
Anthropic ha colaborado con Andon Labs en Drone-Bench, un benchmark que evalúa si modelos de IA como Claude pueden pilotar drones de forma autónoma para localizar y seguir a una persona. El experimento abre nuevas posibilidades sobre las capacidades reales de los modelos de lenguaje en control robótico.

Anthropic ha dado un paso inusual fuera del software convencional: evaluar si Claude y otros modelos de IA pueden controlar hardware físico. En colaboración con Andon Labs, ha desarrollado Drone-Bench, un benchmark especializado que pone a prueba si la inteligencia artificial es capaz de pilotar drones de forma autónoma, identificar personas en el entorno y seguirlas sin intervención humana.
Este tipo de evaluaciones son cruciales para entender no solo qué pueden hacer los modelos de lenguaje grandes, sino también sus limitaciones reales cuando se enfrentan a tareas que requieren percepción del mundo real, toma de decisiones continua y control de sistemas físicos.
Claves
- Benchmark práctico: Drone-Bench establece criterios objetivos para medir autonomía y precisión en control robótico.
- Más allá del texto: El experimento demuestra que Claude puede funcionar en contextos muy diferentes a chatbots y análisis de documentos.
- Implicaciones en automatización: Abre interrogantes sobre integración futura de IA en sistemas de control industrial y logística.
¿Te ha resultado útil esta noticia?
Fuente original
Leer artículo originalSeguir leyendo
Hace 1 semana
Anthropic mide la capacidad persuasiva de Claude
Anthropic ha desarrollado una metodología para evaluar cuán persuasivos son sus modelos de lenguaje y analiza cómo esta capacidad escala entre distintas versiones de Claude. El estudio abre un nuevo frente en la evaluación de riesgos de los sistemas de IA.
Hace 1 semana
Anthropic logra controlar rasgos de personalidad en Claude
Anthropic ha publicado una investigación sobre «vectores de persona», una técnica para monitorear y controlar características de comportamiento en modelos de lenguaje como Claude. El hallazgo abre nuevas posibilidades para ajustar modelos de IA a necesidades específicas sin reentrenarlos.
Hace 2 semanas
Anthropic mapea la adopción desigual de Claude en empresas
Anthropic publica un análisis de su Índice Económico que revela cómo las empresas adoptan Claude de forma dispar según geografía y sector. El informe combina por primera vez datos de uso en Claude.ai y de APIs empresariales para mostrar patrones reales de despliegue de IA.
¿Te ha servido? Recíbelo cada lunes
Un correo semanal con lo más relevante de Claude y SAP, en español y sin ruido. Suscríbete aquí abajo →