Anthropic et Andon Labs testent le pilotage autonome de drones
Le fait — Anthropic a publié Project Pilot le 23 juillet 2026, en partenariat avec Andon Labs. L’équipe y décrit des démonstrations et une nouvelle évaluation, Drone-Bench. Les modèles doivent contrôler un quadrirotor en intérieur pour localiser puis suivre une personne. Cela exige perception visuelle, décision séquentielle et contrôle continu. Anthropic indique que les modèles récents progressent sur toutes les sous-tâches. Le meilleur modèle cité, Claude Fable 5, dépasse la ligne de base sur toutes sauf la reconstruction. Le contexte — Le pilotage robotique est souvent présenté comme une extension naturelle des agents logiciels. Anthropic relie explicitement ces progrès à ses travaux antérieurs sur l’usage de robots génériques. Dans le récit AGI, la question n’est pas seulement de répondre ou coder, mais d’agir dans le monde avec des objectifs ouverts. Un benchmark comme Drone-Bench tente donc de mesurer le passage du raisonnement symbolique à l’action incarnée. L’analyse — Ce résultat ne montre pas une autonomie générale. Il documente cependant un élargissement du front des capacités vers des tâches physiques avec perception et boucle d’action. C’est pertinent pour l’AGI car beaucoup de limites des modèles apparaissent lorsqu’il faut maintenir un objectif dans un environnement changeant. En même temps, le cadre reste borné, intérieur et simple. La tension reste celle-ci, une amélioration régulière sur des sous-tâches suffit-elle à annoncer des agents robustes dans le monde réel, ou masque-t-elle encore une forte fragilité hors distribution.