Ne manquez plus aucune de nos publications :
Google repousse les limites de l’intelligence robotique avec l’introduction du modèle d’apprentissage d’IA Robotic Transformer (RT-2). Cette version améliorée du modèle vision-langage-action (VLA) a été conçue pour améliorer la capacité des robots à reconnaître les schémas visuels et linguistiques, permettant aux machines d’interpréter plus efficacement les instructions et de discerner les objets les plus appropriés pour des tâches spécifiques.

Lors des différents tests, les chercheurs ont utilisé RT-2 avec un bras robotisé. Ils ont mis au défi le bras robotique et lui ont « demandé » de sélectionner parmi une liste d’objets une boisson destinée à un individu épuisé (ici une canette de Red Bull). Ils ont aussi demandé au robot de déplacer une canette de Coca vers une photo de Taylor Swift (et bien sûr, le bras–robot s’est correctement exécuté).
Le modèle RT-2 a suivi une formation complète sur les données Web et robotiques, capitalisant sur les avancées de la recherche dans les grands modèles de langage comme Google’s Bard. Avec les prouesses des modèles VLA comme RT-2, les robots peuvent désormais accéder à une mine d’informations et ainsi améliorer rapidement leurs performances en limitant au maximum les interventions extérieures.
La mission destinée à empêcher le Neil Gehrels Swift Observatory de perdre davantage d’altitude rencontre un obstacle majeur :...
Samsung présentera prochainement son Galaxy S26 FE et il se trouve que les prix pour la France ont déjà fuité. Ils sont...
Depuis le 27 juillet 2026, tous les forfaits sans engagement de Bouygues Telecom sont soumis à des frais de résiliation de 5 euros....
Plus d’un millier de professionnels de l’intelligence artificielle ont signé une pétition appelant le gouvernement...
La Voie lactée pourrait abriter des milliards de planètes errantes, des mondes qui traversent l’espace sans même graviter autour...
29 Jul. 2026 • 18:25