Robotics Transformer 2 (RT-2) este un model de viziune-limbaj-acţiune antrenat pe informaţii şi imagini de pe internet, care pot fi traduse în acţiuni pentru robot, a spus Google într-o postare pe blog.
În timp ce o sarcină precum ridicarea gunoiului sună simplă pentru oameni, ea necesită înţelegerea unei serii de sarcini pe care un robot le poate învăţa.
De exemplu, robotul trebuie să fie mai întâi capabil să recunoască ce articole constituie gunoi, apoi să ştie să-l ridice şi să-l arunce.
În loc să programeze un robot să facă acele sarcini specifice, RT-2 îi permite robotului să folosească cunoştinţele de pe web pentru a-l ajuta să înţeleagă cum să finalizeze sarcina, chiar dacă nu a fost instruit în mod explicit cu privire la paşii exacti.

