Kvantni skok u robotici s modelom Google Gemini Robotics ER 2
Google je službeno predstavio svoj najnoviji i najmoćniji model robotike, nazvan Gemini Robotics ER 2. Programeri su ga dizajnirali kao mozak visoke razine koji robotima omogućuje razgovor s ljudima, razumijevanje fizičkog okruženja i planiranje višestepenih zadataka. Model zatim delegira izvršavanje pokreta kontrolnim sustavima niže razine. Također može samostalno koristiti vanjske alate, poput Google pretraživanja. Glavna prednost ovog dizajna je što robot može planirati svoje sljedeće korake dok istovremeno obavlja trenutne zadatke, uklanjajući prethodno dosadne pauze "razmišljanja".
Nova verzija donosi značajna poboljšanja u odnosu na prethodni model Gemini Robotics ER 1.6. Analizom kontinuiranog videa, roboti sada mogu pratiti svoj napredak u stvarnom vremenu, prilagođavati se potencijalnim pogreškama i točno znati kada je vrijeme za prijelaz na sljedeći korak. U testovima je sustav postigao 57,4 posto točnosti u određivanju razine završenog posla i 91,3 posto točnosti u identificiranju ključnih trenutaka, poput točnog trenutka prestanka ulijevanja tekućine. Još jedna velika inovacija je podrška za zajednički rad više robota, što omogućuje različitim uređajima međusobnu komunikaciju i zajedničko obavljanje složenijih zadataka.
Razvojni inženjeri su također poboljšali prostornu inteligenciju i znatno višu razinu sigurnosti. Model je bolje sposoban detektirati pogreške tijekom izvođenja, poput prolijevanja ili klizanja materijala, te može očitavati podatke iz širokog spektra digitalnih i analognih mjernih uređaja. U testovima sigurnosti pokazao se izvrsnim u prepoznavanju blizine ljudi. Robot se automatski zaustavlja kada mu se osoba približi i nastavlja s radom tek kada je područje ponovno sigurno. Demonstracija njegovog rada provedena je na poznatom robotu Spot partnera Boston Dynamics, koji samostalno pronalazi i donosi grickalicu na temelju glasovne naredbe.
Robotski sustavi u stvarnom svijetu često se susreću s nepredvidivim okolnostima koje računalni modeli u simulacijama ne mogu u potpunosti predvidjeti. Koliko će dobro sustav funkcionirati izvan laboratorija, tek ćemo vidjeti, jer je model trenutno dostupan programerima putem Gemini API-ja, Google AI Studija i u testnoj verziji na Gemini Enterprise Agent Platformi.




















