گوگل دیپمایند در تازهترین کنفرانس خبری خود اعلام کرد مدلهای جدید هوش مصنوعی این شرکت امکان انجام وظایف پیچیدهتر و حتی استفاده از وب برای دریافت کمک را به رباتها میدهد. کارولینا پارادا، مدیر واحد رباتیک دیپمایند تأکید کرد این مدلها طوری طراحی شدهاند که رباتها پیش از هر اقدام بتوانند چندینین مرحله جلوتر فکر کنند.
بهنوشتهی ورج، سیستم جدید با پشتیبانی از Gemini Robotics 1 مدل جدید Gemini Robotics-ER 1.5 کار انجام میدهد؛ نسخههایی بهروزشدهی مدلهای هوش مصنوعی گوگل که نخستینبار در ماه مارس (اسفند ۱۴۰۳ و فروردین ۱۴۰۴) معرفی شدند. این ارتقاء باعث گردید رباتها فراتر از وظایف ساده مانند تا کردن کاغذ یا بازکردن زیپ کیف عمل کنند، لباسها را بر اساس رنگ تیره و روشن جدا کنند، چمدانی را مطابق وضعیت آبوهوای لندن ببندند یا حتی با جستوجوی اینترنتی، زبالهها را بهدرستی به بازیافتی، کمپوست و سایر دستهها تفکیک کنند.
به گفتهی پارادا، رباتها پیشتر فقط امکان داردستند دستورهای منفرد را با دقت اجرا کنند، اما اکنون به درک واقعی و توانایی حل مسئله در دنیای فیزیکی مجهز شدهاند. مدل جمنای Robotics-ER 1.5 در این سیستم، محیط اطراف را تحلیل و در صورت نیاز برای کسب اطلاعات بیشتر از ابزارهایی مثل جستوجوی گوگل استفاده انجام میدهد. این دادهها سپس برای Gemini Robotics 1.5 به زبان طبیعی ترجمه میشوند تا ربات با کمک بینایی ماشینی و پردازش زبان بتواند وظایف را مرحلهبهمرحله اجرا کند.
دیپمایند نیز اعلام کر که Gemini Robotics 1.5 قابلیت یادگیری میانرباتی دارد؛ به این معنا که رباتها امکان داردند مهارتهای آموختهشده را با یکدیگر به اشتراک بگذارند، حتی اگر ساختارشان متفاوت باشد. برای نمونه، وظایفی که به ربات دو بازوی ALOHA2 آموزش داده گردید، بدون مشکل روی ربات دو بازوی Franka و حتی ربات انساننمای Apollo شرکت Apptronik نیز اجرا شدند. این ویژگی امکان کنترل انواع رباتها با یک مدل واحد و نیز انتقال مهارتها از یک ربات به ربات دیگر را فراهم انجام میدهد.
سرانجام، دیپمایند اعلام کرد که مدل Gemini Robotics-ER 1.5 از طریق Gemini API در سرویس Google AI Studio برای توسعهدهندگان در دسترس قرار گرفته هست. البته دسترسی به Gemini Robotics 1.5 فعلاً به شرکای منتخب گوگل محدود خواهد قرار دارای بود.
دیدگاهها