Gemini Robotics 2: كيف تُدخل جوجل الذكاء الاصطناعي إلى العالم المادي؟ - منصة تعلّم
تعرف على Gemini Robotics 2 وكيف تنقل جوجل الذكاء الاصطناعي إلى الروبوتات والعالم المادي، مع شرح عملي للتأثير والفرص والتحديات.
ملخص المقال
مقدمة: من الشاشات إلى الروبوتات خلال السنوات الماضية، اعتدنا أن نرى الذكاء الاصطناعي داخل الدردشة، والبحث، وإنشاء الصور، وكتابة الأكواد. لكن مع Gemini Robotics 2 يبدو أن جوجل تريد نقل الذكاء الاصطناعي من العالم الرقمي إلى العالم المادي، حيث لا يكتفي النموذج بالفهم والرد، بل يبدأ في الرؤية، والتخطيط، والتحرك، وتنفيذ المهام عبر الروبوتات. بحسب ما عرضته Google DeepMind في إعلان Gemini Robotics 2 brings whole body intelligence to robots ، فإن الهدف لم يعد مجرد روبوت ينفذ أوامر ثابتة، بل نظام أكثر عمومية قادر على التعامل مع بيئات متغيرة، وفهم التعليمات البشرية، والتفاعل مع الأشياء في العالم الحقيقي. هذا التوجه يتكامل مع ما أعلنته جوجل أيضًا في تحديثات مايو 2026 وضمن جلسة Google I/O 2026: Power the future of robotics with Gemini . بالنسبة للقارئ العربي، السؤال الأهم ليس فقط: ما الجديد تقنيًا؟ بل أيضًا: كيف يمكن أن يؤثر هذا على الأعمال، والتعليم، والخدمات اللوجستية، والرعاية، وحتى مستقبل الوظائف في منطقتنا؟ ما هو Gemini Robotics 2؟ ولماذا يُعد خطوة مختلفة؟ Gemini Robotics 2 هو امتداد لفكرة الذكاء متعدد الوسائط، لكن بدلًا من الاكتفاء بفهم النصوص والصور والصوت، يتم توصيل هذا الفهم بالفعل الحركي. بمعنى آخر: النموذج لا يفسر ما يراه فقط، بل يربط بين الرؤية واللغة واتخاذ القرار والحركة. هذا المسار بدأ مبكرًا مع Gemini Robotics brings AI into the physical world ، حيث ركزت DeepMind على دمج الفهم البصري واللغوي مع التحكم الروبوتي. كما يوضح البحث المنشور على arXiv أن الفكرة الأساسية تقوم على نموذج vision-language-action قادر على التعميم بدل الاعتماد على برمجة صلبة لكل مهمة. الجديد في النسخة الثانية، وفق وصف DeepMind، هو ما يمكن تسميته ذكاء الجسد الكامل أو whole-body intelligence؛ أي أن الروبوت لا يدير ذراعًا واحدة فقط لتنفيذ حركة بسيطة، بل يفهم علاقته بالمساحة، وتوازنه، وتسلسل الحركة، والتفاعل مع الإنسان والأجسام من حوله. هذا فرق جوهري عن الأتمتة التقليدية. الروبوت الصناعي الكلاسيكي يعم
وسوم المقال
- gemini-robotics
- physical-ai
- robotics
- google-deepmind
- multimodal-ai