Ai robot hava slam dunk

Mar 29, 2025 Mesaj bırakın

A robot equipped with a Gemini Robotics AI model can throw a basketball into the hoop.

Gemini Robotik AI modeli ile donatılmış bir robot kasnağa bir basketbol atabilir.

Birkaç gün önce, Google'ın DeepMind büyük dil modeli (LLM) Gemini'yi robotlara uyguladı. Model ile şirket, robotların diğer robotların hareketlerini gözlemlemek zorunda kalmadan belirli görevleri yerine getirebileceğini söylüyor. Örneğin, masadaki kasnağa mini bir basketbol "dunk".

 

DeepMind, Chatbot teknolojisini kullanarak genel amaçlı botlar geliştirmeye çalışan şirketlerden biridir. Bununla birlikte, bu tür modellerin hata ve zararlı sonuçlar üretmeye eğilimli olduğu düşünüldüğünde, bu teknik yolun güvenlik sonuçları vardır.

 

Araştırma ekibi, işletmek için sezgisel bir makine geliştirmeyi umuyor ve insan denetimi veya program öncesi olmadan çeşitli fiziksel görevler gerçekleştirebiliyor. DeepMind'deki robot ekibi başkanı Carolina Parada, Gemini modelini bağlayarak geliştiricilerin robotun "doğal dili anlama ve fiziksel dünyayı daha ince bir seviyede algılama" yeteneğini geliştirebileceğini belirtti.

 

Gemini Robotics olarak adlandırılan model 12 Mart'ta piyasaya sürüldü. Amerikan Yapay Zeka (AI) şirketi olan Collectedei'de kurucu ortağı ve AI araştırmacısı Alexander Khazatsky, bunun evrensel robotların amacına doğru "küçük ve somut bir adım" olduğunu söyledi.

 

DeepMind ekibi, son teknoloji ürünü vizyon ve dil modeli Gemini 2.

 

Ekip, 3D fizik ve bir nesnenin yörüngesini tahmin etmek veya bir nesnenin aynı kısmını farklı açılardan çekilen görüntülerden tanımlamak gibi 3D fizik ve mekansal akıl yürütmeyi içeren görevlerin yeteneklerini geliştirmek için İkizler'in özel bir versiyonunu geliştirdi.

 

Buna ek olarak, araştırmacılar modeli binlerce saatlik uygulamalı, uzaktan çalıştırılan robot demo verileriyle eğitti. Bu, robotun "beyninin", LLM'lerin bir sonraki kelimeyi öğrenme yoluyla nasıl ilişkilendirebileceğine benzer şekilde gerçek dünya görevlerini yerine getirmesine izin verir.

 

Araştırmacılar, İkizler Robotlarını insansı robotlar ve robotik kollar üzerinde, armonik redüktörler kullanan, eğitimde ortaya çıkan görevleri ve onlara maruz kalmayan yeni görevleri kapsayan robotik kolları test ettiler. Model ile robotun, ayarlanmış ayrıntılarla hem tanıdık hem de yeni görevlerde rakiplerinden daha iyi performans gösterdiğini söylüyorlar.

 

Origami veya bir sırt çantasını sıkma gibi hassas manipülasyon gerektiren görevlerde, robot 100'den az gösteriyi izledikten sonra% 70'den fazla bir başarı oranına sahiptir. Diğer modelleri kullanan robotlar neredeyse hiç başarısız oldu.

 

Khazatsky, Google ekibinin robotun "beynine" sağduyu implante etmek için harika bir iş çıkardığına inanıyor, ancak gerçek sıçramanın bir laboratuvar ortamından ziyade "kaotik gerçek dünyada" toplanan verilerden öğrenmekten geleceğini belirtiyor.

 

Güvenlik, bu tür modelleri uygularken önemli bir zorluk haline gelir. ABD'nin New York'taki Deepmind'deki robotik ve AI araştırmacısı Vikas Sindhwani, "Başlangıçta, robotlar insanlardan güvenli bir mesafe tutacak. Gelecekte yavaş yavaş daha etkileşimli ve işbirlikçi görevler uygulayacağız."