Google DeepMind: Το Physical AI είναι το επόμενο βήμα
Η κούρσα της Τεχνητής Νοημοσύνης μόλις πέρασε σε εντελώς νέο, φυσικό επίπεδο και τα δεδομένα αλλάζουν ραγδαία. Η Google DeepMind δείχνει ξεκάθαρα ότι το επόμενο μεγάλο στοίχημα δεν είναι απλώς να «καταλαβαίνουν» οι μηχανές τον κόσμο μέσα από κείμενα και εικόνες, αλλά να μπορούν να κινούνται μέσα σε αυτόν, να δρουν και να συνεργάζονται με ασφάλεια. Αυτό ακριβώς περιγράφει το Physical AI: η μετάβαση της νοημοσύνης από την οθόνη στο σώμα, από τη θεωρία στην πράξη.
Στο πλαίσιο αυτό, η DeepMind προχώρησε στα επίσημα αποκαλυπτήρια του Gemini Robotics 2, μιας νέας πλατφόρμας που υπόσχεται να δώσει στα ρομπότ πρωτοφανή αυτονομία, ταχύτητα αντίληψης και ικανότητα εκτέλεσης σύνθετων εργασιών σε πραγματικές συνθήκες. Ξεχάστε τα παλιά, στατικά ρομποτικά χέρια που απλώς δίπλωναν χαρτιά πάνω σε ένα τραπέζι ή εκτελούσαν μονότονες κινήσεις. Η νέα γενιά μοντέλων φέρνει στο προσκήνιο αυτό που η εταιρεία ονομάζει “intelligent whole-body control”: ένα είδος «ολιστικού» ελέγχου που επιτρέπει σε ανθρωποειδή ρομπότ να συντονίζουν όλο το σώμα τους με αρμονία, από τα πέλματα μέχρι τα ακροδάχτυλα.
Σε ένα ιδιαίτερα εντυπωσιακό βίντεο που δόθηκε στη δημοσιότητα, βλέπουμε το υπερσύγχρονο ρομπότ Apollo 2 της Apptronik να εκτελεί απρόσκοπτα σύνθετες εντολές καθημερινότητας. Όταν, για παράδειγμα, του ζητήθηκε να βάλει ένα ποτιστήρι σε έναν πράσινο κάδο στο κάτω ράφι, το ρομπότ δεν περιορίστηκε σε μια απλή κίνηση του χεριού. Υπολόγισε διαδρομή, περπάτησε έως το τραπέζι, έπιασε το αντικείμενο, προσανατολίστηκε προς τον σωστό στόχο, λύγισε γόνατα και μέση για να φτάσει χαμηλά και τοποθέτησε το ποτιστήρι με ακρίβεια εκεί όπου έπρεπε. Με άλλα λόγια, μετέτρεψε μια καθημερινή φωνητική εντολή σε μια αλληλουχία από χωρικές εκτιμήσεις, ισορροπία σώματος, σωστή λαβή, και ελεγχόμενη κίνηση — δηλαδή σε αυτό που, στην πράξη, σημαίνει Physical AI.
Physical AI: όταν η νοημοσύνη αποκτά σώμα
Ο όρος Physical AI (ή αλλιώς «ενσώματη» Τεχνητή Νοημοσύνη) περιγράφει την ικανότητα ενός συστήματος να αντιλαμβάνεται τον πραγματικό κόσμο και να αλληλεπιδρά με αυτόν μέσω δράσης: να πιάνει, να μετακινεί, να ανοίγει, να κλείνει, να περπατά, να αποφεύγει εμπόδια, να συνεργάζεται με ανθρώπους ή άλλα ρομπότ. Η δυσκολία δεν είναι μόνο το να «βλέπει» το ρομπότ ένα αντικείμενο, αλλά να καταλαβαίνει πού βρίσκεται στο χώρο, πόση δύναμη χρειάζεται, τι σημαίνει «βάλε το στο κάτω ράφι», και πώς να εκτελέσει την κίνηση χωρίς να ρίξει κάτι, να χάσει ισορροπία ή να χτυπήσει γύρω του.
Εδώ ακριβώς έρχεται το Gemini Robotics 2 να λειτουργήσει ως γέφυρα ανάμεσα στην αντίληψη και τη δράση. Και σύμφωνα με την DeepMind, η «μαγεία» δεν βρίσκεται σε έναν μόνο αλγόριθμο, αλλά σε ένα σύνολο από τρία μοντέλα που δουλεύουν συντονισμένα.
Οι τρεις “εγκέφαλοι” πίσω από το Gemini Robotics 2
Η πλατφόρμα δεν βασίζεται σε μία ενιαία «νοημοσύνη», αλλά σε τρία ξεχωριστά επίπεδα, το καθένα με διαφορετικό ρόλο:
Gemini Robotics 2
Το βασικό VLA (vision-language-action) μοντέλο, που μεταφράζει όσα βλέπει και ακούει το ρομπότ σε πραγματική κίνηση. Είναι το κομμάτι που «πιάνει» την εντολή και την κάνει πράξη, μετατρέποντας τη γλώσσα και την οπτική πληροφορία σε δράση με χρονισμό, ακρίβεια και προσαρμοστικότητα.
Gemini Robotics ER 2
Το μοντέλο “Embodied Reasoning”, δηλαδή ανώτερης λογικής εντός φυσικού περιβάλλοντος. Λειτουργεί σαν κεντρικός εγκέφαλος υψηλού επιπέδου: κατανοεί τον χώρο, σχεδιάζει εργασίες πολλών βημάτων και μπορεί να υποστηρίξει ακόμη και συνεργασία μεταξύ διαφορετικών ρομπότ. Η ιδέα ότι ένα ανθρωποειδές και ένας «μηχανικός σκύλος» μπορούν να συντονιστούν για έναν κοινό στόχο είναι από μόνη της μια γεύση του πού μπορεί να οδηγήσει το Physical AI σε βιομηχανία, logistics και υπηρεσίες.
Gemini Robotics On-Device 2
Μια ελαφριά, βελτιστοποιημένη έκδοση που τρέχει τοπικά στο hardware του ρομπότ, χωρίς να χρειάζεται σύνδεση στο internet. Αυτό σημαίνει μηδενικό latency (καθυστέρηση) και καλύτερο έλεγχο σε περιβάλλοντα όπου η συνδεσιμότητα είναι περιορισμένη ή όπου η ταχύτητα αντίδρασης είναι κρίσιμη. Επιπλέον, η DeepMind υποστηρίζει ότι μπορεί να προσαρμοστεί σε νέο ρομποτικό σώμα μέσα σε λίγες ώρες εκπαίδευσης, κάτι που —αν επιβεβαιωθεί στην πράξη— μειώνει δραστικά το «κόστος εισόδου» για νέες ρομποτικές πλατφόρμες.
Περισσότερη επιδεξιότητα, αλλά όχι ακόμη ανθρώπινος ρυθμός
Εκτός από την κίνηση του κορμού, οι δυνατότητες dexterity έχουν ανέβει επίπεδο. Με προηγμένα ρομποτικά χέρια SharpaWave (22 αρθρώσεων), το ρομπότ μπορεί πλέον να εκτελεί μικρο-κινήσεις: να δένει κόμπους σε καλώδια, να βιδώνει λάμπες ή ακόμη και να κλείνει αεροστεγώς μια σακούλα απορριμμάτων. Πρόκειται για εργασίες που απαιτούν λεπτό χειρισμό, αίσθηση δύναμης και σταθερότητα — θεμέλια για οποιοδήποτε σενάριο Physical AI εντός σπιτιού ή εργασίας.
Ωστόσο, προς τιμήν της, η ίδια η DeepMind κρατά ρεαλιστικούς τόνους και δημοσιεύει στοιχεία που δείχνουν πως υπάρχει δρόμος ακόμη. Σε εργασίες ακριβείας, όπως το κλείσιμο μιας ziplock σακούλας, τα ποσοστά επιτυχίας κυμαίνονται στο 40-44%. Επιπλέον, οι κινήσεις παραμένουν πιο αργές από τις ανθρώπινες: το σύστημα χρειάζεται χρόνο για να «σκεφτεί», να αξιολογήσει το επόμενο βήμα και να εξασφαλίσει ότι η εκτέλεση δεν θα οδηγήσει σε λάθος.
Αυτό όμως δεν ακυρώνει το άλμα. Αντίθετα, το κάνει πιο πειστικό: το Physical AI δεν παρουσιάζεται ως μαγική λύση, αλλά ως μια τεχνολογία που ωριμάζει, με μετρήσιμες επιδόσεις, σαφή όρια και καθαρή κατεύθυνση βελτίωσης.
Τι σημαίνει αυτό για το μέλλον;
Παρά τα εμπόδια ταχύτητας και ακρίβειας, το βήμα είναι τεράστιο. Το όραμα ενός ενιαίου, «έξυπνου» AI οικοσυστήματος που θα ελέγχει ρομπότ σε εργοστάσια, αποθήκες, χώρους εργασίας ή ακόμη και στα σπίτια μας, μοιάζει πιο κοντά από ποτέ. Και εδώ βρίσκεται η ουσία: το Physical AI δεν θα αλλάξει μόνο το τι μπορεί να κάνει ένα ρομπότ, αλλά και το πώς θα φανταζόμαστε την καθημερινή βοήθεια από την τεχνολογία.
Φανταστείτε έναν ψηφιακό βοηθό που δεν απαντά απλώς σε ερωτήσεις, αλλά σηκώνεται, μετακινείται, συγυρίζει, τακτοποιεί και προσαρμόζεται στον χώρο σας. Αν το Gemini Robotics 2 είναι ένα δείγμα της κατεύθυνσης, τότε η DeepMind δείχνει ότι η επόμενη μεγάλη επανάσταση δεν θα είναι μόνο «έξυπνη» — θα είναι και φυσική. Με άλλα λόγια, το Physical AI είναι το επόμενο βήμα, και πλέον δεν μιλάμε για μακρινό μέλλον, αλλά για μια τεχνολογία που αρχίζει να παίρνει μορφή μπροστά στα μάτια μας.
Σχετικά Άρθρα
01/08/2026 - 11:30
01/08/2026 - 10:30
Δείτε επίσης