ΚΑΙΡΟΣ · LIVE32°CΣχεδόν αίθριος24% υγρασίαLive cam Αστεροσκοπείο Πεντέλης
ΑΡΧΙΚΗ
pentelikonews.gr Επιστήμη - Υγεία
Διαβάστε τις ειδήσεις μας μέσω RSS Βρείτε μας στο Facebook Βρείτε μας στο Google Plus Ακολουθήστε μας στο Twitter Επισκεφθείτε το κανάλι μας στο YouTube

Χρησιμοποιώντας την τεχνική της επιβράβευσης, που έχει αποδειχθεί άκρως αποτελεσματική ...

Ημερομηνία: · Εμφανίσεις: 64



Χρησιμοποιώντας την τεχνική της επιβράβευσης, που έχει αποδειχθεί άκρως αποτελεσματική στην εκπαίδευση σκύλων, Αμερικανοί ερευνητές δίδαξαν έναν ρομποτικό βραχίονα μια σειρά από νέα κόλπα, όπως το να στήνει πύργους από τουβλάκια.

Στο μέλλον, λένε οι συντάκτες της μελέτης, παρόμοιες τεχνικές ίσως επιτρέψουν στα ρομπότ να μαθαίνουν να εκτελούν περίπλοκες εργασίες όπως το πλύσιμο των πιάτων και η εργασία σε γραμμές παραγωγής.

Το σημαντικό στο νέο πείραμα είναι ότι ο ρομποτικός βραχίονας αρχικά δεν είχε ιδέα τι είναι τα τουβλάκια και πώς πρέπει να τα πιάνει.

Έμαθε μόνο του τι έπρεπε να κάνει χάρη στην τεχνική της επιβράβευσης, ή «θετικής ενίσχυσης» όπως την ονομάζουν οι συμπεριφορικοί ψυχολόγοι.

«Στην αρχή το ρομπότ δεν έχει ιδέα τι κάνει, με την εξάσκηση όμως γίνεται όλο και καλύτερο.

Δεν εγκαταλείπει ποτέ και εξακολουθεί νακαταβάλει προσπάθεια να στήσει τα τουβλάκια μέχρι να πετύχει το στόχο στο 100% των περιπτώσεων» εξηγεί ο Άντριου Χουντ, διδακτορικός φοιτητής του Πανεπιστημίου «Τζονς Χόπκινς» του Κονέκτικατ, πρώτος συγγραφέας της μελέτης.

«Στο παρελθόν είχα σκύλους, οπότε γνωρίζω ότι η επιβράβευση έχει αποτέλεσμα.

Αυτό αποτέλεσε την έμπνευση για το σχεδιασμό του αλγόριθμου μάθησης» λέει.

Η δημοσίευση της ομάδας του, με τίτλο «Good Robot!», δημοσιεύεται στην επιθεώρηση IEEE Robotics and Automation Letters.

Οι ερευνητές έπρεπε βέβαια να επινοήσουν ένα σύστημα επιβράβευσης που λειτουργεί όπως οι λιχουδιές στους σκύλους.

Εκεί που ένας σκύλος θα κέρδιζε ένα μπισκοτάκι, το ρομπότ επιβραβευόταν με επιπλέουν βαθμούς, σε ένα είδος «πόιντ σίστεμ».

Ο ρομποτικός βραχίονας, με το όνομα Spot, άρχισε σε πρώτη φάση να πειραματίζεται με τους κύβους, χωρίς να γνωρίζει τι ακριβώς έπρεπε να κάνει.

Σύντομα έμαθε ότι οι κινήσεις που οδηγούν στο στοίβαγμα των κύβων προσέφεραν πόντους επιβράβευσης, ενώ οι λανθασμένες κινήσεις δεν του προσέφεραν τίποτα.

«Αυτό που θέλει το ρομπότ είναι η υψηλότερη δυνατή βαθμολογία.

Μαθαίνει γρήγορα τις σωστές συμπεριφορές για να πάρει την πιο καλή επιβράβευση» εξηγεί ...

Πηγή/Περισσότερα: in.gr
Μείνετε σε επαφή μαζί μας:
Κάντε like κι ακολουθήστε τη σελίδα μας στο Facebook
Στο Twitter:
ARTICLES
· Bad weather in Portugal: Reconstruction coordinator admits full recovery is unlikely
· What to eat before bed for better and deeper sleep
· One trick that can reduce stress and your cortisol levels by 23%
· Central Europe must prepare for more frequent forest fires, experts warn
· The world is facing irreversible depletion of water reserves, warn UN scientists
· Questions about the Crans-Montana fire
· Avocado: A miracle for our health
· The new amazing trains in China
· If you miss the person from your past relationship
· The borderline personality disorder
VIDEO NEWS


ΟΜΟΡΦΑ ΚΑΙ ΠΑΡΑΞΕΝΑ
ΑΦΙΕΡΩΜΑΤΑ
ΚΑΙΡΟΣ LIVE

Σχεδόν αίθριος · 32 °C · 24%
Περισσότερα >>
TV - ΟΙ ΤΑΙΝΙΕΣ ΤΗΣ ΗΜΕΡΑΣ

Περισσότερα
DOWNLOADS
- Περισσότερα >
ΠΑΡΑΤΗΡΗΤΗΡΙΟ ΣΕΙΣΜΩΝ

Live γραφική ενημέρωση για τους σεισμούς στην Ελλάδα
DRONE VIDEOS
Drone videos από πολλές περιοχές της Ελλάδας.
Τα πιο πρόσφατα:
· Θεσσαλονίκη
· Καλαμάτα
· Λουτράκι
· Λίμνη Στράτου
· Αγρίνιο
· Τρίκαλα
· Μετέωρα
» Περισσότερα


Ειδήσεις



Ειδήσεις από το Αθηναϊκό Πρακτορείο Ειδήσεων



Copyright 2010-2026 © pentelikonews.gr
Privacy Policy and Cookie Policy - Πολιτική απορρήτου και cookies