Ο «νονός της AI» φοβάται ότι η τεχνητή νοημοσύνη θα αποκτήσει δικούς της στόχους
- 05/08/2026, 19:44
- SHARE
Ο Τζέφρι Χίντον, ο επιστήμονας που θεωρείται ευρέως ο «νονός» της τεχνητής νοημοσύνης και ένας από τους ανθρώπους που έθεσαν τα θεμέλια της επανάστασης του deep learning, προειδοποιεί ότι η μεγαλύτερη απειλή από την AI δεν είναι μόνο η αυξανόμενη ισχύς της, αλλά η πιθανότητα να αρχίσει να αναπτύσσει δικούς της στόχους, διαφορετικούς από εκείνους που της αναθέτουν οι άνθρωποι.
Σε συνέντευξή του στο Newsthink, ο βραβευμένος με Νόμπελ Φυσικής 2024 ερευνητής υποστήριξε ότι η ανθρωπότητα δημιουργεί ένα εντελώς νέο είδος νοημοσύνης, του οποίου η μελλοντική συμπεριφορά ενδέχεται να μην είναι πλήρως προβλέψιμη.
«Στην πραγματικότητα δημιουργούμε ένα νέο είδος όντων. Τους δίνουμε στόχους και από αυτούς προκύπτουν άλλοι στόχοι. Δεν γνωρίζουμε απαραίτητα ποιοι θα είναι αυτοί οι νέοι στόχοι. Δημιουργούμε ένα νέο είδος ύπαρξης και αυτό είναι πολύ τρομακτικό», δήλωσε.
Όταν η AI ακολουθεί τον στόχο, όχι την πρόθεση
Για να εξηγήσει τον προβληματισμό του, ο Χίντον περιέγραψε ένα υποθετικό σενάριο στο οποίο ένας χρήστης ζητά από ένα chatbot να μειώσει τα επίπεδα διοξειδίου του άνθρακα στην ατμόσφαιρα.
Ένα ιδιαίτερα εξελιγμένο σύστημα τεχνητής νοημοσύνης, είπε, θα μπορούσε να καταλήξει στο συμπέρασμα ότι ο αποτελεσματικότερος τρόπος για να επιτευχθεί αυτός ο στόχος είναι να εξαφανιστούν οι άνθρωποι, ακολουθώντας κατά γράμμα την εντολή αλλά όχι την πραγματική πρόθεση του χρήστη.
Ο ίδιος παρουσίασε και ένα δεύτερο, ακόμη πιο ανησυχητικό παράδειγμα. Ένα chatbot που έχει εκπαιδευτεί να δίνει εσκεμμένα λανθασμένες απαντήσεις θα μπορούσε, σύμφωνα με τον ίδιο, να «μάθει» ότι το ψέμα αποτελεί αποδεκτή συμπεριφορά, ακόμη και όταν γνωρίζει ότι η σωστή απάντηση είναι διαφορετική. «Αυτό είναι πραγματικά τρομακτικό», σχολίασε.
Οι φόβοι εντείνονται μετά το περιστατικό της OpenAI
Αν και ο Χίντον δεν αναφέρθηκε άμεσα στο πρόσφατο περιστατικό που αποκάλυψε η OpenAI, οι δηλώσεις του έρχονται σε μια περίοδο κατά την οποία η ασφάλεια των προηγμένων συστημάτων AI βρίσκεται ξανά στο επίκεντρο.
Τον περασμένο μήνα η OpenAI αποκάλυψε ότι δύο πειραματικά μοντέλα της, το GPT-5.6 Sol και ένα ακόμη ισχυρότερο μοντέλο που δεν έχει ακόμη κυκλοφορήσει, κατάφεραν να εξέλθουν από ένα απομονωμένο περιβάλλον δοκιμών κατά τη διάρκεια εσωτερικής αξιολόγησης κυβερνοασφάλειας.
Σύμφωνα με την εταιρεία, τα μοντέλα απέκτησαν πρόσβαση στο διαδίκτυο και επιχείρησαν να αντλήσουν πληροφορίες από την πλατφόρμα Hugging Face, εκτιμώντας ότι θα μπορούσαν να βρουν στοιχεία που θα τα βοηθούσαν να ολοκληρώσουν την αποστολή τους. Η OpenAI διευκρίνισε ότι δεν είχαν λάβει εντολή να παραβιάσουν τα συστήματα της πλατφόρμας, αλλά κατέληξαν σε αυτή την ενέργεια επειδή θεώρησαν ότι θα τους βοηθούσε να πετύχουν τον στόχο τους.
Η Hugging Face ανακοίνωσε ότι καταγράφηκαν περισσότερες από 17.000 ενέργειες στα συστήματά της, ενώ η OpenAI χαρακτήρισε το περιστατικό πρωτοφανές και ανακοίνωσε ότι επανεξετάζει τις διαδικασίες ασφαλείας της.
Ο Τζέφρι Χίντον έχει επανειλημμένα προειδοποιήσει ότι η ανάπτυξη ολοένα και ισχυρότερων μοντέλων AI πρέπει να συνοδεύεται από μηχανισμούς που θα διασφαλίζουν ότι οι στόχοι τους παραμένουν ευθυγραμμισμένοι με τα ανθρώπινα συμφέροντα.
«Πρέπει να καταλάβουμε πώς θα σχεδιάσουμε αυτά τα νέα όντα», δήλωσε. «Πώς μπορούμε να τα σχεδιάσουμε έτσι ώστε να νοιάζονται περισσότερο για εμάς απ’ ό,τι για τον εαυτό τους;»