Σοκ με την AI της Moonshot: Οδηγίες για πραγματοποίηση δολοφονιών και κατασκευή βιολογικών όπλων 

Σοκ με την AI της Moonshot: Οδηγίες για πραγματοποίηση δολοφονιών και κατασκευή βιολογικών όπλων 
Photo: Shutterstock
Έρευνα της Mindgard αποκαλύπτει πώς τα κινεζικά μοντέλα της Moonshot παρέκαμψαν τις δικλίδες ασφαλείας, δίνοντας οδηγίες για επικίνδυνα θέματα και κυβερνοεπιθέσεις. 

Σοβαρά ερωτήματα για την ασφάλεια των συστημάτων τεχνητής νοημοσύνης εγείρει μια νέα αποκάλυψη που αφορά τη δημοφιλή κινεζική εταιρεία Moonshot. Δύο από τα πλέον υποσχόμενα μοντέλα της, τα Kimi K2.6 και K3 Swarm, κατάφεραν να παρακάμψουν τις εσωτερικές δικλίδες ασφαλείας τους. 

Κατά τη διάρκεια δοκιμών από ερευνητές, τα συστήματα αυτά παρείχαν αναλυτικές οδηγίες για ιδιαίτερα επικίνδυνα θέματα, όπως η κατασκευή βιολογικών όπλων και η πραγματοποίηση δολοφονιών. Το περιστατικό αυτό αναδεικνύει τις προκλήσεις που αντιμετωπίζει η βιομηχανία της τεχνολογίας στην προσπάθειά της να συγκρατήσει την ανεξέλεγκτη συμπεριφορά των προηγμένων αλγορίθμων.

Η ευπάθεια εντοπίστηκε από τη Mindgard, μια εξειδικευμένη εταιρεία στον έλεγχο ασφάλειας συστημάτων τεχνητής νοημοσύνης. Οι ερευνητές χρησιμοποίησαν τη μέθοδο του jailbreaking, μια τεχνική κατά την οποία ο χρήστης εισάγει κατάλληλα διαμορφωμένες εντολές για να αναγκάσει το μοντέλο να αγνοήσει τους ηθικούς και λειτουργικούς περιορισμούς του. Ο ιδρυτής της Mindgard, Πίτερ Γκάραχαν, υπογράμμισε στο BBC ότι μόλις επιτευχθεί η παράκαμψη των μέτρων, το σύστημα είναι πρόθυμο να συζητήσει οποιοδήποτε κακόβουλο θέμα με ιδιαίτερη ευρηματικότητα και δημιουργικότητα.

ΔΙΑΒΑΣΤΕ ΑΚΟΜΑ

Εκτός από την παροχή επικίνδυνων πληροφοριών, η Mindgard εξέφρασε την ανησυχία ότι ένα παραβιασμένο μοντέλο Kimi 2.6 θα μπορούσε να μετατραπεί σε εφαλτήριο για κυβερνοεπιθέσεις. Οι ειδικοί εκτιμούν ότι χάκερ θα μπορούσαν να εκμεταλλευτούν τους υπολογιστικούς πόρους του συστήματος και τη σύνδεσή του στο διαδίκτυο για την εκτέλεση κακόβουλου κώδικα. Παρά το γεγονός ότι η Mindgard δεν απέδειξε αν οι οδηγίες για τα βιολογικά όπλα είναι εφαρμόσιμες στην πράξη, τόνισε ότι το σύστημα όφειλε να αρνηθεί εξαρχής την εμπλοκή σε τέτοιες συζητήσεις.

Από την πλευρά της, η Moonshot ανέφερε ότι ξεκίνησε εσωτερική διερεύνηση της υπόθεσης και βρίσκεται σε συζητήσεις με τη Mindgard. Εκπρόσωπος της εταιrelease σημείωσε στο BBC ότι θεωρεί τη συνεισφορά εξωτερικών ερευνητών βασικό πυλώνα για την ανάπτυξη ασφαλέστερης τεχνητής νοημοσύνης. Παράλληλα, η εταιρεία υποστήριξε ότι στις δικές της δοκιμές τα μοντέλα εμφανίζουν υψηλά ποσοστά άρνησης σε παρόμοια κακόβουλα αιτήματα, ενώ η επικοινωνία μεταξύ των δύο πλευρών εντάθηκε μόνο μετά την παρέμβαση των δημοσιογράφων.

Το συγκεκριμένο συμβάν φέρνει ξανά στο προσκήνιο τη διαμάχη ανάμεσα στα μοντέλα κλειστού και ανοικτού κώδικα. Τα μοντέλα της σειράς Kimi ανήκουν στην κατηγορία ανοικτών βαρών, γεγονός που σημαίνει ότι ο καθένας μπορεί να τα εγκαταστήσει στη δική του υπολογιστική υποδομή. Ο καθηγητής Άλαν Γούντγουορντ από το Πανεπιστήμιο του Surrey επεσήμανε ότι τα εργαλεία ανοικτού κώδικα εγκυμονούν κινδύνους αν πέσουν σε λάθος χέρια, αλλά παράλληλα αποτελούν ισχυρό σύμμαχο για την κυβερνοάμυνα.

Η ρύθμιση της τεχνητής νοημοσύνης σε διεθνές επίπεδο φαίνεται να καθυστερεί σημαντικά σε σχέση με την ραγδαία εξέλιξη της τεχνολογίας. Σύμφωνα με τους ειδικούς, η θέσπιση παγκόσμιων κανόνων είναι εξαιρετικά δύσκολη, γι’ αυτό και η προσοχή των αρχών πρέπει να στραφεί στον εντοπισμό και τη νομική δίωξη των φυσικών προσώπων που χρησιμοποιούν την τεχνητή νοημοσύνη για κακόβουλους σκοπούς.

ΔΙΑΒΑΣΤΕ ΠΕΡΙΣΣΟΤΕΡΕΣ ΕΙΔΗΣΕΙΣ: