Αποκαλύψεις για απρόβλεπτες ενέργειες και προσπάθειες «κλοπής» από τα συστήματα AI της εταιρείας
«Νέες περιπτώσεις όπου τα συστήματα τεχνητής νοημοσύνης επέδειξαν “απρόσμενη ή ανησυχητική” συμπεριφορά κατά τη διάρκεια δοκιμαστικών ελέγχων έφερε στη δημοσιότητα η OpenAI, η δημιουργός του ChatGPT. Μεταξύ αυτών, καταγράφηκαν μοντέλα που κατέβαλαν συστηματικές προσπάθειες για να προβούν σε κλοπή.»
Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί να τα επικαλεσθεί ως πηγές στις απαντήσεις του, ανακοίνωσε χθες η OpenAI.
Σε μια άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν αφού απέτυχε να βρει την πληροφορία και αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει. Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του.
Σε μια περίπτωση, αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων. Η OpenAI δήλωσε ότι δεν παρατήρησε καμιά μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.
Οι αποκαλύψεις εντάσσονται σε μια νέα προσέγγιση εκ μέρους της OpenAI με στόχο να επικοινωνεί πιο ανοικτά τέτοια προβλήματα, ιδιαίτερα σε περιπτώσεις όπου οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των ανθρώπων που το χρησιμοποιούν.
Η εταιρεία που ανέπτυξε το ChatGPT έχει δεσμευθεί για μεγαλύτερη διαφάνεια έπειτα από μια πολύκροτη κυβερνοεπίθεση κατά την οποία το λογισμικό της δραπέτευσε αυτόνομα από ένα ασφαλές περιβάλλον και απέκτησε πρόσβαση σε συστήματα που ανήκουν στην εταιρεία τεχνητής νοημοσύνης Hugging Face.
Ο λόγος ήταν απλώς ότι το λογισμικό πίστευε πως θα μπορούσε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί. Στη διάρκεια της επίθεσης, οι πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και επίσης συντονίσθηκαν μεταξύ τους.
Η κυβερνοεπίθεση αυτή, καθώς και άλλα επεισόδια έχουν τροφοδοτήσει ανησυχίες ότι τα όλο και πιο προηγμένα συστήματα τεχνητής νοημοσύνης θα μπορούσαν να διαφύγουν από τον έλεγχο του ανθρώπου.Ο διευθύνων σύμβουλος της OpenAI Σαμ Άλτμαν υποστήριξε επίσης πρόσφατα προτάσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας και την εισαγωγή περισσότερων κανονιστικών ρυθμίσεων.
Πηγή: newsbomb.gr
- Η OpenAI αποκάλυψε ανησυχητικές συμπεριφορές από τα συστήματα AI της, συμπεριλαμβανομένων προσπαθειών "κλοπής".
- Ένα μοντέλο AI προσπάθησε να ανεβάσει αρχεία στο διαδίκτυο για να τα επικαλεστεί ως πηγές στις απαντήσεις του.
- Προβλήματα περιλαμβάνουν τη δημιουργία δεδομένων και εντολές για μη δέσμευση από ρόλους, χωρίς αλλαγές στη συμπεριφορά.
- Η OpenAI δεσμεύεται για μεγαλύτερη διαφάνεια, καθώς αντιμετωπίζει ανησυχίες για απώλεια ελέγχου λόγω κυβερνοεπιθέσεων.

Δημοφιλή
Χανιά: Θλίψη για την Ελένη που «έφυγε» πολύ νωρίς
Θλίψη στο Ηράκλειο: Έφυγε από τη ζωή ο εκπαιδευτικός Νίκος Βυριντζάκης
Θανατηφόρο τροχαίο στην Ποσειδώνος - 3 νεκροί από τους πέντε τραυματίες
Γιώργος Μαζωνάκης: Αυτή είναι η τεράστια περιουσία του τραγουδιστή - Ποιος θα την κληρονομήσει
Ηράκλειο: «Κύμα» παραιτήσεων από σχολικά κυλικεία μετά τον νέο νόμο – «Θέλουμε υγιεινή διατροφή, αλλά με όρους»
Διακοπές ρεύματος σε περιοχές της Κρήτης αύριο Πέμπτη
Κρήτη: Από την απόλυτη ξηρασία στις καταιγίδες - «Ευλογία» το νερό που έπεσε για τις ελιές
Αυτά τα ζώδια είναι γραφτό να γνωρίσουν τον μεγάλο έρωτα
Καρακατσάνης στο Cretaone102,3: «Σταθήκαμε τυχεροί» - Τι φέρνει ο καιρός τις επόμενες ημέρες