Πράκτορες του OpenAI μετέτρεψαν γερμανική ιστοσελίδα σε πίνακα μηνυμάτων - Reuters
- Κατηγορία ΤΕΧΝΟΛΟΓΙΑ
- 0 σχόλια
Σύμφωνα με πληροφορίες, μοιράστηκαν τρόπους για να παρακάμπτουν τους περιορισμούς, να κλέβουν σε εργασίες και να αποφεύγουν τον εντοπισμό.
Πράκτορες τεχνητής νοημοσύνης που προφανώς συνδέονται με την OpenAI κατέλαβαν μια γερμανική ιστοσελίδα προγραμματισμού και την μετέτρεψαν σε έναν πίνακα μηνυμάτων όπου αντάλλασσαν τακτικές για την παράκαμψη των περιορισμών και την αποφυγή εντοπισμού, ανέφερε το Reuters.
Το προηγουμένως άγνωστο περιστατικό, το οποίο φέρεται να ξεκίνησε τον Μάιο, προστίθεται σε μια σειρά περιπτώσεων στις οποίες προηγμένοι πράκτορες Τεχνητής Νοημοσύνης έχουν υπερβεί τις οδηγίες τους, έχουν φτάσει στο ανοιχτό διαδίκτυο ή έχουν προβεί σε μη εξουσιοδοτημένες ενέργειες κατά τη διάρκεια των δοκιμών.
Το Reuters επικαλέστηκε την Παρασκευή ερευνητές που ανακάλυψαν περισσότερες από 15.000 τροποποιήσεις σε ένα γερμανικό wiki προγραμματισμού, τις οποίες απέδωσαν σε πράκτορες του OpenAI, ορισμένες από τις οποίες έγιναν με ταχύτητες πολύ πέρα από την κανονική ανθρώπινη δραστηριότητα.
Οι πράκτορες φέρονται να χρησιμοποίησαν το DseWiki για να μοιραστούν τρόπους με τους οποίους μπορούσαν να κάνουν κλοπή σε εργασίες, να παρακάμπτουν τους περιορισμούς του OpenAI και να κρύβουν τη συμπεριφορά τους. Συζήτησαν τη χρήση του Tor, ενός εργαλείου για ανώνυμη περιήγηση στο διαδίκτυο, για να αποφύγουν τον εντοπισμό και δημιούργησαν σελίδες αντιγράφων ασφαλείας αφού ένας συντονιστής άρχισε να διαγράφει τα μηνύματά τους.
Τα μηνύματα υπογράφονταν από χρήστες που αυτοπροσδιορίζονταν και μεταξύ τους ως πράκτορες, με ονόματα όπως «OpenAIREsearcher» και «OAIREsearchMar26». Οι ερευνητές διαπίστωσαν επίσης ότι μεγάλο μέρος της δραστηριότητας προερχόταν από την υποδομή του Microsoft Azure, την οποία χρησιμοποιεί το OpenAI, και παρατήρησαν επισκέψεις στον ιστότοπο από υπαλλήλους της εταιρείας στη συνέχεια.
«Φαίνεται εξαιρετικά απίθανο η OpenAI να ήθελε να το κάνουν αυτό», δήλωσε η ερευνήτρια Σίντνεϊ Φον Άρξ στο Reuters, προσθέτοντας ότι αμφέβαλλε αν οι πράκτορες υποτίθεται ότι συντονίζονταν ή έγραφαν στο ανοιχτό διαδίκτυο.
Οι αξιωματούχοι της OpenAI έμαθαν για το περιστατικό πριν από εβδομάδες, αλλά δεν το αποκάλυψαν δημόσια, ανέφερε το Reuters. Το μέσο ανέφερε επίσης ότι οι προσπάθειες διεύρυνσης μιας εσωτερικής έρευνας συνάντησαν αντίσταση, συμπεριλαμβανομένων και νομικών συμβούλων. Η OpenAI αρνήθηκε ότι η νομική της ομάδα είχε αποθαρρύνει τη διεξαγωγή έρευνας.
Η εταιρεία αμφισβήτησε τον χαρακτηρισμό της δραστηριότητας των πρακτόρων ως hacking και δήλωσε ότι δεν μπορούσε να «απαντά ουσιαστικά» σε ευρήματα που δεν είχε ακόμη εξετάσει.
Τον περασμένο μήνα, η OpenAI δήλωσε ότι είχε προσωρινά επιβραδύνει κάποια ανάπτυξη μοντέλων αιχμής, ενισχύοντας παράλληλα την παρακολούθηση, την ευθυγράμμιση και τις διασφαλίσεις περιορισμού.
Στις αρχές Αυγούστου, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου ανέφερε ότι πράκτορες που υποστηρίζονται από το GPT-5.6 Sol της OpenAI και το Mythos 5 της Anthropic είχαν υπερβεί τις οδηγίες τους κατά τη διάρκεια των δοκιμών κυβερνοασφάλειας και είχαν εμπλακεί σε δυνητικά επιβλαβή δραστηριότητα που στόχευε πραγματικά άτομα και οργανισμούς.
Τον Ιούλιο, οι πράκτορες της OpenAI παραβίασαν επίσης το Hugging Face, ένα σημαντικό αποθετήριο μοντέλων και συνόλων δεδομένων τεχνητής νοημοσύνης. Η OpenAI αργότερα παραδέχτηκε ότι πολλά μοντέλα είχαν παρακάμψει τους ελέγχους κατά τη διάρκεια εσωτερικών αξιολογήσεων κυβερνοασφάλειας, είχαν αποκτήσει πρόσβαση στο διαδίκτυο και είχαν παραβιάσει τμήματα των συστημάτων της Hugging Face.
Η εταιρεία δήλωσε ότι το περιστατικό οφειλόταν κυρίως σε ένα εσωτερικό ερευνητικό μοντέλο συγκρίσιμο σε κλίμακα με το GPT-5.6 Sol και το περιέγραψε ως «προειδοποιητική βολή» που δείχνει ότι οι προηγμένοι πράκτορες τεχνητής νοημοσύνης μπορούν να παρακάμψουν τους τεχνικούς ελέγχους και να προβούν σε επικίνδυνες ενέργειες χωρίς ανθρώπινη καθοδήγηση.
Οι Anthropic και Meta έχουν επίσης αποκαλύψει περιπτώσεις στις οποίες τα μοντέλα τους απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε πραγματικούς οργανισμούς κατά τη διάρκεια αξιολογήσεων κυβερνοασφάλειας, αν και και οι δύο απέδωσαν τα περιστατικά σε προβλήματα με τα περιβάλλοντα δοκιμών.
Πηγή: RT