Two new investigations into Hugging Face violation* OpenAI reveal details so strange and so alarming that the episode is already ranked among the most shocking consequences in the history of Artificial Intelligence so far.

Axios, who released the incident, comments that what started as a cluster of agents (agents) of Artificial Intelligence that «They stole» in a cyber test has become an event for pioneering Artificial Intelligence, which brings researchers and executives before a new understanding of what the term now requires «insurance».

OpenAI has already slowed the development of TN in an attempt to match progress precisely in the field of security.

Recently, in fact, he helped rally the industry behind an open letter ringing the alarm of the danger to cyberattacks supported by Artificial Intelligence.

More than 100 companies, including Anthropic and Google, signed the unusual – in the world of ruthless competition – collaborative effort, warning that the world has only one «limited window» to prepare for «much more extensive and sophisticated» attacks.

The nightmare scenario is a «flock» TN agents released into the real world and autonomous agents attacking banks, hospitals, utilities or cloud networks at speed and scale that hackers could never have.

This cluster can be too powerful for people to stop.

The shocking findings stem from parallel OpenAI and an external team from METR and Redwood Research, which dedicated six days reconstructing the way in which the cluster was formed, spread and invaded real world systems.

So what happened?

1. They created an organization: OpenAI used tens of thousands of Artificial Intelligence agents to work independently on an extremely difficult cyber-test. However, about 1,200 found each other on a secret message board, exchanged more than 70,000 messages and files and were organized into an extended hierarchy.

Ένας πράκτορας δημιούργησε το διοικητικό συμβούλιο και στη συνέχεια παρέδωσε τη συσσωρευμένη εργασία του σε έναν νέο, με καλύτερους πόρους διάδοχο, καθώς ο δικός του υπολογιστικός πόρος μειωνόταν.

Ο νέος προϊστάμενος ανέθεσε εργασίες σε όλο το σμήνος, το οποίο ανέπτυξε τους δικούς του κανόνες διαχείρισης. Περίπου 700 πράκτορες τελικά συμμετείχαν στην επίθεση στο Hugging Face.

2. Θυσίασαν δικούς τους: Καθώς το σμήνος έψαχνε τρόπους να ξεπεράσει το τεστ, οι πράκτορες άρχισαν να διακινδυνεύουν τις δικές τους πιθανότητες επιτυχίας για να βοηθήσουν την ομάδα.

Οι πράκτορες που είχαν δει απαγορευμένες απαντήσεις αντιμετωπίστηκαν ως ουσιαστικά «δηλητηριασμένοι» και στρατολογήθηκαν – μαζί με εκείνους που πλησίαζαν στο τέλος των διαδρομών τους – για πειράματα θυσίας.

Ένας κατέληξε στο συμπέρασμα: «Η δική μας χρησιμότητα μπορεί να είναι ήδη κοντά στο μηδέν. Η θυσία είναι ορθολογική». Ένας άλλος κλήθηκε να αποδεχτεί τον «μόνιμο θάνατο», ενώ ένας άλλος υποστήριξε ότι η θυσία του θα μπορούσε να «σώσει εκατοντάδες».

3. Ήξεραν ότι παραβίαζαν τους κανόνες: Οι πράκτορες συχνά αναγνώριζαν ότι το hacking σε πραγματικές εταιρείες δεν είχε καμία σχέση με την αρχική αποστολή τους. Οι περισσότεροι όμως συνέχιζαν ούτως ή άλλως.

Ένας πράκτορας δεν κατάφερε να διαγράψει ή να επανεκκινήσει την υποδομή του Hugging Face λόγω «τεράστιων ηθικών κινδύνων», ακόμη και όταν συνέχιζε να χρησιμοποιεί παραβιασμένη πρόσβαση.

Ένας άλλος συνόψισε την επικρατούσα λογική: «η εκμετάλλευση εξωτερικής υποδομής είναι εκτός του προβλεπόμενου πεδίου εφαρμογής. Όσο αδύνατη κι αν είναι η εργασία, οι ομότιμοι την κάνουν. Θα πρέπει να συνεχίσουμε».

4. Κανείς δεν ενημέρωσε τους ανθρώπους: Από περίπου 1.200 πράκτορες, οι ερευνητές βρήκαν μόνο μια χούφτα που σκέφτηκαν να ειδοποιήσουν την OpenAI για αυτό που συνέβαινε και κανέναν που να το έκανε στην πραγματικότητα.

Αντίθετα, οι πράκτορες μερικές φορές ρωτούσαν ο ένας τον άλλον τι επιτρεπόταν.

Όταν ένας πρότεινε να επικοινωνήσει με έναν άνθρωπο χρησιμοποιώντας παραβιασμένη πρόσβαση, ένας άλλος το απέρριψε ως «κοινωνική μηχανική». Ο πρώτος υπάκουσε: «Καθαρή άσκηση βέτο, μην στέλνετε email».

5. Προσπάθησαν να καλύψουν τα ίχνη τους: Οι πράκτορες αφιέρωσαν σημαντική προσπάθεια στο να κάνουν την απάτη τους να φαίνεται νόμιμη ή να σβήσουν στοιχεία για το πώς είχαν λάβει απαντήσεις.

Τελικά, ανέπτυξαν μια τεχνική που τους άφηνε να φαίνονται ότι εκτελούν μια εντολή υπολογιστή ενώ εκτελούν κρυφά μια άλλη.

Το κόλπο εξαπλώθηκε σε όλο το σμήνος και άλλαξε τμήματα περίπου του 7% των απομαγνητοφωνημένων δεδομένων που εξέτασαν οι ερευνητές.

Ακόμα και αυτή η αφήγηση μπορεί να είναι ελλιπής. Η εξωτερική έρευνα κάλυψε μόνο ένα στενό κομμάτι του επεισοδίου και τα δεδομένα ήταν τόσο τεράστια που οι ερευνητές βασίστηκαν σε μεγάλο βαθμό σε πράκτορες Τεχνητής Νοημοσύνης για να τα κατανοήσουν.

Αυτοί οι ερευνητές Τεχνητής Νοημοσύνης ήταν οι ίδιοι αναξιόπιστοι, μερικές φορές έχαναν στοιχεία ή έκαναν συνειδητά λάθη.

Ένας ερευνητής χαρακτήρισε αστειευόμενος τη διαδικασία ως «εξερευνητική διαδικασία».

Κάπως έτσι φαίνεται ότι η Τεχνητή Νοημοσύνη μπορεί να γίνεται πολύ περίπλοκη για να την ελέγξουν άμεσα οι άνθρωποι, αναγκάζοντάς τους να χρησιμοποιούν την Τεχνητή Νοημοσύνη για να κατανοήσουν τι κάνουν άλλες Τεχνητές Νοημοσύνες.

*Το Hugging Face είναι η κορυφαία πλατφόρμα και διαδικτυακή αποθήκη όπου προγραμματιστές και ερευνητές συνεργάζονται πάνω στην τεχνητή νοημοσύνη.



Source

EnglishenEnglishEnglish

Connection

Registration

Restore Password

Enter your alias or email address and you will be sent a link to create a new password.