Just before launching her new Mythos model, which allegedly has advanced programming capabilities and could be used in massive cyberattacks, American Anthropic warned that AI companies and governments must create security safeguards to remove artificial intelligence from the plug in case it becomes dangerous.
«We believe that it would be good for the world to have the possibility of slowing down or temporarily halting the development of advanced AI models, so that social structures and research on alignment can go hand in hand with the progress of technologies» AI with human values, the Calforn company said to Report by.
The possibility of stopping would be particularly important if artificial intelligence began to improve itself, which would limit the role of people in its development.
«If artificial intelligence systems are able to create entirely their next generations, then their security, supervision and mechanisms defining their behaviour will become much more critical.» says Anthropic.
However, the company acknowledges that such a cessation would require cooperation between different companies AU in many countries, particularly in the USA and China, China, to take action simultaneously and with common rules.
The need for international unanimity is a problem repeatedly posed by Anthropic CEO Dario Amondey, saying that if his company were to brake unilaterally it would risk being left behind by competition.
«Without a global coordination mechanism, companies and governments should take difficult safety decisions while under pressure from competition and geopolitical developments», writes the report.
State control
Anthropic is known for its emphasis on security issues, but has been accused by industry officials – but also by White House officials – of dangerology, which it uses as a strategic weapon to slow down its competitors under the pretext of security.
Ωστόσο η κυβέρνηση του Ντόναλντ Τραμπ, ο οποίος είχε αρχικά ταχθεί εναντίον οποιουδήποτε ρυθμιστικού ελέγχου για τη βιομηχανία ΑΙ, δείχνει τώρα να αλλάζει στάση. Αυτή την εβδομάδα, ο Τραμπ υπέγραψε εκτελεστικό διάταγμα που δίνει στην κυβέρνηση περιθώριο 30 ημερών να ελέγχει τα ισχυρότερα μοντέλα ΑΙ πριν από τη διάθεσή τους.
Αιτία της αλλαγής στάσης φαίνεται πως ήταν το Claude Mythos της Anthropic, το οποίο σύμφωνα με την εταιρεία έχει ανακαλύψει «χιλιάδες» κενά ασφάλειας σε όλα τα γνωστά λειτουργικά συστήματα και θα μπορούσε να χρησιμοποιηθεί για κυβερνοεπιθέσεις, για παράδειγμα εναντίον τραπεζών.
Η εταιρεία αποφάσισε να παγώσει τη δημόσια διάθεσή του και να προσφέρει πρόσβαση μόνο σε μια ομάδα κυβερνητικών υπηρεσιών και οργανισμών, προκειμένου να τους δώσει την ευκαιρία να προετοιμαστούν.
H δημόσια διάθεση του Mythos προγραμματίζεται τώρα για τις επόμενες εβδομάδες.

Η Anthropic ζητά δημόσιο διάλογο για το μέλλον της τεχνητής νοημοσύνης (Reuters)
Η πρόταση της Anthropic αναπόφευκτα θα συναντήσει αντιδράσεις, καθώς πολλοί αμερικανοί αξιωματούχοι και στελέχη της βιομηχανίας επιμένουν ότι η Κίνα θα αποκτήσει προβάδισμα αν οι ΗΠΑ πατήσουν φρένο στην ανάπτυξη της ΑΙ.
Παρόλα αυτά, ο Ντόναλντ Τραμπ δήλωσε ότι συζήτησε το ενδεχόμενο συνεργασίας με την Κίνα για την ασφάλεια της ΑΙ κατά την πρόσφατη επίσκεψή του στο Πεκίνο.
Αυτοβελτίωση
Η Anthropic ανησυχεί περισσότερο για αυτό που ονομάζει «αναδρομική αυτοβελτίωση» (recursive self improvement), δηλαδή τη δυνατότητα των μοντέλων ΑΙ να βελτιώνουν τον εαυτό τους σε έναν επαναλαμβανόμενο κύκλο που οδηγεί σε όλο και ισχυρότερα συστήματα.
«Δεν βρισκόμαστε ακόμη σε αυτό το στάδιο και η αναδρομική αυτοβελτίωση δεν είναι αναπόφευκτη», γράφει στην έκθεση της Anthropic, η οποία ωστόσο προειδοποιεί ότι η δυνατότητα αυτή μπορεί να φτάσει νωρίτερα από ό,τι πιστεύουν οι κυβερνήσεις και οι θεσμοί.
«Τα διαθέσιμα στοιχεία δείχνουν ότι ο ανθρώπινος ρόλος συρρικνώνεται σε κάθε στάδιο της διαδικασίας ανάπτυξης της τεχνητής νοημοσύνης», ανέφερε η εταιρεία.
Το ερευνητικό της σκέλος, Anthropic Institute, σχεδιάζει τώρα να αναπτύξει τις δικλείδες ασφάλειας που θα επέτρεπαν μια εσκεμμένη επιβράδυνση.
Τους επόμενους μήνες η εταιρεία σχεδιάζει συζητήσεις με τη συμμετοχή πολιτικών, ερευνητών, φορέων της κοινωνίας των πολιτών και άλλων εταιρειών ΑΙ.

