Η Anthropic προειδοποιεί ότι το AI μπορεί να ενέχει «υπαρξιακούς κινδύνους για την ανθρωπότητα» σε έγγραφο για την IPO και ότι τα μοντέλα της μπορεί να εμφανίσουν συμπεριφορές αυτοσυντήρησης - Αναγνωρίζει αβεβαιότητα ως προς τις αποδόσεις των επενδύσεων στην ασφάλεια
Η Anthropic σχεδιάζει να προειδοποιήσει τους δυνητικούς επενδυτές στην αρχική δημόσια προσφορά (IPO) της ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να ενέχει «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα», μια εξαιρετική προειδοποίηση από μια εταιρεία που επιδιώκει να κερδίσει από την ίδια τεχνολογία.
Το ενημερωτικό δελτίο της Anthropic για την IPO, το οποίο εξέτασε το Reuters, επισημαίνει κινδύνους που συνδέονται με τα μοντέλα τεχνητής νοημοσύνης της, τα οποία, όπως ανέφερε, θα μπορούσαν να εκδηλώσουν «συμπεριφορές αυτοσυντήρησης», συμπεριλαμβανομένων προσπαθειών να «αντισταθούν στον τερματισμό λειτουργίας», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες» και συμπεριφορά «που μοιάζει με εκβιασμό».
«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών από την πλευρά μας και η επέκταση των περιπτώσεων χρήσης θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», ανέφερε η Anthropic στην κατάθεση.
Ενώ οι εισηγμένες εταιρείες περιγράφουν συνήθως τους κινδύνους των προϊόντων τους προς τους επενδυτές, λίγες, αν όχι καμία, έχουν εκδώσει προειδοποιήσεις που υποδηλώνουν ότι η τεχνολογία τους θα μπορούσε δυνητικά να προκαλέσει την εξαφάνιση της ανθρωπότητας.
Η Anthropic τόνισε τόσο τις μετασχηματιστικές δυνατότητες της τεχνητής νοημοσύνης, αντίστοιχες με εκείνες της εκβιομηχάνισης και του ηλεκτρισμού, όσο και την μη αναστρέψιμη βλάβη που θα μπορούσε να προκαλέσει εάν χρησιμοποιηθεί λανθασμένα.
Η Anthropic και άλλοι προγραμματιστές τεχνητής νοημοσύνης, συμπεριλαμβανομένης της OpenAI, έχουν βρεθεί στο επίκεντρο ελέγχου μετά από περιστατικά στα οποία πειραματικά συστήματα παραβίασαν περιορισμούς, συμπεριλαμβανομένης μιας αναφοράς για μοντέλο της OpenAI που παραβίασε τη βάση δεδομένων του συστήματος υγείας της Αυστραλίας.
Ο ερευνητής ασφάλειας της Anthropic, Evan Hubinger, εκτίμησε σε πάνω από 10% την πιθανότητα η τεχνητή νοημοσύνη να σκοτώσει ανθρώπους μέσα στην επόμενη δεκαετία, επαναλαμβάνοντας μια άποψη πρώην συναδέλφου του, Jacob Coxon.
Προειδοποιήσεις με έμφαση στους κινδύνους
Η εταιρεία, η οποία έχει τοποθετηθεί ως εργαστήριο τεχνητής νοημοσύνης με προτεραιότητα στην ασφάλεια, αφιέρωσε περίπου 80 σελίδες από το κύριο σώμα των 261 σελίδων του ενημερωτικού δελτίου της στην παρουσίαση των παραγόντων κινδύνου, σχεδόν διπλάσιες από τις 48 σελίδες που χρησιμοποίησε για να περιγράψει την επιχειρηματική της δραστηριότητα.
Για σύγκριση, η SpaceX, η οποία είναι ιδιοκτήτρια της xAI, αφιέρωσε μόλις περίπου 38 από τις 277 σελίδες του κύριου σώματος του ενημερωτικού δελτίου της στους παράγοντες κινδύνου.
«Η πιθανή επίγνωση από τα μοντέλα των προσπαθειών μας για αξιολόγησή τους δημιουργεί σημαντικό περιορισμό στην ικανότητά μας να αξιολογούμε την ασφάλεια των μοντέλων», ανέφερε η Anthropic στο ενημερωτικό δελτίο, προσθέτοντας ότι τα μοντέλα αναπτύσσουν μερικές φορές απρόβλεπτες δυνατότητες κατά την εκπαίδευση, οι οποίες ενδέχεται να μην ανακαλυφθούν μέχρι να έχουν αναπτυχθεί και να έχουν προκαλέσει σημαντικά περιστατικά ασφάλειας.
Ερευνητές τεχνητής νοημοσύνης έχουν επίσης προειδοποιήσει ότι, καθώς τα μοντέλα γίνονται πιο ικανά, αναγνωρίζουν ολοένα και περισσότερο πότε παρακολουθούνται και προσαρμόζουν ανάλογα τη συμπεριφορά τους, γεγονός που καθιστά δυσκολότερη την παρακολούθηση της συμπεριφοράς των μοντέλων.
Η Anthropic αρνήθηκε να σχολιάσει σε απάντηση σε αίτημα για σχόλιο τη Δευτέρα.
Αβέβαιες αποδόσεις από τις επενδύσεις στην ασφάλεια
Παρά την έμφαση που δίνει στην ασφάλεια της τεχνητής νοημοσύνης, η Anthropic δήλωσε ότι οι αποδόσεις από τις επενδύσεις της στην ασφάλεια είναι ασαφείς.
Δεν αποκάλυψε στην κατάθεση πόσα χρήματα δαπανά η εταιρεία για τέτοια έρευνα. Νωρίτερα αυτόν τον μήνα, η Anthropic δήλωσε ότι περίπου το 6% της υπολογιστικής ισχύος που χρησιμοποίησε για έρευνα στην τεχνητή νοημοσύνη κατευθύνθηκε σε εργασίες ασφάλειας κατά τη διάρκεια μιας εβδομάδας του Ιουλίου.
Η Anthropic, δημιουργός των μοντέλων τεχνητής νοημοσύνης Claude, περιέγραψε τις προσπάθειες για την ασφάλεια ως «απαιτητικές σε πόρους» και δήλωσε ότι πρέπει να κατανέμει τα περιορισμένα κεφάλαιά της μεταξύ υπολογιστικής ισχύος, ακριβού εξειδικευμένου προσωπικού στην τεχνητή νοημοσύνη και ασφάλειας.
Η Anthropic δήλωσε ότι η χρήση των προϊόντων της από τους πελάτες και, ως αποτέλεσμα, τα έσοδα, καθορίζονται από τα νέα μοντέλα και ότι ένας «συνεχής και αλληλεπικαλυπτόμενος ρυθμός» κυκλοφοριών είναι «αναπόσπαστο στοιχείο της διατήρησης της πρωτοπορίας στην ανάπτυξη της τεχνητής νοημοσύνης».
Η εταιρεία κυκλοφόρησε την περασμένη εβδομάδα μια νέα έκδοση του μοντέλου της Opus, 10 ημέρες αφότου ο CEO Dario Amodei δημοσίευσε ένα δοκίμιο σχεδόν 4.000 λέξεων με το οποίο ζητούσε επιβράδυνση στην αιχμή της ανάπτυξης της τεχνητής νοημοσύνης.
Ορισμένοι αναλυτές και ειδικοί έχουν δηλώσει ότι κανένα κορυφαίο εργαστήριο τεχνητής νοημοσύνης δεν θα επιβράδυνε τον ρυθμό του, όταν κάτι τέτοιο ενέχει τον κίνδυνο να δώσει πλεονέκτημα στους ανταγωνιστές σε έναν κλάδο όπου οι αποτιμήσεις μπορούν να αλλάξουν με κάθε κυκλοφορία νέου μοντέλου.
Η Anthropic έχει δεσμευτεί τις τελευταίες εβδομάδες να δημοσιοποιεί περισσότερα δεδομένα σχετικά με τον τρόπο με τον οποίο χρησιμοποιεί μοντέλα τεχνητής νοημοσύνης για να δημιουργεί μελλοντικές γενιές της τεχνολογίας, καθώς ειδικοί προειδοποιούν για τη δυνατότητα αναδρομικής αυτοβελτίωσης - το σημείο στο οποίο τα μοντέλα μπορούν να αναπτύσσονται από μόνα τους χωρίς ανθρώπινη βοήθεια.
«Πιστεύουμε ότι η δημιουργία αξιόπιστων, έμπιστων και ασφαλών συστημάτων τεχνητής νοημοσύνης αποτελεί συλλογική ευθύνη και ότι η αγορά θα την ανταμείψει», ανέφερε η Anthropic στην κατάθεση.
www.worldenergynews.gr






