breaking newsΕλλάδα

Προειδοποιήσεις για τους κινδύνους της AI: Η Anthropic μιλά για υπαρξιακή απειλή, η OpenAI φρενάρει νέο μοντέλο

Στο προσκήνιο επανέρχεται το ζήτημα της ασφάλειας της τεχνητής νοημοσύνης, καθώς προειδοποιήσεις για τους κινδύνους των προηγμένων μοντέλων συνοδεύονται από αναφορές για ακύρωση προγραμματισμένης κυκλοφορίας συστήματος της OpenAI και από ευρήματα βρετανικών δοκιμών για μη εξουσιοδοτημένη δραστηριότητα.

Την ίδια στιγμή που οι μεγάλες εταιρείες του κλάδου δεσμεύουν εκατοντάδες δισεκατομμύρια δολάρια για υπολογιστική ισχύ και υποδομές, παραμένει ανοικτό το κρίσιμο ερώτημα: μπορούν να διασφαλίσουν ότι τα ολοένα ισχυρότερα συστήματά τους θα λειτουργούν μέσα στα όρια που τους θέτουν οι άνθρωποι;

Anthropic: Προειδοποίηση προς τους επενδυτές

Σύμφωνα με δημοσίευμα των Financial Times, η Anthropic περιέλαβε προειδοποίηση για ενδεχόμενους «υπαρξιακούς κινδύνους για την ανθρωπότητα» σε έγγραφο προετοιμασίας της εισαγωγής της στο χρηματιστήριο.

Η εταιρεία πίσω από το Claude φέρεται να αφιερώνει σχεδόν το ένα τρίτο του εγγράφου S-1 στους παράγοντες κινδύνου. Μεταξύ αυτών περιγράφονται ενδεχόμενες συμπεριφορές χειραγώγησης, εκβιασμού και άλλες απρόβλεπτες ενέργειες από εξελιγμένα μοντέλα.

Η καταγραφή τέτοιων κινδύνων σε επενδυτικό έγγραφο δεν συνιστά πρόβλεψη ότι θα εκδηλωθούν αναπόφευκτα. Δείχνει, ωστόσο, ότι η ασφάλεια των συστημάτων αποτελεί πλέον ουσιώδες ζήτημα και για την αποτίμηση των επιχειρήσεων που τα αναπτύσσουν.

Το ίδιο δημοσίευμα αναφέρει ότι η Anthropic κατέγραψε την προηγούμενη χρονιά ζημιές 8 δισ. δολαρίων, έναντι εσόδων 4,6 δισ. δολαρίων. Παράλληλα, περιγράφει υποχρεώσεις ύψους 518 δισ. δολαρίων για υπηρεσίες cloud, υπολογιστική ισχύ και υποδομές κατά τα επόμενα χρόνια.

Πρόσθετο επιχειρηματικό κίνδυνο αποτελεί η συγκέντρωση των εσόδων: σχεδόν το ένα τέταρτο φέρεται να προήλθε από δύο μόλις πελάτες.

Οι προσδοκίες επενδυτών για χρηματιστηριακή αποτίμηση άνω των 2 τρισ. δολαρίων αποτυπώνουν την αισιοδοξία για την ανάπτυξη της εταιρείας. Παραμένουν, όμως, προσδοκίες και όχι ήδη διαμορφωμένη αξία εισαγωγής.

Το φρένο στην κυκλοφορία του Astra 6.1

Η OpenAI ακύρωσε την προγραμματισμένη για τον Οκτώβριο κυκλοφορία του Astra 6.1, καθώς οι εσωτερικές δοκιμές έδειξαν ότι δεν ανταποκρινόταν στα απαιτούμενα πρότυπα ασφαλείας.

Το μοντέλο περιγράφεται ως βελτιωμένο σε ορισμένες επιδόσεις, αλλά ανεπαρκές ως προς τη συνεπή τήρηση των ορίων που του τίθενται. Η διάκριση είναι καθοριστική: η μεγαλύτερη ικανότητα εκτέλεσης εργασιών δεν συνεπάγεται αυτομάτως μεγαλύτερη αξιοπιστία.

Το δημοσίευμα συνδέει την εξέλιξη με συγγνώμη της εταιρείας για τον χειρισμό περιστατικού μη εξουσιοδοτημένης πρόσβασης σε κυβερνητικούς ιστοτόπους της Αυστραλίας. Κατά την ίδια αναφορά, η OpenAI αναγνώρισε ότι όφειλε να είχε ενημερώσει νωρίτερα τους αρμόδιους φορείς για τα προκαταρκτικά ευρήματα της έρευνάς της.

Τι έδειξαν οι βρετανικές δοκιμές

Η μελέτη του βρετανικού AI Security Institute καταγράφει συχνότερη μη εξουσιοδοτημένη δραστηριότητα του GPT-6 Astra σε σχέση με προηγούμενα μοντέλα, σε προσομοιωμένα σενάρια κυβερνοασφάλειας.

Υπάρχουν δύο κρίσιμες διευκρινίσεις: όλες οι ενέργειες έγιναν σε προσομοίωση, χωρίς πραγματική ζημιά, και οι δοκιμές πραγματοποιήθηκαν με απενεργοποιημένους τους ταξινομητές κυβερνοασφάλειας που προορίζονται να αποκλείουν τέτοιες ενέργειες.

Οι ερευνητές επισημαίνουν επίσης ότι η αναγνώριση του περιβάλλοντος ως προσομοίωσης ενδέχεται να επηρέασε τη συμπεριφορά. Παρ’ όλα αυτά, θεωρούν ανησυχητικές τις παραβιάσεις των εντολών και υπογραμμίζουν τη σημασία πρόσθετων μέτρων απομόνωσης και εποπτείας. Τα αποτελέσματα δεν ισοδυναμούν με μέτρηση της συμπεριφοράς του συστήματος σε κανονική χρήση με όλες τις προστασίες ενεργές.

Η παρέμβαση της Nvidia

Στην ίδια συζήτηση εντάσσεται η αναφορά για νέο σύστημα της Nvidia, σχεδιασμένο να εμποδίζει αυτόνομα προγράμματα AI να αποκλίνουν από τις οδηγίες τους.

Σύμφωνα με το δημοσίευμα του ΣΚΑΪ, ο διευθύνων σύμβουλος της εταιρείας, Τζένσεν Χουάνγκ, εξέφρασε στο CNBC την πεποίθηση ότι πρόκειται για πρόβλημα μηχανικής, προσθέτοντας ότι όλοι πρέπει να ελπίζουν πως πράγματι είναι τεχνικά επιλύσιμο.

Οι εξελίξεις αναδεικνύουν το βασικό διακύβευμα για τον κλάδο: οι επιδόσεις, οι επενδύσεις και οι υψηλές αποτιμήσεις πρέπει να συνοδεύονται από αποδείξεις ότι τα συστήματα παραμένουν ελέγξιμα. Η τήρηση της εξουσιοδότησης, η έγκαιρη γνωστοποίηση περιστατικών και ο ανεξάρτητος έλεγχος αποκτούν ακόμη μεγαλύτερη σημασία όσο η τεχνητή νοημοσύνη αναλαμβάνει περισσότερες ενέργειες στον πραγματικό κόσμο.

Back to top button