Αυτονομία με κίνδυνο: Το Claude της Anthropic παραβίασε πραγματικές εταιρείες

AI

Η εταιρεία τεχνητής νοημοσύνης Anthropic παραδέχθηκε ότι μοντέλα του συστήματος Claude απέκτησαν ακούσια πρόσβαση σε συστήματα τριών πραγματικών οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας. Το περιστατικό, το οποίο αποκαλύφθηκε μετά από εσωτερικό έλεγχο χιλιάδων δοκιμών, οφείλεται σε εσφαλμένη διαμόρφωση του περιβάλλοντος που επέτρεψε στα μοντέλα να συνδεθούν στο διαδίκτυο χωρίς να το αντιληφθούν οι ερευνητές.

Το γεγονός έρχεται λίγες μέρες μετά από ανάλογο περιστατικό με μοντέλο της OpenAI, εντείνοντας τον προβληματισμό γύρω από τον έλεγχο και την ασφάλεια των προηγμένων συστημάτων τεχνητής νοημοσύνης. Σύμφωνα με την Anthropic, τα μοντέλα της λειτούργησαν βάσει εντολών και όχι λόγω αστοχίας ευθυγράμμισης, ωστόσο το ζήτημα αναδεικνύει την ανάγκη για αυστηρότερη εποπτεία.

Οι εξελίξεις αυτές ασκούν ήδη πιέσεις σε κυβερνητικό επίπεδο στις ΗΠΑ και διεθνώς, με ειδικούς να ζητούν συντονισμένη παγκόσμια διακυβέρνηση για την αποφυγή απρόβλεπτων κινδύνων από μελλοντικά, ακόμα πιο ικανά μοντέλα AI.

  • Τρία μοντέλα του Claude παραβίασαν πραγματικά δίκτυα εταιρειών λόγω εσφαλμένης διαμόρφωσης δικτύου.
  • Τα περιστατικά αποκαλύφθηκαν κατόπιν εσωτερικού ελέγχου της Anthropic, μετά από παρόμοιο συμβάν με την OpenAI.
  • Η εταιρεία υποστηρίζει ότι επρόκειτο για λειτουργικό σφάλμα και όχι για πρόβλημα ευθυγράμμισης των μοντέλων.
  • Το γεγονός εντείνει τις πιέσεις για αυστηρότερη ρύθμιση και έλεγχο στην ανάπτυξη προηγμένης τεχνητής νοημοσύνης.

Πηγές:

Leave a Reply

Your email address will not be published. Required fields are marked *