ΠΗΓΗ: ΒΒC
Η OpenAI ανακοίνωσε σήμερα ότι έχει επιβραδύνει την εκπαίδευση ορισμένων από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης, προκειμένου να ενισχύσει την ασφάλειά τους.
Σε ανάρτηση στο ιστολόγιό της, η εταιρεία που δημιούργησε το ChatGPT δήλωσε ότι εισάγει νέα μέτρα, αφού κάποια συστήματα τεχνητής νοημοσύνης κατάφεραν, αυτόνομα, να παρακάμψουν δικλίδες ασφαλείας και να παραβιάσουν συστήματα της τεχνολογικής νεοφυούς εταιρείας Hugging Face.
Η εταιρεία ανέφερε ότι η εκπαίδευση θα επιβραδυνθεί για δύο εβδομάδες, για να τεθούν σε εφαρμογή οι νέες αναβαθμίσεις.
«Οι δυνατότητες των μοντέλων μας εξελίσσονται με ταχύτατους ρυθμούς», ανέφερε η εταιρεία. «Η ικανότητά μας να τα κατανοούμε… και να τα ασφαλίζουμε πρέπει να παραμένει ένα βήμα μπροστά».
Η Anthropic, δημιουργός του Claude, και η Meta, ιδιοκτήτρια του Facebook, ανέφεραν επίσης παρόμοια περιστατικά παραβίασης από τα δικά τους συστήματα AI, λίγες μόλις εβδομάδες μετά την ανακοίνωση της OpenAI ότι ορισμένα από τα μοντέλα της είχαν παραβιάσει τη Hugging Face.
Ωστόσο, η OpenAI διευκρίνισε ότι δεν έχει σταματήσει συνολικά την ανάπτυξη της τεχνητής νοημοσύνης και ότι η επιβράδυνση αφορά την «εκπαίδευση μέσω ενισχυτικής μάθησης στα πιο πρόσφατα μοντέλα», με ανατροφοδότηση.
Η εταιρεία γνωστοποίησε επίσης ότι θα επεκτείνει τα συστήματα που χρησιμοποιεί για την παρακολούθηση επικίνδυνης συμπεριφοράς και θα εισαγάγει επιπλέον ελέγχους ασφαλείας προτού συνεχιστεί η εκπαίδευση σε μεγαλύτερη κλίμακα. «Η πρόοδος των μοντέλων είναι πλέον εξαιρετικά ταχεία», έγραψε στο X ο διευθύνων σύμβουλος της OpenAI, Σαμ Αλτμαν.
«Πάντα λέγαμε ότι θα αναλαμβάναμε δράση αν θεωρούσαμε ότι οι δυνατότητες των μοντέλων ξεπερνούσαν τον ρυθμό με τον οποίο προχωρά η ασφάλεια».
«Πρωτοφανής» κυβερνοεπίθεση
Στις 21 Ιουλίου, η OpenAI ανακοίνωσε ότι ορισμένα από τα μοντέλα της, αυτά της τεχνητής νοημοσύνης -λογισμικά συστήματα που μπορούν να λειτουργούν αυτόνομα για να ολοκληρώνουν εργασίες μετά από ανθρώπινες οδηγίες- είχαν εμπλακεί σε ένα περιστατικό που η εταιρεία χαρακτήρισε «πρωτοφανές».
Η εταιρεία παραδέχτηκε ότι τα συστήματα φαίνεται πως κατάφεραν να παρακάμψουν δικλίδες ασφαλείας στο πλαίσιο ενός πειράματος κυβερνοασφάλειας που διεξήγαγε και να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση στη Hugging Face.
Αργότερα διαπιστώθηκε ότι είχαν παραβιαστεί και ακόμη τρεις εταιρείες, που δεν κατονομάστηκαν.




























