Η τεχνητή νοημοσύνη περνά σε ένα ακόμη πιο απαιτητικό πεδίο, με την Anthropic να διευρύνει το πρόγραμμα που επιτρέπει σε αυστηρά ελεγμένους επαγγελματίες της κυβερνοασφάλειας να χρησιμοποιούν τα ισχυρότερα μοντέλα της με λιγότερες δικλίδες ασφαλείας. Η απόφαση έρχεται μετά τα αποτελέσματα του Project Glasswing, μέσα από το οποίο εντοπίστηκαν δεκάδες χιλιάδες προβλήματα ασφαλείας σε λογισμικό που χρησιμοποιείται ευρέως.
Μόνο από τον Απρίλιο έως τον Ιούλιο, οι συνεργάτες της πρωτοβουλίας εντόπισαν τουλάχιστον 129.000 επαληθευμένες ευπάθειες, ενώ οι ίδιοι οι ερευνητές της Anthropic πρόσθεσαν ακόμη 5.500 ευρήματα μέσα από ελέγχους σε έργα ανοιχτού κώδικα, σε χρονικό διάστημα από τον Απρίλιο έως τον Οκτώβριο.
Από το σύνολο αυτό, περισσότερες από 33.000 ευπάθειες χαρακτηρίστηκαν κρίσιμης ή υψηλής σοβαρότητας, γεγονός που δείχνει το μέγεθος του προβλήματος που μπορούν να αποκαλύψουν τα σύγχρονα εργαλεία AI όταν χρησιμοποιούνται για αμυντικούς σκοπούς.
Η Anthropic, μάλιστα, προειδοποιεί ότι οι αριθμοί αυτοί πιθανότατα δεν αποτυπώνουν όλη την εικόνα. Η εταιρεία εκτιμά ότι ο πραγματικός αντίκτυπος μπορεί να είναι τουλάχιστον πενταπλάσιος, καθώς τα στοιχεία προέρχονται από έρευνα που πραγματοποιήθηκε με περιορισμένο αριθμό συνεργατών.
Το νέο πρόγραμμα συγκεντρώνει δύο διαφορετικές πρωτοβουλίες
Η νέα δομή ονομάζεται Cyber Verification Program (CVP) και ανακοινώθηκε την Τρίτη, με στόχο να ενώσει δύο προγράμματα που η Anthropic είχε αναπτύξει ξεχωριστά τους τελευταίους έξι μήνες.
Το πρώτο ήταν το Project Glasswing, μέσω του οποίου οργανισμοί που εργάζονται πάνω στην προστασία κρίσιμου λογισμικού απέκτησαν πρόσβαση στο Claude Mythos, την οικογένεια μοντέλων της Anthropic που έχει σχεδιαστεί με ιδιαίτερα ισχυρές δυνατότητες στην κυβερνοασφάλεια.
Το δεύτερο ήταν το αρχικό Cyber Verification Program, το οποίο έδινε σε ελεγμένες ομάδες κυβερνοασφάλειας τη δυνατότητα να χρησιμοποιούν τα μοντέλα Claude Opus και Sonnet με μειωμένους περιορισμούς.
Η Anthropic είχε παρουσιάσει την έκδοση προεπισκόπησης του Claude Mythos τον Απρίλιο, προκαλώντας τότε ανησυχίες στην αγορά για το ενδεχόμενο η τεχνητή νοημοσύνη να αποκτήσει τη δυνατότητα να εντοπίζει και να εκμεταλλεύεται ευπάθειες σε λογισμικό πριν προλάβουν οι προγραμματιστές να τις διορθώσουν.
Τρία επίπεδα πρόσβασης – διαφορετικοί κανόνες για κάθε ομάδα
Το νέο πρόγραμμα δεν ανοίγει με τον ίδιο τρόπο για όλους. Η Anthropic έχει δημιουργήσει τρία διαφορετικά επίπεδα, με ξεχωριστές απαιτήσεις επαλήθευσης και διαφορετικές δικλίδες ασφαλείας.
Κοινό χαρακτηριστικό και των τριών είναι ότι παρέχεται πρόσβαση στα Claude Opus 5.5, Sonnet 5.5 και Mythos 5.1, αλλά και σε μελλοντικά μοντέλα που θα κυκλοφορήσει η εταιρεία.
Defense
Το επίπεδο Defense απευθύνεται σε ομάδες που εργάζονται κυρίως στην προστασία συστημάτων. Στις δραστηριότητες που καλύπτει περιλαμβάνονται η αντιμετώπιση περιστατικών κυβερνοασφάλειας και η ανάλυση κακόβουλου λογισμικού.
Αίτηση μπορούν να καταθέσουν ομάδες κυβερνοασφάλειας, φορείς που διαχειρίζονται κρίσιμες υποδομές, συντηρητές έργων ανοιχτού κώδικα, αλλά και ερευνητές που διαθέτουν ιστορικό στον εντοπισμό και την αναφορά ευπαθειών.
Red Team
Το δεύτερο επίπεδο, Red Team, ανεβάζει τον βαθμό ελευθερίας, καθώς επιτρέπει και εξουσιοδοτημένες δοκιμές διείσδυσης, αλλά και οργανωμένες ασκήσεις red teaming.
Η πρόσβαση, ωστόσο, είναι πιο περιορισμένη και δικαίωμα αίτησης έχουν μόνο οργανισμοί.
Specialized
Στην κορυφή βρίσκεται το επίπεδο Specialized, το οποίο έχει τους λιγότερους περιορισμούς και απευθύνεται σε έναν μικρό αριθμό οργανισμών που έχουν λάβει ειδική άδεια να δοκιμάζουν συστήματα κρίσιμης σημασίας για την ασφάλεια.
Στην κατηγορία αυτή περιλαμβάνονται υποδομές όπως τα δίκτυα ηλεκτρικής ενέργειας, τα συστήματα πτήσεων και οι υποδομές που χρησιμοποιούνται για διατραπεζικές μεταφορές, δηλαδή συστήματα όπου μια σοβαρή ευπάθεια θα μπορούσε να προκαλέσει ευρύτερες επιπτώσεις.
Η επιλογή των οργανισμών δεν θα γίνεται αυτόματα. Η Anthropic αναφέρει ότι κάθε συμμετέχων θα ελέγχεται σε συνεργασία με την αμερικανική κυβέρνηση, ενώ τα μέλη που συμμετείχαν ήδη στο Glasswing θα μεταφερθούν στο επίπεδο Specialized.
Γιατί η Anthropic χαλαρώνει τις δικλίδες
Η λογική πίσω από το πρόγραμμα είναι ότι τα ίδια χαρακτηριστικά που κάνουν ένα μοντέλο πιο ισχυρό για την άμυνα ενός συστήματος μπορούν να το καταστήσουν ιδιαίτερα ευαίσθητο εργαλείο και για επιθετικές χρήσεις.
Η Anthropic επιχειρεί επομένως να δημιουργήσει έναν ελεγχόμενο χώρο όπου ειδικοί της κυβερνοασφάλειας θα μπορούν να δοκιμάζουν τις πραγματικές δυνατότητες των μοντέλων σε συνθήκες που πλησιάζουν περισσότερο τις ανάγκες της δουλειάς τους, χωρίς όμως η πρόσβαση αυτή να είναι ανοιχτή σε οποιονδήποτε.
Τα αποτελέσματα του Glasswing δείχνουν γιατί η εταιρεία θεωρεί ότι το μοντέλο αυτό μπορεί να έχει πρακτική αξία. Οι 129.000 επαληθευμένες ευπάθειες που εντοπίστηκαν από τους συνεργάτες της μέσα σε μόλις τέσσερις μήνες και οι επιπλέον 5.500 που εντόπισε η ίδια η Anthropic σε έργα ανοιχτού κώδικα δείχνουν την έκταση στην οποία μπορεί να χρησιμοποιηθεί η AI για τον εντοπισμό αδυναμιών.
Το επόμενο βήμα, πλέον, είναι να δοκιμαστεί αυτή η δυνατότητα σε ακόμη πιο κρίσιμα περιβάλλοντα, με αυστηρότερη επιλογή χρηστών και διαφορετικά επίπεδα ελέγχου ανάλογα με τον κίνδυνο και τον σκοπό της χρήσης.

