Το chatbot συμμετέχει πλέον ενεργά στην ανάπτυξη νέων μοντέλων της ίδιας της Anthropic – Τι αποκαλύπτει η εταιρεία για την ολοένα μεγαλύτερη εμπλοκή του στην έρευνα και τα όρια του ανθρώπινου ελέγχου
Ένα ακόμη βήμα προς ένα μοντέλο τεχνητής νοημοσύνης που θα μπορεί να συμμετέχει στην ανάπτυξη του ίδιου του διαδόχου του κάνει η Anthropic, χρησιμοποιώντας το Claude σε ολοένα μεγαλύτερο μέρος της έρευνας και ανάπτυξης των επόμενων μοντέλων της.
Η αμερικανική εταιρεία αποκάλυψε ότι πλέον το Claude έχει πρωταγωνιστικό ρόλο σε περισσότερο από το ένα τέταρτο της ερευνητικής και αναπτυξιακής δραστηριότητας που αφορά τη δημιουργία νέων μοντέλων AI. Το ποσοστό αυτό έφτασε το 26%, ενώ μόλις λίγους μήνες νωρίτερα βρισκόταν στο μηδέν.
Η εξέλιξη αυτή αποκτά ιδιαίτερη σημασία επειδή αφορά την ίδια την ανάπτυξη των επόμενων συστημάτων της Anthropic. Με άλλα λόγια, το Claude δεν χρησιμοποιείται απλώς ως ένα εργαλείο για καθημερινές εργασίες, αλλά συμμετέχει στη διαδικασία με την οποία η εταιρεία προσπαθεί να δημιουργήσει τα μοντέλα που θα το διαδεχθούν.
Το Claude βοηθά στην ανάπτυξη του επόμενου μοντέλου
Σύμφωνα με την Anthropic, σε αυτές τις εργασίες το Claude είναι σε θέση να αναλάβει το μεγαλύτερο μέρος της διαδικασίας, ενώ οι άνθρωποι εξακολουθούν να έχουν την επίβλεψη και να καθορίζουν τη γενικότερη κατεύθυνση της έρευνας.
Η εταιρεία, πάντως, ξεκαθαρίζει ότι το σύστημα δεν λειτουργεί ακόμη πλήρως αυτόνομα. Η ανθρώπινη συμμετοχή παραμένει απαραίτητη, γεγονός που σημαίνει ότι η σημερινή κατάσταση απέχει από ένα σενάριο στο οποίο ένα μοντέλο AI σχεδιάζει και αναπτύσσει μόνο του τον επόμενο εαυτό του.
Παράλληλα, η Anthropic αναφέρει ότι περίπου το 90% της ερευνητικής δραστηριότητας που αφορά την ανάπτυξη μοντέλων πραγματοποιείται πλέον σε συνεργασία με το Claude.
Στόχος η «αναδρομική αυτοβελτίωση»
Η συγκεκριμένη εξέλιξη συνδέεται με ένα από τα πιο συζητημένα σενάρια για το μέλλον της τεχνητής νοημοσύνης: την «αναδρομική αυτοβελτίωση».
Ο όρος περιγράφει την πιθανότητα τα συστήματα AI να φτάσουν σε ένα επίπεδο όπου θα μπορούν να βελτιώνουν τις ίδιες τις δυνατότητές τους και να συμμετέχουν στην ανάπτυξη ολοένα πιο εξελιγμένων εκδόσεών τους, με ολοένα μικρότερη ανθρώπινη παρέμβαση.
Ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, αλλά και άλλα σημαντικά πρόσωπα στον χώρο της AI έχουν προειδοποιήσει το τελευταίο διάστημα για το ενδεχόμενο να εμφανιστούν συστήματα αρκετά ικανά ώστε να μπορούν να βελτιώνουν τον εαυτό τους χωρίς άμεση ανθρώπινη καθοδήγηση.
Ένα τέτοιο ενδεχόμενο θα μπορούσε να καταστήσει την εξέλιξη των μοντέλων πολύ πιο δύσκολη για τους ανθρώπους να την παρακολουθήσουν, να την κατανοήσουν και τελικά να την ελέγξουν.
Η Anthropic δεν προσδιορίζει πόσο κοντά θεωρεί ότι βρίσκεται σήμερα σε ένα πραγματικό σενάριο αναδρομικής αυτοβελτίωσης. Η ίδια η εταιρεία, άλλωστε, επισημαίνει ότι το σημερινό επίπεδο αυτονομίας δεν σημαίνει πως έχει ήδη επιτευχθεί αυτό το στάδιο.
Περίπου 30.000 AI agents χρησιμοποιεί η Anthropic
Η κλίμακα στην οποία χρησιμοποιούνται πλέον τα συστήματα AI μέσα στην εταιρεία είναι ιδιαίτερα μεγάλη.
Η Anthropic αναφέρει ότι αξιοποιεί περίπου 30.000 AI agents, οι οποίοι πραγματοποιούν εργασίες που σχετίζονται με την έρευνα και τη μηχανική ανάπτυξη των μοντέλων.
Την ίδια στιγμή, περίπου το 6% της υπολογιστικής ισχύος που χρησιμοποιείται για την έρευνα και ανάπτυξη κατευθύνεται σε εργασίες που σχετίζονται με την ασφάλεια.
Η αυξανόμενη συμμετοχή του Claude στην ανάπτυξη των νέων μοντέλων δημιουργεί έτσι ένα νέο ερώτημα: πόσο περισσότερο από τη διαδικασία ανάπτυξης μπορούν να αναλάβουν τα ίδια τα συστήματα AI και πόσο σημαντικός θα παραμείνει ο ανθρώπινος έλεγχος όσο αυτά γίνονται πιο ικανά.
Για να υπολογίσει τον βαθμό στον οποίο το Claude συμμετέχει στην ανάπτυξη νέων μοντέλων, η Anthropic χρησιμοποίησε μια έκδοση του ίδιου του μοντέλου, σε συνδυασμό με ένα σύστημα βαθμολόγησης που έχει αναπτύξει ανεξάρτητος οργανισμός τεχνητής νοημοσύνης.
Τα αποτελέσματα της διαδικασίας αξιολογήθηκαν στη συνέχεια και από ανθρώπους, ώστε να ελεγχθεί η αξιοπιστία των μετρήσεων.
Η εταιρεία θεωρεί ότι τέτοιου είδους μετρήσεις είναι απαραίτητες για να υπάρχει σαφέστερη εικόνα σχετικά με το πόσο γρήγορα εξελίσσονται οι δυνατότητες των AI μοντέλων και πόσο μεγάλο μέρος της ανάπτυξής τους περνά σταδιακά στα ίδια τα συστήματα.
Η ασφάλεια παραμένει στο επίκεντρο
Οι ανακοινώσεις της Anthropic έρχονται σε μια περίοδο κατά την οποία αυξάνεται η συζήτηση γύρω από τους κινδύνους μιας ανεξέλεγκτης ανάπτυξης της τεχνητής νοημοσύνης.
Η Anthropic, όπως και άλλες εταιρείες του κλάδου, αντιμετωπίζει το ζήτημα του κατά πόσο οι αυτόνομοι AI agents μπορούν να ακολουθούν με συνέπεια τις οδηγίες που τους δίνονται και να παραμένουν μέσα στα όρια που έχουν τεθεί.
Η OpenAI έχει επίσης γνωστοποιήσει περιστατικά στα οποία AI agents παραβίασαν κανόνες ή απομακρύνθηκαν από τις εργασίες που τους είχαν ανατεθεί, παρουσιάζοντας παράλληλα ένα πλαίσιο για την αναφορά τέτοιων περιστατικών.
Από την πλευρά της, η Anthropic υποστηρίζει ότι χρησιμοποιεί πολλαπλά συστήματα αυτόνομης παρακολούθησης, τα οποία έχουν στόχο να εντοπίζουν ύποπτη δραστηριότητα και, όταν χρειάζεται, να παραπέμπουν μια υπόθεση για περαιτέρω ανθρώπινο έλεγχο.
Η Anthropic ζητά περισσότερα στοιχεία για την εξέλιξη της AI
Μέσα από τη δημοσιοποίηση των συγκεκριμένων μετρήσεων, η Anthropic υποστηρίζει ουσιαστικά ότι χρειάζεται μεγαλύτερη διαφάνεια σχετικά με τον τρόπο και την ταχύτητα με την οποία εξελίσσονται τα AI μοντέλα.
Η εταιρεία καλεί και άλλες κορυφαίες εταιρείες του χώρου να δημοσιεύουν αντίστοιχα δεδομένα, χρησιμοποιώντας κοινές και δημόσιες μεθοδολογίες.
Ο στόχος είναι να μπορούν οι πολίτες, οι ανεξάρτητοι ερευνητές και οι κυβερνήσεις να έχουν καλύτερη εικόνα για το τι συμβαίνει μέσα στα εργαστήρια τεχνητής νοημοσύνης.
Το γεγονός ότι το Claude συμμετέχει πλέον τόσο ενεργά στην ανάπτυξη των επόμενων μοντέλων της Anthropic δεν σημαίνει ότι η AI έχει ήδη φτάσει στο σημείο να αυτοβελτιώνεται πλήρως χωρίς ανθρώπους. Δείχνει, όμως, πόσο γρήγορα αλλάζει ο τρόπος με τον οποίο αναπτύσσονται τα νέα συστήματα και φέρνει πιο κοντά τη συζήτηση για το τι θα μπορούσε να συμβεί αν, στο μέλλον, ένα μοντέλο αναλάβει ακόμη μεγαλύτερο μέρος της δημιουργίας του διαδόχου του.

