
Η Anthropic αποκαλύπτει το νέο «Σύνταγμα» του Claude. Μάθετε πώς το Constitutional AI θέτει νέα πρότυπα ηθικής και ασφάλειας απέναντι σε OpenAI και xAI.

Σε μια κίνηση που σηματοδοτεί μια σημαντική εξέλιξη στον χώρο της τεχνολογίας, την Τετάρτη η Anthropic κυκλοφόρησε μια αναθεωρημένη και πιο ολοκληρωμένη έκδοση του Constitution (Συντάγματος) του Claude. Πρόκειται για ένα «ζωντανό» έγγραφο στρατηγικής σημασίας, το οποίο παρέχει μια «ολιστική» εξήγηση για το πλαίσιο λειτουργίας του Claude και ορίζει το είδος της ψηφιακής οντότητας που η εταιρεία επιθυμεί να διαμορφώσει για το μέλλον.
Η χρονική συγκυρία της δημοσίευσης δεν ήταν τυχαία. Έγινε παράλληλα με την εμφάνιση του CEO της Anthropic, Dario Amodei, στο Παγκόσμιο Οικονομικό Φόρουμ στο Νταβός, μια κίνηση που υπογραμμίζει τη βαρύτητα που δίνει η εταιρεία στην παγκόσμια συζήτηση για την ασφάλεια και τη ρύθμιση της AI.
Για χρόνια, η Anthropic επιδιώκει να διαφοροποιηθεί στον ανταγωνιστικό στίβο της τεχνολογίας μέσω μιας μεθόδου που ονομάζει «Constitutional AI». Σε αντίθεση με άλλα μοντέλα, το chatbot της, ο Claude, εκπαιδεύεται με βάση ένα συγκεκριμένο σύνολο ηθικών αρχών, αντί να βασίζεται αποκλειστικά στην ανθρώπινη ανατροφοδότηση που συχνά μπορεί να είναι ασαφής.
Η Anthropic παρουσίασε για πρώτη φορά αυτές τις θεμελιώδεις αρχές — το Constitution του Claude — το 2023. Η νέα, αναθεωρημένη έκδοση διατηρεί τον πυρήνα των αρχικών αξιών, αλλά προσθέτει απαραίτητες αποχρώσεις και κρίσιμες λεπτομέρειες σχετικά με την ηθική και την ασφάλεια των χρηστών, ενισχύοντας τη διαφάνεια.
Όταν το Constitution του Claude δημοσιεύτηκε αρχικά πριν από σχεδόν τρία χρόνια, ο συνιδρυτής της Anthropic, Jared Kaplan, είχε περιγράψει τη διαδικασία ως εξής:
«Ένα σύστημα AI [που] αυτο-εποπτεύεται, βασισμένο σε μια συγκεκριμένη λίστα συνταγματικών αρχών».
Σύμφωνα με την Anthropic, αυτές οι αρχές είναι που καθοδηγούν «το μοντέλο να υιοθετήσει την κανονιστική συμπεριφορά που περιγράφεται στο σύνταγμα» και, μέσω αυτής της διαδικασίας, να «αποφεύγει τοξικά ή μεροληπτικά αποτελέσματα», διασφαλίζοντας μια πιο δίκαιη αλληλεπίδραση.
Ένα αρχικό υπόμνημα πολιτικής του 2022 σημείωνε πιο άμεσα ότι το σύστημα της Anthropic λειτουργεί εκπαιδεύοντας έναν προηγμένο αλγόριθμο χρησιμοποιώντας μια λίστα οδηγιών φυσικής γλώσσας. Αυτές οι οδηγίες συνθέτουν αυτό που η Anthropic αναφέρει ως το «σύνταγμα» του λογισμικού, θέτοντας τα θεμέλια για μια ασφαλέστερη AI.
Η Anthropic έχει υιοθετήσει εδώ και καιρό μια στρατηγική τοποθέτησης ως η ηθική (και για κάποιους ίσως πιο συντηρητική) εναλλακτική λύση απέναντι σε άλλους κολοσσούς της AI — όπως η OpenAI και η xAI. Οι ανταγωνιστές αυτοί έχουν επιδιώξει πιο επιθετικά την τεχνολογική ανατροπή και συχνά δεν διστάζουν μπροστά στην αμφιλεγόμενη δημοσιότητα.
Προς αυτή την κατεύθυνση, το νέο Constitution που κυκλοφόρησε την Τετάρτη είναι πλήρως ευθυγραμμισμένο με το brand της εταιρείας. Προσφέρει στην Anthropic την ευκαιρία να παρουσιάσει τον εαυτό της ως μια επιχείρηση που χαρακτηρίζεται από τα εξής στοιχεία:
Το έγγραφο των 80 σελίδων αποτελείται από τέσσερα ξεχωριστά μέρη, τα οποία, σύμφωνα με την Anthropic, αντιπροσωπεύουν τον «πυρήνα» της λειτουργίας και της φιλοσοφίας του chatbot.