
Κορυφαίοι ερευνητές από OpenAI & DeepMind ζητούν να «διαβάζουμε» τη σκέψη του AI. Μάθετε για τις αλυσίδες σκέψης (CoTs) & γιατί είναι κρίσιμες για την ασφάλεια.

Μια πραγματική επανάσταση βρίσκεται σε εξέλιξη στον κόσμο της τεχνολογίας AI. Κορυφαίοι ερευνητές από εταιρείες-γίγαντες όπως η OpenAI, η Google DeepMind και η Anthropic, μαζί με έναν ευρύ συνασπισμό ακαδημαϊκών και μη κερδοσκοπικών οργανισμών, δημοσίευσαν ένα κείμενο θέσεων που αλλάζει τα δεδομένα.
Η κεντρική τους πρόταση; Η ανάγκη για βαθύτερη διερεύνηση και παρακολούθηση των λεγόμενων «σκέψεων» των πιο προηγμένων μοντέλων συλλογισμού AI, ένα κρίσιμο βήμα για το ασφαλές μέλλον της τεχνητής νοημοσύνης.
Η καινοτομία των σύγχρονων μοντέλων AI, όπως το o3 της OpenAI και το R1 της DeepSeek, στηρίζεται σε μεγάλο βαθμό στις αλυσίδες σκέψης τους (chains-of-thought ή CoTs). Πρόκειται για την εξωτερίκευση της διαδικασίας επίλυσης ενός προβλήματος από το μοντέλο, κάτι ανάλογο με τον τρόπο που ένας άνθρωπος χρησιμοποιεί ένα πρόχειρο για να λύσει μια σύνθετη μαθηματική εξίσωση.
Αυτή η τεχνολογία αποτελεί τον πυρήνα των AI agents. Οι ερευνητές υποστηστηρίζουν ότι η παρακολούθηση των CoTs θα μπορούσε να είναι η θεμελιώδης μέθοδος για να διασφαλίσουμε ότι οι AI agents παραμένουν υπό έλεγχο, καθώς η εξέλιξή τους τους καθιστά όλο και πιο αυτόνομους και ικανούς.
«Η παρακολούθηση των CoTs αποτελεί μια πολύτιμη προσθήκη στα μέτρα ασφαλείας για την προηγμένη AI, προσφέροντας μια σπάνια ματιά στον τρόπο με τον οποίο οι AI agents λαμβάνουν αποφάσεις», τονίζουν οι ερευνητές. «Ωστόσο, δεν υπάρχει καμία εγγύηση ότι ο σημερινός βαθμός ορατότητας θα διατηρηθεί. Ενθαρρύνουμε την ερευνητική κοινότητα και τους προγραμματιστές προηγμένης AI να αξιοποιήσουν στο έπακρο τη δυνατότητα παρακολούθησης των CoTs και να μελετήσουν πώς μπορεί αυτή να διατηρηθεί.»
Το κείμενο θέσεων αποτελεί μια σαφή πρόσκληση προς τους κορυφαίους προγραμματιστές μοντέλων AI να εστιάσουν στην ενίσχυση της διαφάνειας.
Οι συγγραφείς καλούν την κοινότητα να:
Η σπουδαιότητα της έκκλησης υπογραμμίζεται από τις υπογραφές μερικών από τα πιο λαμπρά μυαλά στον χώρο της AI:
Αυτή η συμμαχία δείχνει μια σπάνια ομοφωνία για την κρισιμότητα της ασφάλειας και της διαφάνειας στη νέα εποχή της τεχνητής νοημοσύνης.