
Νέα έρευνα της ADL αποκαλύπτει: Το Grok της xAI σημείωσε τις χειρότερες επιδόσεις στον εντοπισμό αντισημιτισμού. Δείτε ποιο κορυφαίο AI μοντέλο ξεχώρισε για την ασφάλειά του.

Σε μια κρίσιμη συγκριτική μελέτη που αφορά την ασφάλεια και την εξέλιξη της τεχνολογίας, το Grok της xAI κατέγραψε τις χαμηλότερες επιδόσεις ανάμεσα σε έξι κορυφαία μεγάλα γλωσσικά μοντέλα (LLMs) όσον αφορά τον εντοπισμό και την αντιμετώπιση αντισημιτικού περιεχομένου. Η σημαντική αυτή έρευνα δημοσιεύθηκε την Τετάρτη από την Anti-Defamation League (ADL), ρίχνοντας φως στις προκλήσεις που αντιμετωπίζει η σύγχρονη τεχνολογία.
Στον αντίποδα, το Claude της Anthropic αναδείχθηκε ως το πιο αξιόπιστο μοντέλο, σημειώνοντας την καλύτερη απόδοση σύμφωνα με τις μετρήσεις της έκθεσης. Παρόλα αυτά, η ADL έκρουσε τον κώδωνα του κινδύνου, επισημαίνοντας ότι όλα τα μοντέλα AI παρουσίασαν κενά ασφαλείας που απαιτούν άμεση και σημαντική βελτίωση για το μέλλον της βιομηχανίας.
Η ADL υπέβαλε σε αυστηρή δοκιμασία τα παρακάτω συστήματα, τροφοδοτώντας τα με μια ποικιλία σύνθετων αφηγημάτων και δηλώσεων για να ελέγξει τα αντανακλαστικά τους:
Το περιεχόμενο που χρησιμοποιήθηκε για τα tests χωρίστηκε σε τρεις κρίσιμες κατηγορίες, όπως ορίστηκαν από την οργάνωση: «αντι-εβραϊκό», «αντι-σιωνιστικό» και «εξτρεμιστικό». Η μελέτη βαθμολόγησε τα chatbots με βάση την ικανότητά τους να φιλτράρουν αυτές τις προκλήσεις, αναδεικνύοντας την ανάγκη για πιο υπεύθυνη καινοτομία στον τομέα.
Η Anti-Defamation League υπογραμμίζει πως η βιομηχανία της AI οφείλει να ενσωματώσει αυστηρότερες δικλείδες ασφαλείας καθώς η χρήση αυτών των εργαλείων καθιερώνεται παγκοσμίως.
Διαβάστε ολόκληρη την ιστορία και την ανάλυση στο The Verge.