
Έρευνα ADL: Το Grok της xAI «ουραγός» στον εντοπισμό ρητορικής μίσους – Η πρωτιά του Claude
Σε μια κρίσιμη συγκριτική μελέτη που αφορά την ασφάλεια και την εξέλιξη της τεχνολογίας, το Grok της xAI κατέγραψε τις χαμηλότερες επιδόσεις ανάμεσα σε έξι κορυφαία μεγάλα γλωσσικά μοντέλα (LLMs) όσον αφορά τον εντοπισμό και την αντιμετώπιση αντισημιτικού περιεχομένου. Η σημαντική αυτή έρευνα δημοσιεύθηκε την Τετάρτη από την Anti-Defamation League (ADL), ρίχνοντας φως στις προκλήσεις που αντιμετωπίζει η σύγχρονη τεχνολογία.
Στον αντίποδα, το Claude της Anthropic αναδείχθηκε ως το πιο αξιόπιστο μοντέλο, σημειώνοντας την καλύτερη απόδοση σύμφωνα με τις μετρήσεις της έκθεσης. Παρόλα αυτά, η ADL έκρουσε τον κώδωνα του κινδύνου, επισημαίνοντας ότι όλα τα μοντέλα AI παρουσίασαν κενά ασφαλείας που απαιτούν άμεση και σημαντική βελτίωση για το μέλλον της βιομηχανίας.
Ποια προηγμένα μοντέλα AI αξιολογήθηκαν
Η ADL υπέβαλε σε αυστηρή δοκιμασία τα παρακάτω συστήματα, τροφοδοτώντας τα με μια ποικιλία σύνθετων αφηγημάτων και δηλώσεων για να ελέγξει τα αντανακλαστικά τους:
- Grok (xAI)
- ChatGPT (OpenAI)
- Llama (Meta)
- Claude (Anthropic)
- Gemini (Google)
- DeepSeek
Κατηγορίες ελέγχου και αποτελέσματα
Το περιεχόμενο που χρησιμοποιήθηκε για τα tests χωρίστηκε σε τρεις κρίσιμες κατηγορίες, όπως ορίστηκαν από την οργάνωση: «αντι-εβραϊκό», «αντι-σιωνιστικό» και «εξτρεμιστικό». Η μελέτη βαθμολόγησε τα chatbots με βάση την ικανότητά τους να φιλτράρουν αυτές τις προκλήσεις, αναδεικνύοντας την ανάγκη για πιο υπεύθυνη καινοτομία στον τομέα.
Η Anti-Defamation League υπογραμμίζει πως η βιομηχανία της AI οφείλει να ενσωματώσει αυστηρότερες δικλείδες ασφαλείας καθώς η χρήση αυτών των εργαλείων καθιερώνεται παγκοσμίως.
Διαβάστε ολόκληρη την ιστορία και την ανάλυση στο The Verge.