
Η εξέλιξη του Claude αναγκάζει την Anthropic να αλλάξει τα τεστ προσλήψεων. Μάθετε πώς το AI Opus 4.5 ξεπέρασε τους υποψηφίους και τη νέα πρόκληση.

Στην εποχή της ραγδαίας τεχνολογικής εξέλιξης, η διαδικασία εύρεσης ταλέντων αλλάζει ριζικά. Από το 2024, η ομάδα βελτιστοποίησης απόδοσης της κορυφαίας εταιρείας Anthropic έχει καθιερώσει μια αυστηρή διαδικασία αξιολόγησης για το σπίτι (take-home test) για τους υποψηφίους. Στόχος είναι η διασφάλιση ότι κατέχουν τις απαραίτητες γνώσεις και δεξιότητες προγραμματισμού.
Ωστόσο, καθώς τα εργαλεία προγραμματισμού AI έχουν εξελιχθεί με εκθετικούς ρυθμούς, φέρνοντας μια πραγματική επανάσταση στον κλάδο, το τεστ χρειάστηκε να αναθεωρηθεί πολλές φορές. Ο λόγος; Η ανάγκη να παραμείνει η εταιρεία ένα βήμα μπροστά από την "υποβοηθούμενη από AI" αντιγραφή.
Ο επικεφαλής της ομάδας, Tristan Hume, περιέγραψε το ιστορικό αυτής της μοναδικής πρόκλησης σε ένα πρόσφατο και αποκαλυπτικό blog post. Η καινοτομία των μοντέλων της εταιρείας έγινε, παραδόξως, το εμπόδιο στην αξιολόγηση νέων ανθρώπινων πόρων.
"Κάθε νέο μοντέλο Claude μας ανάγκαζε να επανασχεδιάσουμε το τεστ", γράφει χαρακτηριστικά ο Hume. "Όταν δινόταν το ίδιο χρονικό όριο, το Claude Opus 4 ξεπερνούσε τους περισσότερους ανθρώπους υποψηφίους. Αυτό μας επέτρεπε ακόμα να ξεχωρίζουμε τους πιο δυνατούς υποψηφίους — αλλά μετά, το Claude Opus 4.5 ισοφάρισε ακόμη και αυτούς".
Το αποτέλεσμα είναι ένα σοβαρό πρόβλημα στην αξιοκρατική αξιολόγηση των υποψηφίων. Χωρίς φυσική επιτήρηση, δεν υπάρχει πλέον αξιόπιστος τρόπος να διασφαλιστεί ότι κάποιος δεν χρησιμοποιεί προηγμένο AI για να "κλέψει" στο τεστ.
Οι συνέπειες είναι συγκεκριμένες:
Το ζήτημα της αντιγραφής μέσω AI προκαλεί ήδη χάος σε σχολεία και πανεπιστήμια σε όλο τον κόσμο, αλλά και στην Ελλάδα. Είναι λοιπόν άκρως ειρωνικό το γεγονός ότι τα ίδια τα εργαστήρια AI και οι εταιρείες που δημιουργούν το μέλλον, καλούνται τώρα να αντιμετωπίσουν το ίδιο πρόβλημα που δημιούργησαν τα προϊόντα τους.
Ωστόσο, η Anthropic είναι ταυτόχρονα και η πιο κατάλληλα εξοπλισμένη εταιρεία για να διαχειριστεί αυτή την κατάσταση, προσαρμόζοντας τα κριτήριά της στη νέα πραγματικότητα.
Τελικά, ο Hume σχεδίασε ένα νέο, πιο σύνθετο τεστ που είχε λιγότερη σχέση με την κλασική βελτιστοποίηση υλικού (hardware), κάνοντάς το αρκετά πρωτότυπο ώστε να μπερδέψει τα σύγχρονα εργαλεία AI.
Ωστόσο, ως μέρος της δημοσίευσής του και με πνεύμα ανοιχτής καινοτομίας, μοιράστηκε το αρχικό τεστ για να δει αν κάποιος από τους αναγνώστες θα μπορούσε να βρει μια καλύτερη λύση.
Η πρόκληση: "Αν μπορείτε να κερδίσετε το Opus 4.5," αναφέρει η ανάρτηση, "θα χαρούμε να μάθουμε νέα σας."