
Το Mastodon απαγορεύει την εκπαίδευση AI με δεδομένα χρηστών, ακολουθώντας το X. Μάθετε τι σημαίνει αυτή η κίνηση για το μέλλον της AI και την ιδιωτικότητα.

Σε μια σημαντική εξέλιξη για τον χώρο της τεχνολογίας και της ιδιωτικότητας, τα κοινωνικά δίκτυα ενισχύουν την άμυνά τους απέναντι στην ανεξέλεγκτη συλλογή δεδομένων (data scraping) για την εκπαίδευση μοντέλων AI. Λίγες μόλις ημέρες αφότου το X, ιδιοκτησίας του Elon Musk, ανανέωσε τους όρους του για να μπλοκάρει ρητά την εκπαίδευση AI, το αποκεντρωμένο κοινωνικό δίκτυο Mastodon ακολουθεί με μια παρόμοια στρατηγική κίνηση, απαγορεύοντας κάθε είδους εκπαίδευση προηγμένων μοντέλων με τα δεδομένα των χρηστών του.
Σε email που απέστειλε στους χρήστες του, το Mastodon κατέστησε τις προθέσεις του απόλυτα σαφείς, σηματοδοτώντας μια νέα εποχή για την προστασία των ψηφιακών δικαιωμάτων.
«Απαγορεύουμε ρητά την απόξεση (scraping) δεδομένων χρηστών για μη εξουσιοδοτημένους σκοπούς, π.χ. για αρχειοθέτηση ή εκπαίδευση μεγάλων γλωσσικών μοντέλων (LLM). Θέλουμε να καταστήσουμε σαφές ότι η εκπαίδευση LLMs με δεδομένα χρηστών του Mastodon στους servers (instances) μας δεν επιτρέπεται».
Οι νέοι κανονισμοί, οι οποίοι τίθενται σε ισχύ από την 1η Ιουλίου, ενσωματώνουν αυστηρή νομική ορολογία που απαγορεύει την εξαγωγή δεδομένων και την ανάπτυξη οποιουδήποτε αυτοματοποιημένου συστήματος για αυτόν τον σκοπό.
Η γλώσσα των ανανεωμένων όρων χρήσης είναι κατηγορηματική και δεν αφήνει περιθώρια για διαφορετικές ερμηνείες, θέτοντας ξεκάθαρα όρια.
«Η χρήση, εκκίνηση, ανάπτυξη ή διανομή οποιουδήποτε αυτοματοποιημένου συστήματος, συμπεριλαμβανομένων, ενδεικτικά, οποιουδήποτε spider, robot, cheat utility, scraper, offline reader ή οποιωνδήποτε παρόμοιων εργαλείων εξόρυξης ή συλλογής δεδομένων για την πρόσβαση στον Server (Instance), απαγορεύεται, εκτός από τις περιπτώσεις που αυτό προκύπτει από τυπικές μηχανές αναζήτησης ή προγράμματα περιήγησης στο διαδίκτυο και τοπική προσωρινή αποθήκευση (caching) ή για ανθρώπινη επισκόπηση και αλληλεπίδραση με το Περιεχόμενο στον Server (Instance)».
Είναι κρίσιμο να γίνει κατανοητό ότι οι παραπάνω όροι αφορούν αποκλειστικά τον server Mastodon.social. Αυτός ο server είναι μόνο ένας από τους χιλιάδες που απαρτίζουν το fediverse, ένα τεράστιο, κατανεμημένο και αποκεντρωμένο δίκτυο.
Σημαντική Σημείωση: Αυτό πρακτικά σημαίνει ότι οι data scrapers θα μπορούσαν θεωρητικά να συνεχίσουν να συλλέγουν δεδομένα από άλλους servers του fediverse για την εκπαίδευση μοντέλων AI, εφόσον οι διαχειριστές των εν λόγω servers δεν το απαγορεύουν ρητά στους δικούς τους όρους χρήσης.
Η κίνηση των Mastodon και X δεν αποτελεί μεμονωμένο περιστατικό, αλλά μέρος μιας ευρύτερης τάσης που διαμορφώνει το μέλλον της AI. Κορυφαίες εταιρείες του κλάδου, όπως η OpenAI, το Reddit και η The Browser Company, έχουν ήδη ενσωματώσει παρόμοιες ρήτρες στους κανονισμούς τους. Στόχος τους είναι να προστατεύσουν το περιεχόμενό τους και να εμποδίσουν τρίτες εταιρείες να εκπαιδεύουν ανταγωνιστικά μοντέλα AI χρησιμοποιώντας τα δικά τους δεδομένα.
Στο πλαίσιο της γενικότερης ανανέωσης των πολιτικών του, το Mastodon προχωρά και σε μία ακόμη αλλαγή: