Strategist Ai · AI Takeaways
- Το 404 Media δημοσίευσε μαρτυρίες και έγγραφα για απαγόρευση χρήσης AI από εξωτερικούς αξιολογητές έργων της OpenAI.
- Η Mercor επιβεβαιώνει συμβατικό κανόνα και απομάκρυνση από έργο όταν τεκμηριώνεται παράβαση.
- Δεν υπάρχει δημοσιευμένος αριθμός περιστατικών ή ποσοτική επίδραση στην ποιότητα των μοντέλων.
Το πιο δύσκολο κομμάτι της παραγωγής τεχνητής νοημοσύνης μπορεί να είναι εκείνο που πρέπει να παραμείνει ανθρώπινο. Ρεπορτάζ του 404 Media, βασισμένο σε εσωτερικά έγγραφα και συνομιλίες με τρεις εξωτερικούς συνεργάτες έργων της OpenAI, περιγράφει απομάκρυνση αξιολογητών που χρησιμοποίησαν AI για τις εργασίες τους. Δύο πηγές είπαν ότι είχαν υπάρξει τέτοιες απομακρύνσεις. Η εταιρεία στελέχωσης Mercor επιβεβαίωσε ότι οι συμβάσεις της απαγορεύουν τη χρήση LLM για την ολοκλήρωση των έργων και ότι αφαιρεί συνεργάτες όταν διαπιστώνεται παράβαση.
Γιατί η ποιότητα των δεδομένων αρχίζει από τον άνθρωπο
Συστήματα όπως το ChatGPT βελτιώνονται και μέσω αξιολόγησης των απαντήσεών τους: άνθρωποι κρίνουν ποια απάντηση είναι ακριβής, χρήσιμη ή προβληματική. Αν η αξιολόγηση παράγεται από άλλο μοντέλο χωρίς άδεια και χωρίς διακριτή σήμανση, αλλάζει η φύση του σήματος που παραλαμβάνει η εταιρεία. Το πρόβλημα δεν είναι μια αφηρημένη «μόλυνση» που έχει αποδειχθεί σε κάθε περίπτωση, αλλά η απώλεια της ανεξάρτητης ανθρώπινης κρίσης για την οποία σχεδιάστηκε το συγκεκριμένο έργο.
Έγγραφο που εξέτασε το 404 Media απαγορεύει στους ελεγκτές ακόμη και τη χρήση εργαλείων ανίχνευσης AI, με το επιχείρημα ότι δεν είναι αξιόπιστα, και τους ζητεί να αξιολογούν το συνολικό μοτίβο εργασίας. Αυτό δείχνει πόσο δύσκολη είναι η διακυβέρνηση της αλυσίδας. Μια εταιρεία χρειάζεται κανόνες, διαδικασία ελέγχου και δυνατότητα δίκαιης αμφισβήτησης, χωρίς να θεωρεί ένα σημείο στίξης ή γρήγορη παράδοση αδιάψευστη απόδειξη. Το ίδιο το ρεπορτάζ δεν αποδεικνύει ότι ένας συγκεκριμένος όγκος δεδομένων εκπαίδευσης είχε ήδη υποβαθμίσει το μοντέλο.
Ο προμηθευτής ως κρίκος διακυβέρνησης
Οι εξωτερικοί αξιολογητές δεν είναι απλώς προσωρινό προσωπικό πίσω από μια τεχνολογική βιτρίνα. Παράγουν δεδομένα που επηρεάζουν την αξιολόγηση του προϊόντος. Η Mercor δηλώνει ότι επενδύει σε εργαλεία ανίχνευσης και απομακρύνει από έργα όσους επιβεβαιωμένα χρησιμοποιούν AI. Η OpenAI αρνήθηκε να σχολιάσει στο 404 Media τις καταγγελλόμενες απομακρύνσεις. Δεν έχει δοθεί δημόσιος συνολικός αριθμός απολύσεων, ούτε ποσοστό παραβάσεων ανά έργο.
Για κάθε εταιρεία που αγοράζει υπηρεσίες AI, το μάθημα είναι ευρύτερο: οι εγγυήσεις ποιότητας δεν σταματούν στο ίδιο το μοντέλο. Χρειάζονται καθαρό ορισμό της ανθρώπινης συνεισφοράς, έλεγχο των υπεργολάβων και τεκμηρίωση της προέλευσης των αξιολογήσεων. Η αλυσίδα δεδομένων είναι μέρος της αξιοπιστίας του προϊόντος.