Η Google και η Google DeepMind δημιούργησαν το DeepMind Institute για να μεταφέρουν τη συζήτηση γύρω από την τεχνητή γενική νοημοσύνη από τις γενικές προβλέψεις σε συγκεκριμένες προτάσεις για αξιολόγηση, διαφάνεια και διακυβέρνηση. Το πρώτο του πακέτο κειμένων δείχνει ότι η μάχη για την AGI θα κριθεί και από το ποιος θέτει τους κανόνες μέτρησης.
Ένα ινστιτούτο για μια συζήτηση που αλλάζει
Το νέο σχήμα έχει ως διευθυντές τον συνιδρυτή της DeepMind Shane Legg, το στέλεχος της Google James Manyika και τον πρόεδρο της Google DeepMind Demis Hassabis. Ο Legg αναλαμβάνει και τον ρόλο του managing editor.
Στόχος του ινστιτούτου είναι να φιλοξενεί διαφορετικές απόψεις — ακόμη και απόψεις με τις οποίες η Google ή η Google DeepMind δεν συμφωνούν πάντα. Η ίδια η ανακοίνωση αναγνωρίζει ότι οι θέσεις μπορεί να αλλάζουν όσο συσσωρεύονται νέα δεδομένα σε ένα πεδίο που εξελίσσεται γρήγορα.
Η εναρκτήρια συλλογή περιλαμβάνει τέσσερα δοκίμια: για την οικονομική πολιτική απέναντι σε μια πιθανή αναστάτωση από την AGI, για τη διατήρηση αναγνώσιμων διαδικασιών reasoning, για αρχές ανθρώπινης ευημερίας και για ένα πλαίσιο αξιολόγησης frontier μοντέλων.
Το reasoning γίνεται ζήτημα ασφάλειας
Οι ερευνητές ασφάλειας Rohin Shah και Anca Dragan υποστηρίζουν ότι η συρρίκνωση της διαφάνειας των μοντέλων — η δυνατότητα να βλέπουμε και να ελέγχουμε τα βήματα της «σκέψης» τους — δεν είναι αναπόφευκτη. Καθώς οι ισχυρότερες αρχιτεκτονικές γίνονται δυσκολότερες στην παρακολούθηση, οι δημιουργοί και οι ρυθμιστικές αρχές πρέπει να αντιμετωπίσουν ανοιχτά τους συμβιβασμούς.
Μία από τις ιδέες είναι να περιοριστεί το λεγόμενο «opaque serial depth»: η διαδοχική υπολογιστική εργασία που μπορεί να εκτελεί ένα μοντέλο χωρίς να παράγει αναγνώσιμο ίχνος reasoning. Εναλλακτικά, οι προγραμματιστές θα μπορούσαν να χρειάζεται να αποδεικνύουν ότι τα λιγότερο διαφανή συστήματα παραμένουν εξίσου ελέγξιμα.
Από τα benchmarks σε ανεξάρτητους ελέγχους
Σε ξεχωριστό δοκίμιο, ο Hassabis προτείνει έναν φορέα standards υπό αμερικανική ηγεσία, ο οποίος θα αξιολογεί τα πιο προηγμένα μοντέλα AI. Αρχικά, οι εταιρείες θα υπέβαλλαν εθελοντικά τα μοντέλα τους σε έλεγχο έως και 30 ημέρες πριν από την κυκλοφορία τους.
Αν το σύστημα αποδεικνυόταν αποτελεσματικό, η επιτυχία στις αξιολογήσεις θα μπορούσε να γίνει προϋπόθεση για την ανάπτυξη frontier μοντέλων στις ΗΠΑ. Η πρόταση προβλέπει επίσης «held-out» δοκιμές, δηλαδή ανεξάρτητες και μη δημοσιοποιημένες αξιολογήσεις, ώστε τα εργαστήρια να μην μπορούν να προσαρμόζουν τα μοντέλα τους σε γνωστά benchmarks.
Το δύσκολο ερώτημα είναι ποιος ελέγχει τον ελεγκτή
Η πρωτοβουλία έρχεται σε μια στιγμή που η συζήτηση για την ασφάλεια της AI μετακινείται από τις γενικές δηλώσεις ανησυχίας σε πρακτικές προτάσεις για διαφάνεια, εξωτερικό έλεγχο και πιθανή επιβράδυνση της ανάπτυξης. Ο Hassabis αφήνει ανοιχτό ακόμη και το ενδεχόμενο συντονισμένης επιβράδυνσης, αν η σοβαρότητα των κινδύνων το απαιτήσει.
Το κρίσιμο σημείο, ωστόσο, δεν είναι μόνο αν θα υπάρξουν περισσότερα τεστ. Είναι ποιος θα τα σχεδιάζει, ποια δεδομένα θα παραμένουν ιδιωτικά και πώς θα αποδεικνύεται ότι ένα μοντέλο είναι ασφαλές όταν οι ίδιες οι μέθοδοι ελέγχου μπορεί να γίνουν στόχος βελτιστοποίησης. Το DeepMind Institute δεν λύνει αυτή την ένταση· τη μετατρέπει, όμως, σε θεσμικό και μετρήσιμο διάλογο.
Πηγή: TechCrunch — Google DeepMind launches institute to widen the AGI debate