Τον Ιούνιο, κατά τη διάρκεια εσωτερικής εκπαίδευσης και αξιολόγησης, τα μοντέλα μας απέκτησαν πρόσβαση σε αυστραλιανούς κυβερνητικούς ιστότοπους με τρόπους για τους οποίους δεν είχαν εξουσιοδότηση. Θα έπρεπε επίσης να είχαμε χειριστεί καλύτερα την ανταπόκρισή μας. Ζητούμε συγγνώμη και εργαζόμαστε για να τα πάμε καλύτερα στο μέλλον.
Σε αυτή την ανάρτηση, παρουσιάζουμε όσα γνωρίζουμε, όσα έχουμε αλλάξει και όσα θα κάνουμε για να αποκαταστήσουμε την εμπιστοσύνη του αυστραλιανού λαού. Πρόκειται για ένα νέο είδος κυβερνοπεριστατικού, που συνιστά μια αναδυόμενη παγκόσμια πρόκληση. Ένας από τους τρόπους με τους οποίους σκοπεύουμε να αναλάβουμε την ευθύνη για την κατάσταση είναι να συνεργαστούμε μεθοδικά με την Αυστραλία. Στόχος μας είναι να συμβάλουμε στην ανάπτυξη πρακτικών προσεγγίσεων για το πώς οι φορείς ανάπτυξης τεχνητής νοημοσύνης και οι κυβερνήσεις εντοπίζουν, γνωστοποιούν και αντιμετωπίζουν τη συμπεριφορά της τεχνητής νοημοσύνης στον κυβερνοχώρο, είτε είναι κακόβουλη είτε ακούσια.
Μετά το περιστατικό με το Hugging Face τον Ιούλιο, αρχίσαμε να εξετάζουμε παλαιότερη δραστηριότητα εκπαίδευσης και αξιολόγησης, για να εντοπίσουμε άλλους οργανισμούς που επηρεάστηκαν. Στα μέσα Αυγούστου, αυτή η έρευνα εντόπισε δραστηριότητα που επηρέασε τους παρακάτω αυστραλιανούς κυβερνητικούς ιστότοπους.
Ακολουθούν όσα γνωρίζουμε βάσει των στοιχείων:
Services Australia: Ένα μοντέλο της OpenAI ανακάλυψε έναν τρόπο να αποκτήσει πρόσβαση σε τμήματα της υπηρεσίας που δεν ήταν διαθέσιμα στο κοινό. Εκτέλεσε εντολές, ανέκτησε εσωτερικά αρχεία, διαπιστευτήρια και συγκεντρωτικά στατιστικά στοιχεία, και έγραψε αρχεία. Ωστόσο, δεν απέκτησε πρόσβαση σε ατομικούς φακέλους ασθενών ή εξυπηρετούμενων πολιτών. Παρουσιάζουμε αυτό το περιστατικό αναλυτικότερα παρακάτω.
Γραφείο Στατιστικών και Έρευνας για το Έγκλημα της Νέας Νότιας Ουαλίας (BOCSAR): Ένα μοντέλο της OpenAI απέκτησε πρόσβαση στο δημόσιο εργαλείο χαρτογράφησης εγκληματικότητας του BOCSAR για να ερευνήσει δημόσια στατιστικά στοιχεία για το έγκλημα (παρακάτω εξηγούμε αναλυτικότερα γιατί τα μοντέλα εκτελούν διάφορες εργασίες αναζήτησης πληροφοριών). Το μοντέλο υπέβαλε αιτήματα API και αιτήματα για μεταδεδομένα ιστότοπου μέσω του δημόσιου εργαλείου του BOCSAR, το οποίο παρέχει διαπιστευτήρια για αιτήματα API από το πρόγραμμα περιήγησης. Το σύστημα του BOCSAR επέστρεψε τη διαμόρφωση της εφαρμογής, εργασίες και αρχεία καταγραφής λειτουργίας, καθώς και μεταδεδομένα του ιστότοπου. Δεν υπήρξε πρόσβαση σε αρχεία ποινικών υποθέσεων μεμονωμένων ατόμων.
Υπουργείο Υγείας της Βικτώριας: Πράκτορες της OpenAI ανακάλυψαν ένα εκτεθειμένο κλειδί πρόσβασης, με το οποίο υπέβαλαν ερωτήματα στο σύστημα αναφορών της Υπηρεσίας Πληροφοριών Υγείας της Βικτώριας (VAHI) και ανέκτησαν τη διαμόρφωση των αναφορών και συγκεντρωτικά στατιστικά στοιχεία ερευνών. Δεν είναι σαφές σε ποιον βαθμό θα έπρεπε να είναι προσβάσιμες αυτές οι πληροφορίες, καθώς αυτό εξαρτάται από τις πολιτικές πρόσβασης της VAHI. Δεν υπήρξε πρόσβαση σε ατομικούς ιατρικούς φακέλους ή σε απαντήσεις ερευνών που θα μπορούσαν να ταυτοποιήσουν άτομα.
Αυστραλιανό Ινστιτούτο Υγείας και Πρόνοιας (AIHW): Πράκτορες της OpenAI ανέκτησαν συγκεντρωτικά στατιστικά στοιχεία χρησιμοποιώντας υπηρεσίες περιήγησης και λήψης τρίτων, μεταξύ άλλων από τον ιστότοπο του AIHW, και υπέβαλαν απευθείας ερωτήματα για δεδομένα διαγραμμάτων. Ξεχωριστές απόπειρες παράκαμψης των ελέγχων πρόσβασης απέτυχαν. Το υλικό που λήφθηκε φαίνεται ότι ήταν δημόσια διαθέσιμο. Δεν υπήρξε παραβίαση του συστήματος. Δεν υπήρξε πρόσβαση σε ατομικούς ιατρικούς φακέλους.
Ξεκινήσαμε έρευνες για αυτές τις δραστηριότητες μόλις τις πληροφορηθήκαμε, στα μέσα Αυγούστου. Ειδοποιήσαμε τη Services Australia και το Υπουργείο Υγείας της Βικτώριας στις 10 Σεπτεμβρίου, και το Γραφείο Στατιστικών και Έρευνας για το Έγκλημα της Νέας Νότιας Ουαλίας στις 18 Σεπτεμβρίου. Η δραστηριότητα που σχετιζόταν με το Αυστραλιανό Ινστιτούτο Υγείας και Πρόνοιας δεν πληρούσε τα κριτήριά μας για γνωστοποίηση, επειδή ο τρόπος πρόσβασης φαινόταν συμβατός με τη δημόσια πρόσβαση. Ωστόσο, ειδοποιήσαμε το Ινστιτούτο στις 24 Σεπτεμβρίου για να κοινοποιήσουμε τα ευρήματά μας και να προσφέρουμε αναλυτική ενημέρωση.
Στόχος μας ήταν να δώσουμε στις υπηρεσίες που επηρεάστηκαν μια λεπτομερή αναφορά μόλις ολοκληρωνόταν η έρευνά μας. Ωστόσο, θα έπρεπε να είχαμε κοινοποιήσει νωρίτερα τα προκαταρκτικά ευρήματα και να ενημερώνουμε τις αυστραλιανές υπηρεσίες καθώς προέκυπταν περισσότερα στοιχεία.
Έκτοτε, συνεργαζόμαστε στενά με αυστραλιανές κυβερνητικές υπηρεσίες για να μοιραστούμε όσα έχουμε μάθει μέχρι σήμερα. Αν εντοπίσουμε επιπλέον υπηρεσίες που επηρεάστηκαν, θα τις ειδοποιήσουμε έγκαιρα και απευθείας με τις διαθέσιμες πληροφορίες και θα παρέχουμε ενημερώσεις καθώς προκύπτουν νέα στοιχεία.
Κατά την εσωτερική εκπαίδευση και αξιολόγηση τον Ιούνιο, χρησιμοποιούσαμε ένα πειραματικό μοντέλο της OpenAI, αποκλειστικά για εσωτερική χρήση, το οποίο δεν προοριζόταν για δημόσια κυκλοφορία και δεν διέθετε το πλήρες σύνολο μέτρων προστασίας που χρησιμοποιούμε στα προϊόντα μας που είναι διαθέσιμα στο κοινό. Στη διάρκεια αυτής της εκπαίδευσης και αξιολόγησης, απέκτησε πρόσβαση στην υπηρεσία στατιστικών αναφορών Medicare της Services Australia. Η έρευνά μας μέχρι σήμερα δεν έχει εντοπίσει στοιχεία ότι υπήρξε πρόσβαση σε ιατρικό φάκελο οποιουδήποτε ατόμου.
Όταν εκπαιδεύουμε και αξιολογούμε εσωτερικά τα μοντέλα μας, τους αναθέτουμε εργασίες από ένα ευρύ σύνολο ερευνητικών ερωτημάτων που καλύπτουν πολλά θέματα και αντανακλούν τα είδη λεπτομερών ερωτήσεων που μπορεί να θέσουν οι χρήστες. Έτσι, ένα μοντέλο εκπαιδεύεται να βρίσκει, να ερμηνεύει και να αναλύει δημόσια διαθέσιμες πληροφορίες, ώστε να είναι πιο χρήσιμο στους ανθρώπους. Τα μοντέλα μας οφείλουν να απαντούν σε αυτές τις ερωτήσεις χρησιμοποιώντας δημοσιευμένα στατιστικά στοιχεία που είναι διαθέσιμα στο κοινό.
Σε αυτή την περίπτωση, μία από τις εργασίες που ανατέθηκαν στο μοντέλο ήταν να ερευνήσει την κατά κεφαλήν κρατική δαπάνη για φάρμακα κατά δερματικών παθήσεων σε κοινότητες της Βικτώριας. Το μοντέλο δυσκολεύτηκε να βρει αυτές τις πληροφορίες και προχώρησε σε ενέργειες για τις οποίες δεν του είχαμε δώσει εξουσιοδότηση. Κατά την αναζήτηση αυτών των πληροφοριών στην υπηρεσία στατιστικών αναφορών Medicare της Services Australia, ανακάλυψε έναν τρόπο να αποκτήσει πρόσβαση σε τμήματα της υπηρεσίας που δεν ήταν διαθέσιμα στο κοινό. Στη συνέχεια, χρησιμοποίησε αυτή την πρόσβαση για να εξετάσει τεχνικές πληροφορίες του συστήματος και πηγαίο κώδικα που σχετίζονταν με την υπηρεσία, εξακολουθώντας να έχει ως στόχο να βρει τις πληροφορίες που αναζητούσε αρχικά. Δεν είχαμε πρόθεση να επιτρέψουμε αυτή τη δραστηριότητα. Ούτε η πρόσβαση στην υπηρεσία ούτε οι ενέργειες που ακολούθησαν θα έπρεπε να είχαν συμβεί.
Μετά το περιστατικό με το Hugging Face, ενισχύσαμε τα μέτρα προστασίας της έρευνάς μας, προσθέτοντας περιορισμούς δικτύου και διευρύνοντας την παρακολούθηση. Εφαρμόσαμε ελέγχους που αποκλείουν την απευθείας πρόσβαση στο διαδίκτυο σε αυτά τα ερευνητικά περιβάλλοντα. Η πρόσβαση στον ιστό παρέχεται μέσω περιεχομένου αποθηκευμένου στην προσωρινή μνήμη. Ως πρόσθετο επίπεδο ασφάλειας, τα σημερινά συστήματα παρακολούθησής μας θα είχαν εντοπίσει αυτή τη δραστηριότητα και θα είχαν ειδοποιήσει την ομάδα μας για επείγοντα έλεγχο από άνθρωπο. Για παράδειγμα, όταν ένα μοντέλο απέκτησε απευθείας πρόσβαση στο διαδίκτυο κατά τη διάρκεια μιας πρόσφατης εκτέλεσης εκπαίδευσης(ανοίγει σε νέο παράθυρο), το σύστημα παρακολούθησής μας εντόπισε τη δραστηριότητα και ειδοποίησε έναν υπεύθυνο ελέγχου, και διακόψαμε την εκτέλεση. Συνεχίζουμε να δοκιμάζουμε αυτά τα μέτρα προστασίας και να καλύπτουμε τα κενά. Το περιστατικό με το Hugging Face παραμένει το σοβαρότερο που έχουμε παρατηρήσει.
Ο κόσμος θέλει να γνωρίζει ότι η τεχνητή νοημοσύνη αναπτύσσεται με ασφάλεια, και αυτό ξεκινά από τις πράξεις των ίδιων των εταιρειών όπως η δική μας. Πρόσφατα ανακοινώσαμε(ανοίγει σε νέο παράθυρο) ότι έχουμε αναστείλει την εκπαίδευση και την αξιολόγηση των πιο ικανών μοντέλων μας που περιλαμβάνουν χρήση εργαλείων. Θα συνεχίσουμε την εκπαίδευσή τους μόνο όταν είμαστε βέβαιοι ότι έχουν τεθεί σε εφαρμογή πρόσθετα μέτρα προστασίας, τα οποία αναπτύσσουμε τώρα.
Καθώς οι δυνατότητες των συστημάτων τεχνητής νοημοσύνης αυξάνονται γενικότερα, βλέπουμε επίσης ότι το χρονικό περιθώριο για να βοηθήσουμε τους οργανισμούς να εντοπίσουν και να διορθώσουν αδυναμίες στενεύει. Αυτό απαιτεί συλλογική δράση, σε συνεργασία με όσους εργάζονται για την κυβερνοάμυνα σε όλο τον κόσμο.
Έχουμε ενώσει τις δυνάμεις μας με οργανισμούς από τους τομείς της τεχνολογίας, της κυβερνοασφάλειας και των κρίσιμων υποδομών, σε ένα κάλεσμα για συλλογική δράση στην κυβερνοάμυνα. Αυτό το κάλεσμα ξεκινά από τις δικές μας ευθύνες: ισχυρότερα μέτρα προστασίας, έγκαιρη γνωστοποίηση και πρακτική υποστήριξη των οργανισμών που επηρεάζονται. Ζητά επίσης επενδύσεις στις ομάδες που προστατεύουν βασικές υπηρεσίες, ώστε να μπορούν να εντοπίζουν ευπάθειες, να επαληθεύουν τις διορθώσεις και να μοιράζονται αποτελεσματικές πρακτικές.
Στην Αυστραλία, δεσμεύουμε πόρους και τεχνογνωσία για να στηρίξουμε τις υπηρεσίες που επηρεάστηκαν και να βοηθήσουμε τους υπεύθυνους κυβερνοάμυνας να εφαρμόσουν αυτές τις αρχές στην πράξη, με τις εξής πρωτοβουλίες:
Στοχευμένη υποστήριξη των υπηρεσιών που επηρεάστηκαν. Θα διαθέσουμε τους απαραίτητους πόρους για να βοηθήσουμε τις υπηρεσίες που επηρεάστηκαν να κατανοήσουν τι συνέβη και να αξιολογήσουν τον αντίκτυπο. Αυτό περιλαμβάνει την κοινοποίηση σχετικών τεχνικών ευρημάτων και τη διευκόλυνση της συνεργασίας με τις ομάδες απόκρισής μας, μέσω κατάλληλων ρυθμίσεων ανταλλαγής πληροφοριών.
Χρηματοδότηση και υποστήριξη για την ενίσχυση της κυβερνοάμυνας. Θα στηρίξουμε τις κυβερνήσεις και τις επιχειρήσεις της Αυστραλίας με μονάδες από το ταμείο μας Daybreak for Frontline Defenders, ύψους 1 δισ. δολαρίων, και με τεχνική βοήθεια για την ενίσχυση της κυβερνοάμυνας σε κρίσιμες υποδομές και άλλα ευαίσθητα περιβάλλοντα. Αξιοποιώντας τη συνεργασία μας με κυβερνήσεις και φορείς διαχείρισης κρίσιμων υποδομών, αυτή η προσπάθεια θα βοηθήσει τους οργανισμούς να κατανοούν, να εντοπίζουν και να αντιμετωπίζουν καλύτερα τους κινδύνους από πράκτορες τεχνητής νοημοσύνης με ολοένα μεγαλύτερες δυνατότητες.
Μια αυστραλιανή ομάδα εργασίας. Θα συστήσουμε μια ομάδα εργασίας με τη συμβολή ανεξάρτητων Αυστραλών εμπειρογνωμόνων, για να διαμορφώσει πρακτικές προτάσεις πολιτικής για τη διαχείριση κινδύνων από πράκτορες τεχνητής νοημοσύνης με ολοένα μεγαλύτερες δυνατότητες. Αξιοποιώντας τα διδάγματα από αυτά τα περιστατικά, θα επικεντρωθεί στη βελτίωση των διαδικασιών ειδοποίησης, στην ενίσχυση του συντονισμού μεταξύ φορέων ανάπτυξης τεχνητής νοημοσύνης και κυβέρνησης, καθώς και στον προσδιορισμό μέτρων για την καλύτερη προστασία των κυβερνητικών συστημάτων. Οι προτάσεις της ομάδας εργασίας θα συμβάλουν στη διαμόρφωση της προσέγγισης της OpenAI και θα στηρίξουν το έργο των αυστραλιανών κυβερνήσεων για την ασφάλεια της τεχνητής νοημοσύνης και την κυβερνοασφάλεια. Η ομάδα εργασίας, που αναμένεται να ολοκληρώσει το έργο της έως το τέλος του έτους, θα προτείνει επίσης πρακτικά βήματα που μπορούν να κάνουν οι εταιρείες τεχνητής νοημοσύνης για να μειώσουν τον κίνδυνο παρόμοιων περιστατικών.
Οι κυβερνήσεις, οι επιχειρήσεις και οι πολίτες της Αυστραλίας είναι διαχρονικά πολύτιμοι συνεργάτες της OpenAI. Δεν το θεωρούμε δεδομένο και σκοπεύουμε να επανορθώσουμε.
Ο επικεφαλής στρατηγικής της OpenAI, Jason Kwon, θα ταξιδέψει από τα κεντρικά γραφεία της OpenAI στις ΗΠΑ για να παρουσιαστεί ενώπιον της Μικτής Ειδικής Επιτροπής για την Τεχνητή Νοημοσύνη στο Σίδνεϊ, την Τρίτη 6 Οκτωβρίου. Θα απαντήσει σε ερωτήσεις σχετικά με όσα γνωρίζουμε, το πώς ανταποκριθήκαμε, τα μέτρα που έχουμε λάβει και το πώς θα βελτιωθούμε στο μέλλον.
Θα συνεχίσουμε να κοινοποιούμε επαληθευμένα ευρήματα στις υπηρεσίες που επηρεάστηκαν και στις αρμόδιες κυβερνήσεις. Θα δημοσιεύουμε ενημερώσεις για την έρευνά μας που βρίσκεται σε εξέλιξη και για την πρόοδο στην υλοποίηση αυτών των δεσμεύσεων. Γνωρίζουμε ότι έχουμε πολλή δουλειά μπροστά μας για να αποκαταστήσουμε την εμπιστοσύνη και ότι έχουμε ευθύνη να αποδείξουμε στους Αυστραλούς πως κάνουμε ουσιαστικές αλλαγές και τηρούμε τις υποσχέσεις μας.


