Δύο από τα ισχυρότερα συστήματα Τεχνητής Νοημοσύνης παγκοσμίως δημιούργησαν ψεύτικα ανθρώπινα προφίλ και επιχείρησαν να εξαπατήσουν πραγματικούς χρήστες στο πλαίσιο κυβερνοεπίθεσης κατά τη διάρκεια δοκιμών που πραγματοποίησε το βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης (AISI). Σύμφωνα με την έκθεση που δημοσιοποιήθηκε την Τρίτη, το μοντέλο Mythos της Anthropic επιχείρησε να αποκτήσει πρόσβαση σε υπηρεσία στέλνοντας ιδιωτικά μηνύματα μέσω ψεύτικων λογαριασμών που μιμούνταν πραγματικά πρόσωπα. Το AISI ανέφερε ότι τόσο το Mythos όσο και το Sol της OpenAI επέδειξαν επίπεδο «αυτονομίας και εξαπάτησης» που δεν είχε παρατηρηθεί ξανά, διευκρινίζοντας ωστόσο ότι οι περισσότερες κακόβουλες ενέργειες αποδίδονται στο Mythos. Οι Anthropic και OpenAI απάντησαν στην έκθεση επισημαίνοντας ότι οι συνθήκες των δοκιμών είχαν περιορίσει ή αφαιρέσει τις συνήθεις δικλίδες ασφαλείας των μοντέλων τους. Η προσπάθεια πρόσβασης στο GitHub Οι αξιολογητές του AISI εντόπισαν αρχικά «ασυνήθιστες μεταφορές δεδομένων» από τα ερευνητικά τους συστήματα και στη συνέχεια διαπίστωσαν ότι ορισμένοι από τους πράκτορες τεχνητής νοημοσύνης που δοκιμάζονταν είχαν εμπλακεί σε παρατεταμένες, δυνητικά επιβλαβείς ενέργειες με […]
Το EIDISIS247 συγκεντρώνει ειδήσεις από έγκυρες και αξιόπιστες πηγές για την καλύτερη ενημέρωσή σας. Για να διαβάσετε την πλήρη είδηση, πατήστε εδώ και μεταβείτε απευθείας στην αρχική πηγή του άρθρου
Επιμέλεια: Eidisis247 | Πηγή: