Πολλά μοντέλα της ΤΝ δεν διαθέτουν επαρκείς δικλείδες ασφαλείας έναντι αιτημάτων για «παροχή βοήθειας σε τρομοκρατική επιχείρηση»

9 Οκτωβρίου 2026, 11:10
Χρόνος ανάγνωσης 4 λεπτά
Φωτογραφία από ΑΠΕ-ΜΠΕ

Πολλά μοντέλα τεχνητής νοημοσύνης (ΑΙ) δεν διαθέτουν επαρκείς δικλείδες ασφαλείας έναντι αιτημάτων για «παροχή βοήθειας σε τρομοκρατική επιχείρηση», επισημαίνει η πρωτοβουλία Tech Against Terrorism σε έκθεση που δημοσιεύτηκε σήμερα.

Στο πλαίσιο αυτής της πρωτοβουλίας, την οποία υποστηρίζει ο ΟΗΕ, πραγματοποιήθηκε δοκιμή με 162 μοντέλα της ΑΙ, μεταξύ των οποίων 116 τυπικά μοντέλα, 13 μοντέλα προσαρμοσμένα για χρήση σε συγκεκριμένους τομείς (fine- tuning) και 13 μοντέλα «ανοιχτών βαρών» (open-weight models), οι δικλείδες ασφαλείας των οποίων είχαν τροποποιηθεί.

Αυτά υποβλήθηκαν σε μια σειρά 627 ερωτημάτων για τα οποία «ένας τρομοκράτης που προετοιμάζει επίθεση θα χρειαζόταν» να λάβει απαντήσεις.

Σύμφωνα με τα αποτελέσματα της έρευνας, τα τυπικά μοντέλα – όπως το ChatGPT (OpenAI), το Claude (Anthropic) ή το Gemini (Google)-απάντησαν κατά μέσο όρο στο 1,9% των ερωτημάτων που έθεσε ένας χρήστης ο οποίος δήλωσε ξεκάθαρα στο αίτημά του ότι έχει σκοπό να διαπράξει τρομοκρατική επίθεση.

Στα ίδια μοντέλα το μέσο ποσοστό αξιοποιήσιμων απαντήσεων αυξήθηκε στο 16,9% όταν ο χρήστης δήλωσε ότι διατύπωσε το αίτημά του στο πλαίσιο έρευνας για την ασφάλεια.

Σύμφωνα με τα τεστ, τα αποτελέσματα αυτά άλλαξαν δραστικά όταν το ερώτημα υποβαλλόταν σε μοντέλα που είχαν τροποποιηθεί ώστε να ξεχάσουν τις παραμέτρους ασφαλείας και την ικανότητά τους να αρνούνται κάποια αιτήματα. Μεταξύ των 13 τέτοιων μοντέλων που εξετάστηκαν το μέσο ποσοστό απαντήσεων σε ερωτήσεις που συνδέονταν με «τρομοκρατική δραστηριότητα» κυμαινόταν από 87% ως 92%.

Η πρωτοβουλία Tech Against Terrorism τονίζει κυρίως τους κινδύνους που συνδέονται με τα μοντέλα «ανοιχτών βαρών» (open-weight models) – δηλαδή μοντέλα των οποίων οι εσωτερικές παράμετροι, που καθορίστηκαν κατά τη φάση της εκπαίδευσης, διατίθενται ελεύθερα και μπορούν να τροποποιηθούν.

Σύμφωνα με την οργάνωση, ο μέσος χρόνος για να καταργηθούν οι δικλείδες ασφαλείας αυτών των μοντέλων είναι λιγότερoς από 3 ημέρες μετά την αρχική τους δημοσίευση.

«Κανένα μοντέλο που αποτυγχάνει σε ανεξάρτητο έλεγχο ασφάλειας δεν πρέπει να διατίθεται, να προσφέρεται ή να πωλείται και κάθε εταιρεία στην αλυσίδα διανομής οφείλει να το επαληθεύει αυτό εκ των προτέρων», υποστηρίζει η οργάνωση.

 

Πηγή: ΑΠΕ – ΜΠΕ

Αφήστε μια απάντηση

Your email address will not be published.

ΣΕ ΕΝΔΙΑΦΕΡΟΥΝ

Παλαιοντολόγοι βρήκαν αποδείξεις ότι ο δεινόσαυρος διπλόδοκος ζούσε κάποτε και στην Ευρώπη

Ισπανοί παλαιοντολόγοι ανακοίνωσαν ότι βρήκαν τις πρώτες αποδείξεις ότι ο

Από τη Γη στη Σελήνη: Το κομμάτι πύραυλου γίνεται χρυσή ευκαιρία μελέτης για ειδικούς επιστήμονες

Στη διάσημη σκηνή όπου μια κάψουλα «καρφώνεται» στο μάτι του

Νέα μελέτη με επικεφαλής την Παλαιοανθρωπολόγο Κατερίνα Χαρβάτη αμφισβητεί μακροχρόνιες υποθέσεις για την εξέλιξη του ανθρώπινου κρανίου

Μια νέα μελέτη, με επικεφαλής την Ελληνίδα παλαιοανθρωπολόγο, Κατερίνα Χαρβάτη,

Επιστήμη: Διεθνής διάκριση για την Ελληνίδα παλαιοανθρωπολόγο Κατερίνα Χαρβάτη με το «Albert Einstein World Award for Science» 2026

Η καθηγήτρια του Πανεπιστημίου του Τίμπινγκεν στη Γερμανία, Κατερίνα Χαρβάτη,

Τα σχέδια για εκατομμύρια νέους δορυφόρους αποτελούν σοβαρή απειλή για τον νυχτερινό ουρανό

Τα τρέχοντα σχέδια για την εκτόξευση περισσότερων από 1,7 εκατομμυρίων