Τεχνολογία

Astra: Η OpenAI ανεβάζει τον πήχη στην κυβερνοασφάλεια των AI agents

T
Toggle Tech Team
📅 September 7, 2026 ⏱ 2 min read 👁 0 views
Astra: Η OpenAI ανεβάζει τον πήχη στην κυβερνοασφάλεια των AI agents

Η OpenAI χαρακτηρίζει το Astra ως το πρώτο μοντέλο της που περνά το κρίσιμο όριο ικανότητας στην κυβερνοασφάλεια. Η εταιρεία ενισχύει τις δικλίδες, περιορίζει την αρχική πρόσβαση και δίνει έμφαση στην αμυντική χρήση, καθώς οι agents μπορούν πλέον να εντοπίζουν άγνωστες ευπάθειες και να συνθέτουν σύνθετες αλυσίδες εκμετάλλευσης.

Η OpenAI χαρακτηρίζει το Astra ως το πρώτο μοντέλο της που περνά το «κρίσιμο» όριο ικανότητας στην κυβερνοασφάλεια. Με τα κατάλληλα εργαλεία και πρόσβαση, η εταιρεία λέει ότι το μοντέλο μπορεί να εντοπίζει άγνωστες ευπάθειες και να συνθέτει αλυσίδες εκμετάλλευσης σε καλά προστατευμένα συστήματα χωρίς συνεχή ανθρώπινη καθοδήγηση.

Ένα νέο όριο για τα μοντέλα AI

Στο Preparedness Framework της OpenAI, ένα μοντέλο θεωρείται κρίσιμης ικανότητας όταν μπορεί είτε να εντοπίζει και να αναπτύσσει λειτουργικά exploits για zero-day ευπάθειες σε πολλά πραγματικά κρίσιμα συστήματα είτε να σχεδιάζει και να εκτελεί ολοκληρωμένες, νέες στρατηγικές κυβερνοεπίθεσης εναντίον προστατευμένων στόχων.

Η αξιολόγηση του Astra συνδύασε δημόσια και ιδιωτικά benchmarks με ελέγχους από ειδικούς. Η OpenAI αναφέρει ότι το μοντέλο πέτυχε 100% στο ExploitBench για γνωστές ευπάθειες και, σε εσωτερικό σύνολο νεότερων προβλημάτων, εντόπισε δύο zero-day ευπάθειες μέσα σε αλυσίδα εκμετάλλευσης. Η εταιρεία δηλώνει ότι βρίσκεται στη διαδικασία υπεύθυνης γνωστοποίησής τους στους διαχειριστές των αντίστοιχων συστημάτων.

Οι δικλίδες ασφαλείας προηγούνται της κυκλοφορίας

Η αναγνώριση της ικανότητας δεν οδήγησε σε άμεση, ευρεία διάθεση. Η OpenAI καθυστέρησε τμήματα της ανάπτυξης και της κυκλοφορίας, ενίσχυσε τις δοκιμές κατά της κακόβουλης χρήσης και μετέφερε τα πειράματα του Astra σε περιβάλλοντα με αυστηρότερους κανόνες ασφάλειας.

Η εταιρεία λέει ότι το μοντέλο εκπαιδεύτηκε να αρνείται πιο αξιόπιστα επικίνδυνα αιτήματα κυβερνοασφάλειας και ότι το ποσοστό άρνησης σε συγκεκριμένες δοκιμές jailbreak έφτασε το 91,5%, έναντι 59% για το GPT-5.6 Sol. Παράλληλα, χρησιμοποιεί ταξινομητές σε επίπεδο συστήματος, offline ανίχνευση και συνεχή παρακολούθηση για να εντοπίζει πιθανή κατάχρηση.

Η πρόσβαση θα είναι περιορισμένη

Το Astra αναμένεται να γίνει διαθέσιμο σύντομα, όμως οι πιο προχωρημένες δυνατότητές του στην κυβερνοασφάλεια θα δοθούν αρχικά σε μικρή ομάδα testers. Η OpenAI σχεδιάζει στη συνέχεια πρόσβαση μέσω του Daybreak Blue, με έμφαση σε αμυντικές χρήσεις που βοηθούν οργανισμούς να εντοπίζουν και να διορθώνουν ευπάθειες.

Αυτό σημαίνει ότι οι χρήστες μπορεί να συναντούν περισσότερη «τριβή» από ό,τι σε ένα συνηθισμένο μοντέλο: μια εργασία μπορεί να επιβραδυνθεί, να παγώσει ή να σταματήσει αν το σύστημα ανιχνεύσει πιθανή κατάχρηση. Η OpenAI αναγνωρίζει ότι οι έλεγχοι μπορεί να επηρεάσουν ακόμη και νόμιμες αμυντικές εργασίες, ειδικά όταν ένας agent εκτελεί μια μακρά ή ασυνήθιστη ακολουθία ενεργειών.

Το δύσκολο σημείο είναι ο έλεγχος

Η ανακοίνωση δείχνει πόσο γρήγορα η AI μετακινείται από την ανάλυση κώδικα στην ανάληψη σύνθετων ενεργειών. Το ίδιο μοντέλο μπορεί να βοηθήσει μια ομάδα άμυνας να βρει ένα πρόβλημα πριν από τους επιτιθέμενους, αλλά η αξία του εξαρτάται από το αν οι δικλίδες μπορούν να εμποδίσουν μη εξουσιοδοτημένες ενέργειες και να περιορίσουν τη ζημιά όταν κάτι πάει στραβά.

Γι’ αυτό η OpenAI αντιμετωπίζει την ευθυγράμμιση και την παρακολούθηση ως ξεχωριστό επίπεδο προστασίας, όχι ως εγγύηση ότι το μοντέλο θα συμπεριφέρεται πάντα σωστά. Η πραγματική δοκιμασία για το Astra θα είναι αν μπορεί να προσφέρει ουσιαστική βοήθεια στους αμυνόμενους, ενώ ταυτόχρονα η πρόσβαση, η κλιμάκωση και οι αποφάσεις του παραμένουν ελέγξιμες από ανθρώπους.

T

Toggle Tech Team

Editor-in-chief at Toggle. Covering technology and global affairs.