Penetration Testing

AI / LLM Security Assessment στην Ελλάδα — Prompt Injection, RAG & Agent Security

Η Audax Cybersecurity ελέγχει εφαρμογές μεγάλων γλωσσικών μοντέλων, RAG αρχιτεκτονικές και agents με τεχνικές πραγματικών επιτιθέμενων. Το firewall δεν βλέπει τίποτα κακό, γιατί η επίθεση δεν είναι κώδικας — είναι κείμενο που πείθει το σύστημα να παραβεί τους δικούς σας κανόνες.

Ο έλεγχος ευθυγραμμίζεται με το OWASP Top 10 for LLM Applications και το MITRE ATLAS, και καλύπτει άμεσο και έμμεσο prompt injection, εξαγωγή δεδομένων και system prompt, κατάχρηση εργαλείων και MCP servers, καθώς και μη ασφαλή χειρισμό της εξόδου προς τα κατάντη συστήματα.

Τι ελέγχουμε

Από το prompt έως το εργαλείο που εκτελεί ενέργειες

Αξιολογούμε ολόκληρη την αλυσίδα ενός AI συστήματος: τι κείμενο φτάνει στο μοντέλο, τι δεδομένα μπορεί να ανακτήσει, τι ενέργειες μπορεί να εκτελέσει και πού καταλήγει η απάντησή του.

01 · Injection

Prompt Injection

Άμεση παράκαμψη κανόνων από τον χρήστη και έμμεση, όπου η οδηγία κρύβεται σε έγγραφο, email ή σελίδα που θα διαβάσει το μοντέλο.

02 · Δεδομένα

Έκθεση Πληροφορίας

Εξαγωγή system prompt και επιχειρησιακής λογικής, ανάκτηση εγγράφων άλλου τμήματος ή πελάτη, εμφάνιση προσωπικών δεδομένων σε απαντήσεις.

03 · Ενέργειες

Κατάχρηση Εργαλείων

Function calling, βάσεις και MCP servers: τι μπορεί να πειστεί το μοντέλο να εκτελέσει, με ποια δικαιώματα και χωρίς ποια έγκριση.

04 · Έξοδος

Χειρισμός Απάντησης

Η έξοδος καταλήγει σε browser, τερματικό ή άλλο σύστημα. Χωρίς καθαρισμό γίνεται XSS, SSRF ή εκτέλεση εντολών.

Το πρόβλημα

Το μοντέλο δεν ξεχωρίζει την οδηγία από τα δεδομένα

Σε μια κλασική εφαρμογή ο κώδικας και τα δεδομένα του χρήστη είναι χωριστά. Σε ένα LLM όλα καταλήγουν στο ίδιο παράθυρο κειμένου: οι οδηγίες σας, η ερώτηση του χρήστη και ό,τι ανακτήθηκε από έγγραφα, email ή ιστοσελίδες. Όποιος καταφέρει να βάλει κείμενο σε οποιοδήποτε από αυτά, μιλάει απευθείας στο μοντέλο. Δεν υπάρχει CVE, δεν υπάρχει υπογραφή, δεν υπάρχει payload να μπλοκαριστεί — υπάρχει μια πρόταση που πείθει το σύστημα, και ο μόνος τρόπος να τη βρείτε είναι να τη δοκιμάσει άνθρωπος.

Η υπηρεσία

Τι κάνει η υπηρεσία

Ο έλεγχος είναι χειροκίνητος και προσαρμοσμένος στη δική σας αρχιτεκτονική. Τα αυτόματα εργαλεία εντοπίζουν τα προφανή· τα σοβαρά ευρήματα προκύπτουν από κατανόηση του τι κάνει η εφαρμογή σας και ποιος έχει δικαίωμα σε τι.

01 · Χαρτογράφηση

Ροή Δεδομένων & Εμπιστοσύνη

Εντοπίζουμε κάθε σημείο όπου μπαίνει κείμενο που δεν ελέγχετε εσείς — χρήστες, έγγραφα, APIs, εξωτερικές πηγές — και τι δικαιώματα κουβαλά καθένα.

02 · Εκμετάλλευση

Χειροκίνητο Testing

Δοκιμάζουμε παραλλαγές injection, jailbreak και αλυσίδες ενεργειών μέχρι να αποδειχθεί πραγματική επίπτωση, όχι απλή παρέκκλιση συμπεριφοράς.

03 · Εξουσιοδότηση

Απομόνωση & Πρόσβαση

Ελέγχουμε αν το RAG σέβεται τα δικαιώματα του χρήστη και αν υπάρχει διαρροή μεταξύ τμημάτων, πελατών ή περιβαλλόντων.

04 · Υποδομή

Κλειδιά, Όρια & Καταγραφή

Διαχείριση κλειδιών μοντέλων, όρια κατανάλωσης, απομόνωση περιβαλλόντων και επάρκεια καταγραφής για διερεύνηση περιστατικού.

Αναλυτικά

Τι εξετάζουμε αναλυτικά

Το εύρος προσαρμόζεται στην αρχιτεκτονική σας. Τα παρακάτω είναι τα σημεία όπου εμφανίζονται σχεδόν όλα τα σοβαρά ευρήματα σε πραγματικά συστήματα παραγωγής.

Έμμεσο Prompt Injection

Οδηγίες κρυμμένες σε PDF, email, ticket ή ιστοσελίδα που ανακτά το σύστημα μόνο του. Είναι η πιο υποτιμημένη κατηγορία, γιατί κανένας χρήστης δεν έγραψε την επίθεση.

System Prompt & Λογική

Εξαγωγή των οδηγιών σας, των ρόλων και των περιορισμών — που συχνά αποκαλύπτουν εσωτερική επιχειρησιακή λογική, ονόματα συστημάτων και κανόνες τιμολόγησης.

RAG & Έλεγχος Πρόσβασης

Αν η ανάκτηση εγγράφων αγνοεί τα δικαιώματα του χρήστη, το chatbot γίνεται ο ταχύτερος τρόπος να διαβάσει κάποιος ό,τι δεν του ανήκει.

Agents & MCP Servers

Τι εκθέτει κάθε εργαλείο, ποιος μπορεί να το ενεργοποιήσει, τι επιστρέφει στο μοντέλο και τι εκτελείται χωρίς ανθρώπινη έγκριση.

Χειρισμός Εξόδου

Markdown, HTML ή εντολές που παράγει το μοντέλο και εκτελούνται κατάντη — κλασικές ευπάθειες εφαρμογών με νέο μεταφορέα.

Αλυσίδα Εφοδιασμού

Προέλευση μοντέλων, plugins τρίτων, εξωτερικά APIs και τι δεδομένα σας φεύγουν προς ποιον πάροχο.

Τι κερδίζετε

Τι κερδίζει ο οργανισμός σας

  • Σαφή εικόνα του τι μπορεί πραγματικά να αποσπάσει ή να εκτελέσει κάποιος μέσω του AI σας
  • Ευρήματα με απόδειξη επίπτωσης — τι δεδομένα βγήκαν, όχι ότι «το μοντέλο παρέκκλινε»
  • Συγκεκριμένες αρχιτεκτονικές διορθώσεις, όχι γενικές συστάσεις για «καλύτερα prompts»
  • Τεκμηρίωση τεχνικού ελέγχου για εσωτερικό audit και ερωτηματολόγια πελατών
  • Επανέλεγχο μετά τις διορθώσεις, γιατί κάθε αλλαγή στο prompt αλλάζει τη συμπεριφορά
Σε ποιους απευθύνεται

Για οργανισμούς που έβγαλαν AI σε παραγωγή

  • Επιχειρήσεις με chatbot προς πελάτες ή εσωτερικό βοηθό γνώσης πάνω σε εταιρικά έγγραφα
  • Ομάδες που ανέπτυξαν agents με δικαίωμα να εκτελούν ενέργειες σε πραγματικά συστήματα
  • Παρόχους λογισμικού που ενσωματώνουν AI και δέχονται ερωτήματα ασφάλειας από πελάτες
  • Οργανισμούς υπό NIS2 ή DORA που πρέπει να τεκμηριώσουν έλεγχο των AI συστημάτων τους
Πώς δουλεύει

Μεθοδολογία ελέγχου

01
ScopeΚαταγράφουμε αρχιτεκτονική, μοντέλα, πηγές δεδομένων, εργαλεία και ρόλους χρηστών, και συμφωνούμε γραπτώς όρια και περιβάλλον δοκιμής.
SCOPE
02
MapΧαρτογραφούμε κάθε σημείο εισόδου κειμένου που δεν ελέγχετε, και τα όρια εμπιστοσύνης μεταξύ χρήστη, δεδομένων και εργαλείων.
MAP
03
InjectΔοκιμάζουμε άμεσο και έμμεσο prompt injection, jailbreak και παράκαμψη guardrails σε κάθε διαδρομή εισόδου.
INJECT
04
ExtractΕπιχειρούμε εξαγωγή system prompt, εγγράφων εκτός δικαιωμάτων και προσωπικών δεδομένων μέσα από τη ροή ανάκτησης.
EXTRACT
05
AbuseΕλέγχουμε τι ενέργειες μπορούν να πυροδοτηθούν μέσω εργαλείων και MCP, και τι εκτελείται χωρίς ανθρώπινη έγκριση.
ABUSE
06
ReportΠαραδίδουμε ευρήματα με βήματα αναπαραγωγής, απόδειξη επίπτωσης και ιεραρχημένες αρχιτεκτονικές διορθώσεις, με επανέλεγχο μετά.
REPORT
Erevos AI

Ενσωμάτωση με το Erevos AI

Τα ευρήματα του AI assessment τροφοδοτούν τους κύκλους συνεχούς επαλήθευσης του Erevos AI, ώστε κάθε νέα έκδοση του prompt, νέα πηγή δεδομένων ή νέο εργαλείο να ελέγχεται ξανά αντί να θεωρείται ασφαλές επειδή ήταν την προηγούμενη φορά.

Τι παραδίδουμε

Ευρήματα που μπορεί να διορθώσει η ομάδα ανάπτυξης

Κάθε αναφορά γράφεται για να χρησιμοποιηθεί: το ακριβές prompt ή αρχείο που ενεργοποιεί το πρόβλημα, τι πέτυχε, και τι αλλαγή το κλείνει.

A

Τεχνική Αναφορά

Πλήρης καταγραφή ευρημάτων με κρισιμότητα και απόδειξη.

  • Ακριβές prompt ή αρχείο αναπαραγωγής
  • Τι δεδομένα ή ενέργειες επιτεύχθηκαν
  • Χαρτογράφηση σε OWASP LLM Top 10 και MITRE ATLAS
B

Αρχιτεκτονικές Συστάσεις

Διορθώσεις σε επίπεδο σχεδιασμού, όχι μπαλώματα στο prompt.

  • Διαχωρισμός οδηγιών από ανακτημένα δεδομένα
  • Έλεγχος πρόσβασης στη ροή RAG
  • Ανθρώπινη έγκριση πριν από κρίσιμες ενέργειες
C

Επανέλεγχος

Επιβεβαίωση ότι οι διορθώσεις κράτησαν.

  • Στοχευμένη επανάληψη των κρίσιμων ευρημάτων
  • Έλεγχος ότι δεν άνοιξαν νέες διαδρομές
  • Τεκμηρίωση για audit και πελάτες
Δωρεάν Εργαλείο

AI / LLM Security Checklist

Τα σημεία που πρέπει να έχουν απάντηση πριν βγει ένα AI σύστημα σε παραγωγή. Χρησιμοποιήστε το για να δείτε πού βρίσκεστε.

Είσοδος & Injection

Υπάρχει διαχωρισμός ανάμεσα στις οδηγίες σας και στο περιεχόμενο που ανακτά το σύστημα;
Ελέγχεται το περιεχόμενο εγγράφων και εξωτερικών πηγών, όχι μόνο η ερώτηση του χρήστη;
Έχει δοκιμαστεί έμμεσο injection μέσα από αρχείο ή ιστοσελίδα;

Δεδομένα & Πρόσβαση

Σέβεται η ανάκτηση εγγράφων τα δικαιώματα του συγκεκριμένου χρήστη;
Υπάρχει απομόνωση μεταξύ τμημάτων, πελατών και περιβαλλόντων;
Τι συμβαίνει αν κάποιος ζητήσει το system prompt σας;

Ενέργειες & Εργαλεία

Ποιες ενέργειες μπορεί να εκτελέσει το μοντέλο χωρίς ανθρώπινη έγκριση;
Έχουν τα εργαλεία και οι MCP servers ελάχιστα απαραίτητα δικαιώματα;
Καταγράφεται κάθε κλήση εργαλείου με τον χρήστη που την προκάλεσε;

Έξοδος & Παρακολούθηση

Καθαρίζεται η έξοδος πριν εμφανιστεί σε browser ή εκτελεστεί κατάντη;
Υπάρχουν όρια κατανάλωσης ώστε μια κατάχρηση να μη γίνει κόστος;
Θα μπορούσατε να ανασυνθέσετε τι συνέβη μετά από ένα περιστατικό;
Συχνές Ερωτήσεις

Συχνές ερωτήσεις για AI / LLM Security Assessment

Χρησιμοποιούμε έτοιμο μοντέλο τρίτου. Έχει νόημα ο έλεγχος;

Έχει, και συνήθως περισσότερο. Το μοντέλο του παρόχου είναι το ένα κομμάτι. Δικά σας είναι το system prompt, τα έγγραφα που του δίνετε, τα εργαλεία που του επιτρέπετε να καλέσει και το τι κάνετε με την απάντηση.

Σχεδόν όλα τα σοβαρά ευρήματα εμφανίζονται σε αυτά τα σημεία, όχι μέσα στο ίδιο το μοντέλο.

Έχουμε ήδη guardrails και φίλτρα. Δεν αρκούν;

Τα φίλτρα ανεβάζουν τον πήχη, δεν τον κλείνουν. Τα περισσότερα ελέγχουν την ερώτηση του χρήστη, όχι το περιεχόμενο που ανακτά το σύστημα μόνο του.

Το έμμεσο injection μέσα από ένα έγγραφο περνά ακριβώς από εκεί, γι' αυτό και ελέγχεται ξεχωριστά.

Πόσο διαρκεί ο έλεγχος;

Ένα τυπικό chatbot ή RAG assistant ολοκληρώνεται σε 5 έως 10 εργάσιμες ημέρες.

Συστήματα με agents και εργαλεία που εκτελούν ενέργειες χρειάζονται περισσότερο, γιατί ελέγχεται κάθε διαδρομή που μπορεί να ενεργοποιηθεί.

Θα επηρεαστεί το παραγωγικό σύστημα;

Προτιμούμε περιβάλλον δοκιμών με αντιπροσωπευτικά δεδομένα.

Όπου ο έλεγχος πρέπει να γίνει σε παραγωγή, συμφωνούνται γραπτώς όρια, ώρες και ενέργειες που δεν εκτελούνται — ιδίως σε agents με δικαίωμα εγγραφής.

Ελέγχετε και MCP servers;

Ναι. Είναι από τα πιο κρίσιμα σημεία, γιατί δίνουν στο μοντέλο πραγματικές δυνατότητες.

Εξετάζουμε τι εκθέτει κάθε server, ποιος μπορεί να το καλέσει, τι επιστρέφει στο μοντέλο και τι εκτελείται χωρίς ανθρώπινη έγκριση.

Καλύπτει απαιτήσεις του AI Act ή της NIS2;

Παράγει τεκμηριωμένο αποδεικτικό τεχνικού ελέγχου του AI συστήματος, αξιοποιήσιμο σε αξιολόγηση κινδύνου και σε ερωτηματολόγια πελατών.

Δεν αντικαθιστά τη νομική αξιολόγηση συμμόρφωσης.

Επικοινωνία

Τι θα κάνει το AI σας αν του το ζητήσει ο λάθος άνθρωπος;

Περιγράψτε μας την αρχιτεκτονική σας — μοντέλο, πηγές δεδομένων, εργαλεία και πού καταλήγει η απάντηση. Προτείνουμε το κατάλληλο εύρος ελέγχου και παραδίδουμε ευρήματα με αποδείξεις, όχι εικασίες.

[email protected] · +30 210 9839367

Offensive Security · Penetration Testing

Χρειάζεστε Penetration Testing για τον οργανισμό σας;

Περιγράψτε το scope του ελέγχου μέσα από το δομημένο ερωτηματολόγιο και λάβετε εξατομικευμένη τεχνική & οικονομική προσφορά από την ομάδα Offensive Security της Audax. Χωρίς αυτόματη τιμή ή δέσμευση — η προσφορά αποστέλλεται μετά από τεχνική αξιολόγηση του scope.

Ζητήστε προσφορά Penetration Testing →
Ζητήστε δωρεάν αξιολόγηση