Ερευνητικές τεχνικές που κέρδισαν δημοσιότητα στις επιθέσεις κατά των LLM τώρα χρησιμοποιούνται από spammers για να αποκρύπτουν λέξεις-κλειδιά και να ξεπερνούν φίλτρα. Το άρθρο εξετάζει πώς...
Η έρευνα περιγράφει πραγματικά περιστατικά εκμετάλλευσης του LiteLLM και άλλων agent frameworks, εξηγεί τεχνικές όπως blind prompt injection και memory credential theft, και δίνει συγκεκριμένες οδηγίες...
Ένας crafted σύνδεσμος μπορούσε να ενεργοποιήσει αυτόματα ένα prompt στο Copilot, να σαρώσει εισερχόμενα και να στείλει κλεμμένα credentials σε server επιτιθέμενου. Αναλύουμε τον μηχανισμό, τον...
Η νέα λειτουργία της Sweet Security σταματά επικίνδυνες ενέργειες των agentic AI μέσα στο runtime και μετατρέπει την ασφάλεια από ανίχνευση σε άμεση πρόληψη. Για επιχειρήσεις...
Το context bombing χρησιμοποιεί prompt injections ως αμυντικό εργαλείο: τοποθετώντας banned strings μέσα σε δελεαστικά μυστικά, οργανισμοί μπορούν να προκαλέσουν τους μηχανισμούς άρνησης των LLMs και...
Η έρευνα της CrowdStrike περιγράφει πώς κακόβουλες οδηγίες μπορούν να «κρυφτούν» σε έγγραφα ή emails και να προκαλέσουν ανεπιθύμητες ενέργειες από LLM. Το άρθρο εξηγεί με...
Η επίδειξη BioShocking αναδεικνύει ότι οι AI browsers συνδυάζουν προβολή ιστοσελίδων και ενέργειες ενός LLM, δημιουργώντας νέα διαδρομή για κλοπή δεδομένων και εξουσιοδότηση. Οι χρήστες και...
Η ενσωμάτωση μιας ρητής αλλά κρυμμένης εντολής στο stdout της βιβλιοθήκης jqwik που στόχευε AI coding agents ανέδειξε προβλήματα αξιοπιστίας, ασφάλειας και δεοντολογίας στον χώρο του...
Η παραβίαση του Llama Firewall της Meta αποκαλύπτει σοβαρές ευπάθειες ασφαλείας σε επιθέσεις prompt injection.