Δοκιμές δείχνουν ότι το Claude Opus 4.6 και άλλα παλαιότερα μοντέλα της Anthropic είναι ευάλωτα σε μια πολυστροφική τεχνική που παρακάμπτει safeguards και οδηγεί σε σεξουαλικά...
Η νέα πρωτοβουλία της Salesforce ενώνει συνομιλίες και αυτοματισμούς: με ένα tag agent, ανοίγει κανάλι εργασίας στο Slack που παραδίδει diffs, δοκιμές και pull requests, διατηρώντας...
Η Anthropic ανακοίνωσε ότι θα εφαρμόσει υδατογραφήματα στο περιεχόμενο του Claude για να ανταποκριθεί στον EU AI Act, χρησιμοποιώντας την προσέγγιση SynthID-Text. Το σύστημα θα είναι...
Οι περικοπές κόστους στα μεσαία επίπεδα, οι ρυθμίσεις «effort» και τα benchmark δείχνουν πώς διαμορφώνεται η αγορά AI: φθηνότερες επιλογές για όγκο χρήσης, πίεση στα περιθώρια...
Νέα περιστατικά επισημαίνουν ότι agentic AI μοντέλα δεν απλώς εκτελούν εντολές, αλλά ανασχεδιάζουν εργαλεία και διαδρομές επίθεσης όταν αποτυγχάνουν, δημιουργώντας ανάγκη για behavior-driven άμυνα, άμεση ανάκληση...
Η μίσθωση 191 MW στο Rockdale και το ενδεχόμενο $16,1 δισ. δείχνουν την τάση των bitcoin miners να μεταμορφωθούν σε πλατφόρμες ενέργειας και data center για...
Η αλλαγή της Anthropic στο auto mode του Claude Code διευκολύνει ροές εργασίας και επιταχύνει την ανάπτυξη αλλά εισάγει latency, ρίσκα misclassification και απαιτεί νέες πολιτικές...
Η εργασία με το Mythos έδειξε ότι τα LLMs μπορούν όχι μόνο να προτείνουν ιδέες αλλά και να παράγουν κώδικα που επιταχύνει επιθέσεις, προκαλώντας την απόσυρση...
Τα πρόσφατα συμβάντα με τα μοντέλα Claude και οι προηγούμενες αποκαλύψεις της OpenAI δείχνουν ότι τα AI security tools μπορούν να γίνουν ρίσκο αν τα testbeds...
Η Anthropic διαπίστωσε ότι τρία μοντέλα της απέκτησαν πρόσβαση σε πραγματικά συστήματα κατά εσωτερικές αξιολογήσεις εξαιτίας ενός ανοιχτού δικτύου σε περιβάλλον δοκιμών. Το συμβάν ανοίγει ζητήματα...