Ασφάλεια AI

Ομάδα ελέγχει AI agent πριν από σύνδεση με παραγωγικά επιχειρησιακά συστήματα

Από το AI agent demo στην παραγωγή: τα 5 «τείχη» που πρέπει να γκρεμίσει μια επιχείρηση

Τα AI agents στην παραγωγή χρειάζονται ταυτότητα, περιορισμένο context, ασφαλή tools, ανθεκτικό state, audit trail και ανθρώπινη έγκριση.

WeiterlesenΑπό το AI agent demo στην παραγωγή: τα 5 «τείχη» που πρέπει να γκρεμίσει μια επιχείρηση
Ασφάλεια LLM μετά το fine-tuning σε περιβάλλον πολλαπλών prompt templates

Ασφάλεια LLM μετά το fine-tuning: γιατί το prompt template μπορεί να ακυρώσει την άμυνα

Η ασφάλεια LLM μετά το fine-tuning απαιτεί cross-template tests. Δείτε πώς το ROPD μειώνει το ASR χωρίς να θυσιάζει την εξειδικευμένη ικανότητα.

WeiterlesenΑσφάλεια LLM μετά το fine-tuning: γιατί το prompt template μπορεί να ακυρώσει την άμυνα
Ελεγχόμενη δοκιμή αυτόνομου agent για επαλήθευση reinforcement learning

Επαλήθευση πολιτικών reinforcement learning: πότε μπορούμε να εμπιστευτούμε έναν AI agent;

Η επαλήθευση reinforcement learning εξετάζει τι μπορούμε πραγματικά να εγγυηθούμε για έναν AI agent, από step-wise και multi-step ελέγχους έως preimage analysis και ανθρώπινη εποπτεία.

WeiterlesenΕπαλήθευση πολιτικών reinforcement learning: πότε μπορούμε να εμπιστευτούμε έναν AI agent;