AI governance

Два роботизирани AI агента се координират чрез обща връзка в промишлена лаборатория

Действително ли «говорят» AI агентите? Какво разкрива причинно-следственият анализ на латентните съобщения

Латентната комуникация между AI агентите изисква проверка на причинно-следствените връзки, а не само точност. Вижте какво разкриват CAG, SSG и контролираните замествания.

Прочетете повечеДействително ли «говорят» AI агентите? Какво разкрива причинно-следственият анализ на латентните съобщения
Ασφάλεια LLM μετά το fine-tuning σε περιβάλλον πολλαπλών prompt templates

Ασφάλεια LLM μετά το fine-tuning: γιατί το prompt template μπορεί να ακυρώσει την άμυνα

Η ασφάλεια LLM μετά το fine-tuning απαιτεί cross-template tests. Δείτε πώς το ROPD μειώνει το ASR χωρίς να θυσιάζει την εξειδικευμένη ικανότητα.

Прочетете повечеΑσφάλεια LLM μετά το fine-tuning: γιατί το prompt template μπορεί να ακυρώσει την άμυνα
Ομάδα ελέγχει δεδομένα εκπαίδευσης AI για ιχνηλασιμότητα με FrED και knowledge graphs

FrED: πώς τα knowledge graphs φωτίζουν τα δεδομένα πίσω από ένα AI

Το FrED συνδυάζει latent similarity και knowledge graphs για black-box Training Data Attribution. Τι έδειξαν τα πειράματα, πού σταματά η απόδειξη και πώς μπορεί να αξιολογηθεί επιχειρηματικά.

Прочетете повечеFrED: πώς τα knowledge graphs φωτίζουν τα δεδομένα πίσω από ένα AI
Ομάδα ελέγχει Incomplete Prompt Jailbreaks και ασφάλεια LLM
Παρασυνεπής απαγωγή σε επιχειρησιακό AI workflow με δύο αντικρουόμενες ομάδες στοιχείων

Παρασυνεπής απαγωγή: πώς η AI εξετάζει αντιφατικές εξηγήσεις χωρίς να καταρρέει

Η παρασυνεπής απαγωγή δείχνει πώς ένα AI σύστημα μπορεί να εξετάζει αντικρουόμενες εξηγήσεις χωρίς αυθαίρετα συμπεράσματα. Τι σημαίνει για agents, εταιρικά δεδομένα και ασφαλείς αυτοματισμούς.

Прочетете повечеΠαρασυνεπής απαγωγή: πώς η AI εξετάζει αντιφατικές εξηγήσεις χωρίς να καταρρέει
Ομάδα αξιολογεί υποδομή για Inkling open-weight AI σε επιχειρησιακή εγκατάσταση

Inkling: τι αλλάζει το αμερικανικό open-weight AI για τις επιχειρήσεις

Το Inkling φέρνει open-weight AI για επιχειρήσεις, με multimodal δυνατότητες και fine-tuning, αλλά απαιτεί αυστηρό έλεγχο κόστους, υποδομής και ρίσκου.

Прочетете повечеInkling: τι αλλάζει το αμερικανικό open-weight AI για τις επιχειρήσεις
Ανεξάρτητος έλεγχος AI agent με διαχωρισμό ρόλων και ανθρώπινη εποπτεία

Όταν το AI πείθει τον ελεγκτή του: το κρυφό ρίσκο του Chain-of-Thought monitoring

Νέα έρευνα δείχνει πώς ένας AI agent μπορεί να πείσει τον monitor του και γιατί το ασφαλές CoT monitoring απαιτεί ανεξάρτητο fact-checking και κανόνες.

Прочетете повечеΌταν το AI πείθει τον ελεγκτή του: το κρυφό ρίσκο του Chain-of-Thought monitoring