AI Safety

Ανθρώπινη εποπτεία σε στόλο drones με agentic AI

Agentic AI και στόλοι drones: η αυτονομία χρειάζεται διακυβέρνηση

Τι δείχνουν τα έργα NAMUR και PERSIST για την ασφαλή χρήση agentic AI σε στόλους drones, από την ανθρώπινη έγκριση έως τα ελέγξιμα εργαλεία και την αξιολόγηση.

Прочетете повечеAgentic AI και στόλοι drones: η αυτονομία χρειάζεται διακυβέρνηση
Σύμβουλος εξετάζει πότε η AI πρέπει να ρωτά πριν απαντήσει

Ask or Answer: πότε ένα AI πρέπει να ρωτά πριν διορθώσει λάθος πληροφορίες

Το RO-PnR μαθαίνει πότε ένα AI πρέπει να ζητά διευκρίνιση και πότε να απαντά, συνυπολογίζοντας ποιότητα, κόστος και ασφάλεια.

Прочетете повечеAsk or Answer: πότε ένα AI πρέπει να ρωτά πριν διορθώσει λάθος πληροφορίες
Ερευνητές ελέγχουν υποδομή για monitoring των activations σε LLMs
Μηχανικός ελέγχει κύκλωμα AI για ανεξάρτητη εποπτεία με OWMI

Μπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI

Το OWMI δείχνει ότι η λεκτική αυτοαναφορά οκτώ open-weight μοντέλων έμεινε στην τύχη, παρότι το σήμα υπήρχε στις ενεργοποιήσεις τους.

Прочетете повечеΜπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI
Екип преценява кога един ИИ-агент трябва да се намеси или да остане в мълчание

Why2Speak: защо обяснението на един AI агент може да промени решението му

Why2Speak показва защо разсъжденията могат да променят политиката на действие на един ИИ агент и какви проверки са необходими преди внедряването.

Прочетете повечеWhy2Speak: защо обяснението на един AI агент може да промени решението му
Екип оценява два AI агента по различни траектории на действие в една и съща среда

AI агенти: защо успехът не е достатъчен без тестване на поведението

Поведенческото тестване проучва как действат ИИ агентите, така че един и същ процент на успех да не се приема автоматично като доказателство за надеждна стратегия.

Прочетете повечеAI агенти: защо успехът не е достатъчен без тестване на поведението
AI υπό πίεση σε συγκριτική αξιολόγηση γλωσσικών μοντέλων

AI υπό πίεση: γιατί τα κορυφαία γλωσσικά μοντέλα αντιδρούν τόσο διαφορετικά

Νέα μελέτη δείχνει πώς έξι γλωσσικά μοντέλα διαφέρουν σε διευκρίνιση, άρνηση και ασφαλή εναλλακτική υπό πίεση και τι μετρά μια επιχείρηση.

Прочетете повечеAI υπό πίεση: γιατί τα κορυφαία γλωσσικά μοντέλα αντιδρούν τόσο διαφορετικά