machine learning

Ερευνητής συγκρίνει διαφορετικές διαμορφώσεις για αξιόπιστο AI benchmark harness

Δεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή

Νέα μελέτη δείχνει ότι 26 έγκυρα evaluation harnesses μπορούν να αλλάξουν δραστικά τα scores και τον νικητή ενός LLM leaderboard. Τι σημαίνει για τις επιχειρήσεις.

Прочетете повечеΔεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή
Μηχανικός ελέγχει κύκλωμα AI για ανεξάρτητη εποπτεία με OWMI

Μπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI

Το OWMI δείχνει ότι η λεκτική αυτοαναφορά οκτώ open-weight μοντέλων έμεινε στην τύχη, παρότι το σήμα υπήρχε στις ενεργοποιήσεις τους.

Прочетете повечеΜπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI
Ελεγχόμενη αξιολόγηση AI μοντέλων σε επαγγελματική δοκιμαστική κουζίνα
Αυτόνομο ρομπότ σε αποθήκη ως παράδειγμα σύζευξης world model, AI agent και περιβάλλοντος

World models στην AI: το κρίσιμο ερώτημα δεν είναι μόνο τι προβλέπουν

Τα world models μπορεί να αφορούν το περιβάλλον, τον agent ή την κοινή διαδικασία. Η σωστή διάκριση καθορίζει support, αξιολόγηση και ασφαλή λειτουργία.

Прочетете повечеWorld models στην AI: το κρίσιμο ερώτημα δεν είναι μόνο τι προβλέπουν
Μηχανικός αλλάζει το φορτίο ρομποτικής πλατφόρμας για εκπαίδευση AI agent

Dynamic Context Scheduling: πώς εκπαιδεύεις AI agents για έναν κόσμο που αλλάζει

Το Dynamic Context Scheduling αλλάζει το context μέσα στο training episode ώστε οι AI agents να δοκιμάζονται σε drift, jumps και άγνωστες συνθήκες.

Прочетете повечеDynamic Context Scheduling: πώς εκπαιδεύεις AI agents για έναν κόσμο που αλλάζει
Екип преценява кога един ИИ-агент трябва да се намеси или да остане в мълчание

Why2Speak: защо обяснението на един AI агент може да промени решението му

Why2Speak показва защо разсъжденията могат да променят политиката на действие на един ИИ агент и какви проверки са необходими преди внедряването.

Прочетете повечеWhy2Speak: защо обяснението на един AI агент може да промени решението му
Υποδομή οπτικών ινών με πολλαπλές διαδρομές για το CTQW-GNN
Изследователи анализират звук, изображение и физическа проба с цел създаване на интерпретируема мултимодална изкуствена интелигентност

Интерпретируема мултимодална изкуствена интелигенция: когато дърветата на решения обясняват какво вижда, чува и чете моделът

Как ансамблите от линейни дискриминантни дървета съчетават текст, звук и изображение и какви „врата“ са необходими на интерпретируемата мултимодална изкуствена интелигентност преди пускането в производство.

Прочетете повечеИнтерпретируема мултимодална изкуствена интелигенция: когато дърветата на решения обясняват какво вижда, чува и чете моделът