machine learning

Ερευνητής συγκρίνει διαφορετικές διαμορφώσεις για αξιόπιστο AI benchmark harness

Δεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή

Νέα μελέτη δείχνει ότι 26 έγκυρα evaluation harnesses μπορούν να αλλάξουν δραστικά τα scores και τον νικητή ενός LLM leaderboard. Τι σημαίνει για τις επιχειρήσεις.

Read MoreΔεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή
Μηχανικός ελέγχει κύκλωμα AI για ανεξάρτητη εποπτεία με OWMI

Μπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI

Το OWMI δείχνει ότι η λεκτική αυτοαναφορά οκτώ open-weight μοντέλων έμεινε στην τύχη, παρότι το σήμα υπήρχε στις ενεργοποιήσεις τους.

Read MoreΜπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI
Αυτόνομο ρομπότ σε αποθήκη ως παράδειγμα σύζευξης world model, AI agent και περιβάλλοντος

World models στην AI: το κρίσιμο ερώτημα δεν είναι μόνο τι προβλέπουν

Τα world models μπορεί να αφορούν το περιβάλλον, τον agent ή την κοινή διαδικασία. Η σωστή διάκριση καθορίζει support, αξιολόγηση και ασφαλή λειτουργία.

Read MoreWorld models στην AI: το κρίσιμο ερώτημα δεν είναι μόνο τι προβλέπουν
Υποδομή οπτικών ινών με πολλαπλές διαδρομές για το CTQW-GNN

CTQW-GNN: πώς οι κβαντικοί περίπατοι επιχειρούν να λύσουν δύο αδυναμίες των graph neural networks

Πώς το CTQW-GNN χρησιμοποιεί κλασικά προσομοιωμένους κβαντικούς περιπάτους για heterophily και over-smoothing και τι χρειάζεται πριν από το production.

Read MoreCTQW-GNN: πώς οι κβαντικοί περίπατοι επιχειρούν να λύσουν δύο αδυναμίες των graph neural networks
Ερευνητές αξιολογούν ήχο, εικόνα και φυσικό δείγμα για ερμηνεύσιμη multimodal AI