AI Models

Ερευνητές ελέγχουν υποδομή για monitoring των activations σε LLMs

Μπορούν τα LLMs να κρύψουν τη σκέψη τους; Το benchmark που μετρά τον έλεγχο των activations

Το Activation Controllability Benchmark δείχνει ότι πολλά LLMs αλλάζουν το εσωτερικό τους σήμα με οδηγία, άρα το monitoring χρειάζεται layered safeguards.

Read MoreΜπορούν τα LLMs να κρύψουν τη σκέψη τους; Το benchmark που μετρά τον έλεγχο των activations
Αστικό τοπίο για CLIP και περιφερειακό γεωεντοπισμό

Τι μαθαίνει το CLIP για μια πόλη; Η προσαρμογή αποκαλύπτει τη δύναμη της σκηνής

Η προσαρμογή του CLIP βελτιώνει τον περιφερειακό γεωεντοπισμό, αλλά το scene configuration και το train–test overlap καθορίζουν την ερμηνεία.

Read MoreΤι μαθαίνει το CLIP για μια πόλη; Η προσαρμογή αποκαλύπτει τη δύναμη της σκηνής
Μηχανικός ελέγχει κύκλωμα AI για ανεξάρτητη εποπτεία με OWMI

Μπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI

Το OWMI δείχνει ότι η λεκτική αυτοαναφορά οκτώ open-weight μοντέλων έμεινε στην τύχη, παρότι το σήμα υπήρχε στις ενεργοποιήσεις τους.

Read MoreΜπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI