Oktober 2026

Ομάδα αξιολογεί το reward design και το περιβάλλον ενός AI agent

ERDM: όταν η «λανθασμένη» συμπεριφορά είναι λογική απάντηση σε λάθος περιβάλλον

Το ERDM δείχνει γιατί ένας AI agent μπορεί να μαθαίνει σωστά και να δρα λάθος όταν οι ανταμοιβές, οι επιλογές και το περιβάλλον του συγκρούονται.

WeiterlesenERDM: όταν η «λανθασμένη» συμπεριφορά είναι λογική απάντηση σε λάθος περιβάλλον
Ομάδα συγκρίνει παρόμοια προϊόντα με interactive visual grounding πριν αποφασίσει

Interactive visual grounding: γιατί το AI πρέπει να μάθει να ρωτά πριν αποφασίσει

Το interactive visual grounding δείχνει ότι ένα αξιόπιστο multimodal AI πρέπει να ζητά τη σωστή διευκρίνιση πριν επιλέξει προϊόν, εικόνα ή ενέργεια.

WeiterlesenInteractive visual grounding: γιατί το AI πρέπει να μάθει να ρωτά πριν αποφασίσει
Ομάδα software συνεργάζεται διαδοχικά στο MARS με εξειδικευμένους AI agents

MARS: όταν οι εξειδικευμένοι AI agents παραδίδουν ο ένας στον άλλο τον ίδιο κώδικα

Το MARS συντονίζει εξειδικευμένους AI agents πάνω στον ίδιο κώδικα. Τι έδειξε στο CodeContests και ποια όρια χρειάζεται μια επιχειρησιακή εφαρμογή.

WeiterlesenMARS: όταν οι εξειδικευμένοι AI agents παραδίδουν ο ένας στον άλλο τον ίδιο κώδικα
Επαγγελματίες εξετάζουν βιοϊατρικά τεκμήρια για το BioCheck Agent

BioCheck Agent: πώς το AI μαθαίνει να τεκμηριώνει τον βιοϊατρικό έλεγχο γεγονότων

Το BioCheck Agent αναζητά στο PubMed και συνθέτει ελέγξιμη αναφορά. Τι έδειξε το EG-GRPO για ακρίβεια, evidence quality και hallucinations στην πράξη.

WeiterlesenBioCheck Agent: πώς το AI μαθαίνει να τεκμηριώνει τον βιοϊατρικό έλεγχο γεγονότων