AI agents

Ερευνητική ομάδα αξιολογεί πειράματα με AI agents και ανθρώπινο έλεγχο

AI agents στην επιστημονική έρευνα: τι μάθαμε από την αναπαραγωγή 2.226 papers

Η ανοιχτή αναπαραγωγή 2.226 papers δείχνει πώς AI agents, audit trails, ανεξάρτητοι evaluators και ανθρώπινη κρίση κάνουν τον έλεγχο πιο αξιόπιστο.

Read MoreAI agents στην επιστημονική έρευνα: τι μάθαμε από την αναπαραγωγή 2.226 papers
Εξειδικευμένοι AI agents για χρηματοοικονομική ανάλυση με κοινό πλαίσιο αξιολόγησης

Εξειδικευμένοι AI agents στα χρηματοοικονομικά: πότε κερδίζει το decomposition και πότε το RL

Ελεγχόμενη μελέτη δείχνει πότε οι εξειδικευμένοι AI agents βελτιώνουν αριθμητικές εργασίες και πότε η σύνθετη κρίση χρειάζεται GRPO post-training.

Read MoreΕξειδικευμένοι AI agents στα χρηματοοικονομικά: πότε κερδίζει το decomposition και πότε το RL
CGMas AI agents για προσομοιώσεις πολυμερών

CGMas: πώς μια ομάδα AI agents αυτοματοποιεί τις προσομοιώσεις πολυμερών

Το CGMas συνδυάζει AI agents, ντετερμινιστικά εργαλεία και φυσικούς ελέγχους για επαληθεύσιμη αυτοματοποίηση προσομοιώσεων πολυμερών.

Read MoreCGMas: πώς μια ομάδα AI agents αυτοματοποιεί τις προσομοιώσεις πολυμερών
Τεχνικός έλεγχος προέλευσης και λειτουργικής ροής για AI skills

SkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει

Το SkillTrace εξετάζει χωριστά κείμενο, κώδικα και λειτουργική ροή για να εντοπίσει ίχνη προέλευσης σε AI skills που έχουν μετασχηματιστεί.

Read MoreSkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει
Αυτοματοποιημένη ροή εργασίας με state-matched καθοδήγηση για AI agent

SMRC-SD: γιατί η σωστή καθοδήγηση ενός AI agent εξαρτάται από την κατάστασή του

Το SMRC-SD ελέγχει αν μια επιτυχημένη διαδρομή ταιριάζει με την πραγματική κατάσταση ενός AI agent πριν τη χρησιμοποιήσει ως καθοδήγηση. Δείτε τι έδειξαν ALFWorld, WebShop και τα ablation tests.

Read MoreSMRC-SD: γιατί η σωστή καθοδήγηση ενός AI agent εξαρτάται από την κατάστασή του
Ερευνητές ελέγχουν evidence για αποτυχημένους AI search agents και το SearchAuditor

SearchAuditor: γιατί οι AI search agents αποτυγχάνουν ενώ έχουν ήδη βρει την απάντηση

Το SearchAuditor δείχνει γιατί οι AI search agents μπορεί να έχουν ήδη βρει τη σωστή απάντηση και παρ’ όλα αυτά να αποτυγχάνουν στη διαχείριση evidence, constraints και πηγών.

Read MoreSearchAuditor: γιατί οι AI search agents αποτυγχάνουν ενώ έχουν ήδη βρει την απάντηση