Automation

Ρομπότ μαθαίνει χειρισμό πετσετών από ανθρώπινη επίδειξη για το Dyna-2

Dyna-2: τι αλλάζει όταν ένα ρομπότ μαθαίνει από 1 εκατ. ώρες ανθρώπινου βίντεο

Το Dyna-2 εκπαιδεύτηκε σε 1 εκατ. ώρες ανθρώπινου βίντεο. Τι δείχνουν τα robot tests και πώς σχεδιάζεται ένα ασφαλές επιχειρηματικό pilot στην πράξη.

Read MoreDyna-2: τι αλλάζει όταν ένα ρομπότ μαθαίνει από 1 εκατ. ώρες ανθρώπινου βίντεο
Τεχνικός έλεγχος προέλευσης και λειτουργικής ροής για AI skills

SkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει

Το SkillTrace εξετάζει χωριστά κείμενο, κώδικα και λειτουργική ροή για να εντοπίσει ίχνη προέλευσης σε AI skills που έχουν μετασχηματιστεί.

Read MoreSkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει
Human-AI συνεργασία επαγγελματία με ρομποτικό βοηθό σε κοινή εργασία

Human-AI συνεργασία: γιατί το AI πρέπει να μαθαίνει τι μπορεί να κάνει ο συνεργάτης του

Η Human-AI συνεργασία βελτιώνεται όταν ο agent ξεχωρίζει δυνατότητες, προτιμήσεις και συμπεριφορά. Τι δείχνουν οι μέθοδοι CE-CM και CE-CM-Div.

Read MoreHuman-AI συνεργασία: γιατί το AI πρέπει να μαθαίνει τι μπορεί να κάνει ο συνεργάτης του
Έλεγχος υποδομής για overthinking, κρυμμένη γνώση και AI auditing

Overthinking στα AI μοντέλα: όταν η ενισχυμένη σκέψη αποκαλύπτει κρυμμένη γνώση

Τι είναι το overthinking στα AI μοντέλα, πώς αποκαλύπτει κρυμμένη γνώση και ποια όρια χρειάζεται ένα υπεύθυνο πρόγραμμα AI auditing για επιχειρήσεις.

Read MoreOverthinking στα AI μοντέλα: όταν η ενισχυμένη σκέψη αποκαλύπτει κρυμμένη γνώση
Έλεγχος πολλών εγγράφων για αξιοπιστία long-context AI και PredicateLongBench

Μεγάλο context δεν σημαίνει αξιόπιστο AI: τι αποκαλύπτει το PredicateLongBench

Το PredicateLongBench δείχνει γιατί το μεγάλο context window δεν εγγυάται αξιόπιστο AI και πώς δοκιμάζονται RAG, decoys, πληρότητα και πηγές στην πράξη.

Read MoreΜεγάλο context δεν σημαίνει αξιόπιστο AI: τι αποκαλύπτει το PredicateLongBench