august 2026

AI υπό πίεση σε συγκριτική αξιολόγηση γλωσσικών μοντέλων

AI υπό πίεση: γιατί τα κορυφαία γλωσσικά μοντέλα αντιδρούν τόσο διαφορετικά

Νέα μελέτη δείχνει πώς έξι γλωσσικά μοντέλα διαφέρουν σε διευκρίνιση, άρνηση και ασφαλή εναλλακτική υπό πίεση και τι μετρά μια επιχείρηση.

Citește mai multAI υπό πίεση: γιατί τα κορυφαία γλωσσικά μοντέλα αντιδρούν τόσο διαφορετικά
Κλινικά όρια στην AI και αξιολόγηση προβλέψεων από ειδικούς

Κλινικά όρια στην AI: πότε η απλούστευση κάνει τις προβλέψεις πιο κατανοητές

Μια μελέτη για το ισχαιμικό εγκεφαλικό δείχνει πότε τα κατανοητά όρια διατηρούν την απόδοση ενός μοντέλου AI και πότε χάνουν κρίσιμο σήμα.

Citește mai multΚλινικά όρια στην AI: πότε η απλούστευση κάνει τις προβλέψεις πιο κατανοητές
Ignition Index και δυναμική πληροφορίας σε υποδομή LLM

Ignition Index: τι αποκαλύπτει για το πώς «ανάβει» η πληροφορία στα LLM

Ο Ignition Index εξετάζει πόσο απότομα γίνεται προσβάσιμη η πληροφορία στα LLM και γιατί η αρχιτεκτονική αλλάζει τον σωστό άξονα μέτρησης.

Citește mai multIgnition Index: τι αποκαλύπτει για το πώς «ανάβει» η πληροφορία στα LLM
Τεχνικός έλεγχος προέλευσης και λειτουργικής ροής για AI skills

SkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει

Το SkillTrace εξετάζει χωριστά κείμενο, κώδικα και λειτουργική ροή για να εντοπίσει ίχνη προέλευσης σε AI skills που έχουν μετασχηματιστεί.

Citește mai multSkillTrace: πώς αποδεικνύεται η προέλευση ενός AI skill όταν κείμενο και κώδικας έχουν αλλάξει
Αυτοματοποιημένη ροή εργασίας με state-matched καθοδήγηση για AI agent

SMRC-SD: γιατί η σωστή καθοδήγηση ενός AI agent εξαρτάται από την κατάστασή του

Το SMRC-SD ελέγχει αν μια επιτυχημένη διαδρομή ταιριάζει με την πραγματική κατάσταση ενός AI agent πριν τη χρησιμοποιήσει ως καθοδήγηση. Δείτε τι έδειξαν ALFWorld, WebShop και τα ablation tests.

Citește mai multSMRC-SD: γιατί η σωστή καθοδήγηση ενός AI agent εξαρτάται από την κατάστασή του