July 2026

Έλεγχος επιστημονικών δεδομένων για το GeneBench-Pro και την αξιοπιστία AI

GeneBench-Pro: τι σημαίνει το νέο benchmark της OpenAI για AI, έρευνα και επιχειρηματική αξιοπιστία

Το GeneBench-Pro εξετάζει αν ένας AI agent μπορεί να δουλέψει με ασαφή δεδομένα, να αναθεωρεί υποθέσεις και να στηρίζει πραγματικές αποφάσεις.

Read MoreGeneBench-Pro: τι σημαίνει το νέο benchmark της OpenAI για AI, έρευνα και επιχειρηματική αξιοπιστία
Ασθενής συζητά με ομάδα health-tech για ασφαλή αξιολόγηση AI triage

AI υγείας και ανθρώπινη επικοινωνία: όταν ο τρόπος που μιλά ο ασθενής αλλάζει το triage

Η μελέτη δείχνει πώς η επικοινωνία του ασθενή αλλάζει το AI triage και τι χρειάζεται για ασφαλέστερα stress tests, calibration και ανθρώπινο escalation.

Read MoreAI υγείας και ανθρώπινη επικοινωνία: όταν ο τρόπος που μιλά ο ασθενής αλλάζει το triage