машинно обучение

Екип планира контролиран експеримент по смесване на данни за предварително обучение на големи езикови модели (LLM)
Екип за електронна търговия разработва пилотен проект за прогнозиране на търсенето с ICI-Time

ICI-Time: когато моделът за визуално разпознаване прогнозира времеви редове, сякаш допълва изображения

Το ICI-Time μετατρέπει χρονοσειρές σε εικόνες και αξιοποιεί visual in-context learning για forecasting. Τι δείχνουν τα few-shot αποτελέσματα και τι απαιτεί ένα ασφαλές επιχειρησιακό pilot.

Прочетете повечеICI-Time: когато моделът за визуално разпознаване прогнозира времеви редове, сякаш допълва изображения
Специалисти структурират обемни корпоративни документи за търсене с помощта на мултивекторни вграждания
Μηχανικοί ελέγχουν αισθητήρες για explainable AI στις χρονοσειρές

Explainable AI στις χρονοσειρές: όταν το ίδιο μοντέλο δίνει άλλη εξήγηση

Το explainable AI στις χρονοσειρές αλλάζει ανά framework. Η ανασκόπηση έξι εργαλείων δείχνει κενά σε methods, metrics, συχνότητες και αναπαραγωγιμότητα.

Прочетете повечеExplainable AI στις χρονοσειρές: όταν το ίδιο μοντέλο δίνει άλλη εξήγηση
Ερευνητής συγκρίνει διαφορετικές διαμορφώσεις για αξιόπιστο AI benchmark harness

Δεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή

Νέα μελέτη δείχνει ότι 26 έγκυρα evaluation harnesses μπορούν να αλλάξουν δραστικά τα scores και τον νικητή ενός LLM leaderboard. Τι σημαίνει για τις επιχειρήσεις.

Прочетете повечеΔεν υπάρχει ουδέτερο AI benchmark: πώς το harness αλλάζει τον νικητή
Μηχανικός ελέγχει κύκλωμα AI για ανεξάρτητη εποπτεία με OWMI

Μπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI

Το OWMI δείχνει ότι η λεκτική αυτοαναφορά οκτώ open-weight μοντέλων έμεινε στην τύχη, παρότι το σήμα υπήρχε στις ενεργοποιήσεις τους.

Прочетете повечеΜπορεί ένα AI να καταλάβει τι συμβαίνει μέσα του; Τι αποκαλύπτει το OWMI
Контролирана оценка на модели с изкуствен интелект в професионална тестова кухня

FlavourBench: какво ни учи една кухня за надеждното оценяване на изкуствения интелект

FlavourBench показва как плътните карти на възнагражденията, общите задачи и проверките за несигурност правят оценяването на моделите за изкуствен интелект по-контролируемо и полезно.

Прочетете повечеFlavourBench: какво ни учи една кухня за надеждното оценяване на изкуствения интелект