LLMs

Ερευνητές ελέγχουν υποδομή για monitoring των activations σε LLMs

Μπορούν τα LLMs να κρύψουν τη σκέψη τους; Το benchmark που μετρά τον έλεγχο των activations

Το Activation Controllability Benchmark δείχνει ότι πολλά LLMs αλλάζουν το εσωτερικό τους σήμα με οδηγία, άρα το monitoring χρειάζεται layered safeguards.

Read MoreΜπορούν τα LLMs να κρύψουν τη σκέψη τους; Το benchmark που μετρά τον έλεγχο των activations
Μικρό διαγνωστικό σύστημα εντοπίζει τοπικό σφάλμα για τη Woodpecker Distillation

Woodpecker Distillation: όταν ένα ασθενέστερο AI εντοπίζει τα λάθη ενός ισχυρότερου

Η Woodpecker Distillation χρησιμοποιεί ασθενέστερο μοντέλο ως diagnostic probe. Δείτε πώς τα contrastive patches, ο verifier και τα ablations αποκαλύπτουν τοπικά reasoning bugs.

Read MoreWoodpecker Distillation: όταν ένα ασθενέστερο AI εντοπίζει τα λάθη ενός ισχυρότερου
Υπολογιστικά συστήματα για LLM ensembles και συνάθροιση προβλέψεων

Η σοφία του πλήθους των LLMs: πότε τα μοντέλα AI προβλέπουν καλύτερα μαζί

Μπορούν πολλά LLMs να προβλέπουν καλύτερα μαζί; Η έρευνα δείχνει πότε η διαφορετικότητα λαθών βοηθά και γιατί το training cutoff contamination αλλάζει την αξιολόγηση.

Read MoreΗ σοφία του πλήθους των LLMs: πότε τα μοντέλα AI προβλέπουν καλύτερα μαζί