Modelli deboli aiutano quelli forti
I modelli linguistici forti possono fallire nei compiti di ragionamento a causa di bug localizzati. La tecnica di Woodpecker Distillation proposta su arXiv utilizza modelli deboli per diagnosticare e correggere questi errori.

I modelli linguistici di grandi dimensioni spesso falliscono nei compiti di ragionamento nonostante siano in grado di risolverli. Ciò accade a causa di bug di ragionamento localizzati nelle fasi intermedie. La tecnica di Woodpecker Distillation, proposta su arXiv, utilizza modelli deboli per diagnosticare e correggere questi errori. I modelli deboli generano 'patch' che vengono utilizzati per correggere la traiettoria del modello forte verso una soluzione corretta. Questo approccio si differenzia dal fine-tuning tradizionale, poiché il segnale utile non risiede nel testo di intervento stesso, ma nel modo in cui esso influenza la distribuzione di ragionamento del modello. La Woodpecker Distillation rappresenta un nuovo framework di addestramento che apprende da interventi locali contrastivi.
Leggi anche

Glossario AI: i termini più usati da conoscere
TechCrunch AI pubblica un glossario con le definizioni dei termini più rilevanti nell'era dell'intelligenza artificiale.

Gli agenti IA sommergono i servizi pubblici con richieste
Secondo un ricercatore citato da TechCrunch AI, gli agenti IA stanno generando un volume elevato di richieste nei servizi pubblici, principalmente da persone già aventi diritto a presentare domande.
Seattle Times e Newsday intentano causa contro OpenAI e Microsoft
Seattle Times e Newsday hanno intentato una causa contro OpenAI e Microsoft, accusandoli di aver sfruttato i loro articoli per addestrare sistemi di intelligenza artificiale.
Ricevi Morning Tech & AI
Ogni mattina alle 7:30, la notizia AI del giorno nella tua casella.
Iscriviti