Download
← Morning Tech & AI
Ricerca2 min di lettura

DEEPO: nuova ottimizzazione per ridurre le allucinazioni nei MLLM

Il paper DEEPO introduce una strategia a doppio stadio per contrastare le allucinazioni nei modelli linguistici multimodali, intervenendo su entropia delle query e gradienti.

25 settembre 2026·Fonte: arXiv cs.AI·Assistito da AI
DEEPO: nuova ottimizzazione per ridurre le allucinazioni nei MLLM

## Introduzione Il recente lavoro pubblicato su arXiv (2609.28570v1) affronta un problema critico dei modelli linguistici multimodali (MLLM): le allucinazioni persistenti nonostante l'uso di reinforcement learning (RL). Gli autori identificano due punti deboli nella catena di correzione dal reward all'aggiornamento dei parametri.

## Problemi individuati 1. Livello di rollout: le *hard queries*, caratterizzate da alta entropia semantica, tendono a generare gruppi di campioni unanimemente errati. Questo annulla il vantaggio relativo del gruppo proprio nei momenti di maggior rischio di allucinazione. 2. Livello di ottimizzazione: i token che, sebbene molto sicuri, risultano errati diventano invisibili al gradiente. In una politica categoriale, il gradiente atteso si annulla quando la distribuzione si affina, penalizzando le previsioni più bisognose di correzione.

## La proposta DEEPO Il metodo proposto, Dual-Entropy Enhanced Policy Optimization (DEEPO), combina due interventi: una regolarizzazione della varianza del segnale e un miglioramento del gradiente. Questa doppia azione mira a mantenere una certa entropia nelle query e a rendere visibili al gradiente i token errati ma confidenti.

## Implicazioni future Se confermata, la strategia DEEPO potrebbe rappresentare un passo significativo verso MLLM più affidabili, riducendo le allucinazioni senza sacrificare la capacità di ragionamento avanzato. Gli autori invitano la comunità a sperimentare ulteriormente il loro approccio.

*Fonte: arXiv cs.AI, 2026-09-25*

#multimodale#RL#ottimizzazione#allucinazioni

Ricevi Morning Tech & AI

Ogni mattina alle 7:30, la notizia AI del giorno nella tua casella.

Iscriviti
Shellonback

Preferenze cookie

Scegli quali categorie di cookie accettare. I cookie tecnici e funzionali sono sempre attivi.

Per maggiori informazioni, consulta la nostra Cookie Policy e la Privacy Policy.

Cookie di profilazione

Utilizzati per creare profili relativi all'utente e inviare messaggi promozionali in linea con le preferenze espresse.

Cookie analitici

Ci permettono di capire come gli utenti navigano il sito per migliorare l'esperienza e i contenuti.

Cookie tecnici

Sempre attivo

Necessari per il funzionamento del sito. Non possono essere disattivati.

Cookie funzionali

Sempre attivo

Consentono funzionalità avanzate come la memorizzazione delle preferenze di navigazione.