Xiaomi AI Cube porta gli LLM in locale con tre chip Xring proprietari
Xiaomi ha presentato AI Cube, un mini-PC sperimentale che combina tre processori Xring per eseguire localmente modelli AI fino a 120 miliardi di parametri. Il progetto mostra l’espansione dell’azienda oltre il mobile, ma non ha ancora prezzo né una data di lancio.

<p>Xiaomi ha mostrato AI Cube, un prototipo di mini-PC progettato per gestire modelli linguistici di grandi dimensioni direttamente sul dispositivo. L’elaborazione locale può ridurre la dipendenza dal cloud e mantenere dati e parametri all’interno del sistema.</p><p>La piattaforma riunisce tre componenti della famiglia proprietaria Xring: O3, O100 e D100. Questa configurazione fa di AI Cube una dimostrazione della strategia di Xiaomi nei semiconduttori, ormai estesa dagli smartphone ai computer compatti, agli acceleratori neurali e alle applicazioni automobilistiche.</p><p>Xring O3 è il SoC principale, prodotto da TSMC a 3 nanometri. Integra una CPU a 10 core, una GPU G2-Ultra NX a 16 core e una NPU capace, secondo Xiaomi, di raggiungere 200 TOPS; supporta inoltre memoria LPDDR6 con una larghezza di banda fino a 113,8 GB/s.</p><p>Il chip O100, realizzato a 6 nanometri, svolge invece il ruolo di acceleratore AI ad alta banda. Grazie al packaging tridimensionale e alle interconnessioni molto ravvicinate, offre un throughput dichiarato di 1,22 TB/s e prestazioni di inferenza fino a 330 token al secondo.</p><p>Completa il sistema Xring D100, nato per i carichi di guida intelligente: dispone di una CPU a 20 core, una NPU a 16 core e supporta fino a 160 GB di memoria unificata. Pur potendo teoricamente affrontare modelli da 200 miliardi di parametri, nell’AI Cube viene impiegato in configurazioni comprese tra 3B e 120B.</p><p>L’hardware è racchiuso in uno chassis ricavato da un blocco di alluminio, con 33.874 perforazioni destinate alla ventilazione e un sistema termico dimensionato per sostenere 150 watt a pieno carico. Xiaomi prevede modalità operative rapide o lente in base al carico, ma AI Cube resta per ora una dimostrazione tecnologica senza prezzo o calendario commerciale; inoltre, sebbene i chip siano progettati internamente, la loro produzione continua a dipendere da TSMC.</p>
Leggi anche

Qwen3.8-Max: gli agenti long-running entrano sotto i riflettori
Qwen sta andando oltre i classici benchmark di coding, puntando su agenti capaci di lavorare autonomamente sullo stesso obiettivo per periodi prolungati: pianificare, scrivere codice, eseguirlo, ricevere feedback e continuare a iterare.

OpenAI scioglie team di sicurezza
OpenAI ha sciolto il team di preparedness, che si occupava di valutare i rischi dei modelli di intelligenza artificiale. Il team aveva il compito di identificare e mitigare eventuali rischi legati ai modelli.

Architettura Cognitiva Modulare
Una nuova ricerca pubblicata su arXiv rivela che i Large Language Models sviluppano un'architettura cognitiva modulare simile a quella del cervello umano. Questo studio esplora come tali modelli, creati attraverso processi di ottimizzazione diversi, possano esibire una specializzazione funzionale in vari domini cognitivi.
Ricevi Morning Tech & AI
Ogni mattina alle 7:30, la notizia AI del giorno nella tua casella.
Iscriviti