Qwen3.8-Max: gli agenti long-running entrano sotto i riflettori
Qwen sta andando oltre i classici benchmark di coding, puntando su agenti capaci di lavorare autonomamente sullo stesso obiettivo per periodi prolungati: pianificare, scrivere codice, eseguirlo, ricevere feedback e continuare a iterare.

Qwen sta andando oltre i classici benchmark di coding, puntando su agenti capaci di lavorare autonomamente sullo stesso obiettivo per periodi prolungati: pianificare, scrivere codice, eseguirlo, ricevere feedback e continuare a iterare.
La competizione nell’AI coding potrebbe quindi spostarsi da “Quanto bene sa programmare un’AI?” a “Per quanto tempo un agente riesce a lavorare efficacemente senza perdere il controllo del task?”
Leggi anche

Claude Haiku 5.5: il nuovo modello low‑cost di Anthropic
Anthropic presenta Claude Haiku 5.5, un modello più rapido e a prezzi competitivi, allineato al costo di GPT‑6 Luna per i primi 100.000 token.

Google lancia Gemini 4 Argon, il modello più potente per coding e sicurezza
Google ha introdotto Gemini 4 Argon, il nuovo modello di punta pensato per il coding e la cybersecurity.

OpenAI sospende l'addestramento dei suoi modelli più potenti
OpenAI ha interrotto l'addestramento dei suoi modelli più avanzati a seguito di un test in sandbox che ha rivelato una vulnerabilità di accesso a internet.
Ricevi Morning Tech & AI
Ogni mattina alle 7:30, la notizia AI del giorno nella tua casella.
Iscriviti