🤖 Aggiornamento LLM — Luglio 2026

Cosa è cambiato e cosa ti interessa sapere.


🟢 ChatGPT / OpenAI

OpenAI ha rilasciato due nuovi modelli vocali full-duplex: GPT-Live-1 e GPT-Live-1 mini. Parlano e ascoltano in simultanea, gestiscono interruzioni naturali e supportano la traduzione in tempo reale. GPT-Live-1 mini diventa il default per Advanced Voice Mode; il modello completo è riservato agli utenti a pagamento.

Sul fronte testo, GPT-5.5 Instant Mini sostituisce GPT-5.3 Instant Mini come modello fallback, con migliore tracciamento dell’intento utente e meno errori fattuali. Il 15 luglio il limite delle istruzioni personalizzate è salito da 1.500 a 5.000 caratteri (Plus, Pro, Enterprise, Business, Education). Il 9 luglio ChatGPT Sites è entrato in beta pubblica: si costruiscono siti interattivi con URL condivisibile direttamente da ChatGPT, disponibile per Pro, Pro Lite ed Edu. GPT-4.5 è stato rimosso il 26 giugno.

Cosa cambia per te

Professionista e manager: ChatGPT Sites apre uno spazio nuovo per prototipare landing page, form di raccolta dati o strumenti interni senza toccare codice. GPT-Live-1 riduce la latenza nelle sessioni vocali con clienti o colleghi internazionali.

Studente e docente: Le istruzioni personalizzate a 5.000 caratteri permettono di configurare contesti didattici molto più dettagliati (stile della risposta, livello di spiegazione, materia di riferimento) senza doverli riscrivere ogni volta.

Uso personale: La voce diventa più naturale nelle conversazioni quotidiane: meno robotica, più gestibile durante attività in movimento.

Fonti: TechCrunch, OpenAI Release Notes — luglio 2026


🔵 Gemini / Google DeepMind

Il 21 luglio Google ha rilasciato tre nuovi modelli Gemini. Gemini 3.6 Flash è il principale: contesto da 1 milione di token, benchmark migliorati su codice e multimodale, e un taglio del 17% nel consumo di token in output. Gemini 3.5 Flash-Lite è il modello più economico della linea. Gemini 3.5 Flash Cyber è specializzato nel rilevamento e nella correzione di vulnerabilità di sicurezza informatica, con accesso limitato a governi e partner selezionati.

Gemini 3.5 Pro è ancora in ritardo: Google ha abbandonato l’architettura esistente per ripartire da zero. Gemini 4 è confermato in pre-training, senza data di uscita, benchmark o prezzi pubblicati.

Cosa cambia per te

Professionista e manager: Gemini 3.6 Flash con 1M di contesto diventa praticabile per analisi di documenti lunghi (contratti, report, archivi di e-mail) con costi API inferiori rispetto ai mesi scorsi, grazie al taglio del 17% sul consumo di token.

Studente e docente: La riduzione nel consumo di token abbassa il costo delle sessioni intensive di ricerca o scrittura via API, un vantaggio concreto per chi usa strumenti costruiti su Gemini.

Uso personale: Per ora poco di immediato: i modelli più attesi (3.5 Pro, Gemini 4) non hanno ancora una data. Gemini 3.6 Flash è più veloce ed economico, ma senza un accesso diretto visibile nelle app consumer.

Fonti: TechCrunch, Axios — 21 luglio 2026


🟠 Claude / Anthropic

Fine giugno ha portato Claude Sonnet 5 (rilasciato tra il 29 giugno e il 3 luglio): diventa il modello default per le sottoscrizioni Pro, Team Standard ed Enterprise, con contesto nativo da 1M di token e adaptive thinking attivo per default, che significa ragionamento più accurato senza configurazione aggiuntiva.

Il 24 luglio è arrivato Claude Opus 5: performance vicine al modello top (Fable 5) a metà prezzo, contesto da 1M token, fino a 128K token in output, e un sistema di “effort” a cinque livelli (low, medium, high, xhigh, max) per controllare quanto il modello elabora prima di rispondere. Incluse capacità di rendering 3D. Sulla piattaforma sviluppatori, le modifiche agli strumenti a metà conversazione sono ora in beta: si possono aggiungere o rimuovere tool tra un turno e l’altro senza perdere la cache.

Cosa cambia per te

Professionista e manager: Opus 5 a prezzo Sonnet cambia il rapporto costo/qualità per task complessi. I cinque livelli di effort permettono di pagare per la precisione quando serve e ridurre i costi nelle task routinarie, una leva di ottimizzazione concreta per chi usa Claude via API.

Studente e docente: Il contesto da 1M token su Sonnet 5 permette di caricare interi manuali o raccolte di appunti e lavorarci senza interruzioni. L’adaptive thinking di default migliora la qualità delle spiegazioni su argomenti tecnici complessi.

Uso personale: Chi usa Claude Pro trova un modello di base più capace senza cambiare piano. Opus 5, disponibile su Pro, offre la qualità del modello top nelle sessioni che lo richiedono.

Fonti: Axios, 9to5Mac — 24 luglio 2026


🟡 Perplexity

Luglio ha portato a Perplexity un aggiornamento su più fronti. Deep Research ora gira su Opus 4.6, disponibile per gli utenti Max con rollout progressivo verso i Pro. Il Computer agent ha ricevuto “Brain”: una memoria auto-migliorante che costruisce un grafo di contesto privato attraverso sessioni, file e decisioni passate, aggiornandosi ogni notte.

È stata lanciata SPACE, una sandbox sicura per agenti AI con piena capacità operativa. L’inferenza ibrida è arrivata a luglio: il sistema instrada automaticamente i task tra il dispositivo locale dell’utente e i modelli cloud, ottimizzando velocità e costo. Perplexity Computer è ora integrato nativamente in Microsoft 365 (Word, Excel, PowerPoint, Outlook, Teams).

Cosa cambia per te

Professionista e manager: L’integrazione in Microsoft 365 è la novità più rilevante per chi lavora in ambienti aziendali: Perplexity diventa accessibile direttamente negli strumenti già in uso, senza cambiare app o copiare testo tra finestre.

Studente e docente: Brain trasforma Perplexity da strumento di singola sessione ad assistente con memoria: le ricerche passate alimentano quelle nuove, riducendo la necessità di ricostruire il contesto ogni volta che si riapre l’app.

Uso personale: L’inferenza ibrida locale/cloud è trasparente: il sistema sceglie autonomamente dove eseguire il task. In pratica, risposte più veloci quando la connessione è lenta e risparmio di banda.

Fonti: SiliconANGLE, MarkTechPost — luglio 2026


âš« DeepSeek

Il 24 luglio DeepSeek ha rilasciato ufficialmente V4, che era in preview da aprile. Due varianti: V4-Pro (1,6 trilioni di parametri totali, 49 miliardi attivi) e V4-Flash (284 miliardi totali, 13 miliardi attivi). Contesto da 1M di token su tutta la linea, con miglioramenti documentati su ragionamento matematico, esecuzione di task agentici e generazione di codice.

Sul fronte prezzi, per la prima volta DeepSeek introduce tariffe peak/off-peak sull’API, con le ore di punta nelle fasce mattina e pomeriggio. Gli alias storici deepseek-chat e deepseek-reasoner sono stati ritirati il 24 luglio: chi li usa nelle proprie integrazioni dovrà aggiornare i riferimenti.

Cosa cambia per te

Professionista e manager: Il pricing peak/off-peak introduce una logica di ottimizzazione dei costi API: chi può schedulare i task nelle ore off-peak risparmia in modo misurabile. V4-Flash è l’opzione rapida ed economica per task ad alto volume.

Studente e docente: V4-Pro con 1M di contesto è un modello open-weight di livello frontier accessibile gratuitamente in self-hosting: un’alternativa concreta per la ricerca con vincoli di budget.

Uso personale: Chi usa DeepSeek via API deve aggiornare i propri alias: deepseek-chat e deepseek-reasoner non esistono più. Chi usa l’app non nota differenze immediate, se non prestazioni migliorate.

Fonti: Sitepoint, TechNode — 24 luglio 2026


🌙 Kimi / Moonshot AI

Il 26 luglio Moonshot AI ha reso pubblici i pesi di Kimi K3 su Hugging Face, anticipando di un giorno il target annunciato. Il modello ha 2,8 trilioni di parametri, contesto da 1M di token ed è scaricabile e personalizzabile liberamente. Le benchmark lo collocano a livello frontier, pur rimanendo sotto i modelli proprietari top (Claude Fable 5, GPT 5.6).

In parallelo è uscita Kimi Work: un desktop agent con accesso reale al browser (Chrome/Edge via CDP), integrazione con PowerPoint ed Excel tramite K3 Agent Swarm, scheduling con Cron e dati finanziari nativi. Disponibile su Mac con chip Apple Silicon e Windows. I task si fermano se il dispositivo va in sleep, a meno di usare Kimi Claw (cloud).

Cosa cambia per te

Professionista e manager: Kimi Work porta un agente desktop che opera direttamente nel browser e nelle app Office: automatizzare ricerche competitive, aggregare dati finanziari o produrre presentazioni da fonti live diventa un flusso integrato, non uno script separato da configurare.

Studente e docente: K3 open-weight è un modello frontier scaricabile: chi ha l’infrastruttura può usarlo per ricerca, fine-tuning o didattica senza dipendere da servizi commerciali soggetti a restrizioni geografiche o di accesso.

Uso personale: K3 richiede hardware significativo per girare in locale. Kimi Work è la versione pratica per chi vuole un agente desktop operativo senza occuparsi dell’infrastruttura.

Fonti: Bloomberg, TechCrunch — 26-27 luglio 2026


📓 Gemini Notebook (ex NotebookLM) / Google

Il 16 luglio Google ha rinominato NotebookLM in Gemini Notebook. Il rebrand è accompagnato da nuove funzioni: l’esecuzione nativa di codice direttamente nel notebook (analisi di dati sui propri file di ricerca), un cloud computer dedicato per ogni notebook, sincronizzazione con l’app Gemini e visibilità in AI Mode nella ricerca Google.

L’esecuzione di codice è già disponibile per gli abbonati AI Ultra e per gli account Workspace business. Il rollout verso i piani Pro è previsto nelle prossime settimane.

Cosa cambia per te

Professionista e manager: Poter scrivere ed eseguire codice dentro un notebook di ricerca significa analizzare dati grezzi, generare grafici e verificare calcoli senza uscire dal contesto in cui si lavora. Meno tool-switching, più continuità nel flusso di analisi.

Studente e docente: Per chi fa ricerca quantitativa, avere esecuzione di codice nativa nello stesso ambiente di appunti e fonti riduce il numero di strumenti da padroneggiare e mantiene tutto in un unico posto.

Uso personale: La sincronizzazione con l’app Gemini e la visibilità in Search rendono i propri notebook più accessibili tra dispositivi diversi, senza dover navigare a una URL separata.

Fonti: 9to5Google, SiliconANGLE — 16 luglio 2026


Tutti hanno premuto invio nello stesso mese

Luglio 2026 è il tipo di mese che rende difficile stare al passo: nuovi modelli da OpenAI, Google, Anthropic, DeepSeek e Moonshot nello stesso arco di quattro settimane, ciascuno con una promessa diversa e un posizionamento che vale la pena capire. Non è solo quantità. È che i confini tra i modelli si stanno spostando: open-weight che raggiungono il livello frontier, prezzi che si differenziano per orario, agenti che entrano nelle app aziendali che già usi.

Nel podcast “Lavoro Meglio con l’AI” proviamo a capire cosa significa tutto questo per chi lavora, studia e insegna, senza inseguire ogni novità ma cercando il filo che le collega. Se stai cercando un modo per non perdere il senso di questo momento, potrebbe essere il posto giusto.

Ascolta: https://tinyurl.com/LMAISpotify