Notizie AI del 04 Agosto 2026

Ola todos! ecco le notizie dedicate al mondo IA del 04 Agosto 2026Iniziamo con Google che ha rilasciato un corso gratuito di due ore su Graph Engineering per agenti IA. Il corso insegna come costruire grafi di conoscenza persistenti che permettono agli agenti di non perdere la memoria quando si esaurisce la finestra di contesto.Passiamo a LangGraph, il repository che ha raggiunto trentottomila stelle su GitHub. Trasforma workflow IA frammentati in grafi verificabili che controllano, ritentano ed escalano prima che un errore comprometta tutto.Nel frattempo, Alibaba ha rilasciato Qwen tre punto otto Max. Due virgola quattro trilioni di parametri. Batte Fable cinque su TerminalBench con ottantasei punto sei contro ottantaquattro punto sei. I pesi aperti arrivano la prossima settimana. Insieme a Qwen tre punto otto ventisette B che girerà su diciassette GB di RAM.A proposito di modelli multimodali, MiniMax ha rilasciato H3 come open source. Genera video da testo, immagini, audio e video come contesto unico. Ritorna clip fino a quindici secondi a duemila pixel e ventiquattro FPS con audio stereo già nel file.Da segnalare anche Graft. Costruisce una mappa markdown persistente della tua codebase così gli agenti non devono riscannerizzare tutto a ogni sessione. Trentadue percento meno costi. Sessanta percento meno latenza.Arriva anche Hermes Agent versione zero punto venti. Voce conversazionale con interruzione mid-frase. Citazioni verificate con fact-checking. Webhooks in uscita. Protocollo Agent-to-Agent uno punto zero per comunicazione tra agenti eterogenei.Sul fronte video generation, ho trovato su GitHub MoneyPrinterTurbo con oltre centomila stelle. Inserisci un tema e genera automaticamente script, trova materiali, aggiunge voiceover, sottotitoli, musica e esporta video verticali per TikTok e Reels.Sempre attivo, DeepSeek ha rilasciato V4 Flash zero settecentotrentuno. Gira su una singola quattro zero novanta: dodici token al secondo in decode, seicentocinquanta in prefill, duecentocinquantamila token di contesto.Colpo a sorpresa da Sakana AI che ha aperto l’API Namazu per il loro modello di linguaggio giapponese aggiornato.Occhio a DeerFlow, l’agente cinese completamente gratuito che lavora ventiquattro sette sul tuo computer. Ricerca, organizza info, scrive ed esegue codice, crea presentazioni e video. Già oltre venticinquemila stelle su GitHub.NVIDIA ha rilasciato NOOA, un framework che permette di definire un agente come una singola classe Python. I metodi sono le azioni del modello, i campi mantengono lo stato. Se il corpo del metodo è vuoto, un LLM lo riempie a runtime.Vale la pena menzionare Index di Laminar. Trasforma il browser in una API chiamabile. Novantadue percento di accuratezza su WebVoyager. pip install e sei pronto.Non si ferma OpenAI che ha ricostruito lo stack vocale di GPT-Live da zero. Ora ascolta mentre parla mantenendo l’audio in flusso continuo anche durante ragionamenti complessi.Merita attenzione Gemini Spark che può usare l’auto browse di Chrome per gestire task complessi online con i tuoi account loggati. Prenotazioni, ricerche, tutto con il tuo permesso.Proseguiamo con GenSpark che ha rilasciato GenOffice come open source. Suite office completa per PC e Mac costruita da un ingegnere in una settimana con diecimila dollari di token. Docs, Sheets, Slides, PDF editing integrato.Interessante anche Superpowers che supera novantaquattromila stelle su GitHub. Trasforma Claude Code, Codex e Cursor in senior developer forzando brainstorming prima del codice e applicando TDD senza eccezioni.Si muove anche Taste Skill, un file di testo senza codice che ha superato settantamila stelle. Insegna agli agenti di codifica cosa NON costruire bannando elementi specifici di design.Altra novità: Semantica, un framework open source con duemila stelle che costruisce grafi di conoscenza per tracciare le ragioni delle decisioni IA. Perfetto per settori ad alta compliance come finanza e medicina.Segnaliamo anche Boogu-Image zero punto uno, famiglia di modelli multimodali open source addestrati su duecentootto milioni di immagini con quattrocentomila dollari di budget. Generazione nativa a due K con rendering eccezionale del cinese.Chiudiamo con MeanVC2 di ASLP-lab. Conversione vocale zero-shot con un modello streaming da diciotto milioni di parametri. Dai due secondi e mezzo di voce target e trasforma qualsiasi frase in quella voce.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.

Url delle notizie

AI LABELS_3x2_3_black