Ola todos! ecco le notizie dedicate al mondo IA del 08 Agosto 2026Iniziamo con Anthropic. Claude ha aggiornato i filtri di sicurezza biologica di Fable 5, riducendo gli errori di blocco dell’OTTANTACINQUE percento. Ora risponde a più domande su salute ed educazione. Le richieste a doppio uso — virologia, tossicologia, progettazione molecolare — passano ancora a Opus 5.Passiamo a Google. Gemini Omni Flash riceve montagne di video creativi da parte degli sviluppatori. Cambio angolatura, prospettiva, zoom cinematografico: tutto da testo, immagine, video o audio. Una creatrice ha catturato la stessa scena da venti prospettive diverse, cambiando sfondo e inquadratura senza perdere coerenza.Sul fronte open source, OpenAI, Microsoft, Google, Cursor, Vercel e GitHub hanno standardizzato Agent Plugins. Un unico formato per skills e server MCP: scrivi una volta, funziona ovunque. File plugin punto json, cartella skills, file mcp punto json. Nessuna configurazione extra.Anche Andrew Ng entra in scena. OpenWorker è un agente desktop che produce deliverable finiti: report, messaggi Slack, aggiornamenti calendario. Legge liberamente, scrive solo dopo approvazione. Venticinque integrazioni, modello personalizzabile, funziona da Slack con mention.Da segnalare anche Claude Managed Agents. Quattro aggiornamenti questa settimana: budget per sessione, pausa automatica al limite, ripresa modificabile. Spesa prevedibile e controllo completo.Sempre attivo, Claude Code. Versione due punto uno punto duecentoventiquattro: trentuno modifiche CLI. Self-hosted runner per esecuzione privata su macchina locale. Edit tool con sostituzione esatta: applica solo se il testo corrisponde, altrimenti niente modifica.Non si ferma Claude Code. Ora le sessioni possono messaggiarsi tra loro. Mandi un riassunto da una sessione all’altra, senza ricopiare cronologia o file. La seconda sessione riprende il lavoro dove l’hai lasciato.Arriva anche Magnitude. Agente locale al cento percento: niente API, niente token, niente cloud. Modello e inference engine girano direttamente sul tuo computer. Un comando, scegli il modello che ci sta in RAM, e via. Shell, editing file, script. Aggiungi skills per Excel, PowerPoint, PDF, Chrome.Merita attenzione Oh-My-Hermes. Trasforma hermes-agent in orchestratore di coding. Non fa tutto da solo: coordina. Claude Code e Codex scrivono codice. Pi Runtime esegue e valuta. Kimi, Qwen, GLM, DeepSeek partizionano il carico. Grok scrappa X. Gemini e Nemotron comprimono contesto. Analisi task, routing multi-vendor, check intelligenti.Sul fronte ricerca, NVIDIA ha scoperto come rendere la cache KV trasferibile tra modelli. Converti la cache e il modello ricevente salta il prefill. Da due punto sette a venticinque volte più veloce. Sei coppie testate: Qwen3, Llama tre punto uno, Ministral 3. Conserva dal settantatré al novantotto percento di accuratezza.Passiamo a tool pratici. Mi sono accorto dell’esistenza di questo repository su GitHub: Brain punto md. Memoria persistente per agenti di coding. Salva conoscenza progetto in Markdown dentro la repository stessa.Da non sottovalutare, Langchain ha rilasciato openwiki. Quattordicimila stelle. Un comando genera e aggiorna documentazione per codebase. Git action per aggiornamento quotidiano. Interfaccia chat per parlare con la wiki. Inject in Agent punto md: Code Agent ottiene conoscenza progetto automaticamente.Occhio a Qwen-Audio tre punto zero TTS. Sistema sintesi vocale multilingua per produzione reale. Gestisce riferimenti sporchi, abbreviazioni, formati lunghi. Non solo testo pulito: input reali.Si muove anche Ultralytics. YOLO26 su dispositivi Apple con CoreML: da tredici a cinquantaquattro FPS. Esporti PyTorch in CoreML, accelerazione hardware immediata.Segnaliamo anche OpenCode Go. Modelli funzionano come subagent dentro Codex. Quattro in parallelo, stesso task, ognuno con finestra contesto propria. Solo risposte tornano all’orchestratore. Lavoro ripetitivo a DeepSeek economico, quota ChatGPT spesa solo dove serve. Router open source.Un aggiornamento da Microsoft. Creatore automatico di Skills per IA. Registri una volta la tua azione: diventa skill per l’agente. Rileva click, cambio app, finestre, web. Narrazione vocale opzionale. CLI GitHub Copilot per generare skill.Proseguiamo con Gemma 4. Hackathon recente: copilot per meeting live a mille token al secondo. Conversazioni parlate diventano prototipi funzionanti prima della fine della riunione.Altra novità: BigBang-v1 da Endless Frontier Lab a Shanghai. Modello trentasei miliardi con training auto-evolutivo. Task frontier generati da IA. Performa come modelli molto più grandi. Diecimila esempi alta qualità. Costruito per scienza, coding, tool use, ragionamento lungo.Colpo a sorpresa da Obsidian. La compagnia stessa ha rilasciato obsidian-skills: skill che gestisce Vault completamente via agente. Lettura, scrittura, ricerca, organizzazione automatica. Funziona con Claude Code, Codex, OpenCode. Markdown, Bases, Canvas.Ancora una segnalazione: mi sono accorto dell’esistenza di questo repository su GitHub che trasforma PDF, documenti e pagine web in grafi di conoscenza Neo4j strutturati usando LLM e framework LangChain.Chiudiamo con Sebastian Raschka. Il suo repository LLMs-from-scratch ha superato le centomila stelle. Codice completo: tokenizzazione, attenzione, pretraining, classificazione, instruction fine-tuning. Implementazioni from-scratch di Llama, Qwen, Gemma, Olmo. Varianti attention, GQA, MLA, sliding-window, Gated DeltaNet, DeepSeek Sparse Attention, mixture-of-experts. KV caching, performance training, DPO, LoRA.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.