Ola todos! ecco le notizie dedicate al mondo IA del 05 Agosto 2026Iniziamo con Hermes Agent, che fa girare team multi-agente dentro workspace Buzz condivisi. Tre agenti, tre macchine diverse, una sola chat: si cercano info, si controllano a vicenda, e correggono gli errori in diretta. Setup ancora ostico, ma funziona.Passiamo a Mnimax H3, la variante uncensored del modello video. Costruita per creator e studi indipendenti. Nessun filtro, nessun no.Sempre nel mondo video, uno sviluppatore ha messo il pianeta intero in una tab del browser. Guidi su qualsiasi strada, il mondo si genera in tempo reale davanti alla tua auto. Dati OpenStreetMap, elevazione satellitare. Gratis, senza installare nulla.Mi sono accorto dell’esistenza di Graphify su GitHub, ottantatremila stelle. Trasforma un progetto in una knowledge graph: codice, interfacce, SQL, documenti. Tutto collegato. Compatibile con Claude Code, Codex, OpenCode e Cursor. Open source, modificabile senza limiti.Celeris punto uno è il modello più veloce secondo Artificial Analysis. Duemilatrentotto token al secondo, primo su cinquecentonovantuno modelli. Il doppio del secondo classificato. Batte anche Grok quattro punto tre su HLE. Senza chip custom.Passiamo ad AnyDoc, parser locale per PDF, DOCX, PPTX e altri dieci formati. Conversione in markdown sotto i cinque millisecondi. Cinquecento file docx in uno punto sette secondi. Basato su Rust. Open source. Già dentro Firecrawl.Sempre attivo, ModelScope. Ora puoi far girare MiniMax-H3 in locale, anche su Mac. Versione quantizzata a quattro bit con DiffSynth-Studio. Minimo otto gigabyte di VRAM. Gira su Mac da sedici giga in modalità estrema.Arriva anche il Channels SDK di CopilotKit. Qualsiasi agente AG-UI gira in Slack, Teams, Discord, WhatsApp. Stesso backend, output adattato per ogni piattaforma. Approvazioni umane, persistenza, trascritti. Open source. LangGraph, CrewAI, Mastra, Google ADK: tutti compatibili.Sul fronte video automatici, MoneyPrinterTurbo ha centomila stelle su GitHub. Input: parola chiave. Output: video completo con script, materiali, sottotitoli e musica. Verticale nove sedici e orizzontale sedici nove. OpenAI, Gemini, DeepSeek, Ollama. Materiali da Pexels e Pixabay. WebUI, API, CLI, Docker.Cursor ha rilasciato Mixture-of-Kittens, megakernel MoE per NVL72. Fonde comunicazione e calcolo in un singolo kernel deterministico. Fino a due punto trentasette volte più veloce dei baseline pubblici. Open source.Tra le indiscrezioni, Claude Sonnet cinque punto cinque potrebbe arrivare il mese prossimo. Fase finale prima del rilascio. Risposte più rapide, latenza ridotta. Finestra context di uno punto cinque milioni di token. Capacità vicine a Fable cinque, prezzo da Sonnet.Anthropic ha rilasciato su GitHub un workflow completo per trovare e sistemare bug nel codice. Minacce, ispezione, eliminazione duplicati, correzioni. Verifica i bug tre volte prima di confermarli. Ambiente isolato, comunicazione bloccata. Riferimento MIT, seimilaottocentonovantotto stelle.Novità anche da HermesOffice, suite open source con Word, Fogli, Slides e PDF. L’assistente IA gira interamente sulla tua macchina. Nessun cloud, nessun proxy. Stesso agente che conosce i tuoi file, la tua memoria, i tuoi strumenti. Basato su GenOffice, Apache due punto zero.Un utente ha dimostrato Claude che ricostruisce architetture in Blender partendo da un’immagine. Blocca edifici, aggiusta camera, materiali, vegetazione, luci. Poi rende, ispeziona il risultato, e continua a modificare la scena. Il risultato è ancora grezzo, ma Claude opera il software e itera sul progetto reale.Proseguiamo con VoiceBox, repository su GitHub di jamiepine. Clona la tua voce con pochi secondi di audio. Gira sul tuo PC, dati privati. Claude Code, Cursor e agenti MCP rispondono con quella voce. Crei contenuti in giapponese, arabo o polacco senza muovere la bocca.Maple-Preview, modello open source da venti miliardi di parametri con pesi ternari. Risolve problemi livello IMO. Gira a oltre duecento token al secondo su Mac Mini M4. Cinque-sedici volte più veloce di Gemma quattro, Qwen tre punto cinque, gpt-oss.Microsoft ha rilasciato Orchard, infrastruttura open source per training, reinforcement learning e testing di agenti. Tre direzioni: Orchard-SWE al sessantanove punto sette percento su SWE-bench Verified, Orchard-GUI con modello da quattro miliardi, Orchard-Claw per email e calendario. Basato su Kubernetes, ambienti isolati, dati e training condivisi.DeepSeek V4 Flash zero sette slash trentuno è gratis sei ore al giorno in ogni paese, su Roundtable Space.Tencent ha rilasciato Hy ASR tre punto zero preview. Riconoscimento vocale preciso, comprensione semantica profonda. Audio sporco del mondo reale, trascrizioni pulite e coerenti. WER multilingua circa tre percento.Un utente ha condiviso tre file per trasformare i documenti caricati in una libreria che l’agente cerca da solo. Un INDEX punto md che mappa tutto. Un punto brief punto md per ogni fonte principale. Stack di conoscenza pre-collegati per progetto e contatto. Generazione lazy: il brief si crea la prima volta che serve.Liquid AI ha rilasciato LFM due punto cinque-due punto sei B, modello agentico che gira completamente on-device. Pianifica, chiama strumenti, lavora su task multi-step. Su telefoni, laptop, PC, robot. Dati mai fuori dal device. Addestrato su circa trentaquattro T token, architettura ibrida, contesto centotrentotto K, vocabolario centotventotto K. ToolSandbox settantasette punto ottantatré, Multi-IF ottanta punto zero sette, IFStruct ottantacinque punto quarantanove.QuerySplat, modello feed-forward tridimensionale open source di InSpatio. Poche immagini senza pose, scena navigabile in pochi secondi. Organizza scene con query 3D, nessuna posa camera richiesta, ricostruisce in un singolo forward pass. Open source, codice e pesi.Un altro progetto interessante: memvid, memoria portabile per agenti IA. Circa sedicimila stelle. Livello memoria single-file, ricerca veloce senza RAG o vector DB complessi. Memoria portabile, append-only. Semplifica RAG pesante.NVIDIA ha rilasciato PersonaPlex 7B, modello conversazionale real-time. Ascolta e parla simultaneamente. Gestisce interruzioni e sovrapposizioni naturali. Cento percento open source.Mistral ha rilasciato Shieldstral, modello da tre miliardi per content safety. Deploy on-device. Open weights.Un attacco alla supply chain npm ha compromesso almeno ottocentosessantotto pacchetti, oltre due miliardi di installazioni mensili. Worm per rubare credenziali. Partito dall’account GitHub del maintainer di keyv, centoventisettemilioni di download settimanali. Hook preinstall, stealer che raccoglie segreti npm, GitHub, AWS, Kubernetes, Vault, poi si diffonde.Forge, piattaforma open source per agenti IA. Drag-and-drop per costruire agenti e workflow. Deep Agent, multi-agente, routing, loop, task paralleli. REST, GraphQL, SQL, MCP. Knowledge base, RAG, memoria long-term, human-in-the-loop. Visualizza latenza, token, costi. Pubblica come API, MCP Server, email agent, web component. Basato su LangChain v1 + LangGraph v1. MIT. Nessun Docker, PostgreSQL, Redis necessari.Un dev ha costruito un agente di ricerca in-browser con LFM due punto cinque-due punto sei B. Crea piano, ragiona, chiama strumenti, itera. Due punto sei miliardi di parametri, veloce, on-device.Auto-Deep-Research, alternativa open source a Deep Research di OpenAI per assistenza IA personale completamente automatizzata.E’ apparso ECC su GitHub, duecentotrentasette mila stelle. Estensione che aggiunge memoria a Claude Code. Hook registrano correzioni, errori, pattern. Haiku legge i log, cerca schemi, assegna punteggi. Separa abitudini per progetto. Evolve comando trasforma instinct in skill permanenti. Compatibile con Claude Code, Cursor, Codex, OpenCode, Gemini, Zed, Copilot.TurboFieldfare permette di eseguire Qwen tre punto sei 35B con solo uno punto quattro giga di RAM. MoE streaming da SSD. Carica solo l’esperto necessario. Circa venti token al secondo su Mac.AirLLM fa girare modelli giganti su GPU low-end. Quattro giga per Llama3 70B, otto giga per 405B. Modelli fino a due punto otto T. Nessuna quantizzazione, distillazione, pruning. Carica una layer alla volta, la scarta dopo l’uso. Per MoE carica solo l’esperto attivo.Nous Research ha rilasciato Skills Hub di Hermes Agent. Novantamilaseicentoottantuno skill. Novantamilacinquecentouno dalla community. Centonovantanove categorie. Skill da Anthropic, OpenAI, HuggingFace, NVIDIA. Tutto gratis, installabile.Ollama riporta che DeepSeek-V4-Flash-zero sette tre uno è il modello a crescita più rapida di sempre per uso token. Scalano capacità in USA ed Europa. Su Ollama gira con alte prestazioni, oltre cento token al secondo, zero data retention.LocalMiniDrama, progetto open source per creare video IA localmente. Input: una frase. Output: storia, storyboard, video. Genera automaticamente personaggi, scene, storyboard. Flusso completo locale. Integrazione con modello Agnes gratuito.LiveKit Agents, framework open source per agenti vocali real-time. WebRTC audio-video, telefonate in e out, rilevamento turni semantico, MCP tool calling nativo, multi-agent handoff, test e LLM Judge integrati. Stack completo self-hosted.Morphicons, libreria per trasformare icone SVG con animazioni fluide. Lucide, Tabler, Heroicons. Nessuna dipendenza, sei punto cinque kilobyte.Chiudiamo con un utente che ha fatto girare Gemma quattro su iPhone con circa cinquecento mega di RAM. Approccio calibration-aware quantization. Assistente offline che gestisce azioni calendario con circa cinquecentosedici mega di RAM attiva.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.