Ola todos! ecco le notizie dedicate al mondo IA del 10 Agosto 2026Iniziamo con WorldClaw di Tencent: genera interi ambienti tridimensionali editabili dentro Blender, partendo da un solo prompt. Terrain procedurale, mesh testurizzate, posizionamento automatico degli oggetti. Gli agenti correggono scala, pose e contatto col terreno. Ancora acerbo, ma rappresenta un passo significativo verso mondi 3D generati completamente dall’IA.Passiamo a PolyLayout: ricostruisce il layout tridimensionale di un edificio intero solo da immagini. A differenza dei sistemi che mappano una stanza alla volta, questo elabora spazi connessi in un’unica passata. La planimetria resta coerente, senza spezzarsi a ogni porta. Reti neurali più ragionamento geometrico. CENTO PERCENTO open source.Nel frattempo, MotionBricks di NVIDIA: genera trecentocinquantamila skill di movimento in tempo reale a quindicimila fps, con solo due millisecondi di latenza. Niente motion capture, niente rigging. Primitive intuitive per costruire scene velocemente. Integrato direttamente nello stack robotico GR00T. E pure open source.Sempre nel mondo IA, Qwen3-TTS è arrivato in llama punto cpp. Due GGUF da caricare insieme: il parlante e il tokenizzatore audio. A Q4_K_M fanno uno punto due GB più duecentocinquantacinque MB. Apache due punto zero. Audio mono a ventiquattro kHz. Ho testato con un clip di riferimento di nove secondi della mia voce e quaranta frasi. Q4 su uno punto sette miliardi gira in tempo reale su CPU desktop normale. Il punto sei miliardi va al doppio della velocità. Timbro perfetto, ma le domande escono piatte. Q8 risolve tutto, ma costa novecentoMB extra.A proposito di ottimizzazioni, ClipProj riduce MiniMax H3 da quindici punto sette GB a cinque punto due GB di VRAM. Nessuna modifica al modello, VAE o sampler. Sostituisce il text encoder da trentadue miliardi con Qwen3-VL-4B. Qualche perdita di qualità, ma praticabile per chi ha meno memoria.Arriva anche un sistema che traccia le variazioni di quote ore prima degli aggiornamenti di Polymarket. Studente cinese, chip da tre dollari, Claude Code. Il wallet vale ora quattro virgola cinque milioni.Da segnalare anche agent-reach: migliora la ricerca web degli agenti IA. Evita API a pagamento, blocchi, login, cookie e siti illeggibili. Seleziona, installa e verifica automaticamente la migliore opzione per ogni piattaforma. Sessantanovemila stelle.Merita attenzione A-MEM: un team della Rutgers ha smesso di trattare la memoria come database a slot fissi. Ogni esperienza diventa una nota atomica con contenuto, keyword, tag, embedding. L’LLM trova i vicini, li collega, riscrive le vecchie note. Al recall tira fuori un’intera scatola di memorie connesse, non un pezzo isolato. Multi-hop F1 ventisette contro nove-dodici di MemGPT e ReadAgent. Circa milleduecento token per operazione contro sedicimilanovecento. Scala linearmente fino a un milione di memorie.Occhio a Lonkero: scanner di sicurezza web modulare in Rust per penetration test. Oltre centoventicinque capacità di scansione avanzate. Integra machine learning per ridurre i falsi positivi. Scanner XSS proof-based senza dipendenze browser.Sul fronte formazione, Andrew Ng ha rilasciato un corso gratuito di due ore sull’ingegneria dei grafi. Un prompt, cento agenti, loop, grafi da zero. Si parte costruendo il primo agente, si passa ai loop, poi ai grafi completi. Sistemi che si riscrivono da soli.Anche Anthropic ha pubblicato un workshop di ventisette minuti su come scrivere prompt per Claude. Insegnato da chi ha costruito il modello. Gratis, senza registrazione, senza paywall.Novità anche da Zhipu AI con ZCode: IDE desktop per coding con GLM cinque punto due integrato. TRE MILIONI di token gratuiti al giorno, senza carta di credito. Goal Mode per pianificare ed eseguire task, subagenti, controllo remoto del telefono, chatbot integrati. Puoi portare le tue API key. Quota gratuita si resetta ogni giorno.Si muove anche Obscura: browser headless in Rust per agenti IA e crawler. Trenta MB di memoria, avvio istantaneo. Screenshot, registrazione schermo, esportazione PDF. Niente Chromium, compatibile con Puppeteer e Playwright.Segnaliamo anche Jellyfish: tool open source per creazione short drama. Trasforma sceneggiatura in video finito. Scompone la storia, genera storyboard strutturato, blocca aspetto personaggi e atmosfera scene. Supporta image-to-video, monitora rendering lunghi, esporta formato verticale.Proseguiamo con OpenObserve: piattaforma di osservabilità in Rust che sostituisce tool di logging costosi. AGPL tre punto zero, deploy singolo file. Storage costa CENTOQUARANTA volte meno: architettura Parquet più S3. Log, metriche, tracciamento, RUM frontend, monitoring LLM in un pacchetto unico. Query SQL o PromQL dirette.Altra novità: NaraRouter. Gateway con sette milioni di token ogni ventiquattro ore, senza carta o abbonamento. Claude Opus cinque, GPT cinque punto sei Sol, Kimi K3, Qwen tre punto otto Max, GLM cinque punto due, DeepSeek V4 Pro, MiniMax M3. Route compatibile Anthropic e OpenAI. Ogni modello drena l’allowance al proprio tasso.Un aggiornamento da Qwen: arriva Qwen tre punto otto da ventisette miliardi il dodici agosto. Pesi aperti. Dovrebbe girare localmente con circa diciassette GB RAM/VRAM quantizzato.Colpo a sorpresa da Anthropic: si parla di Sonnet cinque punto cinque in arrivo già il mese prossimo. Codename interno Fennec. Due milioni di token di contesto, ragionamento long-context più forte, pianificazione multi-step. Inferenza più veloce, latenza ridotta. Tool use potenziato: browser, terminali, strumenti esterni. La voce più folle: prestazioni quasi a livello Fable cinque, ma a prezzo Sonnet.Anche Hermes Agent ha una novità: se usi GPT cinque punto sei, ora puoi attivare la compaction server-side con l’API Responses nativa di OpenAI. Invece di aspettare la compressione locale, OpenAI compatta il vecchio contesto lato server. Hermes tiene il checkpoint cifrato e lo riproduce nei turni successivi. Gestione contesto migliore per sessioni lunghe.Interessante anche Ix: converte l’intera codebase in una mappa interrogabile per IA. Tree-sitter analizza ventisei lingue, costruisce grafo di simboli, chiamate, import localmente. Map, Structure, Remember, Understand: quattro fasi per strutturare la comprensione. Riduzione token trenta-novantanove punto sette percento nei task di sviluppo.Anche OoO-Spec merita attenzione: usa un sidecar Qwen3 da punto sei miliardi per predire funzione e argomenti in parallelo mentre l’LLM principale continua a decodificare. Tool calling da due punto quattro a cinque punto tre volte più veloce. Speedup medio tre punto otto nove. Lo stesso drafter punto sei miliardi funziona su Qwen due punto cinque, Qwen3 e Llama. Niente retraining specifico per target. Su Qwen3 da quattro a trentadue miliardi: trentaquattro punto uno percento più veloce di ToolSpec in media.Sul fronte repository utili, mi sono accorto dell’esistenza di diversi progetti interessanti su GitHub: cinquanta lab Kubernetes eseguibili direttamente nel browser, un simulatore web di design di sistemi, uno scraper Python per Google Flights che copre oltre centottanta paesi, e un tool che clona qualsiasi sito con un comando e lo ricostruisce in Next punto js e Tailwind usando agenti IA paralleli.Chiudiamo con phone-harness: permette a Claude Code di controllare iPhone. Automazione nativa di qualsiasi app iOS senza API, senza jailbreak. Connetti una volta, controlla sempre. Setup con un prompt.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.