Ola todos! ecco le notizie dedicate al mondo IA del 23 Luglio 2026Iniziamo con OpenAI che lancia Presence, una piattaforma enterprise per costruire agenti vocali e testuali da integrare in flussi aziendali interni e customer-facing. Gli agenti rispondono, eseguono azioni approvate, scalano a operatori umani quando serve. Migliorano nel tempo.Passiamo a Poolside: Laguna S due punto uno tiene testa a modelli con sei volte più parametri. Centodiciotto miliardi totali, solo otto attivi per token. Su Terminal Bench due punto uno e giochi arcade arriva a prestazioni vicine a GLM cinque punto due. Gira su un MacBook con centoventiotto gigabyte.Da Hong Kong arriva CLI-Anything: trasforma qualsiasi software GUI o API in uno strumento a riga di comando che gli agenti possono usare. Blender, GIMP, FreeCAD, Kdenlive. Funziona con Claude Code, Codex, Gemini. Duemiladuecentoottanta test passati, documentazione automatica, zero configurazione complessa.Nel frattempo, Kimi introduce Attention Residuals nel modello K3. Ogni layer decide quanto attingere dai layer precedenti, input-dependent. Niente più somma fissa: ogni token preleva le rappresentazioni più utili dalla profondità. Due virgola otto trilioni di parametri, sei punto tre volte più veloce in decodifica su contesti da un milione di token. I pesi arrivano il ventisette luglio.Anche Anthropic si muove: Claude Managed Agents ora supporta livelli di effort configurabili per agente, sessioni avviate con eventi precaricati, fino a cinquecento skill per sessione, webhook per ambienti e memory store, stream di eventi per sub-agent.Sempre Anthropic pubblica la libreria ufficiale di prompt per Claude Code. Template pre-costruiti che mostrano come strutturare contesto, istruzioni e ragionamento. Serve da riferimento per chi scrive prompt complessi.Occhio a Moonshot AI che rilascia Kimi Code CLI: un agente da terminale basato su Kimi K3, con supporto a input video e sub-agenti dedicati. Open source.Tencent Hunyuan presenta Hyra uno punto zero, un sistema agente ricorsivo auto-migliorante per ricerca scientifica. Experience bank più context agent più swarm di proposal agent. Scoperte in matematica, drug design, quantum computing.Cursor lancia Router, un sistema di routing intelligente che seleziona automaticamente il modello giusto per ogni task. Qualità da frontiera, SESSANTA PERCENTO di costi in meno.Lottie Creator due punto zero è uno studio di motion design che gira completamente nel browser. Descrivi l’animazione, Motion Copilot la costruisce. Graph editor completo, State Machines per interattività, export production-ready. Zero installazioni.Si parla di Impeccable quattro World Builder: motore creativo per design greenfield e redesign. Direzioni creative estratte da centinaia di mondi visual approvati da umani. Core cinquantotto percento più leggero. Ora supporta mobile app design con Apple HIG e Material tre. Audit di accessibilità VoiceOver e TalkBack integrati.Merita attenzione anche questa feature avvistata in test su Claude: Managed Projects. Claude gestisce task autonomamente e mantiene organizzato il progetto. Ogni progetto condivide memoria e istruzioni tra sessioni. Potrebbe essere costruito su Claude Managed Agents.Arriva una notizia poco piacevole: fonti del Dipartimento di Stato USA affermano che Moonshot AI avrebbe distillato Anthropic Fable per sviluppare K3. Piattaforma interna sofisticata per distillazione su larga scala, accesso a server GB300 in Thailandia. Gli Stati Uniti condannano la distillazione industriale segreta mirata a rubare tecnologia proprietaria.Da Microsoft Asia ecco Mage-Flow: modello da quattro miliardi per image generation e editing. Quattro step in meno di un secondo a milleventiventiquattro per milleventiventiquattro. Supporta fino a quattro K. Open source.Su GitHub ho trovato un repository che spiega come costruire un LLM da zero con PyTorch. Tutto il percorso: download dati da The Pile, preprocessing, tokenizzazione con tiktoken, architettura transformer completa. Si può addestrare un modello da tredici milioni di parametri su una T4 Colab. Include anche guida a SFT e RLHF.Poolside ha rilasciato i GGUF ufficiali per Laguna S due punto uno. Gira su una singola RTX quattro-zero-novanta con ventiquattro gigabyte di VRAM. Duecentocinquantamila token di contesto, undici punto cinque token al secondo in decodifica, mille in prefill. Con flag specifici di llama punto cpp si arriva a novecento-ottantasei token al secondo in prefill.LTX-due punto tre IC-LoRA: re-render di video esistenti da una nuova angolazione. Stessa scena, stessa azione, camera diversa. Scegli l’angolo, il modello lo costruisce.Google DeepMind ha testato centottanta configurazioni di team di agenti con lo stesso budget. Su task indipendenti i team hanno vinto con ottanta punto nove percento di miglioramento. Su task sequenziali un singolo agente ha sempre vinto. Team non coordinati amplificano gli errori diciassette punto due volte.NVIDIA rilascia Cosmos tre Super: modelli a quattro step per immagini e video, venticinque volte più veloci delle versioni originali. Primi su image-to-video senza audio, secondi su text-to-image su Artificial Analysis.NVIDIA offre accesso API gratuito a oltre ottanta modelli: MiniMax M due punto sette, GLM cinque punto uno, Kimi due punto cinque, DeepSeek tre punto due, GPT-OSS-centoventi B. Funziona con Cursor, Hermes, OpenCode.Toonflow: open source che converte romanzi in cortometraggi AI. Carica il testo, l’AI fa sceneggiatura, storyboard, character design, video generation. Tre layer di agenti, canvas infinito, deploy locale. Due ore per un cortometraggio da due minuti, costo totale centrotrenta dollari. Oltre undicimilanovecento stelle su GitHub.Ed ecco una serie di notizie interessanti da non farsi scappare.
Su GitHub è apparso un vault open source che dà memoria persistente agli agenti AI. Funziona con Claude Code, Codex, Gemini. Cattura decisioni, successi, prove di review automaticamente dentro un vault Obsidian.Su Reddit hanno segnalato una lista di modelli ottimizzati per diverse quantità di RAM e VRAM: Nanbeige per hardware con quattro-otto gigabyte, Bonsai-ventisette B per otto-ventiquattro gigabyte, Qwen tre punto sei-ventisette B Thinking Cap per ventiquattro-novantasei gigabyte, Laguna-S due punto uno per novantasei-centonovantadue gigabyte, Motif per centonovantadue-trecentoottantaquattro gigabyte.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.