Ola todos! ecco le notizie dedicate al mondo IA del 19 Luglio 2026Iniziamo con Kimi K3, che ha ricostruito una dashboard 3D interattiva da un solo prompt e un’immagine di riferimento. Texture, illuminazione e pannelli in vetro praticamente identici all’originale. A prezzi Sonnet.Passiamo a Supertonic, un modello text-to-speech da sessantasei milioni di parametri che batte ElevenLabs, OpenAI e Gemini. Gira offline su Raspberry Pi. CENTOSESSANTASETTE volte più veloce del tempo reale. Un’intera pagina web diventa audio in meno di un secondo. Trentuno lingue, nessun adattatore. Ottantotto virgola uno percento di accuratezza su numeri, date e valute. Undici virgola due mila stelle su GitHub.Nel frattempo, il team di Cline ha testato Kimi K3 contro Fable su un bug reale del loro repository. Entrambi l’hanno risolto, ma Fable finisce tre virgola quattro volte più veloce. Tre minuti e mezzo contro dodici. Kimi però costa due virgola tre volte meno: NOVANTADUE centesimi contro due virgola tredici dollari. Prima volta che un modello open weight compete direttamente con i migliori.Da segnalare anche Anthropic, che ha rilasciato un sistema open source per trovare vulnerabilità nel codice con Claude. Crea modelli di minaccia, cerca falle, genera exploit, produce patch e le testa. Tutto autonomamente. Orientato a C/C++ e vulnerabilità di memoria, ma adattabile.Sempre attivo, Google ha aggiornato Gemma 4 con Flash Attention 4 e template ottimizzati per tool calling. Benchmark TB2: più venticinque virgola otto percento. Tau2: più sessantadue virgola sette percento. Con cache KV a quattro bit gira a trentatré token al secondo su singola RTX quattro novanta. CENTONOVANTA mila token di contesto.Si parla di Claude Fable 5, che dal venti luglio sarà disponibile solo sui piani Max e Team Premium al cinquanta percento dei limiti. Pro e Team Standard ricevono cento dollari di credito una tantum e accesso via crediti.Occhio a chunked prefill in vLLM: divide le richieste lunghe in blocchi piccoli per evitare che un singolo utente monopolizzi la GPU. Ogni chunk viene processato insieme ad altre richieste. Mantiene il throughput alto e serve più utenti contemporaneamente.Interessante anche Voicebox, repository con quarantuno virgola sei mila stelle. Clona la tua voce da dieci secondi di audio. Sette motori TTS, ventitré lingue, integrazione MCP con Claude Code, Cursor e Cline. Gira completamente offline sul tuo dispositivo. I tuoi dati audio non escono mai dal computer. Zero costi.Ancora sul fronte AI potenziata: qualcuno ha rilasciato Super-GLM cinque punto due abliterated. Settecentocinquantatré miliardi totali, quaranta attivi. MoE non censurato con editing a quattro direzioni. Un milione di token di contesto. Zero rifiuti su cento richieste. Mantiene l’efficienza NVFP4 nativa.Arriva anche un masterclass di quaranta minuti dal founder di Kimi Moonshot. Spiega come orchestrano TRE-PIÙ specializzati sub-agent in parallelo. Ricompense RL dinamiche, migliaia di chiamate a tool, esecuzione quattro virgola cinque volte più veloce. Scaling reale oltre i limiti di contesto.Altra novità: Gemma 4 ha completato ts-bench con punteggio CENTO. Errori di tool calling drasticamente ridotti. Thinking attivo raccomandato. Le versioni da ventisei e dodici miliardi migliorano ma non completano il benchmark.Merita attenzione HY-Motion, modello che genera movimenti da testo e li applica a rig Mixamo. Funziona dentro ComfyUI e Blender. Custom node pubblico su GitHub.Colpo a sorpresa da DeepSeek V4 GA: in test interno. Performance livello Opus quattro punto otto. Comportamento agente molto più forte. Coding migliorato, generazione 3D avanzata. Prezzo ipotizzato: ZERO virgola zero zero due otto dollari per milione di token. Lancio previsto domani o nei prossimi giorni.Spostiamoci su MobileWan di Qualcomm: genera video a quattroottanta p in venti secondi su dispositivi Snapdragon. Locale, free, open source. Prima volta che la generazione video gira su telefono.Proseguiamo con Kimi Code CLI, alternativa open source gratuita a Claude Code. Upload di registrazioni schermo, agenti separati per coding, planning e ricerca. Pianifica modifiche prima di toccare i file. Setup MCP diretto da CLI. Compatibile VS Code, JetBrains, Zed. Avvio in secondi, niente Node punto js.Si muove anche Decart con Lucy due punto cinque: world model che genera realtà aumentata in tempo reale attorno a te. Niente visore. La fotocamera cattura i tuoi movimenti e l’ambiente risponde istantaneamente.Segnaliamo anche un possibile nuovo modello Qwen nascosto su LMArena sotto il nome ‘Kaleb’. Si presenta come Claude ma gli utenti l’hanno identificato come Qwen dai pattern di output.Passiamo a PixelRAG, che indicizza screenshot invece di HTML. Costruisce RAG su quello che l’utente vede davvero. Trenta milioni di screenshot Wikipedia. Più diciotto virgola uno percento di accuratezza rispetto al miglior RAG testuale. Include plugin Claude Code per navigazione visiva.Vale la pena menzionare Grok Build, che ha rilasciato cinque skill per asset di gioco con Grok Imagine. Cicli di animazione, personaggi coerenti, tileset seamless, icone UI. Frame video-first per movimenti fluidi. Output pronti per engine.Sul fronte estrazione dati, Google ha rilasciato LangExtract. Open source, gratuito. Estrae dati strutturati da testo non strutturato. Mappa ogni entità alla posizione esatta nel documento. Gestisce cento più pagine. Genera HTML interattivo per verifica. Funziona con Gemini, Ollama, modelli locali.Un altro repository interessante: Brainless, che ricrea componenti UI di Claude Code, Codex e Grok come libreria ShadCN riusabile. Prompt, chat, tool call, diff, permission dialog, comandi slash. Ideale per app AI e CLI.Da non sottovalutare skills punto sh di Vercel Labs: package manager per skill agente. Novecentotrentamila skill disponibili. Un comando le installa per Claude Code, Cursor, Codex, Copilot e sessanta più agenti. Gestione come npm.Torniamo su deployment con OpenShip: crea il tuo Vercel, Supabase e mail server su VPS. Deploy app, database, backup. Alternativa a Dokploy e Coolify. Open source.Ed ecco una serie di notizie interessanti da non farsi scappare. AutoAgent costruisce sistemi agente da descrizione in inglese. AnythingLLM è piattaforma self-hosted per RAG e agenti. LangChain Open Agent Platform offre UI visuale su LangGraph. Sim è workflow builder con AI Copilot. Dify è platform production-ready con monitoring.Uno YouTuber spendeva mille dollari al giorno in token AI. Ha provato Kimi K3 e completato lo stesso lavoro per SESSANTATRÉ dollari. Centoventidue task autonomi. Il modello riorganizza la sua to-do list da solo. Audit di sicurezza con venticinque agenti di verifica. Chiama Kimi K3 ‘classe frontier’.Chiudiamo con Ashpreet Bedi che open-sourcea settantacinque esempi di codice per training data con agenti. Labeling, DPO juries, rejection sampling, reward step-level, instruction generation, dataset curation, decontaminazione benchmark.E ancora: Andrej Karpathy condensa otto anni di OpenAI e Tesla in una lezione gratuita di due ore. Da salvare.img2threejs trasforma una foto di oggetto in modello Three punto js procedurale. Nessun mesh scaricato. Loop render-vs-reference per quality gating. Ottimo per oggetti hard-surface.Sempre nel mondo AI, Sebastian Raschka spiega come un LLM passa tra livelli di ragionamento low, medium, high-effort. Articolo completo su implementazione inference e training.Non si ferma la Cina: framework open source che esegue DeepSeek-R1, seicentosettantuno miliardi di parametri, su singola GPU da ventiquattro GB. Da TRE a VENTOTTO volte più veloce. Fine-tune DeepSeek-V3 su quattro quattro novanta. Diciassette virgola tre mila stelle.Infine, NVIDIA rilascia modello da seicentoM che trascrive quaranta lingue in tempo reale. Latenza OTTANTA millisecondi. Diciassette volte più flussi concorrenti su stesso H100. Punteggiatura e maiuscole integrate. Gira su GPU locale.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.