Notizie AI del 29 Luglio 2026

Ola todos! ecco le notizie dedicate al mondo IA del 29 Luglio 2026Iniziamo con Anthropic: Claude Mythos Preview ha aiutato i ricercatori a trovare debolezze negli algoritmi crittografici, i metodi matematici che mantengono i dati privati. Un passo avanti nell’uso dell’IA per la sicurezza informatica.Passiamo ad ACE-Step: qualcuno ha costruito ACE-Step UI, un’interfaccia stile Spotify per ACE-Step uno punto cinque che genera canzoni complete con voce fino a quattro minuti, completamente in locale sulla GPU. Open source.Nel frattempo, Sol-Attn: un nuovo metodo di sparse attention training-free che accelera la generazione video. Su Wan due punto uno-quattordici B raggiunge due punto zero due volte la velocità end-to-end, su HunyuanVideo-tredici B due punto uno due volte.Sempre attivo, Pipe Network: il team ha rilasciato un port MLX di Kimi K3, il modello da due punto otto trilioni di parametri. Con REAP pruning lo portano a trecentocinquanta GB, dentro un Mac Studio. Open source.Da segnalare anche Flux 3: eccelle nelle generazioni split screen. Una sola ripresa continua, due metà verticali sincronizzate frame per frame. Risultati impressionanti.Vale la pena menzionare MiniCPM5-1B: uno sviluppatore ha creato tiny-llm, un motore di inferenza in puro Rust. Solo CPU, nessuna cache KV, visualizzazione TUI delle mappe di attenzione. Un laboratorio di anatomia per LLM.Occhio a VibeVoice-ASR di Microsoft: trascrizione da voce a testo fino a sessanta minuti di audio senza segmentazione, riconoscimento del parlante, timestamp, cinquanta lingue. MIT, locale, zero costi API.Merita attenzione KAT-Coder-V2.5-Dev: modello MoE da trentacinque B con tre B attivi. Sessantanove punto quattro su SWE-bench Verified, sessantatré punto zero su Multilingual. Contesto nativo duecentocinquantasei K. Apache due punto zero.Sul fronte modelli, Gemma 4: il team Cactus ha post-addestrato Gemma 4 per restituire un punteggio di confidenza. Prompt elaborato in locale se confidenza alta, routing al modello cloud solo nel quindici-cinquantacinque percento dei casi.Novità anche da Mirage: Avatar X, il nuovo modello per avatar IA. Preservazione dell’identità industry-leading, avatar più espressivi disponibili, supporto video verticale e orizzontale.Torniamo su encoder con Liquid AI: LFM due punto cinque-Encoder-duecentotrenta M e trecentocinquanta M. Encoder bidirezionali veloci su contesti lunghi, anche su CPU. Il modello da duecentotrenta M è tre punto sette volte più veloce di ModernBERT-base su CPU a ottomilacentonovantadue token.Cambio di scena: Reka AI apre WorldModelGym leaderboard. Valuta se un modello può prevedere quale azione porta al miglior risultato tra una lista di possibilità. Dreamer-v3 di Reka guida tre benchmark su quattro.Spostiamoci su PrunaVAED: decoder drop-in più veloce per LTX-due punto tre. Uno punto sette-due punto uno volte più veloce, cinquanta percento in meno di VRAM di picco. Open source.Da non sottovalutare, MCP: la versione due zero due sei-zero sette-ventotto è live. Il protocollo diventa stateless, più facile da deployare e scalare. Il più grande aggiornamento dal lancio.Interessante anche Hermes: la funzione slash moa (Mixture of Agents) invia lo stesso prompt a due o più modelli in parallelo, poi un terzo sintetizza la risposta migliore. Risultato su HermesBench: zero punto otto due zero due.Si muove anche oh-my-hermes: sistema di memoria layered per hermes-agent. Memoria nativa più blocchi etichettati con gestione, persistenza, recall, consolidazione ed eviction plan.Segnaliamo anche un post tecnico su Kimi K3: un ingegnere Baseten ha analizzato il codice del modello. Ventidueimilacinquecentottanta GPT-2 del duemiladiciannove, architettura da KDA (Kimi Delta Attention), attenzione residuale cross-layer, NoPE ovunque.Altra novità: Cursor sta testando Composer 3 in beta interna. Pare superi Opus 5 e GPT-cinque punto sei Sol in coding e agenti. Dieci volte più economico. Codename interno: Vega.Colpo a sorpresa da llama.cpp: fixato un bug di performance MTP. Dieci percento più veloce su Qwen tre punto sei-trentacinque B-A3B. Incluso nella release b10152 del ventisette luglio.Ancora ComfyUI: un creator ha costruito un’intera sequenza motion 2D ispirata agli anime, da storyboard a render finale in un’ora. Tutto dentro un unico workflow pipeline.Proseguiamo con Fish Audio: rilasciato S due punto uno Pro, modello vocale per conversational AI real-time. Dialogo multi-speaker, clonazione vocale da campioni brevi, supporto MCP e agent-skill.Un aggiornamento da Microsoft: Fara uno punto cinque, collezione di modelli computer-use (quattro B, nove B, ventisette B) che guidano un browser reale. Loop screenshot, click, ripeti. Performanti anche in locale.Sempre nel mondo AI, VODER: otto modalità di elaborazione vocale in un’unica interfaccia. Speech-to-text, conversione vocale, generazione musicale, scripting dialoghi multi-speaker, clonazione vocale. Tutto in locale.Passiamo a Grok: build di app da web, iOS e Android. Un prompt trasforma un’idea in prodotto pubblicato con dominio proprio. Disponibile per utenti SuperGrok Heavy.Chiudiamo con Higgsfield: Seedance due punto zero tiene la consistenza del personaggio per dieci secondi interi, camera in movimento continuo. Nessun drift di identità. Stesso blocco descrittivo del personaggio in ogni shot.Ed ecco una serie di notizie interessanti da non farsi scappare. Su GitHub: un ex-ingegnere Vercel ha rilasciato un setup punto claude con ventisei skill production-ready. Centosettantanovemila stelle. Workflow completi, non prompt. Clonabile gratis. Anthropic ha pubblicato diciassette plugin ufficiali Claude quasi nessuno usa: centoquarantuno skill assumibili in sessanta secondi. Da The Engineer a The Guardian. Un repo chiamato GeoLibre trasforma licenze di mapping costose in open source MIT: SQL spaziale via DuckDB-WASM, LiDAR, PMTiles, Zarr, 3D Tiles. Mappe Terra, Luna, Marte, Giove. Google ha rilasciato Open Knowledge Format v zero punto due: segnali di trust agentico in frontmatter YAML. Attested Computation per metriche approvate. Microsoft Foundry ora include OTel due punto zero: showcase AT&T per produzione IA su larga scala con Phi-4, Gemma-4, GPT-OSS, AMD MI300X. Fish Audio S due punto uno Pro costa settanta percento meno di ElevenLabs: open source, self-hostable, ottantatré lingue, clonazione vocale da quindici secondi. Rilasciato un CLI e SDK TypeScript open source per trovare, validare e fixare vulnerabilità di sicurezza nel codice: scan repo, review modifiche, tracking finding, check CI. Un creator ha costruito un sistema auto-aim zero-delay su microcontrollore ESP-32 da otto dollari: tracciamento movimento con precisione zero-pixel, inferenza IA locale, zero latenza.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.

Url delle notizie

AI LABELS_3x2_3_black