Notizie AI del 12 Agosto 2026

Ola todos! ecco le notizie dedicate al mondo IA del 12 Agosto 2026Iniziamo con Alibaba che ha rilasciato Wan-Animate-2, un aggiornamento importante al suo modello open source per animazione di personaggi. Supporta animazioni ad alta fedeltà, gestisce più personaggi contemporaneamente, controlla il punto di vista della camera tramite testo e genera in streaming in tempo reale.Passiamo a Tencent con 3D WorldClaw. Un workflow agentico che trasforma un prompt di testo in un mondo aperto 3D di grandi dimensioni. Ogni scena è esplorabile liberamente, costruita con asset 3D pronti per il gaming con geometria reale e texture. Mesh vere, non video o splat.Nel frattempo, Muse Glimmer 30B di Meta ha dimostrato capacità sorprendenti. In un test head-to-head contro Gemma 4 31B e Qwen3.6 27B ha generato giochi arcade retrò perfettamente funzionanti. Space Invaders, Tetris e Arkanoid con multiball giocabili come gli originali, senza freeze o crash.Vale la pena menzionare che Muse Glimmer 30B può girare localmente nel browser su WebGPU alla stessa velocità di llama.cpp, circa venticinque token al secondo su M4 Max. Basta aprire un sito web, nessuna installazione richiesta.Arriva anche la virtualizzazione Metal per macOS VM. Su un M1 Ultra, i miglioramenti nelle prestazioni sono significativi: TinyLlama undici virgola otto per prompt e sedici virgola trentasei per generazione, Gemma 4 12B sette virgola venti e quattordici virgola cinquantaquattro, Muse Glimmer 30B sette virgola cinquantacinque e otto virgola ottantasette.A proposito di innovazione, Moonshot AI ha rilasciato Attention Residuals, il più grande upgrade ai transformer dal 2015. Ogni layer usa ora softmax attention sulla profondità, guarda indietro, valuta ogni layer precedente e preleva selettivamente solo i dati necessari. Prestazioni equivalenti a modelli addestrati con VENTICINQUE PERCENTO in più di compute.Da segnalare anche OpenRSI, progetto open source nel campo dell’Agent self-evolution. Costruisce un sistema completo dove l’Agent scrive codice, esegue esperimenti, riceve feedback reale e migliora attraverso Draft, Improve, Debug e Crossover. Include un modello 35B chiamato Frontis-MA1.Sul fronte della sicurezza, OpenAI ha lanciato GPT 5.6-Cyber. Cerca vulnerabilità, accelera i team di difesa e aiuta a patchare progetti open source. Più capace e permissivo di GPT 5.6-Sol, ma richiede approvazione previa.Anche Claude introduce watermark invisibili in tutto ciò che genera: testo, file, codice. Il watermark resiste a copia-incolla e modifiche superficiali. Funzionerà su tutti i prodotti Claude Code, Cowork, API, web. I modelli esistenti sono in fase di implementazione, arriverà anche su Opus 5 e Fable 5.Cambio di scena: su GitHub è comparso Malware Research Hub, una delle più grandi basi di dati di malware mai rilasciate. Duemilaseicentonovantanove campioni raccolti in oltre cinquant’anni. Include specimen di famiglie come Stuxnet e LockBit, un catalogo forense con ottanta famiglie documentate. Strumento per ricercatori in ambienti controllati.Torniamo su transcription con VibeVoice di Microsoft. Modello text-to-speech open source che processa fino a sessanta minuti di audio in una sola passata. Identifica automaticamente chi parla, quando e cosa dice. Compatibile con oltre cinquanta lingue, completamente in locale.Proseguiamo con OpenRouter for tools. Duemilaseicento tool agent-friendly: SEO, geo, social, lead, ads. Ricerca per task, vedi prezzo per richiesta e risposta, chiamalo. Paghi per chiamata, zero subscription, zero markup. Open source.Sempre attivo, Zep ha rilasciato Observations tramite il motore grafico Graphiti. Pattern recognition che analizza i fatti memorizzati come struttura e scrive cosa mostra la struttura, senza attendere query. Il clustering lavora su topologia grafica pura, senza embeddings.Interessante anche LTX 2.5. Pesi aperti rilasciati: modello in int8-convrot, BF16 e NVFP4, upscaler temporali e spaziali, lora distillate, encoder di testo e VAE.Segnaliamo anche il template chatbot minimalista open source rilasciato. Porta insieme nuovi componenti, shadcn/typeset, shadcn/react, tool calling, HITL con questionario e message parts. Deploy con un click su Vercel AI Gateway.Novità anche da Needle 2. Modello da quarantacinque milioni di parametri capace di funzionare come agente e controllare dispositivi in locale. Occupa quattordici MB, richiede circa ventotto MB di RAM. Non serve GPU, nemmeno un computer.Si muove anche lo speech-to-speech. Il nuovo stack elimina STT. Ora VAD manda audio direttamente a MLLM multimodali, poi TTS. Il modello comprende la voce, niente più speech-to-text intermedio.Un aggiornamento da OpenChatCut, progetto open source per editing video. L’AI modifica direttamente una timeline multi-traccia reale ed editabile. Elimina pause e ripetizioni, aggiunge sottotitoli, musica, transizioni e grafica dinamica. Supporta LUT, green screen, zoom ed effetti WebGL. Integrazione MCP con Codex e Claude Code.Sul fronte trading, TradingAgents è completamente gratuito. Analizza fondamentali, notizie, sentiment e grafici. Un team di agenti IA gestisce il trading automaticamente. Oltre novantasettemila stelle.Altra novità: Graft risolve il problema di spreco token. Mappa il repository una volta e l’agente legge la mappa. Quarantadue percento meno token, quarantasei percento meno tool calls, sessanta percento meno tempo. Pure tree-sitter, cento percento locale.Colpo a sorpresa da FLUX 3 Video. Secondo posto mondiale. Gratuito nel playground fino a domenica sedici, ventitré e cinquantanove PT. In arrivo 4K, video editing e input multipli di immagini e video.Ancora Capy v2, il cloud coding agent più veloce. Batte Claude Code, Codex, Devin e Cursor su DeepSWE, costa cinquanta percento in meno. Spawn RLM agents con fino a trentadue vCPU, centoventotto GB RAM e boot VM sotto un secondo.Occhio a Unsloth Desktop, prima app desktop per eseguire e addestrare modelli localmente. Open source, gira su Mac, Windows e Linux. Supporta MLX, diffusion immagini video, audio, GGUF. Connette Claude Code e Codex a LLM locali. Tool calls cinquanta percento più accurati.Da non sottovalutare, Orca per orchestrare agenti IA. Claude Code, Codex, OpenCode, Cursor, Grok. Invia lo stesso prompt a cinque agenti e confronta. App mobile più GitHub più Terminal più Browser. Open source per macOS, Windows e Linux.Merita attenzione MiniMax M3, modello open-weight multimodale con capacità coding e agentiche frontier-level. Comprensione nativa multimodale, finestra di contesto fino a un milione di token. MiniMax Code ora include browser integrato. M3 cerca il web, legge pagine, cattura screenshot e visualizza output HTML.Spostiamoci su DeepSeek V4 Flash e Qwen3.6, gratis su AMD Token Factory con dieci dollari di utilizzo al giorno. Il contatore si resetta quotidianamente. Tutto fuori lista gira su crediti Firework AI.Chiudiamo con Soniox TTS v2. Modello text-to-speech potentissimo. Qualità vocale straordinaria, controllo espressivo tramite tag audio, precisione eccezionale, clonazione vocale ad alta fedeltà. Oltre sessanta lingue, mixing linguistico naturale, streaming a bassa latenza. Settanta centesimi per ora generata.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.

Url delle notizie

AI LABELS_3x2_3_black