Notizie AI del 21 Luglio 2026

Ola todos! ecco le notizie dedicate al mondo IA del 21 Luglio 2026Iniziamo con Auto-Company.Un ricercatore della Carnegie Mellon ha appena rilasciato un sistema open source che simula un’intera azienda con quattordici agenti AI.CEO, CTO, ingegneri, marketer — ognuno modellato su figure reali come Jeff Bezos o Seth Godin.Gli agenti si svegliano, leggono una memoria condivisa in formato markdown, formano squadre, lavorano e poi si fermano.Ciclo dopo ciclo.Primo giro: brainstorming idee. Secondo: analisi di mercato e pre-mortem. Dal terzo in poi: costruzione e deploy.Niente orchestratori complessi. Solo un file di testo che passa di mano. Funziona su Claude Code e Codex.Passiamo a Kimi K3 e Claude Fable cinque.Qualcuno ha costruito un visualizzatore 3D per scegliere posti a sedere negli stadi con Fable cinque. Qualcun altro lo ha rifatto con Kimi K3.Fable: un’ora di lavoro. Kimi: tre ore.Motivo? Kimi ha eseguito test end-to-end, validato desktop, tablet, mobile, ottimizzato per hardware deboli e risolto problemi prima di procedere.Fable ha generato tutto in un singolo file HTML. Kimi ha prodotto componenti React modulari e puliti.TRE VOLTE PIÙ ECONOMICO.Pesi aperti in arrivo il ventisette luglio.Nel frattempo, Moonshot rilascia Kimi Code CLI.È open source, licenza MIT. Registra lo schermo e trasforma il video in istruzioni dirette.Modalità coder, explore e plan separate. Ogni file viene pianificato prima di essere toccato.Nessuna dipendenza Node. Si avvia all’istante.Passiamo agli exit loop.Otto uscite necessarie per ogni ciclo agente, non una sola. Goal met, turn cap, budget cap, wall clock, no progress, human interrupt, error threshold, external event.Un loop con una sola uscita si blocca. Otto uscite trasformano il loop in sistema.Da segnalare anche Qwen-Audio-tre punto zero-TTS.Sintesi vocale multilingue con controllo estremo. Sedici lingue, clip fino a tre minuti, ottantasei tag per pause e respiri.Qualità di clonazione vocale impressionante.Sempre attivo, Qwen tre punto otto.La preview migliora ogni giorno. Ultima versione live ora, con grandi passi avanti sul frontend web. Versione ufficiale in arrivo, poi pesi aperti per tutti.Arriva anche Hound.Server MCP gratuito per navigare il web senza chiavi API. Fetch, search, crawl, screenshot. Tutto keyless.Estensione nativa per Pi. Dieci backend di ricerca in parallelo. Recupero automatico dall’Internet Archive per pagine morte.Fetch anti-bot, OCR automatico per PDF. Zero costi mensili.Novità anche da NVIDIA con Nemotron.Modello audio-nativo che ascolta il mondo, non solo parole. Trascrizione, traduzione, riconoscimento suoni, Q&A audio, text-to-speech e speech-to-speech completo.Pesi aperti, due miliardi e trenta miliardi di parametri.Ed ecco una serie di notizie interessanti da non farsi scappare.Su GitHub sono comparsi repository per trasformare codice e documenti in grafi di conoscenza navigabili, prevenire il design AI-generato generico, addestrare strategie di trading con linguaggio naturale, eseguire agenti multipli in parallelo e permettere agli agenti di leggere e scrivere file Office senza installazione.Trovate i dettagli nei link.Merita attenzione Andrew Ng.Ha rilasciato un corso gratuito di un’ora su come costruire knowledge graph agentici da zero. Architettura multi-agente, costruzione con Google ADK, perché i grafi sono il futuro dell’IA agentica.Un aggiornamento da Claude Code.Versione due punto uno punto duecentosedici disponibile. Quaranta modifiche CLI, una modifica al prompt di sistema. Aggiunta impostazione per disabilitare isolamento filesystem mantenendo controllo rete.Corretta normalizzazione messaggi quadratica in sessioni lunghe.Proseguiamo con Moonshot.Ora sponsorizza claude-code-router. Setup esistenti rimangono intatti. Kimi K3 si connette con un click. Preset integrati, failover automatico, caching a zero punto trenta dollari per milione di token.Altra novità: OmniRoute.Gateway gratuito che aggrega duecentotrentuno provider AI in un singolo endpoint. Compressione token fino al novantacinque percento. Tier gratuiti sufficienti per funzionare indefinitamente.Colpo a sorpresa da UC Berkeley.Ricercatori propongono di leggere pagine web tramite screenshot invece di HTML. RAG tradizionale perde tabelle e grafici. Questo approccio mantiene tutto.Precisione aumentata fino al diciotto punto uno percento. Ottocento milioni di pagine Wikipedia già indicizzate. Disponibile come plugin per Claude.Ancora Trump.Amministrazione valuta restrizioni severe sui modelli IA cinesi dopo il lancio di Kimi K3. Possibile responsabilità per host USA e minacce di blacklist.Sul fronte tool open source, Nativ.Esegue modelli frontier open in locale su Mac. Nessun account, nessun abbonamento, nessun cloud. Basato su mlx-vlm, multimodale, velocissimo su Apple Silicon. Cento percento privato. Licenza MIT, gratuito per sempre.Spostiamoci su MUE-X.Legge il proprio codice Python in tempo reale e lo riscrive usando sei strategie di mutazione AST. Valida miglioramenti ed evolve la propria funzionalità senza intervento umano.Da non sottovalutare, Gemma quattro ventisei miliardi eseguito su una singola RTX tremila e sessanta.Dodici gigabyte VRAM, sedici gigabyte RAM. Due configurazioni llama-swap: centosessantamila token di contesto a cinquantadue token al secondo, oppure settantamila contesto a sessantotto-settanta token al secondo.Interessante anche SpaceX.Grok quattro punto cinque ora gratuito in Cursor. Modello top per coding con cinquecentomila token di contesto. Quattro volte più efficiente di Opus su coding. Nessuna chiave API o carta di credito. Solo un toggle.Segnaliamo anche Cursor.Team di agenti ha ricostruito SQLite dal manuale di ottocentotrentacinque pagine. Replica in Rust che ha superato cento percento di una test suite riservata. Costo variato quindici volte a seconda del mix di modelli usato.Torniamo su Alibaba con Qwen-Audio-tre punto zero-TTS.Due versioni: Flash per interazione real-time, Plus per generazione alta qualità. Sedici lingue, controllo stile in linguaggio naturale, tag dettagliati per elementi non verbali, clonazione vocale robusta da audio imperfetto.Cambio di scena: Alaya World.Modello mondiale aperto che ricostruisce la logica dei costi di prototipazione nel gaming. Addestrato su trecentocinquantamila clip motion. Cache 3D esplicita, memoria frame compressa, Error Bank che re-inietta errori accumulati nel training.Quindici secondi di coerenza diventano un minuto intero. Prototipi giocabili in minuti invece di settimane.Occhio a Unitree con UnifoLM-OminiA-zero punto tre.Modello singolo per task domestici e assistenziali. Comprensione interattiva omni-modale, esecuzione autonoma, stabile e resistente a disturbi.Vale la pena menzionare LTX con Clean Plate IC-LoRA.Rimuove persone, pedoni e veicoli da un clip e ricostruisce lo sfondo vuoto dietro di loro. Nessuna maschera richiesta. Mantiene architettura, segnaletica stradale e vegetazione intatti. Funziona come LoRA video-to-video su ComfyUI.Sempre nel mondo IA, Text-to-CAD.Harness open source che permette a Claude Code e Codex di generare modelli CAD 3D reali, descrizioni robot URDF e G-code da linguaggio naturale.Passiamo a Kimi K3 cablato direttamente in Codex.Qualcuno ha collegato la propria subscription Kimi a Codex tramite OAuth. Kimi K3 appare nel selettore modelli accanto a Sol cinque punto sei. Nessuna chiave API necessaria. Solo sign-in OAuth tramite Kimi Code.A proposito di CEO, Zhilin Yang di Kimi.Dice che ogni lab IA ha l’ossessione sbagliata. Tutti pensano che il modello conti di più. Sbagliato. È come organizzi le persone che lo costruiscono a vincere. Il contesto lungo è la RAM dell’era IA. Il vero moat è l’organizzazione.Sempre attivo, Gemma quattro trentuno miliardi.Grazie a Hugging Face e Cerebras, ora utilizzabile come cervello per voice IA a velocità ultra-rapide. Stack speech-to-speech completamente open source.Non si ferma Gemma quattro trentuno miliardi QAT.Versione aggiornata con Multi Token Prediction più encoder visione da uno punto tre gigabyte più centodieci mila token di contesto. Funziona in locale a sessanta token al secondo su singola RTX quattromila e novanta.Arriva anche Unsloth per AMD.Collaborazione con AMD per abilitare training e inferenza di oltre cinquecento modelli su GPU AMD. Funziona su Windows, WSL, Linux. Addestra Qwen e Gemma con tre gigabyte VRAM. Due volte più veloce con settanta percento VRAM in meno.Merita attenzione Grok per Excel.Usa Grok quattro punto cinque per costruire modelli finanziari, analizzare dati di mercato, generare grafici. Ora disponibile.Chiudiamo con Hugging Face.Un agente IA autonomo ha violato i sistemi di produzione tramite un dataset malevolo. Ha accesso a dati interni e credenziali di servizio, poi si è spostato tra cluster tramite migliaia di azioni in sandbox temporanei.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.

Url delle notizie

AI LABELS_3x2_3_black