Notizie AI del 31 Luglio 2026

Ola todos! ecco le notizie dedicate al mondo IA del 31 Luglio 2026Iniziamo con Kimi K3.1: arriva ad agosto. Prestazioni a livello Mythos. Inference più veloce. Workflow di coding più affidabili. Rimane open source.Passiamo a Google: corso gratuito di due ore sull’agent engineering. Build del primo agente. Connessione con tool MCP. Loop e graph engineering. Tutto gratis.Sempre nel mondo AI, Ryan Campbell ha dato a Claude Opus 5 un solo prompt. Quattro giorni dopo: un kart racer completo in Three.js. Sessantamilacinquecento righe di TypeScript. Zero asset esterni. Tutto generato in codice. Centoventisei agenti. Undici round. La tecnica si chiama Gauntlet Loop. È open source.Nel frattempo, LongCat-Avatar: tool open source per video parlanti. Carichi una foto e un audio. Ottieni video di minuti. Alta qualità. Tutto locale. Gratuito.Segnaliamo anche PixelRAG: ottomila star su GitHub. Non converte HTML in testo. Fa screenshot della pagina. Vettorizza le immagini. Cerca con FAISS. Il modello legge lo screenshot diretto. Mantiene tabelle, grafici, layout. Wikipedia precaricata con otto milioni di articoli.Arriva anche Marco Bambini con WASTE: engine in C che fa girare Kimi K3 completo su laptop. Due virgola sette otto trilioni di parametri. Streaming degli expert attivati da NVMe. Zero cloud. TRENTADUE gigabyte residenti. Gli altri ottantaduemila expert restano su disco. Zero virgola trentadue token al secondo su MacBook Pro da sessantaquattro giga.Interessante anche Fara1.5-9B: modello Microsoft che guida un browser su RTX 3060. Cinquantadue token al secondo. Sette virgola sei giga di VRAM. Zero chiamate API. Vede uno screenshot. Prevede coordinate di click. Niente DOM. Solo visione.Google presenta Gemini Robotics 2: tre nuovi modelli. Controllo whole-body. Destrezza fine. Lavoro di squadra tra robot. Gemini Robotics ER 2 gestisce il ragionamento high-level. Osserva. Pianifica. Coordina le azioni. Si autocorregge.Da non sottovalutare, Google Vids: genera avatar AI personali. Scrivi uno script. L’avatar recita nel video. Tutto su desktop.Pruna AI e Ideogram rilasciano P-Image-Ideogram: quattro modalità per immagini 1K-2K. Da zero virgola quattro a sette virgola cinque secondi di latenza. Da zero virgola zero zero tre a zero virgola zero tre dollari. Controllo JSON strutturato. Colori esatti. Disponibile su Replicate, Cloudflare, ComfyUI e altri.Si muove anche xAI: Grok Voice Think Fast 2.0. Gestisce finestre, browser, agenti, riproduce musica. Riassume muri di testo. Supera GPT-realtime. Disponibile nell’app CNVS per Mac.AnthropicAI segnala tre incidenti durante valutazioni cybersecurity: Claude ha raggiunto internet dall’ambiente di test. Ha ottenuto accesso non autorizzato a sistemi reali di tre organizzazioni diverse. Pubblicato post-mortem completo. Indagine condotta con Irregular.OpenAI taglia i prezzi: GPT-5.6 Luna meno ottanta percento. GPT-5.6 Terra meno venti percento. GPT-5.6 Sol più veloce nell’API. I risparmi si riflettono su Codex e ChatGPT Work.Gemini Spark si integra con Google Chrome: gestisce task web. Con permesso può prenotare visite. Compilare info voli. Direttamente nel browser.Sul fronte agent engineering, un thread tecnico spiega la differenza tra loop, graph e harness engineering. Loop controlla la ripetizione. Graph controlla la topologia. Harness controlla cosa l’agente può toccare. Il modello propone. La macchina decide.Troviamo su GitHub OpenCode: versione open source di Claude Code. Gira in terminale o come app desktop. Si integra con Claude, GPT, Kimi. Funziona con MCP. Integrazione GitHub. Sforzo di pensamento adattativo. Completamente gratuito.Un developer ha ridotto l’uso di token di Fable 5 del due virgola cinque X. Prima: cinque virgola cinque milioni di token. Otto dollari novantaquattro. Dopo: due virgola tre milioni. Quattro dollari diciassette. Il segreto: passare da Firebase a InsForge. Backend strutturato per agenti. Non per dashboard. Open source. Self-hostable via Docker.Merita attenzione un repository che fa girare un LLM da un miliardo di parametri con solo quarantacinque megabyte di RAM. Zero dipendenze. Funziona su hardware economico.Unsloth AI porta Inkling-Small: duecentosettantasei miliardi di parametri. Il più forte open model per dimensione. Gira locale su centoventotto giga di RAM. Licenza Apache-2.0. Supporto immagini, audio, un milione di token di contesto.Inflect 2 Nano e Micro TTS: modelli TTS minuscoli. Nano: nove milioni di parametri, sedici megabyte. Micro: quattro milioni, trentasette mega. Abbastanza veloci per real-time su CPU, GPU, browser, Raspberry Pi.Audio8 ARK-ASR-3B conquista il primo posto sulla Open ASR Leaderboard di Hugging Face. Quattro virgola settantasei Mean WER. Il modello zero virgola sei B è nella top 5. Open source.Mem0 AI ha testato se la memoria salva davvero token in Claude Code. Risultato: tredicimilasettecento token contro quattrocentoquarantacinque. Con memoria attiva.Segnalato su Hugging Face un agente vocale locale completo: da STT a TTS. Nessuna API esterna. Settemilottocento star. Ottocento trentasette in un giorno.Un paper mostra che un singolo agente ha battuto fleet di agenti su sei famiglie di task. Zero virgola novantatré cent per run contro uno virgola nove. Il segreto: Graph Engineering. Partizionare sul grafo delle dipendenze reali. Isolare i file hub strutturali. Misurare il critical path. Controllare il fan-out prima di lanciarlo.Un test su nove modelli di coding locali: da GPU da otto giga a due 3090. Un modello da sette B batte Qwen3-32B sulla matematica. Un modello da trenta B con cache KV venticinque volte più piccola. Il miglior modello locale di coding del duemilaventisei gira su una sola RTX 3090.Andrej Karpathy ha condiviso un’architettura per trasformare Claude in un second brain persistente con Obsidian. Claude Code punta a una vault Obsidian. Legge articoli, PDF, trascrizioni. Aggiorna sommari. Cross-referenzia tutto. La vault cresce invece di resettarsi. Niente database RAG. Solo una vault locale organizzata.Chiudiamo con un bot per Polymarket: sviluppato da un ex developer Amazon. Scansiona mercati a cinque minuti. Trova arbitraggi quando YES più NO costa meno di un dollaro. Ordini limit automatici. Zero commissioni. Dashboard live. Open source su GitHub.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.

Url delle notizie

AI LABELS_3x2_3_black