Ola todos! ecco le notizie dedicate al mondo IA del 08 Ottobre 2026Iniziamo con Anthropic. Claude Haiku CINQUE PUNTO CINQUE è arrivato. Sembra essere il modello small più economico che abbiano mai rilasciato: costa circa il SETTANTACINQUE percento in meno rispetto a Haiku QUATTRO PUNTO CINQUE. Disponibile sia su Claude Platform che su Claude Code, è stato pensato per compiti ad alto volume come riassunti, compattazione dati o query su database. Potrebbe funzionare bene come subagent in coppia con Opus o Sonnet.Nel frattempo, OpenAI ha annunciato GPT-SEI e Intelligent UI per ChatGPT. L’Intelligent UI promette risposte interattive più veloci, con contenuti visivi che dovrebbero rendere argomenti complessi più accessibili e strumenti disponibili direttamente nel punto in cui servono. È in fase di rollout per tutti gli utenti.Sempre da OpenAI, arriva anche Decisions API. Si tratta di un modello multimodale chiamato Jev, basato su GPT-SEI Luna, costruito per decisioni in tempo reale. Negli esempi mostrati analizza oggetti come uova rilevando se sono pulite, sporche o rotte con una latenza di circa DUECENTOSETTANTA millisecondi.Passiamo a Google. SynthID Detector è ora disponibile globalmente in inglese. È uno strumento di verifica che permette di controllare se un contenuto — immagine, video o audio — è stato generato con IA. Funziona con contenuti creati da Google AI e dai partner tra cui OpenAI, NVIDIA, Kakao e presto Apple. Fino ad oggi Google ha marchiato CENTOTTANTA miliardi di immagini e video, oltre a DUECENTOQUARANTAMILA anni di contenuto audio, gestendo circa UN MILIONE di richieste di verifica al giorno.Da segnalare anche Google Playground. Sembra essere uno strumento no-code che permette di creare giochi direttamente tramite prompt, generando in tempo reale fisica, personaggi e regole. Supporta web e mobile con multiplayer in tempo reale, e integra Unity Spark per portare i prototipi verso giochi tridimensionali di qualità superiore.Microsoft ha rilasciato MAI-Code-UNO PUNTO UNO-Flash in versione locale su GitHub Copilot. Il modello gira direttamente sul dispositivo, senza costi di inferenza per le chiamate locali. Dovrebbe permettere sviluppo agentico di qualità senza passare per il cloud.Occhio a Perplexity. Ha appena rilasciato come open source pplx-embed-v2-late: embedding multi-vettore per testo e immagini in uno spazio condiviso. Esistono due versioni, una da NOVE miliardi e una da ZERO PUNTO SEI miliardi di parametri. Quest’ultima può girare on-device per fare query locali. Permette di indicizzare dati multimodali e cercare direttamente in pagine PDF senza OCR. Ottiene il NOVANTADUE PUNTO QUATTRO percento su MADQA e il SESSANTAQUATTRO percento su BrowseComp plus.Sul fronte ricerca, ho trovato un paper interessante su ricostruzione tridimensionale in streaming. Un sistema che ricostruisce scene dal vivo a circa VENTI frame al secondo usando una singola fotocamera, senza lidar. End-to-end, senza passaggi di ottimizzazione o pulizia. Batte sia metodi streaming che alcuni offline. Il codice è disponibile.Segnaliamo anche Liquid AI. Ha rilasciato Open d1: due modelli multimodali della famiglia d1, pensati per decisioni in tempo reale. d1-TRE B supporta testo più visione, d1-omni-SEICENTO M supporta testo più immagine o testo più audio. Possono girare da data center NVIDIA DGX fino a workstation RTX o Jetson edge.Chiudiamo con Karotte. È un framework open source per costruire ambienti di reinforcement learning, sviluppato da un team che lo usa da oltre un anno per creare ambienti machine learning enterprise. È stato testato attraverso oltre UN MILIONE di evaluation run e sessioni di red-teaming.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.