Ola todos! ecco le notizie dedicate al mondo IA del 18 Settembre 2026Iniziamo con Anthropic. Tre metriche pubbliche per tracciare lo sviluppo IA: quanto R&D è fatto da IA stessa, quanto gli agenti sono supervisionati, come viene allocato il compute. Pubblicano i primi numeri interni. Ogni lab potrebbe fare lo stesso. L’obiettivo è ridurre il gap tra quello che sanno i lab e quello che sa il pubblico.Passiamo a OpenAI. Astra for Law. GPT-6 Astra dedicato a studi legali. Strumenti, impostazioni e contesto costruiti per supportare avvocati e aziende di legal tech. Una nuova offerta pensata per l’expertise legale.Nel frattempo, Claude Code introduce Projects. Un progetto è una conversazione. Claude divide il lavoro in thread paralleli. Sessioni cloud indipendenti. Passaggio di contesto automatico. Continua anche quando chiudi il laptop. In beta per utenti Pro e Max. Presto per tutti.A proposito di ottimizzazione, Anthropic ha usato Claude per accelerare oltre trenta modelli open source per biologia. Quattro volte più veloci in media. Codice custom per GPU. Tutto il codice di ottimizzazione è open source. Modelli per struttura molecolare, design farmaceutico, predizione mutazioni genetiche.Da segnalare anche Zai. GLM-5.3 ha costruito e ottimizzato l’infrastruttura che serve GLM-5.3-Flash. Da primo avvio a produzione in meno di due settimane. Throughput triplicato. Feedback denso: test di correttezza locale, trace di esecuzione, microbenchmark, misurazioni end-to-end.Vale la pena menzionare TypeSafe. Jev. Un modello che fa scelte discrete in millisecondi. Non genera testo: sceglie. Quale elemento cliccare. Quale azione eseguire. Quale categoria assegnare. Latenza mediana di duecentocinquantasei millisecondi per classificare mille paper. Costo di otto centesimi. Un browser agent basato su Jev ha cercato voli in sette secondi. Costo: meno di un centesimo.Sempre attivo, PrismML. Ternary Bonsai 2 27B. Basato su Qwen 3.8 27B. Nove volte più piccolo della controparte full-precision. Mantiene il novantotto punto due percento delle performance aggregate. Footprint di cinque punto nove gigabyte. Guadagni forti in coding agente, ragionamento multimodale, tool use a lungo orizzonte. Disponibile sotto Apache 2.0.Non si ferma Cactus Compute. Needle 3. Un foundation model per automazione da otto a ventinovemegabyte. Ogni profondità da due a venti layer è un modello a sé. Da venticinque a centoventuno milioni di parametri a CQ2-bit. Fino a quattromila token al secondo su Raspberry Pi 5. Non chatta: ogni turno è una function call. Sceglie il tool giusto e riempie ogni argomento. Nessun tool disponibile? Lista vuota, nessuna supposizione.Arriva anche Bend 2. Un linguaggio di programmazione che blocca errori IA tramite proof checking. La stessa tecnica usata dai lab per risolvere problemi matematici aperti. Molto veloce. Gira su GPU. Open source.Sul fronte ricerca, un team cinese ha rilasciato Cache-to-Cache. C2C. Gli LLM comunicano senza generare parole. Proiettano direttamente il kv-cache del modello sorgente nel modello target. Comunicazione semantica pura. Accuratezza fino al quattordici punto due percento in più rispetto a modelli singoli. Batte la comunicazione testuale tra agenti di oltre il cinque percento. Due punto cinque volte più veloce.Chiudiamo con Cobalt. Uno strumento open source per scaricare video, audio, foto e gif da praticamente qualsiasi sito web. Quarantaduemilatrecento stelle su GitHub. Nessun annuncio, nessun tracker, nessun paywall. Incolli il link e funziona.Trovate i link di queste notizie altri link interessanti sul mio sto ziobuddalabs punto itSalvate il video così da non perderlo, seguitemi sui miei canali social e sul nuovo podcast su spotify e mannaggia a voi se ancora non lo state facendo, condividete il video con amici e nemici e ola todos.