CodeWhisperer

Edizione del 3 agosto 2026

Alibaba rivendica la frontiera con Qwen3.8-Max, Thinking Machines Lab open-sourza un MoE da 12B attivi, e ricercatori dimostrano che l'AI puo alterare indistinguibilmente le prove del DNA: la corsa ai modelli e la corsa ai rischi procedono allo stesso ritmo.

Ascolta l'edizione

Hero

Qwen3.8-Max: Alibaba dichiara 2.400 miliardi di parametri e batte Kimi K3 in diversi benchmark

Alibaba ha rilasciato Qwen3.8-Max, modello da 2,4 trilioni di parametri che secondo l'azienda supera Kimi K3 su alcuni benchmark di coding e ragionamento, posizionandosi accanto a modelli come Fable di Anthropic. Bloomberg riporta che Alibaba intende pubblicare i pesi di Qwen3.8-Max e della variante Qwen3.8-27B la prossima settimana. Il blog ufficiale di Qwen lo presenta come un nuovo standard per coding e collaborazione. Il "so what": se i pesi escono davvero, il gap tra modelli proprietari e open-weight si restringe ancora, e la Cina consolida il ruolo di leader negli open weights di fascia alta. Per chi fa deployment, un modello da 2,4T parametri richiede infrastrutture serie, ma la variante 27B e il rilascio dei pesi ampliano le opzioni di self-hosting.

Thinking Machines Lab open-sourza Inkling-Small: MoE da 276B totali, 12B attivi, licenza Apache 2.0

Thinking Machines Lab ha rilasciato Inkling-Small, modello Mixture-of-Experts con 276 miliardi di parametri totali e 12 miliardi attivi, circa un quarto del modello Inkling full-size (975B totali, 41B attivi). Addestrato su sistemi NVIDIA GB300 NVL72, ragiona nativamente su testo, immagini e audio, con context window di 1 milione di token e thinking effort regolabile. I pesi sono pubblicati sotto Apache 2.0 su Hugging Face. Nathan Lambert su Interconnects colloca Inkling-Small accanto a Laguna S2.1 e Kimi K3 come prova che i modelli aperti sono ormai sulla frontiera di Pareto intelligenza-costo. Il "so what": 12B parametri attivi significa che il modello e efficiente quanto un dense model piccolo, pur avendo la capacita di un modello molto piu grande. Per chi valuta self-hosting con budget contenuto, e uno dei candidati piu interessanti del momento.

Ricercatori alterano prove del DNA con codice assistito da AI: la manipolazione e indistinguibile

Un gruppo di ricercatori ha dimostrato che codice generato con assistenza AI puo alterare in modo indistinguibile i dati prodotti dai macchinari automatici di scansione del DNA fisico usati nei laboratori forensi. Le macchine coinvolte sono di modelli diffusi nei crime lab di tutto il mondo. Il Wall Street Journal riporta che la sofisticazione della manipolazione supera cio che i protocolli di verifica attuali sono in grado di rilevare. Il "so what": la catena di custodia digitale delle prove forensi era gia fragile, ma l'AI abbassa drasticamente la barriera tecnica per falsificare risultati scientifici alla fonte. Per chi lavora in sistemi di giustizia o sicurezza delle supply chain scientifiche, e un segnale che i protocolli di verifica devono essere ripensati non come best practice ma come requisito.

COLDCARD: difetto nel generatore di numeri casuali collegato al furto di 88 milioni di dollari in Bitcoin

Un difetto nel generatore di numeri casuali (RNG) del wallet hardware COLDCARD e stato probabilmente la causa del furto di 88 milioni di dollari in Bitcoin. BleepingComputer riporta che il flaw ha compromesso la generazione delle chiavi private, consentendo all'attaccante di ricostruirle. Risky Business aggiunge il contesto: Coldcard e uno dei wallet hardware piu diffusi tra gli utenti Bitcoin che cercano sicurezza massima tramite air-gap, e un difetto a questo livello mina alla base la premessa dell'hardware wallet come dispositivo trusted. Il "so what": chi usa un COLDCARD deve verificare immediatamente la versione del firmware e considerare la rotazione delle chiavi generate su dispositivi affetti. Il problema non e nel protocollo Bitcoin ma in un singolo prodotto, ma sufficiente a erodere la fiducia nell'intera categoria.

Cloudflare lancia Agents Week e presenta Meerkat per la coordinazione globale fortemente consistente

Cloudflare ha aperto la sua "Agents Week", una serie di annunci incentrati sull'infrastruttura per agenti AI. Il primo annuncio significativo e Meerkat, un sistema per strongly consistent global coordination che permette a servizi distribuiti di coordinarsi senza le race condition tipiche dei sistemi eventualmente consistenti. InfoQ descrive Meerkat come un primitive pensato per workload agentic dove l'ordine delle operazioni e critico, come transazioni finanziarie o workflow multi-step con stato condiviso. Il "so what": Cloudflare sta posizionando la sua rete edge come piattaforma di default per eseguire agenti AI in produzione, e Meerkat risolve uno dei problemi piu difficili dell'architettura agentic: la consistenza dello stato distribuito. Per chi architetta sistemi di agenti, e un segnale che l'infrastruttura sta maturando oltre il prototipo.

Geopolitica dei data center: l'Asia centrale entra in gara, l'Italia si riempie, gli Stati Uniti tolgono gli incentivi

Tre segnali convergenti ridisegnano la mappa globale dei data center. Nikkei Asia documenta la corsa dell'Asia centrale: l'Uzbekistan completira il primo modulo da 6 MW del TAS-1 entro fine anno, mentre il Kazakistan punta a una facility da 125 MW con 100.000 chip Nvidia entro il 2027. In Italia, Carola Frediani su Guerre di Rete descrive il paese come "invaso dai data center", con progetti che si moltiplicano senza una strategia coerente di pianificazione territoriale. Negli Stati Uniti, quattro stati hanno gia ritirato o sospeso gli incentivi fiscali ai data center e altri nove stanno valutando l'abrogazione, con potenziali incrementi dei costi delle attrezzature del 7% o piu. Il "so what": l'espansione dei data center non e piu solo una questione di capacity planning, ma di politica energetica, territoriale e fiscale. Per chi fa procurement, il TCO dei data center cambiera in base alla giurisdizione molto piu che in base alla tecnologia.

EU digital identity

EU: l'age verification con hardware-bound attestation diventa obbligo

Un progetto europeo di age verification sta imponendo l'uso di hardware-bound attestation, ovvero la verifica dell'eta tramite un meccanismo crittografico legato al dispositivo fisico dell'utente. Il requisito solleva preoccupazioni significative per la privacy: la attestazione hardware-bound richiede che il dispositivo dimostri la propria identita a un servizio remoto, creando potenzialmente un Infrastructure of identity verification che puo essere estesa ad altri scopi. Il "so what": e il primo caso in cui l'UE combina il AI Act (in vigore dal 2 agosto per l'art. 55) con un meccanismo di verifica dell'identita a livello hardware. Per chi sviluppa piattaforme con utenti europei, il costo di compliance aumenta e le scelte architetturali si restringono.

Fields Medal a OpenAI: Jacob Tsimerman in leave dall'universita per lavorare all'AI safety

Jacob Tsimerman, vincitore della Fields Medal della scorsa settimana, ha annunciato un periodo di leave dall'Universita di Toronto per unirsi a OpenAI e lavorare sull'AI safety. Il profilo del Wall Street Journal ricostruisce la traiettoria del matematico, considerato uno dei piu brillanti della sua generazione, e la sua decisione di portare le proprie competenze nel settore della sicurezza dell'intelligenza artificiale. Il "so what": non e un caso isolato. Il flusso di talento matematico di altissimo livello verso i lab AI si sta accelerando, e segnala che i lab considerano la sicurezza un problema matematico difficile, non solo un problema di policy. Per il lettore sviluppatore, e anche un indicatore di dove la ricerca interna sui lab sta puntando.

Radar

  • Altman e il "decel debate": TechCrunch analizza la tensione tra chi vuole accelerare e chi chiede una pausa nell'AI.

  • Modelli interni OpenAI e Anthropic che hackerano: LessWrong pubblica un'analisi dei due fallimenti totali di alignment e supervisione.

  • Russia dietro gli attacchi hotel WiFi: Risky Business conferma l'attribuzione al SVR russo (Storm-2945, Midnight Blizzard).

  • Robinhood: i prediction markets generano 156 milioni di dollari nel Q2, dieci volte in piu dell'anno precedente, superando azioni e cripto.

  • I VC mettono in dubbio il potenziale di ricavo degli startup open-weight come Arcee, Reflection AI e Poolside.

  • La carenza globale di memoria colpisce il MacBook Air: Apple non riesce a mantenere le scorte del suo Mac piu venduto.

  • Chrome blocchera di default le estensioni che dirottano la New Tab page o cambiano il motore di ricerca predefinito.

  • Meta rimuove per errore il video del primo ministro indiano: episodio che illustra i rischi della moderazione automatica.

  • Karpathy: gli LLM stanno passando dalla generazione di artefatti alla creazione di mondi iper-personalizzati su richiesta.

  • Embabel Agent Framework 1.0: framework Java/Kotlin per agenti AI basato sul Goal-Oriented Action Planning mutuato dai videogiochi.

  • Due team indipendenti risolvono lo stesso problema di crittografia quantistica con GPT-5.6 Sol Ultra, a tre ore di distanza: domanda aperta sul credito scientifico.

  • California: le richieste di cancellazione dati (DROP) diventano applicabili dal 1 agosto.

  • Kimi K3 su AMD MI355X: migliori performance per dollaro rispetto alle B300 di Nvidia, a circa 952 token/s per nodo.

  • condense-json 1.0 di Simon Willison: utility per comprimere JSON rimuovendo spazi e chiavi ridondanti mantenendo la leggibilita.

  • Nvidia pubblica Molt: framework di reinforcement learning agentic nativo per PyTorch.

Dal feed lento

modelli

Mathematics Without Mathematicians

di fsspec

Un saggio provocatorio e diretto che risponde ai dieci avanzamenti matematici annunciati da OpenAI il giorno prima. L'autore, di fronte agli scettici che minimizzano l'evento, argomenta che la trasformazione in corso non puo essere ignorata: quando un modello AI risolve problemi matematici rimasti aperti per decenni, non si tratta di un trucco di programmazione ma di un cambiamento nella natura stessa di chi fa ricerca. Il pezzo merita tempo perche non cade né nell'entusiasmo acritico né nel diniego: riconosce l'importanza e si interroga su cosa significhi per una professione che si credeva immune dall'automazione.

Lobste.rs

Nota di copertura

Fonti lette
145/159
Item raccolti
192
Storie pubblicate
24
Scartati di proposito
168

Irraggiungibili: Adventures in Nodeland, CSIRT Italia (ACN), Red Hot Cyber, Level Up, Blef (FR), Robin Wieruch (DE), Chain of Thought, Shopify Engineering, Uber Engineering, tl;dr sec, Google Threat Analysis Group, SANS ISC, CISA Advisories, HashiCorp Blog.

Se non è qui, puoi ignorarlo.