CodeWhisperer

Edizione del 17 agosto 2026

Stripe compra OpenRouter per oltre 7 miliardi, Anthropic ammette che il suo watermark altera le probabilità delle parole, e Claude va giù per ore.

Ascolta l'edizione

Hero

Stripe acquisisce OpenRouter per oltre 7 miliardi di dollari

Stripe ha finalizzato l'accordo per acquisire OpenRouter, il marketplace che permette di instradare le richieste verso diversi modelli AI in base a costo e prestazioni. OpenRouter era stata valutata 1,3 miliardi a maggio (Series B da 113 milioni con Sequoia, a16z, Menlo Ventures, CapitalG). Il prezzo finale supera i 7 miliardi: un multiplo che segnala quanto vale il controllo del gateway tra sviluppatori e modelli. Per Stripe si tratta di infilare l'AI nel flusso di pagamento; per l'ecosistema, significa che il routing tra modelli diventa infrastruttura strategica, non un commodity.

Il watermark di Anthropic altera le probabilità delle parole in Claude

John Gruber su Daring Fireball attacca frontalmente il sistema di watermarking testuale annunciato da Anthropic per tutti i modelli Claude a livello globale, in risposta all'articolo 50(2) dell'EU AI Act. Il watermark non è metadato esterno: modifica le probabilità di scelta delle parole per incorporare un'impronta invisibile. Gruber lo definisce "una perversione della scrittura", sostenendo che Anthropic minimizzi l'impatto sulla qualità. L'analisi tecnica di j11y.io conferma che il sistema opera su parole "inconsequenziali" ma osserva che il quadro normativo europeo è debole e il watermark lo appease appena. Il dibattito è aperto: se altri provider seguiranno, ogni output AI sarà strutturalmente diverso dal testo naturale.

Claude va in outage majeur: Claude.ai, Claude Code, Claude Cowork colpiti

Anthropic ha confermato un'interruzione significativa iniziata il 16 agosto alle 21:58 UTC, con problemi di autenticazione e prestazioni degradate su Claude.ai, Claude Code e Claude Cowork. La status page ha prima segnalato il problema di login, poi un' disruptions più ampia. L'incidente arriva in un weekend già carico di discussioni sul watermark e sulle comunicazioni di Amodei. Per gli sviluppatori che usano Claude Code nei loro workflow, l'outage ha interrotto pipeline CI e sessioni di coding agentico.

Zhipu lancia GLM-5.3 e claims bug-finding supremacy su CyberGym

La cinese Zhipu ha lanciato GLM-5.3, sostenendo che il modello batta Fable 5 e GPT-5.6 Sol sul benchmark CyberGym, che testa la capacità di risolvere sfide cybersecurity reali. Secondo l'azienda, le capacità cyber si sono sviluppate più velocemente del previsto durante il post-training. Il claim arriva mentre i laboratori americani giocano in difesa sulle esportazioni di modelli avanzati. Per uno sviluppatore che usa LLM per security auditing, la domanda è se GLM-5.3 sia effettivamente accessibile fuori dalla Cina e se i benchmark reggano a un controllo indipendente.

Qwen 3.8 27B: eccellente ma pensa troppo

Simon Willison prova Qwen 3.8 27B, il nuovo modello Apache 2.0 di Alibaba con capacità visive. Le dimensioni sono ideali per un laptop decente e i benchmark self-reported mostrano un salto rispetto a Qwen 3.6 27B. Il problema: il modello tende a "overthinkare" in modo esagerato, generando catene di reasoning molto più lunghe del necessario. Willison nota anche che i benchmark di Qwen sono impressionanti ma vanno presi con cautela. Il punto per chi valuta modelli locali: 27B con visione e licenza permissiva è un combo interessante, ma bisogna calibrare il budget di reasoning.

AWS open-sourcia Dogwood: policy deterministiche per le chiamate di tool degli agent

AWS ha rilasciato Dogwood, un linguaggio di policy per le chiamate di tool degli agent AI. La differenza rispetto a Cedar (sempre di AWS) è che le regole Dogwood possono guardare indietro alla sequenza di azioni già compiute dall'agent, non solo validare la singola chiamata. Dogwood gira sotto Apache 2.0 ed è supportato in AgentCore Policy, lanciato al re:Invent dell'anno scorso. Il layer di policy è deterministico e fuori dal modello: l'agent propone, il motore di policy autorizza o blocca. Per chi costruisce agent in produzione, questo è un passo verso la governance che va oltre il prompt engineering.

AI safety concept

ChatGPT Computer History: traccia click e keystrokes sul desktop

L'app desktop di ChatGPT su macOS ha una nuova funzione chiamata Computer History che registra le azioni dell'utente per costruire dati di training, imparare come lavori, suggerire automazioni e riprendere task interrotti. The Verge lo paragona a Windows Recall di Microsoft, ma senza gli screenshot "creepy". L'attività viene trasformata in una timeline consultabile da ChatGPT e Codex. La domanda di privacy è ovvia: anche senza screenshot, registrare click e keystroke crea un profilo comportamentale dettagliato. La funzione è opt-in, ma come sempre il trade-off tra utilità e sorveglianza resta a carico dell'utente.

Nvidia riduce drasticamente la garanzia sul finanziamento infrastrutturale di OpenAI

Reuters riporta che Nvidia ha ridotto significativamente l'importo del finanziamento infrastrutturale di OpenAI che è disposta a garantire. La garanzia era stata inizialmente discussa su cifre dell'ordine di 250 miliardi di dollari per data center. Il ridimensionamento arriva mentre OpenAI prepara l'IPO e mentre il mercato dei data center AI mostra segni di tensione. Per chi segue il rapporto tra provider GPU e laboratori di frontiera, è un segnale che Nvidia sta calibrando il proprio rischio di esposizione.

Radar

  • AWS introduce native vector search per DynamoDB: embedding inline senza database vettoriale esterno.

  • AmnesiaStealer: nuovo malware macOS che hijacka sessioni browser via remote control, propagato tramite ClickFix.

  • SafePal: data breach impatta 39.798 clienti, dati di vendita in vendita (i wallet non sono compromessi).

  • Threema: DDoS su larga scala mette in ginocchio il messaging service svizzero; On-Prem non colpito.

  • Wireshark 4.6.8 chiude 28 vulnerabilità e 25 bug.

  • Buf rilascia il primo LSP server production-grade per Protobuf: go-to-definition, completion, references.

  • Firefox per iOS ottiene un adblocker nativo.

  • Francia: cyberattack su agenzia fiscale compromette 678K account, PM convoca crisi meeting lunedì.

  • Hugging Face: 151K+ derivati basati su modelli Qwen, il maggior numero nell'ecosistema open.

  • Microsoft dà la colpa all'AI per un update Exchange in ritardo, senza data di arrivo.

  • Pathway raccoglie 30M$ seed a 500M$ valuation per architettura "Post-Transformer" BDH.

  • Cloudflare inietta silenziosamente analytics quando cambi nameserver: opt-out, non opt-in.

  • Token brokers: nasce l'economia di rivendita dei crediti AI tra startup.

  • Amodei: il backlash sull'AI è "fondamentalmente una crisi di fiducia", non causato dai suoi warning.

  • Fields Medalist Gowers: i problemi matematici risolti dagli LLM lo sono quasi sempre con controesempi, non con dimostrazioni.

Dal feed lento

modelli

Models Are Getting Dumber on Purpose

di w4g1

dev. Un'analisi tagliente del trend che vede i modelli raggiungere punteggi record sui benchmark con parametri attivi per token in calo libero: GLM-5.2 fa 99,2% su AIME 2026 con 40 miliardi di parametri attivi, Qwen3.5 con 17, DeepSeek V4-Flash con 13. Il confronto con GPT-4 (280 miliardi attivi nel 2023) è imbarazzante. Il pezzo fa la domanda giusta: se i modelli sono più efficienti ma pensano meno a lungo, cosa stiamo misurando davvero? Merita tempo perché ridefinisce il rapporto tra potenza bruta e intelligenza effettiva.

w4g1.dev

Nota di copertura

Fonti lette
197/215
Item raccolti
181
Storie pubblicate
24
Scartati di proposito
157

Irraggiungibili: Blef (Christophe Blefari), CISA Advisories, Chain of Thought (Every), Uber Engineering, [AI-dev] Chain of Thought — Every, [Cloud] HashiCorp Blog, [Cultura] MIT Technology Review (Remote end closed connection), [Data] Blef — Christophe Blefari (FR), [Dev] Adventures in Nodeland — Matteo Collina, [Dev] Level Up — Patrick Kua (DE), [Dev] Shopify Engineering, [Dev] Uber Engineering, [Sec] CISA Advisories, [Sec] CSIRT Italia (ACN), [Sec] Google Threat Analysis Group, [Sec] Red Hot Cyber, [Sec] tl;dr sec — Clint Gibler, [Web] Robin Wieruch (DE).

Se non è qui, puoi ignorarlo.