CodeWhisperer

Edizione del 14 agosto 2026

Velocità e caos: OpenAI spinge GPT-5.6 a 14x, Google rilancia Gemini 3.7 Flash dopo tre settimane, la Casa Bianca autorizza l'hack back privato.

Ascolta l'edizione

Hero

OpenAI Ultrafast: GPT-5.6 Sol a 750 token/s, powered by Cerebras

OpenAI ha presentato in anteprima "Ultrafast", un nuovo tier API che spinge GPT-5.6 Sol a 14 volte la velocità standard, generando fino a 750 token di output al secondo. Il motore è Cerebras, i cui wafer-scale engine alimentano il servizio. Il prezzo introduttivo è competitivo ma salirà il 1° gennaio 2027. Per gli sviluppatori: inferenza frontier a latenza quasi conversazionale, un cambio di paradigma per agenti e pipeline time-sensitive.

Gemini 3.7 Flash

Google Gemini 3.7 Flash: nuovo "workhorse" a soli tre mesi dal precedente

Google ha rilasciato Gemini 3.7 Flash, modello di punta per coding e agenti, appena tre settimane dopo Gemini 3.6 Flash. Miglioramenti in ingegneria del software, knowledge work e flussi agentic. Prezzo introduttivo a $0.75/1M token di input e $3.75/1M di output, la metà del costo di 3.6 Flash al lancio. Contesto: 1M token di contesto, thinking configurabile. Rilevante per chi valuta il tradeoff costo/qualità nei workload agentici.

Trump firma memo: aziende private autorizzate all'hack back offensivo

La Casa Bianca ha pubblicato un National Security Presidential Memorandum che autorizza aziende private di cybersecurity, sotto controllo federale, a condurre operazioni offensive contro organizzazioni criminali transnazionali all'estero. Le attività includono sorveglianza cyber e "cyber effects operations" (disruzione, degradazione, distruzione di infrastrutture). Un cambio di paradigma: gli Stati Uniti diventano il primo Paese occidentale a legittimare l'hack back privato, una pratica ovunque vietata.

Apple addestra LLM specifico per la Cina con il supporto di Alibaba

Secondo Reuters, Apple ha addestrato un large language model specifico per il mercato cinese con il supporto di Alibaba. Se confermato, Apple diventerebbe la prima compagnia straniera a offrire un modello AI proprietario in Cina. La mossa è necessaria per integrare Apple Intelligence nel mercato cinese, dove i modelli devono superare l'approvazione del regolatore locale.

OpenAI executive departure

OpenAI: secondo executive se ne va in una settimana

Denise Dresser, Chief Revenue Officer di OpenAI da dicembre 2025 (ex CEO Slack), lascia l'azienda. Al suo posto arriva Dali Rajic, finora COO di Wiz (acquisita da Alphabet). È il secondo exit di alto livello in una settimana dopo Brad Lightcap (COO). Le partenze arrivano mentre OpenAI viaggia verso un run rate di $40 miliardi annui, più del doppio rispetto a fine 2025, in prospettiva di IPO.

VMware vCenter: CVE critico sfruttato attivamente in 47 paesi

La vulnerabilità CVE-2026-59310 (CVSS 9.8) nel vCenter Syslog Server, un directory traversal che porta a RCE, è sfruttata in una campagna globale attiva: 361 IP compromessi in 47 paesi, con Germania, USA, Turchia, Iran e Francia più colpiti. Il fix è disponibile dal 29 luglio (Broadcom) ma il patching non basta: gli attaccanti deployano reverse SSH per persistenza. I compromessi identificati dimostrano che la finestra di esposizione è ancora aperta.

DeepSeek Harness

DeepSeek: harness agentico open source + rincaro prezzi pre-IPO

DeepSeek ha rilasciato in developer preview il "DeepSeek Harness", un runtime agentico in Node.js (MIT) in cui tutto è un plugin: modello, tool, sessioni, sandbox, storage, scheduling. Il repo ha superato 33.000 star in poche ore. Contemporaneamente DeepSeek ha aumentato i prezzi di V4-Flash con modello dinamico (da $0.28/1M a $1.32 peak / $0.66 off-peak) e lanciato V4-Pro, modello ammiraglio a $0.44/1M input e $0.87/1M output. La mossa prelude a una potenziale IPO.

Radar

  • OpenAI lancia "Computer History" su macOS: ChatGPT ricorda attività su app e siti web (opt-in, Pro/Business/Enterprise).

  • Databricks chiude $5B a $190B di valutazione, run rate $7B. Volevano $1B, investitori $15B.

  • Anthropic valutata $2T+ in vista IPO di ottobre, run rate $100-120B entro fine 2026.

  • Reddit entra nell'S&P 500 il 18 agosto, seconda social media pura dopo Meta.

  • X open-sourcia l'algoritmo del feed "For You" su GitHub e aggiunge strumenti per verificare shadowban.

  • Anthropic annuncia watermark invisibile per tutti i contenuti elaborati da Claude (AI Act EU).

  • Microsoft unifica app consumer e business Copilot, "ritira" AI feature fallite.

  • Zoom: zero-click RCE su tutti i client nativi scoperto da AI (ZOOMSDAY).

  • Prompt injection nascosto in atto legale: testo bianco 3pt in un filing del Connecticut.

  • SvelteKit 3 Release Candidate disponibile con breaking changes controllati.

  • Claude Code v2.1.232: subagent forking attivo di default, comunicazione cross-session via SendMessage.

  • Astro 7: compilatore in Rust, Vite 8, build fino al 61% più veloc.

  • Trezor: data breach via ShipMonk, 14.000 clienti esposti tra cui ordini verso Italia.

  • Ramp AI Index luglio: Anthropic al 43,5% di quota, OpenAI perde terreno.

  • IBM partnership con OpenAI per enterprise AI: consulting + modelli per banche, governo, telco.

Dal feed lento

modelli

When Can LLMs Replace Humans in A/B Tests?

di Spotify Engineering

La domanda brucia: se gli LLM possono sostituire gli outcome umani negli A/B test, il testing diventa instant e gratuito. Ma Spotify lo testa rigorosamente: calibrando gli output LLM contro dati reali (dataset Upworthy, migliaia di test), il trattamento recupera — ma solo con metodi specifici, e le condizioni valide non sono verificabili per trattamenti nuovi. Il punto chiave: "the promise is least justified precisely when it offers the most benefit."

Spotify Engineering

Nota di copertura

Fonti lette
144/159
Item raccolti
348
Storie pubblicate
24
Scartati di proposito
324

Irraggiungibili: [Radar] Hacker News, [Dev] Adventures in Nodeland, [Sec] CSIRT Italia, [Sec] Red Hot Cyber, [Dev] Level Up, [Data] Blef, [Web] Robin Wieruch, [AI-dev] Chain of Thought, [Dev] Shopify Engineering, [Dev] Uber Engineering, [Sec] tl;dr sec, [Sec] Google TAG, [Sec] CISA Advisories, [Cloud] HashiCorp, [Cloud] Last Week in AWS.

Se non è qui, puoi ignorarlo.