Fonte
The New Stack
86 item
DeepSeek assume circa 150 ingegneri senior solo per il backend e l'infrastruttura, nessuno lavorerà ai modelli
Pachocki, giorno due: perché bisogna continuare nonostante tutto
Polars 2.0 (RC): collect() su LazyFrame passa di default allo streaming engine, 5x più veloce ma può cambiare l'ordine delle righe
Claude Mythos 5.1 e Fable 5.1: prime valutazioni indipendenti, e il salto sembra più piccolo del previsto
GPT-6 Astra, giorno due: Altman si scusa per il rollout pasticciato, Copilot la integra a prezzo di listino
GPT-6 Astra arriva ufficialmente: "l'era AGI" per Brockman, prezzi pari a Fable
OpenAI destina 1 miliardo in crediti ai difensori cyber delle infrastrutture
Muse Spark 1.3 di Meta batte Gemini nel coding secondo i benchmark interni e promette open weights "presto"
Gemini 3.8 Flash e Flash Cyber: Google punta al lavoro agentico e ai difensori
Anthropic pubblica Fable 5.1 e Mythos 5.1: stesso modello, due livelli di guardia
Meta Muse Voice Transcribe supera OpenAI e Google nella trascrizione vocale in tempo reale
Anthropic addestra un "reward seeker" disallineato e mette in pausa il RL ad alto rischio
OpenAI testa il pricing a risultato con alcuni clienti enterprise: si paga solo quando l'AI completa il task — il cambio di modello contrattuale più interessante dell'anno per chi consuma API
Mentre OpenAI taglia l'accesso diretto di Cursor a novembre, Anthropic resta sul tool: The New Stack ricostruisce il triangolo con SpaceX e cosa significa per chi ci ha costruito workflow
OpenAI e Cursor, terza puntata: The New Stack sposta il focus sull'impatto per gli sviluppatori — "dovete essere pronti ad adattarvi quando succede" — mentre lo spegnimento del 12 novembre incombe su chi aveva investito tempo sulle skill OpenAI via Cursor
GitHub: i commit mensili raddoppiati in quattro mesi, la capacità di verificarli no
Z.ai pubblica i pesi di GLM-5.3, ma la licenza nuova chiede un esame di sicurezza agli hyperscaler
JetBrains si buca da sola: breach sul cloud Cadence via TeamCity non patchato
DeepMind pilota le prime valutazioni AI "double-blind": i benchmark chiusi in una scatola crittografica
Aider, Claude Code, and OpenClaw ran an identical model. Token use varied 70-fold.
Z.ai svela GLM-5.3-Flash (Ox Alpha): 320B parametri, open-weight, a un decimo del prezzo
Claude Desktop ottiene un browser integrato in Cowork
OpenAI Jalapeño: i primi benchmark battono Nvidia Blackwell sull'inferenza
Anthropic unifica la memoria di Claude chat e Cowork
Shopify vs Claude Code: il CEO minaccia il ban per il file AGENTS.md
IBM Granite 4.2: modelli dense con reasoning da 3B, 8B e 30B parametri, open-weight
Perplexity Portable Computer: agente AI locale su NVIDIA DGX Spark, zero costo per-token per step locali