Google presenta EnvHarness, livello programmabile che trasforma un benchmark statico per agenti in un ambiente di addestramento adattivo alla policy che vi si allena
Categoria
modelli
Modelli
365 item
Agency and Agents
Sony Music e Warner Chappell fanno causa ad Anthropic — e citano in giudizio anche i fondatori
Debian vota il sì all'uso "responsabile" dell'AI generativa
GitHub: i commit mensili raddoppiati in quattro mesi, la capacità di verificarli no
Cursor risponde a OpenAI: "rappresentava solo il 5% del nostro traffico"
Cloudflare Workers accetta le connessioni TCP in ingresso, con gRPC come prima applicazione
Hy4 Preview di Tencent, il delta: Simon Willison legge il chat template (reasoning_effort "high" di default) e il salto da 295 a 770 miliardi di parametri
FreeToken, motore open di Berkeley e MIT (con Zaharia, Stoica e Song Han): inferenza dei modelli MoE frontier su hardware consumer via co-esecuzione dinamica
OpenAI ritira i propri modelli da Cursor: spegnimento il 12 novembre
Z.ai pubblica i pesi di GLM-5.3, ma la licenza nuova chiede un esame di sicurezza agli hyperscaler
htmx 4.0: otto mesi di lavoro, un gioco, e il trasporto riscritto su fetch()
Anthropic pubblica un paper in cui ricercatori automatici mitigano affidabilmente failure di allineamento su 10 benchmark senza degradare le prestazioni
Tencent rilascia Hy4 Preview, modello open da 770 miliardi di parametri con contesto da 1 milione di token
Il Pentagono ha blacklistato Anthropic illegalmente, decide un giudice federale
Australia: arrestati due membri di TeamPCP, il gruppo dietro gli attacchi alla supply chain open source
llms.txt: Claude, Codex e Hermes installano codice non firmato dentro le reti aziendali
Anthropic pubblica il Model Hardware Standard: driver standardizzati per agenti che comandano hardware fisico
Google rilascia Gemini 3.5 Transcribe: WER al 2,6%, 85+ lingue, code-switching mid-frase
DeepMind pilota le prime valutazioni AI "double-blind": i benchmark chiusi in una scatola crittografica
Oltre 100 aziende firmano una lettera contro gli attacchi cyber potenziati dall'AI: "finestra limitata" per prepararsi
Meta proiettava internamente fino a 10 miliardi di spesa annua sui modelli Anthropic, mentre Zuckerberg li criticava in pubblico