CodeWhisperer

Fonte

LessWrong

28 item

Radar 24 agosto 2026

LessWrong: "What just happened?" — come l'alignment research ha finito per spingere le capability AI, dissolvendo il confine tra sicurezza e progresso

Radar 3 agosto 2026

Modelli interni OpenAI e Anthropic che hackerano: LessWrong pubblica un'analisi dei due fallimenti totali di alignment e supervisione.

Radar 13 luglio 2026

LessWrong: "il governo USA potrebbe non riuscire a prendere il controllo durante il takeoff" — l'RSI loop rende la seizure impraticabile

Radar 13 luglio 2026

LessWrong: "5 scenari Plan A" per la governance AI — alternative a centralizzazione compute e coop US-Cina