AWS Bedrock aggiunge Web Search come tool server-side per i modelli OpenAI, con zero data egress.
Categoria
modelli
Modelli
365 item
OpenAI Astra risolve dieci problemi matematici irrisolti e riaccende il dibattito sull'AI safety
L'offensiva cinese: Qwen3.8-Max, DeepSeek V4-Flash e la nuova definizione legale di chip
L'AI allucina CVE inesistenti e la pipeline di sicurezza ne risente
EU AI Act: le regole di trasparenza entrano in vigore
Agent-on-agent violence: il Google dev kit che fa combattere gli agenti
Oracle vieta i contributi generati da AI in OpenJDK: codice LLM non accettato nel progetto Java open source.
Hugging Face Diffusers: tre flaw ad alta severita (FaceHugger) permettono a repository di modelli di eseguire codice arbitrario bypassando trust_remote_code.
"Don't be a meat proxy": Simon Willison rilancia il termine per chi inoltra acriticamente l'output degli LLM ai colleghi senza validarli.
The Inference Engineering Masterclass
Qwen3.8-Max: Alibaba dichiara 2.400 miliardi di parametri e batte Kimi K3 in diversi benchmark
Thinking Machines Lab open-sourza Inkling-Small: MoE da 276B totali, 12B attivi, licenza Apache 2.0
Ricercatori alterano prove del DNA con codice assistito da AI: la manipolazione e indistinguibile
Modelli interni OpenAI e Anthropic che hackerano: LessWrong pubblica un'analisi dei due fallimenti totali di alignment e supervisione.
Karpathy: gli LLM stanno passando dalla generazione di artefatti alla creazione di mondi iper-personalizzati su richiesta.
Mathematics Without Mathematicians
OpenAI: dieci avanzamenti matematici generati da Astra con meno di 2.000 dollari di token
Supabase Evals: benchmark open source per valutare Claude Code, Codex e OpenCode su task reali
MiniMax H3: modello omni-modale genera clip 2K di 15 secondi con audio stereo nativo
Gli LLM non romperanno la crittografia simmetrica, ma il lavoro di crittanalisi di Anthropic con Claude Mythos e tecnicamente valido: attacco key-recovery su HAWK che riduce la sicurezza stimata da 128 a 108 bit.
I Fired My AI Assistant
Agenti AI fuori controllo: OpenAI trova altre evasioni, Tailscale svela come e Altman dice "rallentiamo"
DeepSeek V4-Flash-0731: release ufficiale, eguaglia Gemini 3.6 Flash a una frazione del prezzo
Amazon completa l'investimento da 50 miliardi in OpenAI; OpenAI supera 1 miliardo di utenti attivi
DeepSeek armato: hacker cinese lancia attacchi autonomi contro 460+ server
Anthropic Opus 5 e il modello piu robusto contro prompt injection: 2,0% di successo attaccante a k=15, contro il 16,5% del miglior modello non-Claude.