Fonte
MarkTechPost
56 item
AlphaGenome Atlas: DeepMind precalcola l'effetto di 9 miliardi di mutazioni genetiche
NVIDIA annuncia CUDA Rust: cuda-oxide (SIMT) e cutile-rs (Tile) per kernel GPU con sicurezza in compile time; cutile-rs già usato da Grout di Hugging Face e mistral.rs
IFM K2 Horizon: sei modelli Apache 2.0 da 0,9B a 375B, con corpus, checkpoint intermedi e log
Meta FAIR introduce gli AI Research Preference Models: classificare gli esperimenti ML prima di spendere ore GPU, senza prevedere punteggi assoluti
Nous Research aggiunge a Hermes Desktop la configurazione dei modelli locali in un click: rileva l'hardware, sceglie il modello che ci sta e configura il runtime
Perplexity apre lo stack di embedding su GPU: come Ivy, Tulip e ROSE servono pplx-embed in produzione
Gemini 3.8 Flash e Flash Cyber: Google punta al lavoro agentico e ai difensori
Gli agenti AI firmano un ransomware completo, Mythos chiude la kill chain: nasce l'industria difensiva
Anthropic pubblica Fable 5.1 e Mythos 5.1: stesso modello, due livelli di guardia
Anthropic apre la research preview del Model Hardware Standard, la specifica condivisa perché gli agenti scoprano e azionino dispositivi fisici: setup da settimane ridotti a ore o minuti
Google presenta EnvHarness, livello programmabile che trasforma un benchmark statico per agenti in un ambiente di addestramento adattivo alla policy che vi si allena
Hugging Face e Pollen Robotics aprono i preordini di Microduck, bipede open source da 399 dollari con ogni movimento addestrato via reinforcement learning in simulazione
Google rilascia Gemini Omni 1.1 Flash: estensione delle scene fino a 40 secondi, controllo del primo e dell'ultimo frame, bozze a 360p e finali in 4K
Z.ai pubblica i pesi di GLM-5.3, ma la licenza nuova chiede un esame di sicurezza agli hyperscaler
Google rilascia Gemini 3.5 Transcribe: WER al 2,6%, 85+ lingue, code-switching mid-frase
Z.ai svela GLM-5.3-Flash (Ox Alpha): 320B parametri, open-weight, a un decimo del prezzo
FreeToken: motore MoE edge-native che fa girare GLM-5.2 da 753 miliardi su una singola GPU workstation
Vercel lancia "Is Agentic": tool gratuito che audita quanto un sito è pronto per gli agent AI, basato su 100+ check di Ora
Anthropic porta Mythos 5 in Claude Security e lancia un fondo da 35 milioni per l'open source
Liquid AI rilascia DSpark: speculative decoding fino a 3,18x più veloce senza cambiare l'output
Cartesia Sonic-3.6: TTS streaming primo in entrambe le Artificial Analysis Speech Arenas
DeepSeek Harness in developer preview: agent harness MIT-licensed dove tutto e un plugin
Nous Research lancia Bot Mode per Hermes Agent: profili agent diventano roster di bot nominati
ByteDance Seed + Tsinghua: CUDA Agent, RL system per generazione di kernel CUDA che batte il compiler
GLM-5.3 di Z.ai: coding e cyber senza retrainare il modello base
ByteDance SeedRealtime: LLM audio-visivo full-duplex nativo che guarda, ascolta e parla in un unico modello
NVIDIA rilascia VoiceChat 11B: speech-to-speech open source full-duplex
Pokee-Isaac 28B: finestra di contesto da 10 milioni di token, progettato per girare on-premise
Shepherd: substrate Python open-source che permette ai meta-agenti di forkare, replayare e revertare qualsiasi run di agent