Cisco Foundation AI rilascia Antares: modelli open-weight (350M e 1B) per localizzare vulnerabilità nei repository
Cisco Foundation AI ha pubblicato Antares, una famiglia di security SLM open-weight (Antares-350M e Antares-1B) e il benchmark VLoc Bench. Il modello 1B raggiunge 0.209 File F1 su 500 task, offrendo una soluzione specializzata per la prima fase di triage delle vulnerabilità.
srt-slurm di NVIDIA: validare benchmark distribuiti per il serving di LLM con ricette SLURM e analisi Pareto
Un tutorial mostra come usare NVIDIA srt-slurm e srtctl per trasformare configurazioni YAML in workflow SLURM riproducibili, includendo dry‑run, sweep parametrici, disaggregazione prefill/decode e analisi Pareto per throughput vs latenza.
Quali LLM locali possono girare su una singola GPU da 24 GB nel 2026
Una panoramica sui modelli LLM che entrano su una GPU da 24 GB: come si spende la VRAM, perché i modelli MoE sono una criticità per il single‑GPU, e quali runtime usare per inferenza locale in produzione.
WANDR di Perplexity: benchmark open per agenti di ricerca 'wide-and-deep'
Perplexity ha pubblicato WANDR, un benchmark open con 500 task progettati per valutare agenti che devono scoprire ampie raccolte di entità e fornire prove per ogni voce. I risultati evidenziano limiti nella scoperta e nella validazione delle evidenze.
Always‑On Memory Agent di Google Cloud: memoria continua con Gemini 3.1 Flash‑Lite senza vettori
Google Cloud pubblica un esempio di agent che mantiene una memoria continua: Always‑On Memory Agent usa Gemini 3.1 Flash‑Lite e SQLite, eliminando l'uso di embeddings e vector DB e consolidando ricordi ogni 30 minuti.
Perdere la passkey: come reagire
Le passkey possono risiedere su un solo dispositivo: se lo perdi rischi di non poter accedere agli account. Scopri le misure preventive e le azioni da compiere subito per ridurre il rischio di lockout.
Zyphra pubblica ZUNA1.1: modello EEG open-source con input variabili da 0,5 a 30 s
Zyphra ha rilasciato ZUNA1.1 (Apache 2.0), un modello foundation per scalp‑EEG da 380M parametri che introduce input variabili (0,5–30 s), tokenizzazione spaziale‑temporale 4D e maggiore robustezza sui dropout.
Passkey: spiegare in pratica le credenziali senza password
Le passkey sono credenziali basate su chiavi crittografiche che riducono il rischio di phishing rispetto alle password. Questo articolo spiega come funzionano e quali precauzioni adottare per il recupero dell'accesso.
Grok Build open-source: il harness Rust, la TUI e gli strumenti dietro il CLI per sviluppatori
SpaceXAI ha pubblicato su GitHub Grok Build, il «harness» in Rust che alimenta il CLI grok: agent runtime, TUI, layer di strumenti e supporto headless. L'open source facilita audit, esecuzioni air-gapped e integrazione CI ma impone controlli di sicurezza e governance.
Usare Gin Config per pipeline PyTorch riproducibili: MLP configurabile, cosine scheduler e override runtime
Un tutorial mostra come separare il codice eseguibile dalle scelte sperimentali usando Gin Config con PyTorch: modelli MLP configurabili, scheduler coseno, override a runtime e esportazione della config operativa per tracciabilità e riproducibilità.


