Intelligenza Artificiale
Cisco Foundation AI rilascia Antares: modelli open-weight (350M e 1B) per localizzare vulnerabilità nei repository

Cisco Foundation AI ha pubblicato Antares, una famiglia di security SLM open-weight (Antares-350M e Antares-1B) e il benchmark VLoc Bench. Il modello 1B raggiunge 0.209 File F1 su 500 task, offrendo una soluzione specializzata per la prima fase di triage delle vulnerabilità.

Leggi tutto
Intelligenza Artificiale
srt-slurm di NVIDIA: validare benchmark distribuiti per il serving di LLM con ricette SLURM e analisi Pareto

Un tutorial mostra come usare NVIDIA srt-slurm e srtctl per trasformare configurazioni YAML in workflow SLURM riproducibili, includendo dry‑run, sweep parametrici, disaggregazione prefill/decode e analisi Pareto per throughput vs latenza.

Leggi tutto
Intelligenza Artificiale
Quali LLM locali possono girare su una singola GPU da 24 GB nel 2026

Una panoramica sui modelli LLM che entrano su una GPU da 24 GB: come si spende la VRAM, perché i modelli MoE sono una criticità per il single‑GPU, e quali runtime usare per inferenza locale in produzione.

Leggi tutto
Intelligenza Artificiale
WANDR di Perplexity: benchmark open per agenti di ricerca 'wide-and-deep'

Perplexity ha pubblicato WANDR, un benchmark open con 500 task progettati per valutare agenti che devono scoprire ampie raccolte di entità e fornire prove per ogni voce. I risultati evidenziano limiti nella scoperta e nella validazione delle evidenze.

Leggi tutto
Intelligenza Artificiale
Always‑On Memory Agent di Google Cloud: memoria continua con Gemini 3.1 Flash‑Lite senza vettori

Google Cloud pubblica un esempio di agent che mantiene una memoria continua: Always‑On Memory Agent usa Gemini 3.1 Flash‑Lite e SQLite, eliminando l'uso di embeddings e vector DB e consolidando ricordi ogni 30 minuti.

Leggi tutto
Sciamano Digitale
Perdere la passkey: come reagire

Le passkey possono risiedere su un solo dispositivo: se lo perdi rischi di non poter accedere agli account. Scopri le misure preventive e le azioni da compiere subito per ridurre il rischio di lockout.

Leggi tutto
Intelligenza Artificiale
Zyphra pubblica ZUNA1.1: modello EEG open-source con input variabili da 0,5 a 30 s

Zyphra ha rilasciato ZUNA1.1 (Apache 2.0), un modello foundation per scalp‑EEG da 380M parametri che introduce input variabili (0,5–30 s), tokenizzazione spaziale‑temporale 4D e maggiore robustezza sui dropout.

Leggi tutto
Sciamano Digitale
Passkey: spiegare in pratica le credenziali senza password

Le passkey sono credenziali basate su chiavi crittografiche che riducono il rischio di phishing rispetto alle password. Questo articolo spiega come funzionano e quali precauzioni adottare per il recupero dell'accesso.

Leggi tutto
Intelligenza Artificiale
Grok Build open-source: il harness Rust, la TUI e gli strumenti dietro il CLI per sviluppatori

SpaceXAI ha pubblicato su GitHub Grok Build, il «harness» in Rust che alimenta il CLI grok: agent runtime, TUI, layer di strumenti e supporto headless. L'open source facilita audit, esecuzioni air-gapped e integrazione CI ma impone controlli di sicurezza e governance.

Leggi tutto
Intelligenza Artificiale
Usare Gin Config per pipeline PyTorch riproducibili: MLP configurabile, cosine scheduler e override runtime

Un tutorial mostra come separare il codice eseguibile dalle scelte sperimentali usando Gin Config con PyTorch: modelli MLP configurabili, scheduler coseno, override a runtime e esportazione della config operativa per tracciabilità e riproducibilità.

Leggi tutto