Intelligenza Artificiale
Harvey presenta Tenet: post‑training su Kimi K3 per agenti legali a lungo orizzonteNuovo!

Harvey rende disponibile in research preview Tenet, checkpoint post‑trained su una base Kimi K3 con RL asincrono. Migliora i risultati sui benchmark legali e introduce una stack specialistica rivolta a studi legali enterprise.

Leggi tutto
Intelligenza Artificiale
NeMo Guardrails in pratica: guida per costruire guardrail multilivello su assistenti finanziari LLMNuovo!

Un tutorial dettagliato mostra come NeMo Guardrails combina controlli deterministici, self-check LLM, filtraggio retrieval e policy-gating per rendere più audibili e misurabili le protezioni di un assistente finanziario basato su LLM.

Leggi tutto
Intelligenza Artificiale
Anthropic porta Claude Mythos 5 in Claude Security: scansioni di vulnerabilità Enterprise senza accesso diretto al modelloNuovo!

Anthropic ha reso disponibile in beta pubblica per clienti Enterprise la scansione di codice basata su Claude Mythos 5: risultati strutturati (CWE, gravità, confidenza, suggerimento di patch) esposti come artefatti anziché come interazioni dirette col modello.

Leggi tutto
Intelligenza Artificiale
TensorRT Model Connect: da checkpoint Hugging Face a inference nativa C++ in due comandiNuovo!

NVIDIA ha reso pubblico TensorRT Model Connect (TRTMC): una toolchain open-source che costruisce un artefatto .bundle da checkpoint Hugging Face o locali e permette inference in C++ senza passare per ONNX, con implicazioni per edge, robotica e applicazioni embedded.

Leggi tutto
Intelligenza Artificiale
Cartesia Sonic‑3.6: TTS streaming in beta che guida due leaderboard di valutazione percepitaNuovo!

Cartesia ha rilasciato Sonic‑3.6, modello TTS streaming basato su state space models che, in beta e come API ospitata, figura al primo posto in due classifiche di Artificial Analysis; include controlli per trascrizioni agentiche e rivendica latenza modello sub‑90 ms.

Leggi tutto
Sciamano Digitale
Parole che contano negli LLM: perché una parafrasi può cambiare la rispostaNuovo!

Scopri perché parafrasi e l'ordine degli esempi possono far variare le risposte degli LLM. Imparerai un semplice test A/B per verificarlo e pratiche per stabilizzare le formulazioni.

Leggi tutto
Intelligenza Artificiale
MiniMax rilascia MiniMax‑Music3: modello open‑weights che genera canzoni intere da testi e captionNuovo!

MiniMax pubblica MiniMax‑Music3, un modello open‑weights text‑to‑music che genera brani fino a cinque minuti (32 kHz, 16‑bit stereo). Pesi, codice e tre vie di deploy sono disponibili dal giorno del rilascio; architettura ibrida e vincoli di licenza definiscono opportunità e limiti di impiego.

Leggi tutto
Sciamano Digitale
Quando le fonti fanno inventare l'AI: il ruolo del retrieval nei sistemi RAGNuovo!

In alcuni sistemi RAG l'aggiunta di documenti può rendere le risposte più persuasive ma non necessariamente più accurate. Scopri perché la qualità del retriever è determinante e come verificare rapidamente se una risposta è supportata dalle fonti.

Leggi tutto
Intelligenza Artificiale
Pipeline pratica per il fine-tuning di LLM tool-calling: XYZ‑Aquila‑SFT + Qwen3 con LoRANuovo!

Un tutorial mostra una pipeline end-to-end per estrarre traiettorie di uso strumenti dal dataset XYZ‑Aquila‑SFT, renderle in ChatML preservando blocchi di ragionamento, e adattare Qwen3‑0.6B con LoRA valutando la capacità di predire chiamate a tool.

Leggi tutto
Intelligenza Artificiale
Z.ai rilascia GLM-5.3: miglioramenti ottenuti via post‑training aumentano performance su coding a lungo orizzonte e test di cybersecurity

GLM-5.3 riutilizza il base model di GLM-5.2 e ottiene guadagni sostanziali tramite scaling del post‑training: progressi rilevanti sui benchmark di coding a lungo orizzonte e su suite di scoperta vulnerabilità, pesando su deploy e rischi di policy.

Leggi tutto