Harvey presenta Tenet: post‑training su Kimi K3 per agenti legali a lungo orizzonteNuovo!
Harvey rende disponibile in research preview Tenet, checkpoint post‑trained su una base Kimi K3 con RL asincrono. Migliora i risultati sui benchmark legali e introduce una stack specialistica rivolta a studi legali enterprise.
NeMo Guardrails in pratica: guida per costruire guardrail multilivello su assistenti finanziari LLMNuovo!
Un tutorial dettagliato mostra come NeMo Guardrails combina controlli deterministici, self-check LLM, filtraggio retrieval e policy-gating per rendere più audibili e misurabili le protezioni di un assistente finanziario basato su LLM.
Anthropic porta Claude Mythos 5 in Claude Security: scansioni di vulnerabilità Enterprise senza accesso diretto al modelloNuovo!
Anthropic ha reso disponibile in beta pubblica per clienti Enterprise la scansione di codice basata su Claude Mythos 5: risultati strutturati (CWE, gravità, confidenza, suggerimento di patch) esposti come artefatti anziché come interazioni dirette col modello.
TensorRT Model Connect: da checkpoint Hugging Face a inference nativa C++ in due comandiNuovo!
NVIDIA ha reso pubblico TensorRT Model Connect (TRTMC): una toolchain open-source che costruisce un artefatto .bundle da checkpoint Hugging Face o locali e permette inference in C++ senza passare per ONNX, con implicazioni per edge, robotica e applicazioni embedded.
Cartesia Sonic‑3.6: TTS streaming in beta che guida due leaderboard di valutazione percepitaNuovo!
Cartesia ha rilasciato Sonic‑3.6, modello TTS streaming basato su state space models che, in beta e come API ospitata, figura al primo posto in due classifiche di Artificial Analysis; include controlli per trascrizioni agentiche e rivendica latenza modello sub‑90 ms.
Parole che contano negli LLM: perché una parafrasi può cambiare la rispostaNuovo!
Scopri perché parafrasi e l'ordine degli esempi possono far variare le risposte degli LLM. Imparerai un semplice test A/B per verificarlo e pratiche per stabilizzare le formulazioni.
MiniMax rilascia MiniMax‑Music3: modello open‑weights che genera canzoni intere da testi e captionNuovo!
MiniMax pubblica MiniMax‑Music3, un modello open‑weights text‑to‑music che genera brani fino a cinque minuti (32 kHz, 16‑bit stereo). Pesi, codice e tre vie di deploy sono disponibili dal giorno del rilascio; architettura ibrida e vincoli di licenza definiscono opportunità e limiti di impiego.
Quando le fonti fanno inventare l'AI: il ruolo del retrieval nei sistemi RAGNuovo!
In alcuni sistemi RAG l'aggiunta di documenti può rendere le risposte più persuasive ma non necessariamente più accurate. Scopri perché la qualità del retriever è determinante e come verificare rapidamente se una risposta è supportata dalle fonti.
Pipeline pratica per il fine-tuning di LLM tool-calling: XYZ‑Aquila‑SFT + Qwen3 con LoRANuovo!
Un tutorial mostra una pipeline end-to-end per estrarre traiettorie di uso strumenti dal dataset XYZ‑Aquila‑SFT, renderle in ChatML preservando blocchi di ragionamento, e adattare Qwen3‑0.6B con LoRA valutando la capacità di predire chiamate a tool.
Z.ai rilascia GLM-5.3: miglioramenti ottenuti via post‑training aumentano performance su coding a lungo orizzonte e test di cybersecurity
GLM-5.3 riutilizza il base model di GLM-5.2 e ottiene guadagni sostanziali tramite scaling del post‑training: progressi rilevanti sui benchmark di coding a lungo orizzonte e su suite di scoperta vulnerabilità, pesando su deploy e rischi di policy.









