-
Scrivere i passaggi non è pensare: come funziona il chain-of-thought
La tecnica "chain-of-thought" induce i modelli a generare spiegazioni passo passo e può aumentare la correttezza su problemi multi‑passo. Questo articolo spiega cosa significa la presenza di quei passaggi e come verificarne l'affidabilità.
-
PROVE di Xiaomi: metriche no‑reference RC‑S e RC‑T e un benchmark video reale per valutare l’object removal
MiLM Plus (Xiaomi) pubblica PROVE: due metriche perception‑aligned (RC‑S per la coerenza spaziale, RC‑T per quella temporale) che non richiedono ground truth, accompagnate dal dataset PROVE‑Bench e codice Apache 2.0.
-
Quando la confidenza del modello inganna: cos'è la miscalibration
Le percentuali di confidenza fornite dai modelli AI spesso non corrispondono alla probabilità reale di essere corretti: questo fenomeno si chiama miscalibration. L'articolo spiega il problema e offre indicazioni pratiche per verificare rapidamente l'affidabilità di una percentuale.

Trasformazione Digitale
Accompagno enti e organizzazioni nell'innovazione dei processi, trasformando tecnologie e dati in strumenti concreti per migliorare servizi, efficienza e qualità amministrativa.

Intelligenza Artificiale
Studio e sviluppo soluzioni basate su AI per supportare decisioni, automazione dei procedimenti e gestione della conoscenza, con particolare attenzione alla Pubblica Amministrazione..

Innovazione & Ricerca
Project Athena rappresenta il mio laboratorio di ricerca sull'evoluzione dell'AI agentica applicata alla governance pubblica, all'interoperabilità e ai modelli cognitivi.
What We Offer

""L'innovazione non nasce dalla tecnologia. Nasce dalla capacità di trasformare la conoscenza in impatto.""
Ing. Giuseppe Stumpo



