Microsoft-Decision-1: Nei test l'AI è 35 volte più veloce di GPT-6 Sol

Microsoft presenta Decision-1, un modello AI specializzato nelle decisioni: ecco come funziona e cosa rivela il confronto con GPT-6 Sol.
Microsoft-Decision-1: Nei test l'AI è 35 volte più veloce di GPT-6 Sol

L’evoluzione dell’Intelligenza Artificiale non riguarda soltanto la capacità di scrivere testi, creare immagini o rispondere a domande complesse.

Una parte crescente del settore si concentra su sistemi progettati per valutare alternative e indirizzare automaticamente le operazioni di un software. In questo contesto si inserisce Microsoft-Decision-1, il nuovo modello presentato da Microsoft per gestire decisioni strutturate con tempi di risposta ridotti.

L’obiettivo è offrire agli sviluppatori uno strumento specializzato, utilizzabile all’interno di applicazioni, servizi aziendali e agenti AI. La proposta si distingue dagli assistenti tradizionali perché non punta a produrre contenuti articolati, ma a restituire valutazioni utilizzabili direttamente da altri sistemi.

Come funziona il nuovo modello di Microsoft

Microsoft-Decision-1 è stato progettato per affrontare compiti nei quali le risposte possibili sono già definite. Può, per esempio, classificare una richiesta di assistenza, stabilire quale strumento debba elaborare un comando oppure verificare se una risposta generata da un altro modello rispetti criteri prestabiliti. Il risultato viene restituito in forma strutturata, così da permettere al software che lo integra di scegliere l’azione successiva senza dover interpretare una lunga spiegazione testuale.

Alla base del sistema c’è Qwen3.5-9B, un modello sviluppato da Alibaba che Microsoft ha ulteriormente addestrato per ottenere valutazioni rapide. L’architettura supporta domande con risposte sì o no, opzioni multiple, valutazioni numeriche e verifiche basate su rubriche. Per ciascuna alternativa può assegnare una probabilità, fornendo un’indicazione utile per distinguere le situazioni chiare da quelle che richiedono ulteriori controlli.

Secondo i test pubblicati dall’azienda, Decision-1 ha ottenuto i migliori risultati di accuratezza in una valutazione che comprendeva 36 benchmark e quasi 150.000 domande. Microsoft dichiara inoltre una latenza mediana circa 35 volte inferiore rispetto a GPT-6 Sol. Questi dati provengono dalle valutazioni dell’azienda e non costituiscono una garanzia di prestazioni identiche in ogni applicazione: carico di lavoro, configurazione e complessità delle richieste possono influenzare i risultati.

Costi, disponibilità e limiti da conoscere

Il modello è disponibile attraverso Microsoft Foundry, la piattaforma che consente di integrare modelli AI nelle applicazioni. Il prezzo dichiarato per gli input è di 0,042 dollari per milione di token, mentre i token generati in uscita non vengono fatturati. Questa struttura può risultare interessante per servizi che devono classificare grandi volumi di richieste, purché la qualità delle decisioni soddisfi le esigenze del progetto.

Le applicazioni potenziali comprendono il filtraggio dei contenuti, l’assegnazione delle segnalazioni ai reparti competenti, il controllo delle risposte prodotte da altri sistemi e la selezione delle operazioni da eseguire negli agenti automatizzati. In questi scenari, un modello specializzato può affiancare un sistema generativo, evitando di utilizzare una soluzione più complessa per ogni singolo passaggio.

Esistono però limiti importanti. Decision-1 non è pensato per conversazioni aperte, traduzioni o produzione di testi originali, e non dovrebbe essere impiegato come unico decisore in ambiti delicati che riguardano le persone. Gli sviluppatori devono definire controlli adeguati e prevedere verifiche umane quando le conseguenze di un errore sono rilevanti.

Ti consigliamo anche

Link copiato negli appunti