Session

Non fidarti, testa: evaluation pratica in Microsoft Foundry

L’AI generativa non può essere portata in produzione basandosi solo su demo convincenti o risposte “che sembrano corrette”. Così come il codice richiede unit test, anche modelli, prompt e agenti hanno bisogno di un processo strutturato di evaluation.

In questa sessione vedremo come usare Microsoft Foundry per valutare modelli e agenti, partendo dai concetti fondamentali fino ad arrivare a scenari più pratici di automazione dei test. Esploreremo come definire dataset di valutazione, scegliere metriche rilevanti, confrontare risultati, individuare regressioni e integrare l’evaluation in un flusso di sviluppo più robusto.

L’obiettivo è mostrare come trasformare l’evaluation da attività manuale e occasionale a pratica ingegneristica continua, utile per costruire soluzioni AI più affidabili, misurabili e pronte per la produzione.

Massimo Bonanni

Senior Technical Trainer @ Microsoft

Rome, Italy

Actions

Please note that Sessionize is not responsible for the accuracy or validity of the data provided by speakers. If you suspect this profile to be fake or spam, please let us know.

Jump to top