<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Evaluations | The .NET Blog</title><link>https://thedotnetblog.com/it/tags/evaluations/</link><description>Articles, tutorials and insights from the .NET community.</description><generator>Hugo</generator><language>it</language><managingEditor>@thedotnetblog (The .NET Blog)</managingEditor><webMaster>@thedotnetblog</webMaster><lastBuildDate>Fri, 29 May 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://thedotnetblog.com/it/tags/evaluations/index.xml" rel="self" type="application/rss+xml"/><item><title>Le eval del model router sono il passaggio che troppi team saltano</title><link>https://thedotnetblog.com/it/news/emiliano-montesdeoca/model-router-evals-before-you-trust-the-routing/</link><pubDate>Fri, 29 May 2026 00:00:00 +0000</pubDate><author>Emiliano Montesdeoca</author><guid>https://thedotnetblog.com/it/news/emiliano-montesdeoca/model-router-evals-before-you-trust-the-routing/</guid><description>Il nuovo repository di valutazione del model router in Foundry è importante perché le decisioni di routing devono essere misurate rispetto a qualità, latenza e costo prima che i team trattino la selezione automatica dei modelli come se fosse magia.</description><content:encoded>&lt;blockquote&gt;
&lt;p&gt;&lt;em&gt;Questo articolo è stato tradotto automaticamente. Per la versione originale, &lt;a href="https://thedotnetblog.com/it/news/emiliano-montesdeoca/model-router-evals-before-you-trust-the-routing/"&gt;clicca qui&lt;/a&gt;.&lt;/em&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Il routing automatico dei modelli sembra fantastico finché non ti rendi conto che devi comunque dimostrare che è la scelta giusta per il tuo carico di lavoro.&lt;/p&gt;
&lt;p&gt;Per questo il nuovo &lt;strong&gt;repository di valutazione del model router&lt;/strong&gt; è utile.&lt;/p&gt;
&lt;p&gt;Dà ai team un modo più concreto di rispondere alle domande che contano davvero:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;il routing preserva la qualità?&lt;/li&gt;
&lt;li&gt;migliora il costo?&lt;/li&gt;
&lt;li&gt;cosa fa alla latenza?&lt;/li&gt;
&lt;li&gt;cosa cambia se restringo il sottoinsieme di modelli?&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="larticolo-sorgente-fa-le-domande-giuste"&gt;L&amp;rsquo;articolo sorgente fa le domande giuste&lt;/h2&gt;
&lt;p&gt;Una cosa che mi piace molto del post originale è che non tratta il model router come ovviamente buono.&lt;/p&gt;
&lt;p&gt;Piuttosto, pone le domande scomode ma corrette:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&amp;ldquo;&lt;strong&gt;Sui miei prompt, il modello selezionato automaticamente dal model router eguaglia o supera il singolo modello che altrimenti sceglierei?&lt;/strong&gt;&amp;rdquo;&lt;/li&gt;
&lt;li&gt;&amp;ldquo;&lt;strong&gt;Sto davvero risparmiando denaro end to end, o sto solo spostando la spesa da una parte all&amp;rsquo;altra?&lt;/strong&gt;&amp;rdquo;&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questa è esattamente l&amp;rsquo;atteggiamento giusto.&lt;/p&gt;
&lt;p&gt;Perché il routing automatico è allettante, ma resta comunque una decisione di sistema. E le decisioni di sistema dovrebbero essere misurate, non ammirate.&lt;/p&gt;
&lt;h2 id="perché-questo-repository-conta-più-di-quanto-sembri-allinizio"&gt;Perché questo repository conta più di quanto sembri all&amp;rsquo;inizio&lt;/h2&gt;
&lt;p&gt;A un livello, è solo un repository di valutazione.&lt;/p&gt;
&lt;p&gt;A un altro livello, è un segnale di maturità.&lt;/p&gt;
&lt;p&gt;Dice: se vuoi adottare il routing automatico, ecco un modo più disciplinato per testare:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;qualità&lt;/li&gt;
&lt;li&gt;costo&lt;/li&gt;
&lt;li&gt;latenza&lt;/li&gt;
&lt;li&gt;compromessi del sottoinsieme&lt;/li&gt;
&lt;li&gt;comportamento della distribuzione dei modelli&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;È molto meglio che trattare il routing come una scatola nera con un buon branding.&lt;/p&gt;
&lt;h2 id="il-mio-parere"&gt;Il mio parere&lt;/h2&gt;
&lt;p&gt;Questo è un buon esempio del tipo di strumenti di cui le piattaforme AI hanno bisogno di più: non più magia, ma più modi per validare la magia prima di fidarsi di essa.&lt;/p&gt;
&lt;p&gt;È così che i team evitano di costruire fiducia costosa su ipotesi non testate.&lt;/p&gt;
&lt;p&gt;Articolo originale: &lt;a href="https://devblogs.microsoft.com/foundry/how-to-run-evals-for-model-router/"&gt;How to run evals for the model router&lt;/a&gt;&lt;/p&gt;</content:encoded></item><item><title>La parte difficile dello sviluppo AI non è più l'accesso. È gestire bene il modello giusto</title><link>https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-managing-models-cost-quality-developer-guide/</link><pubDate>Tue, 26 May 2026 00:00:00 +0000</pubDate><author>Emiliano Montesdeoca</author><guid>https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-managing-models-cost-quality-developer-guide/</guid><description>La nuova guida Foundry sostiene con forza che la selezione del modello, il controllo dei costi, la valutazione e la gestione del ciclo di vita sono ormai i veri fattori distintivi dei sistemi AI in produzione.</description><content:encoded>&lt;blockquote&gt;
&lt;p&gt;&lt;em&gt;Questo articolo è stato tradotto automaticamente. Per la versione originale, &lt;a href="https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-managing-models-cost-quality-developer-guide/"&gt;fai clic qui&lt;/a&gt;.&lt;/em&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Abbiamo superato la fase in cui il semplice accesso a un modello potente bastava.&lt;/p&gt;
&lt;p&gt;È esattamente il punto che questa nuova &lt;strong&gt;guida Foundry per gestire modelli, costi e qualità&lt;/strong&gt; coglie bene.&lt;/p&gt;
&lt;p&gt;La vera sfida ora è operativa:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;scegliere il modello giusto per ogni workload&lt;/li&gt;
&lt;li&gt;validarlo sui propri dati&lt;/li&gt;
&lt;li&gt;gestire latenza e spesa&lt;/li&gt;
&lt;li&gt;governare aggiornamenti e rischio di regressione&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;È questo che i team seri devono imparare a fare bene.&lt;/p&gt;
&lt;h2 id="larticolo-sorgente-definisce-bene-il-problema"&gt;L&amp;rsquo;articolo sorgente definisce bene il problema&lt;/h2&gt;
&lt;p&gt;Una frase dell&amp;rsquo;articolo originale cattura molto bene questo cambiamento:&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&amp;ldquo;&lt;strong&gt;La parte più difficile di costruire sistemi AI oggi non è più ottenere accesso a un modello capace. È sapere come scegliere, validare, ottimizzare e operare il modello giusto lungo l&amp;rsquo;intero ciclo di vita di una vera applicazione.&lt;/strong&gt;&amp;rdquo;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;È esattamente la diagnosi corretta.&lt;/p&gt;
&lt;p&gt;Troppi team pensano ancora che la selezione del modello sia la decisione principale.&lt;/p&gt;
&lt;p&gt;Non lo è.&lt;/p&gt;
&lt;p&gt;L&amp;rsquo;operazione del modello è il problema più grande:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;quale workload riceve quale modello?&lt;/li&gt;
&lt;li&gt;come si verifica la qualità?&lt;/li&gt;
&lt;li&gt;quale forma di costo è accettabile?&lt;/li&gt;
&lt;li&gt;cosa succede quando compare un nuovo modello o uno vecchio si degrada?&lt;/li&gt;
&lt;li&gt;come si testa un cambiamento senza rompere i workflow reali?&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questa è la vera attività di ingegneria adesso.&lt;/p&gt;
&lt;h2 id="perché-questo-pezzo-di-foundry-è-utile"&gt;Perché questo pezzo di Foundry è utile&lt;/h2&gt;
&lt;p&gt;Mi piace questo articolo perché parla dei sistemi AI nel modo in cui gli ingegneri di piattaforma esperti devono davvero pensarli.&lt;/p&gt;
&lt;p&gt;Non come &amp;ldquo;scegli il modello più intelligente e vai avanti&amp;rdquo;.&lt;/p&gt;
&lt;p&gt;Ma come sistemi che vivono sotto trade-off:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;capacità&lt;/li&gt;
&lt;li&gt;latenza&lt;/li&gt;
&lt;li&gt;costo&lt;/li&gt;
&lt;li&gt;sicurezza&lt;/li&gt;
&lt;li&gt;governance&lt;/li&gt;
&lt;li&gt;pressione degli upgrade&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;È molto più utile dell&amp;rsquo;ottimismo guidato dai benchmark.&lt;/p&gt;
&lt;h2 id="il-cambiamento-più-importante-è-pensare-prima-ai-criteri"&gt;Il cambiamento più importante è pensare prima ai criteri&lt;/h2&gt;
&lt;p&gt;L&amp;rsquo;articolo originale consiglia di definire i criteri di successo prima di aprire il catalogo dei modelli.&lt;/p&gt;
&lt;p&gt;Penso che questo sia uno degli abitudini più importanti che i team possano adottare.&lt;/p&gt;
&lt;p&gt;Se apri prima il catalogo, ti ancora alla reputazione.&lt;/p&gt;
&lt;p&gt;Se definisci prima i criteri, ti ancora alla realtà del workload.&lt;/p&gt;
&lt;p&gt;È un processo più sano.&lt;/p&gt;
&lt;p&gt;Perché il modello che vince un benchmark non è automaticamente quello che vince su:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;i tuoi prompt&lt;/li&gt;
&lt;li&gt;il tuo budget di latenza&lt;/li&gt;
&lt;li&gt;i tuoi guardrail di costo&lt;/li&gt;
&lt;li&gt;i tuoi requisiti di governance&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questa distinzione è il punto da cui inizia l&amp;rsquo;ingegneria AI matura.&lt;/p&gt;
&lt;h2 id="la-storia-multi-modello-sta-diventando-un-vero-vantaggio"&gt;La storia multi-modello sta diventando un vero vantaggio&lt;/h2&gt;
&lt;p&gt;Un&amp;rsquo;altra cosa che mi piace è il framing esplicitamente agnostico rispetto al modello.&lt;/p&gt;
&lt;p&gt;L&amp;rsquo;articolo presenta Foundry non come una destinazione a modello singolo, ma come una superficie operativa su:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;modelli Microsoft&lt;/li&gt;
&lt;li&gt;modelli dei partner&lt;/li&gt;
&lt;li&gt;modelli open source&lt;/li&gt;
&lt;li&gt;varianti post-addestrate&lt;/li&gt;
&lt;li&gt;strategie di routing e ottimizzazione&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questo conta perché la flessibilità del modello non è più un lusso. È parte della gestione del rischio.&lt;/p&gt;
&lt;p&gt;Se la qualità cambia, i prezzi si muovono o le quote si restringono, i team hanno bisogno di opzioni.&lt;/p&gt;
&lt;h2 id="il-controllo-dei-costi-non-è-una-preoccupazione-secondaria"&gt;Il controllo dei costi non è una preoccupazione secondaria&lt;/h2&gt;
&lt;p&gt;L&amp;rsquo;articolo ha anche ragione nel trattare il costo come una questione architetturale.&lt;/p&gt;
&lt;p&gt;Non è un problema del tipo &amp;ldquo;lo ottimizzeremo più tardi&amp;rdquo;.&lt;/p&gt;
&lt;p&gt;Se mandi ogni task al modello più pesante per impostazione predefinita, può funzionare benissimo in una demo e crollare sotto l&amp;rsquo;economia di produzione.&lt;/p&gt;
&lt;p&gt;Per questo penso che le sezioni su:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;routing&lt;/li&gt;
&lt;li&gt;batching&lt;/li&gt;
&lt;li&gt;caching&lt;/li&gt;
&lt;li&gt;provisioned throughput&lt;/li&gt;
&lt;li&gt;gestione delle quote&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;siano più importanti di quanto molti potrebbero pensare.&lt;/p&gt;
&lt;p&gt;I team che trattano la disciplina dei costi come parte del design del sistema invecchieranno molto meglio di quelli che la trattano come lavoro di pulizia successivo.&lt;/p&gt;
&lt;h2 id="la-mia-opinione"&gt;La mia opinione&lt;/h2&gt;
&lt;p&gt;Questo è un pezzo utile di Foundry perché parla dei sistemi AI nel modo in cui gli ingegneri esperti devono davvero operarli.&lt;/p&gt;
&lt;p&gt;Non come demo.
Non come prototipi una tantum.
E non come turismo dei benchmark.&lt;/p&gt;
&lt;p&gt;Ma come sistemi operativi per workload, vincoli, trade-off e cambiamento continuo.&lt;/p&gt;
&lt;p&gt;Questo è il livello di conversazione verso cui dobbiamo continuare a muoverci.&lt;/p&gt;
&lt;p&gt;E se stai costruendo sistemi AI in produzione, questa è esattamente la mentalità che voglio che i team adottino presto.&lt;/p&gt;
&lt;p&gt;Articolo originale: &lt;a href="https://devblogs.microsoft.com/foundry/build-2026-foundry-models/"&gt;A Developer’s Guide to Managing Models, Cost and Quality in Microsoft Foundry&lt;/a&gt;&lt;/p&gt;</content:encoded></item><item><title>La storia di Foundry dall'osservabilità al ROI è ciò che serve alle piattaforme di agenti serie</title><link>https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-observability-to-roi-agent-devops-loop/</link><pubDate>Mon, 25 May 2026 00:00:00 +0000</pubDate><author>Emiliano Montesdeoca</author><guid>https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-observability-to-roi-agent-devops-loop/</guid><description>L'ultimo annuncio di Foundry sull'osservabilità conta perché collega tracing, valutazione, ottimizzazione e ROI in un unico ciclo operativo per gli agenti AI.</description><content:encoded>&lt;blockquote&gt;
&lt;p&gt;&lt;em&gt;Questo articolo è stato tradotto automaticamente. Per la versione originale, &lt;a href="https://thedotnetblog.com/it/news/emiliano-montesdeoca/foundry-observability-to-roi-agent-devops-loop/"&gt;fai clic qui&lt;/a&gt;.&lt;/em&gt;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Se gli agenti AI devono vivere in produzione, l&amp;rsquo;osservabilità non può fermarsi ai log e ai trace.&lt;/p&gt;
&lt;p&gt;Per questo la nuova storia di Foundry dall&amp;rsquo;osservabilità al ROI sembra importante.&lt;/p&gt;
&lt;p&gt;Il vero messaggio non è &amp;ldquo;abbiamo aggiunto più dashboard&amp;rdquo;.&lt;/p&gt;
&lt;p&gt;Il vero messaggio è che le piattaforme di agenti serie hanno bisogno di un ciclo operativo continuo:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;tracciare ciò che è successo&lt;/li&gt;
&lt;li&gt;valutare se è stato buono&lt;/li&gt;
&lt;li&gt;ottimizzare ciò che richiede lavoro&lt;/li&gt;
&lt;li&gt;collegare il risultato al valore di business&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questa è una storia molto più solida del solito parlare a vuoto di piattaforma.&lt;/p&gt;
&lt;h2 id="la-frase-chiave-dellarticolo-originale-dice-tutto"&gt;La frase chiave dell&amp;rsquo;articolo originale dice tutto&lt;/h2&gt;
&lt;p&gt;Il post originale si apre con una frase a cui penso che ogni team che costruisce agenti dovrebbe prestare attenzione:&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&amp;ldquo;Rilasciare un agente AI è la parte facile. Tenerlo accurato, sicuro e responsabile in produzione è il punto in cui i team si bloccano.&amp;rdquo;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;È esattamente vero.&lt;/p&gt;
&lt;p&gt;Abbiamo già superato la fase in cui la domanda principale era: &amp;ldquo;posso far fare a un agente qualcosa di interessante?&amp;rdquo;&lt;/p&gt;
&lt;p&gt;La domanda più difficile e più preziosa è:&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;posso gestire il sistema una volta che inizia a interagire con utenti reali, strumenti reali e costi reali?&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;È lì che Foundry sta cercando di spostare la conversazione.&lt;/p&gt;
&lt;h2 id="perché-questo-conta-più-di-unaltra-demo-di-agente"&gt;Perché questo conta più di un&amp;rsquo;altra demo di agente&lt;/h2&gt;
&lt;p&gt;Molti annunci di agenti AI continuano a concentrarsi sulla creazione: costruisci l&amp;rsquo;agente, collega gli strumenti, instrada i task, pubblica l&amp;rsquo;interfaccia.&lt;/p&gt;
&lt;p&gt;Va tutto bene.&lt;/p&gt;
&lt;p&gt;Ma le domande operative sono il punto in cui la maggior parte dei sistemi seri diventa sostenibile oppure si trasforma in esperimenti costosi:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;cosa sta davvero facendo l&amp;rsquo;agente in produzione?&lt;/li&gt;
&lt;li&gt;ha fatto la cosa giusta?&lt;/li&gt;
&lt;li&gt;sta peggiorando nel tempo?&lt;/li&gt;
&lt;li&gt;costa troppo rispetto al valore che crea?&lt;/li&gt;
&lt;li&gt;quali modifiche di configurazione hanno davvero migliorato la qualità?&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Per questo penso che l&amp;rsquo;annuncio di Foundry sia più importante di un tipico riepilogo di funzionalità. Sta cercando di definire un ciclo di Agent DevOps, non solo una storia di creazione dell&amp;rsquo;agente.&lt;/p&gt;
&lt;h2 id="il-ciclo-in-quattro-parti-è-il-vero-prodotto-qui"&gt;Il ciclo in quattro parti è il vero prodotto qui&lt;/h2&gt;
&lt;p&gt;L&amp;rsquo;articolo organizza sostanzialmente la piattaforma attorno a quattro capacità:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Trace&lt;/li&gt;
&lt;li&gt;Evaluate&lt;/li&gt;
&lt;li&gt;Monitor&lt;/li&gt;
&lt;li&gt;Optimize&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questa è la forma giusta.&lt;/p&gt;
&lt;p&gt;Direi persino che qualunque piattaforma voglia essere presa sul serio per workload di agenti in produzione finirà per aver bisogno di tutte e quattro.&lt;/p&gt;
&lt;p&gt;Il tracing da solo non basta.&lt;/p&gt;
&lt;p&gt;La valutazione da sola non basta.&lt;/p&gt;
&lt;p&gt;L&amp;rsquo;ottimizzazione senza prove è solo un&amp;rsquo;ipotesi.&lt;/p&gt;
&lt;p&gt;E parlare di ROI senza telemetria è spesso teatro.&lt;/p&gt;
&lt;h2 id="langolo-dellinteroperabilità-è-particolarmente-intelligente"&gt;L&amp;rsquo;angolo dell&amp;rsquo;interoperabilità è particolarmente intelligente&lt;/h2&gt;
&lt;p&gt;Una delle scelte più forti dell&amp;rsquo;annuncio è che Foundry non finge che tutti gli agenti saranno costruiti in un unico framework.&lt;/p&gt;
&lt;p&gt;Il post originale parla esplicitamente di tracing e valutazioni che si estendono a:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;LangChain&lt;/li&gt;
&lt;li&gt;LangGraph&lt;/li&gt;
&lt;li&gt;OpenAI SDK&lt;/li&gt;
&lt;li&gt;Microsoft Agent Framework&lt;/li&gt;
&lt;li&gt;framework personalizzati tramite OpenTelemetry&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Questo è importante.&lt;/p&gt;
&lt;p&gt;Perché il lock-in di piattaforma è uno dei modi più rapidi per rendere meno attraente una storia operativa che in origine era utile.&lt;/p&gt;
&lt;p&gt;Se i team possono mantenere le proprie scelte di framework e comunque ottenere telemetria e superfici di valutazione di livello production, l&amp;rsquo;attrito diminuisce parecchio.&lt;/p&gt;
&lt;h2 id="la-valutazione-con-rubriche-potrebbe-finire-per-contare-più-di-quanto-la-gente-si-aspetti"&gt;La valutazione con rubriche potrebbe finire per contare più di quanto la gente si aspetti&lt;/h2&gt;
&lt;p&gt;Anche la parte di rubric evaluation merita di essere citata.&lt;/p&gt;
&lt;p&gt;Penso che sia una delle aggiunte più pratiche dell&amp;rsquo;intero post.&lt;/p&gt;
&lt;p&gt;Perché? Perché ciò che è &amp;ldquo;buono&amp;rdquo; dipende dal contesto.&lt;/p&gt;
&lt;p&gt;L&amp;rsquo;articolo dice che la rubric evaluation genera &amp;ldquo;criteri di valutazione sensibili al contesto a partire dal comportamento previsto del tuo agente&amp;rdquo;. È esattamente la direzione di cui questi sistemi hanno bisogno.&lt;/p&gt;
&lt;p&gt;Il punteggio di qualità generico è utile.&lt;/p&gt;
&lt;p&gt;Ma alla fine i team devono valutare gli agenti secondo i propri standard:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;tono&lt;/li&gt;
&lt;li&gt;completamento delle attività&lt;/li&gt;
&lt;li&gt;aderenza alle policy&lt;/li&gt;
&lt;li&gt;aspettative di latenza&lt;/li&gt;
&lt;li&gt;limiti di costo&lt;/li&gt;
&lt;li&gt;regole di business specifiche del dominio&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;È lì che la valutazione diventa operativamente significativa invece che solo interessante dal punto di vista accademico.&lt;/p&gt;
&lt;h2 id="il-roi-è-la-parte-più-scomoda-ed-è-per-questo-che-conta"&gt;Il ROI è la parte più scomoda, ed è per questo che conta&lt;/h2&gt;
&lt;p&gt;Penso anche che la parte ROI dell&amp;rsquo;annuncio sia importante proprio perché è scomoda.&lt;/p&gt;
&lt;p&gt;Il post pone la domanda direttamente:&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&amp;ldquo;questo agente vale quello che costa?&amp;rdquo;&lt;/p&gt;
&lt;/blockquote&gt;
&lt;p&gt;Questa domanda viene spesso evitata nelle conversazioni sull&amp;rsquo;AI.&lt;/p&gt;
&lt;p&gt;Ma è la domanda giusta.&lt;/p&gt;
&lt;p&gt;Se la piattaforma può davvero collegare costi, completamento dei task, tempo risparmiato e trace di produzione in un unico posto, offre a engineering e leadership un linguaggio condiviso molto migliore.&lt;/p&gt;
&lt;p&gt;E sinceramente, quel linguaggio condiviso serve eccome.&lt;/p&gt;
&lt;h2 id="la-mia-opinione"&gt;La mia opinione&lt;/h2&gt;
&lt;p&gt;Questo è uno degli annunci a livello di piattaforma migliori del gruppo, perché si concentra sull&amp;rsquo;operare gli agenti, non solo sul costruirli.&lt;/p&gt;
&lt;p&gt;Ed è lì che inizia davvero il lavoro duro.&lt;/p&gt;
&lt;p&gt;Le piattaforme AI più forti dei prossimi anni non saranno solo quelle con accesso a più modelli o a più demo. Saranno quelle che aiutano i team a tracciare il comportamento, valutare i risultati, ottimizzare in sicurezza e giustificare i costi con prove.&lt;/p&gt;
&lt;p&gt;Questa storia di Foundry sta cercando di andare esattamente in quella direzione.&lt;/p&gt;
&lt;p&gt;Per questo vale la pena prenderla sul serio.&lt;/p&gt;
&lt;p&gt;Articolo originale: &lt;a href="https://devblogs.microsoft.com/foundry/build-2026-from-observability-to-roi-for-ai-agents-on-any-framework/"&gt;Build 2026: From observability to ROI for AI agents on any framework&lt;/a&gt;&lt;/p&gt;</content:encoded></item></channel></rss>