Copilot Studio: una risposta può consumare più contatori di crediti

|Autore: Redazione QUASA|5 min di lettura
Copilot Studio: una risposta può consumare più contatori di crediti

Per stimare il consumo mensile di Copilot Studio, calcola i crediti delle funzioni eseguite in ogni interazione e moltiplica il risultato per il numero di interazioni previste. Se l’agente segue percorsi diversi, stima separatamente il volume di ciascuno e somma i subtotali. Il numero di conversazioni, da solo, non basta: una conversazione può comprendere più richieste e risposte.

La tabella Microsoft delle tariffe mostra perché le voci vanno sommate: nell’esempio con grounding sul Microsoft Graph del tenant, una risposta generativa attiva 10 Copilot Credits per il grounding e 2 per la risposta, per un totale di 12. Prima di trasformare la previsione in capacità da acquistare, separa inoltre l’attività fatturabile dall’uso interno compreso nella licenza di un utente autenticato di Microsoft 365 Copilot.

Le voci da sommare per interazione

Negli agenti che usano lo standard harness, una risposta classica predefinita vale 1 credito e una risposta generativa 2. Un’azione dell’agente aggiunge 5 crediti quando viene eseguita; il grounding sul Microsoft Graph del tenant ne aggiunge 10. Quest’ultima è una funzione specifica e facoltativa: la presenza di una fonte di conoscenza non significa che ogni risposta debba ricevere automaticamente la tariffa del grounding del tenant.

Con un modello di ragionamento si applicano due contatori: la tariffa della funzione svolta e quella degli strumenti di IA generativa premium, pari a 10 crediti per 1.000 token. Per una risposta generativa, la formula diventa quindi 2 crediti più la quota premium calcolata sui token utilizzati. Le azioni e gli eventuali flussi dell’agente entrano nel conto soltanto quando il percorso li esegue; i flussi hanno una tariffa distinta di 13 crediti per 100 azioni.

La formula generale è crediti mensili = somma dei volumi di ciascun percorso × crediti delle funzioni attivate in quel percorso. Questi calcoli riguardano lo standard harness e i modelli forniti da Copilot Studio. Le configurazioni che portano un proprio modello, per esempio da Azure Foundry, seguono una fatturazione separata.

Tre scenari con lo stesso volume mensile

I casi seguenti sono ipotesi di pianificazione, non consumi misurati. Ciascuno prevede 1.000 interazioni fatturabili in un mese, con una risposta per interazione. Nei primi due casi non sono previste azioni o strumenti aggiuntivi; nel terzo cambia il modello usato per generare la risposta.

  1. Agente interno semplice. Supponi che utenti privi dell’inclusione Microsoft 365 Copilot ricevano sempre una risposta classica predefinita. Il costo unitario è 1 credito e la previsione è 1.000 × 1 = 1.000 Copilot Credits. Se l’agente è usato anche da dipendenti la cui attività rientra nella licenza, tieni le loro interazioni in un conteggio distinto.
  2. Agente con grounding del tenant. Supponi che ogni richiesta attivi il grounding sul Microsoft Graph del tenant e produca una risposta generativa. Il costo unitario è 10 + 2 = 12 crediti e la previsione è 1.000 × 12 = 12.000 crediti. Se il grounding viene usato soltanto per una parte delle richieste, applica questa somma solo a quella parte; per le altre usa le funzioni che eseguono effettivamente.
  3. Agente con reasoning. Supponi che ogni risposta generativa usi 2.000 token soggetti alla tariffa premium, senza grounding o altre azioni. Il costo unitario ipotetico è 2 + (2 × 10) = 22 crediti e quello mensile è 1.000 × 22 = 22.000. La previsione va ricalcolata con il volume di token atteso per il proprio agente: è questo dato, in tale scenario, a determinare gran parte della differenza.

Un agente reale può distribuire le richieste tra tutti e tre i percorsi. Per esempio, una quota può ricevere risposte classiche, un’altra usare il grounding e una terza richiedere reasoning. Assegna un volume a ciascuna quota, calcola i rispettivi subtotali e sommali; se una richiesta produce più risposte o esegue un’azione, aggiungi quelle voci al suo percorso.

Quale attività interna escludere dalla capacità a pagamento

«Interno» non equivale automaticamente a «incluso». L’uso rivolto ai dipendenti rientra nella licenza Microsoft 365 Copilot quando la persona che interagisce con l’agente possiede quella licenza e l’agente opera con la sua identità autenticata. Le risposte classiche e generative, le azioni e il grounding del tenant previsti dalla tabella risultano allora senza addebito aggiuntivo, entro i limiti di uso equo.

Per i flussi l’inclusione vale quando sono avviati dal trigger «When an agent calls the flow» durante l’interazione con un utente autenticato e licenziato. Un flusso con un altro trigger può consumare crediti; anche gli agenti che usano il computer restano fuori da questa inclusione. Nel preventivo, quindi, separa gli utenti licenziati da quelli privi della licenza e distingui le esecuzioni avviate da una persona dai percorsi attivati in altro modo.

Dai crediti previsti alla capacità

Il totale stimato esprime consumo, non ancora una spesa in euro. Nel riepilogo di Frontrow sui Copilot Credits, un pacchetto prepagato comprende 25.000 crediti mensili condivisi nel tenant, mentre la modalità a consumo addebita i crediti utilizzati tramite una sottoscrizione Azure collegata. I crediti inutilizzati del pacchetto non passano al mese successivo.

Confronta dunque la stima con la capacità disponibile per l’intero tenant, considerando anche gli altri agenti che la utilizzano. Se il traffico varia molto tra i mesi, il solo valore medio può nascondere il mese di maggiore utilizzo. Allo stesso modo, un numero stabile di utenti non garantisce crediti stabili: una maggiore quota di risposte con grounding, azioni o reasoning cambia il consumo per richiesta.

Dove confrontare la previsione con il consumo

Il team Copilot Studio CAT indica Licensing > Copilot Studio nel Power Platform admin center come punto di partenza per i dati di consumo del tenant. Per gli agenti standard, il dettaglio disponibile può distinguere funzionalità, strumento, modello, canale e origine della conoscenza, oltre ai crediti fatturati e non fatturati.

Nella scheda Summary trovi il quadro della capacità; in Environments puoi restringere l’esame all’ambiente e all’agente interessati. Confronta i crediti fatturati con la previsione e osserva quali funzioni incidono sullo scarto. Se cambia la quota di richieste con grounding o il numero di token delle risposte con reasoning, aggiorna quei parametri nella formula: correggere soltanto il numero di conversazioni lascerebbe invariata la causa della differenza.

Condividi:

Iscriviti alla nostra newsletter

Ricevi le ultime notizie su Web3, IA e cripto direttamente nella tua casella di posta.

0