Si lega a
deriva dall'autoattenzione; motiva la cache di chiavi e valori e le attenzioni raggruppate del pezzo sulle evoluzioni; si lega al costo del contesto misurato nella serie agenti-ai
Da qui ci si arriva
- Costo per token
Quanto si paga per ogni token di ingresso, di ragionamento e di uscita: dipende dalla lingua attraverso il tokenizzatore, dalla finestra di contesto, dai parametri attivi e dai token di ragionamento