fix(ms-ai-architect): ✅ Verified → ✅ Documented (tillit-hygiene)
Markøren over-påsto ekstern verifisering; faktisk semantikk (per legend i
m365-copilot-plugins-ecosystem.md) er «hentet fra MS Learn via MCP» = Documented.
Smal scope (operatør-besluttet A): de 101 ✅ Verified-konfidens-cellene i 13 filer
+ 5 kolonne-overskrifter (ptu, agent-memory) + skill-gen-taksonomien
(Verified/Baseline/Assumed → Documented/Baseline/Assumed) + licensing-seksjonstittel.
La de 137 plain «Verified»-cellene i 31 kilde-attribusjons-tabeller stå — de peker
på en faktisk kilde i nabokolonnen (proveniens bevart). Suite 509/509.
This commit is contained in:
parent
5cff871c99
commit
83fd9b58d3
15 changed files with 110 additions and 110 deletions
|
|
@ -21,25 +21,25 @@ En hybrid tilnærming, der man kombinerer PTU for stabil baseline-traffic og Pay
|
|||
|
||||
### PTU-prismodell
|
||||
|
||||
| Komponent | Beskrivelse | Verified |
|
||||
| Komponent | Beskrivelse | Documented |
|
||||
|-----------|-------------|----------|
|
||||
| **Provisioned Throughput Unit (PTU)** | Generisk enhet for modellprosesseringskapasitet. Ikke modellspesifikk – samme PTU-quota kan brukes på tvers av Azure OpenAI-modeller og Foundry-modeller (DeepSeek, Llama, etc.). | ✅ Verified |
|
||||
| **Hourly billing** | Faktureres per time: `$/PTU/hr × antall PTUer`. Proratert ved partial hours (15 min = 1/4 av time-rate). | ✅ Verified |
|
||||
| **Azure Reservations** | 1-måned eller 1-år commitments gir betydelige rabatter (ofte 50%+). Reservasjoner kjøpes i Azure Portal, ikke AI Foundry. | ✅ Verified |
|
||||
| **Deployment types** | Global Provisioned (multi-region), Data Zone Provisioned (data residency), Regional Provisioned (single-region). Hver type krever separat reservation. | ✅ Verified |
|
||||
| **Minimum PTU** | Varierer per modell: GPT-4o (50 PTU regional, 15 PTU global), GPT-4o-mini (25 PTU regional, 15 PTU global), DeepSeek-R1 (100 PTU global, ingen regional). | ✅ Verified |
|
||||
| **Throughput per PTU** | For nyere modeller (GPT-4.1+): Separate input/output TPM per PTU. Eksempel: GPT-5 har 4750 input TPM per PTU. Output tokens "koster" mer kapasitet enn input. | ✅ Verified |
|
||||
| **Utilization metric** | Azure Monitor: `Provisioned-Managed Utilization V2` måler utnyttelse. Ved 100% returneres HTTP 429. | ✅ Verified |
|
||||
| **Provisioned Throughput Unit (PTU)** | Generisk enhet for modellprosesseringskapasitet. Ikke modellspesifikk – samme PTU-quota kan brukes på tvers av Azure OpenAI-modeller og Foundry-modeller (DeepSeek, Llama, etc.). | ✅ Documented |
|
||||
| **Hourly billing** | Faktureres per time: `$/PTU/hr × antall PTUer`. Proratert ved partial hours (15 min = 1/4 av time-rate). | ✅ Documented |
|
||||
| **Azure Reservations** | 1-måned eller 1-år commitments gir betydelige rabatter (ofte 50%+). Reservasjoner kjøpes i Azure Portal, ikke AI Foundry. | ✅ Documented |
|
||||
| **Deployment types** | Global Provisioned (multi-region), Data Zone Provisioned (data residency), Regional Provisioned (single-region). Hver type krever separat reservation. | ✅ Documented |
|
||||
| **Minimum PTU** | Varierer per modell: GPT-4o (50 PTU regional, 15 PTU global), GPT-4o-mini (25 PTU regional, 15 PTU global), DeepSeek-R1 (100 PTU global, ingen regional). | ✅ Documented |
|
||||
| **Throughput per PTU** | For nyere modeller (GPT-4.1+): Separate input/output TPM per PTU. Eksempel: GPT-5 har 4750 input TPM per PTU. Output tokens "koster" mer kapasitet enn input. | ✅ Documented |
|
||||
| **Utilization metric** | Azure Monitor: `Provisioned-Managed Utilization V2` måler utnyttelse. Ved 100% returneres HTTP 429. | ✅ Documented |
|
||||
|
||||
### PayGo-prismodell
|
||||
|
||||
| Komponent | Beskrivelse | Verified |
|
||||
| Komponent | Beskrivelse | Documented |
|
||||
|-----------|-------------|----------|
|
||||
| **Token-based billing** | Faktureres per 1000 tokens (1K tokens). Input og output har ulike priser (output er dyrere). | ✅ Verified |
|
||||
| **Dynamic quota (preview)** | Lar standard-deployments opportunistisk bruke mer quota når tilgjengelig, uten ekstra konfigurasjon. Faktureres fortsatt per token. | ✅ Verified |
|
||||
| **TPM-quota** | Tokens Per Minute (TPM) quota definerer maks throughput. Kan økes via quota-request. | ✅ Verified |
|
||||
| **Rate limiting** | Custom rate limiting basert på estimert traffic load. Kan gi HTTP 429 før quota nås hvis traffic er ujevnt distribuert. | ✅ Verified |
|
||||
| **No minimum commitment** | Ingen forhåndskostnader eller minimum deployment-størrelse. Betaler kun for faktisk forbruk. | ✅ Verified |
|
||||
| **Token-based billing** | Faktureres per 1000 tokens (1K tokens). Input og output har ulike priser (output er dyrere). | ✅ Documented |
|
||||
| **Dynamic quota (preview)** | Lar standard-deployments opportunistisk bruke mer quota når tilgjengelig, uten ekstra konfigurasjon. Faktureres fortsatt per token. | ✅ Documented |
|
||||
| **TPM-quota** | Tokens Per Minute (TPM) quota definerer maks throughput. Kan økes via quota-request. | ✅ Documented |
|
||||
| **Rate limiting** | Custom rate limiting basert på estimert traffic load. Kan gi HTTP 429 før quota nås hvis traffic er ujevnt distribuert. | ✅ Documented |
|
||||
| **No minimum commitment** | Ingen forhåndskostnader eller minimum deployment-størrelse. Betaler kun for faktisk forbruk. | ✅ Documented |
|
||||
|
||||
### Breakeven-analyse
|
||||
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue