Verifisert mot live Microsoft Learn (cost-management-billing/reservations/azure-openai +
provisioned-throughput-billing + provisioned-throughput-sizing):
- VERIFY BEKREFTET — overage-prioritering: kilden sier «discount is shared automatically
across all models in scope ... matching isn't by model or deployment ID». Filens
«anvendes først Azure OpenAI, deretter Foundry Models» var feil regel-framing → erstattet
med aggregert-per-time-på-tvers-av-scope. Eksempelet (500/300/200/100) matcher docs eksakt, beholdt.
- DRIFT (kirurgisk): «~150 PTU»-kalkulatoreksempel var stale (gammel TPM/PTU). Dagens
gpt-5.1 = 4750 input-TPM/PTU, ratio 8 → 300K/4750 ≈ 63 rå → 100 regional. Korrigert + reproduserbar.
- gpt-5→gpt-5.1 (2 steder): ratio verifisert = 8 (identisk gpt-5; gpt-5.5 ville vært 6 — unngått).
- Ny «Priority processing» (pay-per-token, latensmål, ikke reserverbar) i beslutningstre.
- Min-PTU-caveat (varierer per modell: gpt-5-mini 25, DeepSeek/Fireworks 100+) + sizing-link.
- Header 2026-04→2026-06 + 2 verifiserte kilde-stempler til 2026-06 (gov-rad urørt, ikke re-verifisert). validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>