fix(ms-ai-architect): Spor 0 — 37 kilde-verifiserte KB-feil fikset (25 ref-filer), 1 avvist [skip-docs]

Per-kilde verifiserings-agenter (Opus xhigh, live microsoft_docs_fetch) bekreftet
hver verdi mot kilden FOER endring; alle forekomster av samme gale fakta fikset
fil-vidt (ikke bare sitert linje).

- 37/38 confirm-fix anvendt; #8 (model-selection «Model Router GA») AVVIST: fila var
  allerede korrekt (Model Router GA siden 2025-11-18); den siterte model-choice-guide
  har utdatert «(preview)»-etikett. AA «fikse» ville innfoert en feil.
- Tverteklynger reconciled til kilde-sann verdi: AI Search storage (S1 160/S2 512/S3
  1024/L1 2048/L2 4096 GB; vektor 5/35/150/300), Quota Tiers (erstatter
  Default/Enterprise + «1 Unit Capacity»).
- Hoey-innsats: realtime Schrems II omskrevet (global deployment != EU-residens,
  selv-verifisert mot kilde); Data Zone Norway East = gpt-5.4 OG gpt-5.5 (ikke kun
  5.5); computer-use = gpt-5.4 + computer-tool (region flagget for verifisering).
- Suite 552/552 groenn. Manifest oppdatert (fixed/verdict/verified per fiks).

Spor 1-froe (cross-fil-gjentakelser i UBEROERTE filer): «DDoS Protection Standard» i
ros-ai-threat-library.md + zero-trust-ai-services.md. Tilstoetende funn (ikke i de 38):
se docs / STATE.
This commit is contained in:
Kjell Tore Guttormsen 2026-06-29 09:39:20 +02:00
commit 2c54f0d5a0
26 changed files with 327 additions and 207 deletions

View file

@ -57,8 +57,8 @@ Azure OpenAI samler automatisk token-baserte metrics:
**Tilgjengelige metrics:**
- `TokenTransaction` — Total token count (input + output)
- `PromptTokens` — Input tokens
- `CompletionTokens` — Output tokens
- `InputTokens` — Input tokens
- `OutputTokens` — Output tokens
- `ProcessedPromptTokens` — Tokens faktisk prosessert (kan avvike ved caching)
**Aksess via:**
@ -442,7 +442,7 @@ AzureMetrics
| **PTU** | Track utilization percentage against reserved capacity |
**PTU Metrics:**
- `PTUUtilization` — Percentage of reserved capacity used
- `AzureOpenAIProvisionedManagedUtilizationV2` — Percentage of reserved capacity used
- `ProcessedPromptTokens` — Input tokens processed
- Input TPM per PTU — Model-specific (f.eks. 8450 TPM for Llama-3.3-70B)
@ -455,7 +455,7 @@ AzureMetrics
```kusto
AzureMetrics
| where ResourceProvider == "MICROSOFT.COGNITIVESERVICES"
| where MetricName == "PTUUtilization"
| where MetricName == "AzureOpenAIProvisionedManagedUtilizationV2"
| summarize AvgUtilization = avg(Average), MaxUtilization = max(Maximum)
by Resource, bin(TimeGenerated, 1h)
| extend EfficiencyStatus = case(