Formaliserer gjenstående KB-refresh (97 filer: High 11, Medium 33, Low 52, Unverified 1)
i tiered + batchet rekkefølge med bevist arbeidsmønster og foreslåtte release-versjoner
(HIGH→v1.16.3, MEDIUM→v1.16.4, LOW→v1.16.5). Noterer separate spor (Spor C kurs-deteksjon,
onboarding-uplift) som egen prioritering. STATE.md peker hit.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Versjonsbump 1.16.1 → 1.16.2 med konsistent plugin.json + README-badge + README
version-history + CHANGELOG. KB-refresh-patch: kun reference docs i cost-optimization/.
Alle 8 critical cost-filer verifisert mot Microsoft Learn og oppdatert (commits
d36cddd→c0b8b51). report-changes.mjs: critical-count for klyngen 8 → 0. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Header «2026-06» → «2026-06-24» (dag-presis). report-changes.mjs sammenligner
leksikografisk: «2026-06» tolkes som prefiks < kildens lastmod «2026-06-08», så filen
forble flagget critical selv etter innholds-refresh i 8/8. Filen ble faktisk live-verifisert
mot Foundry-katalogen i dag (2026-06-24) — etter 2026-06-08-kildeendringen — så dag-presis
dato er både ærlig og korrekt. Critical-count for cost-klyngen nå 0 (var 8 ved baseline).
Ingen innholdsendring; kun header-presisjon.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry-models/concepts/models-from-partners,
aks/concepts-ai-ml-language-models, machine-learning/concept-models-featured):
- TRYGT: fjernet «(175B+)» fra GPT-4o (uoffisielt/uverifiserbart parametertall).
- TRYGT: «GPT-4 utfaset» → «GPT-4 legacy» (2 steder: pristabell-label + besparelse-prosa).
GPT-4-familien er legacy (superseded), ikke fjernet — konsistent med ground truth fra fil 3-6.
- KALIBRERINGS-KORREKSJON: agentens VERIFY-påstand «Phi-3-small/medium + Phi-2 + Falcon-7B ikke i
aktiv katalog (kun Phi-4-familien)» AVKREFTET ved verifisering. models-from-partners viser nå kun
Phi-4-familien (det agenten så), MEN Phi-3-mini/Phi-3-small er fortsatt i Foundry-katalogen
(featured models, azureml-registry), og Phi-2 + Falcon-7B er fortsatt dokumentert i filens egen
kilde #2 (AKS «Small and large language models»). Modellene er IKKE fjernet → ingen «retired»-merking
lagt inn (ville vært upresis). Phi-3/Phi-2/Falcon urørt som illustrative eksempler.
- Header 2026-04→2026-06. Disclaimed priser (kanonisk peker) urørt. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (ai-foundry/openai/how-to/batch + deployment-types):
- Data Zone Batch lagt til som deployment-type (SKU `DataZoneBatch`): samme 50% rabatt som
Global Batch, men inferens-prosessering begrenset til Microsofts definerte datasone (EU/US),
data-at-rest forblir i ressursens Azure-geografi. Lagt til 4 steder: kjernekomponent-tabell,
setup-steg, prismodell-tabell, og som FØRSTE Schrems II-mitigering (høy verdi for offentlig sektor).
- «Exponential backoff queuing» reframet til «fail-fast token-quota-håndtering»: serveren feiler
raskt på enqueued-token-grensen, KLIENTEN gjør exponential backoff-retry (kodeeksempel er
klient-side) — filens «automatisk retry» antydet feilaktig server-side auto-retry. Region-listen
verifisert current (urørt).
- Header 2026-05→2026-06, kilde #1 + konfidens-tabell Verified 2026-02→2026-06.
- 50%/24t/expiration verifisert current (doc: «doesn't expire jobs that take longer»). Disclaimed
priser (GPT-4o Jan-2026 + NOK) urørt. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry/openai/how-to/fine-tuning-cost-management,
prompt-caching, use-your-data):
- RFT (Reinforcement Fine-Tuning) lagt til (filen dekket kun SFT/DPO): tidsbasert «pris = treningstid
× timepris + grader-tokens», ~$100/time core training for o4-mini-2025-04-16, per-job-tak $5000
(pauses + deploybart checkpoint ved tak, kan resume uten videre pristak). Cost-control-strategier med.
- Cache-TTL-tabell hadde FEIL akse («Foundry Classic vs AI Services») → korrigert til in-memory
(5-10 min/maks 1t, alle GPT-4o+) vs extended (24h, GPT-5-serien+gpt-4.1, default for nyere).
- prompt_cache_key ~15 req/min overflow-caveat lagt til.
- On Your Data deprecation 2026-10-14 flagget (3 steder: token-est-seksjon, Foundry-seksjon, kilde #6).
- tiktoken model-set manglet o1-mini/o3-mini → lagt til.
- Header 2026-02→2026-06, verification-date 2026-02-04→2026-06. Priser urørt (kanonisk peker). validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>