Header «2026-06» → «2026-06-24» (dag-presis). report-changes.mjs sammenligner
leksikografisk: «2026-06» tolkes som prefiks < kildens lastmod «2026-06-08», så filen
forble flagget critical selv etter innholds-refresh i 8/8. Filen ble faktisk live-verifisert
mot Foundry-katalogen i dag (2026-06-24) — etter 2026-06-08-kildeendringen — så dag-presis
dato er både ærlig og korrekt. Critical-count for cost-klyngen nå 0 (var 8 ved baseline).
Ingen innholdsendring; kun header-presisjon.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry-models/concepts/models-from-partners,
aks/concepts-ai-ml-language-models, machine-learning/concept-models-featured):
- TRYGT: fjernet «(175B+)» fra GPT-4o (uoffisielt/uverifiserbart parametertall).
- TRYGT: «GPT-4 utfaset» → «GPT-4 legacy» (2 steder: pristabell-label + besparelse-prosa).
GPT-4-familien er legacy (superseded), ikke fjernet — konsistent med ground truth fra fil 3-6.
- KALIBRERINGS-KORREKSJON: agentens VERIFY-påstand «Phi-3-small/medium + Phi-2 + Falcon-7B ikke i
aktiv katalog (kun Phi-4-familien)» AVKREFTET ved verifisering. models-from-partners viser nå kun
Phi-4-familien (det agenten så), MEN Phi-3-mini/Phi-3-small er fortsatt i Foundry-katalogen
(featured models, azureml-registry), og Phi-2 + Falcon-7B er fortsatt dokumentert i filens egen
kilde #2 (AKS «Small and large language models»). Modellene er IKKE fjernet → ingen «retired»-merking
lagt inn (ville vært upresis). Phi-3/Phi-2/Falcon urørt som illustrative eksempler.
- Header 2026-04→2026-06. Disclaimed priser (kanonisk peker) urørt. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (ai-foundry/openai/how-to/batch + deployment-types):
- Data Zone Batch lagt til som deployment-type (SKU `DataZoneBatch`): samme 50% rabatt som
Global Batch, men inferens-prosessering begrenset til Microsofts definerte datasone (EU/US),
data-at-rest forblir i ressursens Azure-geografi. Lagt til 4 steder: kjernekomponent-tabell,
setup-steg, prismodell-tabell, og som FØRSTE Schrems II-mitigering (høy verdi for offentlig sektor).
- «Exponential backoff queuing» reframet til «fail-fast token-quota-håndtering»: serveren feiler
raskt på enqueued-token-grensen, KLIENTEN gjør exponential backoff-retry (kodeeksempel er
klient-side) — filens «automatisk retry» antydet feilaktig server-side auto-retry. Region-listen
verifisert current (urørt).
- Header 2026-05→2026-06, kilde #1 + konfidens-tabell Verified 2026-02→2026-06.
- 50%/24t/expiration verifisert current (doc: «doesn't expire jobs that take longer»). Disclaimed
priser (GPT-4o Jan-2026 + NOK) urørt. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry/openai/how-to/fine-tuning-cost-management,
prompt-caching, use-your-data):
- RFT (Reinforcement Fine-Tuning) lagt til (filen dekket kun SFT/DPO): tidsbasert «pris = treningstid
× timepris + grader-tokens», ~$100/time core training for o4-mini-2025-04-16, per-job-tak $5000
(pauses + deploybart checkpoint ved tak, kan resume uten videre pristak). Cost-control-strategier med.
- Cache-TTL-tabell hadde FEIL akse («Foundry Classic vs AI Services») → korrigert til in-memory
(5-10 min/maks 1t, alle GPT-4o+) vs extended (24h, GPT-5-serien+gpt-4.1, default for nyere).
- prompt_cache_key ~15 req/min overflow-caveat lagt til.
- On Your Data deprecation 2026-10-14 flagget (3 steder: token-est-seksjon, Foundry-seksjon, kilde #6).
- tiktoken model-set manglet o1-mini/o3-mini → lagt til.
- Header 2026-02→2026-06, verification-date 2026-02-04→2026-06. Priser urørt (kanonisk peker). validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry/openai/how-to/prompt-caching,
foundry-classic/openai/concepts/use-your-data, ai-foundry/openai/concepts/model-retirements):
- Extended cache retention 24t BEKREFTET: «keeps cached prefixes active for longer, up to a maximum
of 24 hours», param prompt_cache_retention='24h'. Model-gated: gpt-5/5.1/5.2/5.4 (+codex/chat) +
gpt-4.1 (BEVISST utelatt gpt-5.5 — IKKE i extended-listen). Default 24h for nyere modeller
(in_memory ikke støttet); gpt-5.4 og eldre: in_memory default. Filens «5-10 min/maks 1t» var kun
in-memory-delen → cache-tabell splittet i in-memory vs extended + støttemodell-lister korrigert.
- On Your Data BEKREFTET deprecated, retires «October 14, 2026» → kilde #5 flagget m/ migrasjonspeker
(Foundry Agent Service + Foundry IQ).
- prompt_cache_key-nyanse lagt til (~15 req/min overflow-grense, fra docs).
Korreksjons-disiplin (operatør-godkjent):
- Data-residens-nyanse (HØYVERDI for offentlig sektor): extended-cache holdes i-region KUN ved
Regional Standard/Provisioned; Global/DataZone kan forlate region. Rettet GDPR- + Datasuverenitet-bullets
(gammel «clears etter maks 1 time» + «lagres i samme region» var nå feil for extended).
- Pristabell: o1-preview (retired 2025-07) + GPT-4/32K (retired 2025-06) flagget retired m/ peker til
kanonisk pricing (model-retirements-tabellen). Prompt Flow «GPT-3.5» → gjeldende modeller.
- Header 2026-02→2026-06, footer 2026-02-04→2026-06. 3 kilde-rader stemplet Verified MCP 2026-06. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (foundry/openai/concepts/priority-processing,
foundry/foundry-models/concepts/deployment-types, foundry/concepts/manage-costs):
- Priority processing lagt til (deployment-tabell + Nivå 4). ÆRLIG framing: delt doc-signal —
provisioned-throughput-siden lister den som fullverdig pay-per-token-kategori m/ latensmål per
modell (gpt-5.5/5.4/5.2/5.1/4.1), mens deployment-types/enable-siden markerer preview/invitasjon.
Skrevet som tier på GlobalStandard/DataZoneStandard (modellv. 2025-12-01+), m/ «rulles ut»-caveat.
- VERIFY meter-skille bekreftet: «Foundry Models sold by Azure billed via Azure meters as First Party
Consumption Services» under Foundry-ressurs; partner/community «billed through Azure Marketplace» →
Global resources, format model-name-GUID. Oppdatert Cost-tracking-bullet (slo feil sammen før).
- Phi-3→Phi-4-familien (2 steder): katalog viser kun Phi-4-familien (Phi-4, -mini-instruct,
-multimodal, -reasoning) i sky-serverless; Phi-3 superseded. Estimat-priser beholdt m/ (estimat).
- Quota 200k TPM/1k RPM: lagt til «verifiser i quota-docs (varierer per modell/type/region)».
Korreksjons-disiplin (operatør-godkjent): footer-dato-inkonsistens fikset — header 2026-04→2026-06,
footer «Sist oppdatert 2026-02»→2026-06 (561-seksjonsstempel urørt, ikke re-verifisert). 2 kilde-
rader stemplet Verified MCP 2026-06 (faktisk re-fetchet). Disclaimed priser urørt. validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Verifisert mot live Microsoft Learn (cost-management-billing/reservations/azure-openai +
provisioned-throughput-billing + provisioned-throughput-sizing):
- VERIFY BEKREFTET — overage-prioritering: kilden sier «discount is shared automatically
across all models in scope ... matching isn't by model or deployment ID». Filens
«anvendes først Azure OpenAI, deretter Foundry Models» var feil regel-framing → erstattet
med aggregert-per-time-på-tvers-av-scope. Eksempelet (500/300/200/100) matcher docs eksakt, beholdt.
- DRIFT (kirurgisk): «~150 PTU»-kalkulatoreksempel var stale (gammel TPM/PTU). Dagens
gpt-5.1 = 4750 input-TPM/PTU, ratio 8 → 300K/4750 ≈ 63 rå → 100 regional. Korrigert + reproduserbar.
- gpt-5→gpt-5.1 (2 steder): ratio verifisert = 8 (identisk gpt-5; gpt-5.5 ville vært 6 — unngått).
- Ny «Priority processing» (pay-per-token, latensmål, ikke reserverbar) i beslutningstre.
- Min-PTU-caveat (varierer per modell: gpt-5-mini 25, DeepSeek/Fireworks 100+) + sizing-link.
- Header 2026-04→2026-06 + 2 verifiserte kilde-stempler til 2026-06 (gov-rad urørt, ikke re-verifisert). validate 239/0.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Lukker K5-FAIL (navngitte fil-lenker / totale ref-filer ≥ 0,20) ved å følge
infrastructure-forbildet (0,97): full-sti `references/<mappe>/<fil>.md`-pekere
til kjernefiler, ikke bare mappe-refs.
Funn: security + advisor hadde filene navngitt allerede, men som BARE filnavn
uten `references/`-prefiks → ufanget av både eval-regex og kb-integrity (samme
klasse som de døde ref-paths i steg 2). Fiks = konverter til full sti:
- security: 10→16 navngitte (0,16→0,26). Konverterte 5 perf-filer (§3) + owasp (§1).
- advisor: 1→25 navngitte (0,016→0,40). Konverterte ~18 bare-filnavn i Kunnskaps-
basen + la til model-catalog-2026 og entry-points for copilot-extensi-
bility/prompt-engineering (40 filer som manglet ALLE navngitte pekere).
- engineering: 0→35 navngitte (0,0→0,23). Genuint 0 før; la til `> Kjernefiler:`-linje
med 4-6 kuraterte filer per §1-7.
Bivirkning: kb-integrity-checks 115→181 (de nye full-sti-refsene valideres nå),
orphan-warnings 260→223. Verifisert: K5 PASS alle 5 · K3/refTall ikke regredert ·
validate 239 · kb-eval 15 · kb-update 122 · kb-integrity 181/181.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
De 3 ref-filene som siteres av nøyaktig 1 URL med rent topisk treff får sin **Source:**-autoritetsheader (entydig, ingen gjetning): late-chunking-patterns→embeddings-tutorial, ai-red-team-operations-practical→ai-red-team/training, batch-api-usage-optimization→batch-blob-storage. authority_source-dekning 0→0,22%; lag-5 regel 3 nå virksom for disse filene.
Bevisst utelatt: ai-act-annex-iii-checklist.md — dens autoritet er EU-forordningen (deklarert **Hjemmel:** Regulation (EU) 2024/1689), ikke den tangentielle Purview-URLen den siterer. Å sette Purview som autoritet ville vært en gjetning som får regel 3 til å bomme (verifiseringsplikt).
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
Phase B (M-items) av #8 currency-rest. Nytt innhold, verifisert mot
Microsoft Learn + OWASP GenAI 2026-06-18 (tre research-subagenter).
Begge nye KB-filer wiret i SKILL.md (de-orphan bekreftet: kb-integrity
115/115, orphan-warnings uendret 262).
Nye KB-filer (ms-ai-security/references/ai-security-engineering/):
- owasp-llm-top10-azure-mitigations.md — konsolidert dekning av de fire
OWASP 2025-kategoriene som manglet referanse i SKILL.md-mappingen
(LLM04 Data/Model Poisoning, LLM06 Excessive Agency, LLM08 Vector/
Embedding Weaknesses, LLM09 Misinformation) med verifiserte Azure-tiltak.
OWASP-side 404 for LLM06/08/09 → definisjoner kryssverifisert, merket.
- defender-threat-protection-ai-services.md — Defender for Cloud «AI threat
protection» (gjeldende navn; plan «Defender for AI Services»). GA for
AI applications, Preview for AI agents (fra 2026-02-02). Varselliste m/
Alert ID + MITRE-taktikk, Prompt Shields-integrasjon, prising (75B-token
trial). KRITISK: ikke tilgjengelig i Azure Government (norsk off. sektor).
SKILL.md (ms-ai-security):
- Fylte de 4 «—»-radene LLM04/06/08/09 → owasp-llm-top10-azure-mitigations.md.
- La til Defender-referanse (kjøretids-trusseldeteksjon) + Government-forbehold.
- Fil-telling ai-security-engineering 17→22 (17 var stale; faktisk 20 + 2 nye).
licensing-matrix.md (ms-ai-advisor):
- Ny rad «Microsoft 365 E7» i master-matrisen + dedikert E7/Agent 365-seksjon.
E7 (GA 2026-05-01) bundler E5 + M365 Copilot + Agent 365 + Entra Suite.
Agent 365 = IT-admin kontrollplan (registry/Entra Agent ID/Defender/Purview).
VERIFISERT at begge er reelle SKU-er. Priser (~$99 E7 / ~$15 Agent 365) er
community-/partnerkilder → eksplisitt merket uverifisert.
disconnected-ai-scenarios.md (ms-ai-infrastructure):
- Ny seksjon «Foundry Local — generativt lokalt og air-gapped». To produkter:
on-device (offline etter nedlasting, ingen Azure-sub) + on Azure Local
(Arc/Kubernetes, Preview). Air-gapped/disconnected støttet fra juni 2026
(Preview): edgeartifacts-registry, expansion packs, lokal AD, ingen
telemetri. Del av Microsoft Sovereign Private Cloud — relevant for norsk
suverenitet.
Tester: validate-plugin 239 PASS / 0 FAIL / 0 WARN · kb-integrity 115/115
(262 pre-eksisterende orphan-warnings, uendret) · run-e2e alle suiter PASS.
#8 nå komplett (S-bannere #8a + M-items #8b). Neste: #9 v1.16.0 release.
FLAGG: `/architect:kb-update` apply forblir UTSATT (krever egen bekreftelse).
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
Verifisert mot Microsoft Learn region-tabeller 2026-06-18 (alle deployment-pivoter):
KUN gpt-4o/gpt-4o-mini er Norge-resident (Standard/Regional PTU) i Norway East.
gpt-4.1, o3/o4-mini/o3-mini/o1 og HELE GPT-5-familien er IKKE regionale der — kun Global.
Reverserer feilaktig baseline fra del 2/3 (8f9fe8b) som anbefalte gpt-4.1/o3/o4-mini for streng Norge-residens.
- model-catalog-2026.md: ny deployment-type-matrise (seksjon 9), korrigert beslutningstre/
hurtigguide/Norway East-rad (seksjon 10), nye modeller (gpt-5.2-5.5, gpt-5.3-codex/chat,
gpt-chat-latest, gpt-oss-120b/20b, sora-2, gpt-image-2), 1.05M kontekst for 5.4/5.5
- azure-ai-foundry.md: residens-presisering (Norway East-seksjon + spesifikke rad)
- gpt5-gpt41-pricing-models.md: korrigert deployment-valg + TCO-premiss (gpt-4o-mini for residens)
validate-plugin: 219 PASS
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
Audit-hypotesen («GPT-5 data-resident via Regional PTU/Data-Zone der streng
residens kreves») er MOTBEVIST mot live Microsoft Learn (hentet 4 doc-sider,
2026-06-18). GPT-5 har INGEN regional/PTU-deployment i Norway East — kan ikke
gjøres Norge-resident. Hadde planen blitt fulgt blindt, ville en falsk
compliance-påstand blitt skrevet inn i KB. STATEs verifiseringsplikt-advarsel
fanget dette.
Verifisert matrise (GPT-5 × Norway East × deployment-type):
- Standard (regional) / Regional Provisioned (= Norge-residens): INGEN GPT-5-variant
- Data Zone Standard (= EU-residens): kun gpt-5.5; ikke 5/mini/nano/5.1/5.2
- Data Zone Provisioned: norwayeast finnes ikke som region
- Global Standard (global): gpt-5/mini/nano/5.1/5.2 (ikke 5.5)
- Global Provisioned (global): gpt-5/mini/5.1/5.2/5.5
KB-ens nåværende forsiktighet («data kan forlate Norway East») var altså
RIKTIG for de deployment-typene som finnes. De reelle gapene var:
1. Manglende Data Zone-mellomtier (gpt-5.5 = EU-residens)
2. Upresist «kun via Agent Service» (er Global Standard + Global Provisioned)
3. Falsk implisert «GPT-5 + Regional PTU Norway East»-prising
Endringer (3 filer):
- model-catalog-2026.md: regional-tabell (GPT-5-celler), nordisk oppsummering
(fjernet «(regional PTU)»-merkelapp), beslutningstre (tre-tier residens:
Norge/EU-sone/global), hurtigguide (+ EU-residens-rad), Norway East-råd.
- azure-ai-foundry.md: Norway East-modellliste + Norway East-råd (GPT-5-residens).
- gpt5-gpt41-pricing-models.md: fjernet falsk «Norway East Regional ~10-20%»
for gpt-5; modelltilgjengelighet-merknad på offentlig-sektor-tabellen.
For streng Norge-residens forblir svaret gpt-4.1/o3/o4-mini/gpt-4o — IKKE GPT-5.
Kilder: learn.microsoft.com/azure/foundry/foundry-models/concepts/models-sold-directly-by-azure-region-availability
+ .../azure/ai-foundry/openai/how-to/deployment-types
Verifisert: validate-plugin.sh 219 PASS, test-kb-integrity.sh 117/117.
Scope: tilgjengelighetstabell-utvidelse (gpt-5.2/5.5-rader, kolonner) utsatt til del 3/3.
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Pre-trekexecute snapshot of in-progress CLAUDE.md/SKILL.md edits and
extracted docs/ files. Captured as one commit so /trekexecute claude-design
can run against a clean working tree.
Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
Add /ultraresearch-local for structured research combining local codebase
analysis with external knowledge via parallel agent swarms. Produces research
briefs with triangulation, confidence ratings, and source quality assessment.
New command: /ultraresearch-local with modes --quick, --local, --external, --fg.
New agents: research-orchestrator (opus), docs-researcher, community-researcher,
security-researcher, contrarian-researcher, gemini-bridge (all sonnet).
New template: research-brief-template.md.
Integration: --research flag in /ultraplan-local accepts pre-built research
briefs (up to 3), enriches the interview and exploration phases. Planning
orchestrator cross-references brief findings during synthesis.
Design principle: Context Engineering — right information to right agent at
right time. Research briefs are structured artifacts in the pipeline:
ultraresearch → brief → ultraplan --research → plan → ultraexecute.
Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>