chore(ms-ai-architect): refresh KB medium-bucket — 74 files [skip-docs]

KB-currency refresh (medium priority, 2026-06-19) via /architect:kb-update.
74 medium-prioritets filer re-verifisert mot Microsoft Learn (MCP) — delegert
til 15 parallelle Opus-subagenter (3 bølger) gruppert etter delt kilde, med
disjunkte fil-sett. Verifisert i hovedkontekst (scope-sjekk + diff-review av
de faktatunge gruppene + tester).

Hovedendringer (faktuelle korreksjoner + currency):
- Azure AI Search semantic ranker: TILGJENGELIG PÅ ALLE TIERS (også Free/Basic
  m/ gratis månedlig kvote) — gammel KB sa feilaktig "kun S1+". Korrigert i
  tier-tabell, anti-patterns og beslutningstabell (azure-ai-search-setup).
- APIM score-threshold = DISTANSE (lavere = strengere): tuning-tabellen i
  rag-caching-optimization hadde retningen baklengs — invertert til korrekt.
- Agentic retrieval GA/preview-nyanse presisert (hovedkontekst-korreksjon mot
  agentic-retrieval-how-to-migrate): GA via REST 2026-04-01 returnerer EKSTRAKTIV
  grounding (references + activity), IKKE syntetiserte svar. Answer synthesis,
  ikke-minimal reasoning effort (LLM query planning) og multi-turn messages
  forblir preview (2026-05-01-preview). Subagent hadde overforenklet til "hele
  kjernepipelinen GA"; rettet i agentic-rag-patterns + citation-tracking.
- Copilot Studio modell-tabeller (platforms/copilot-studio): fjernet Claude Opus
  4.5 + GPT-5.2 (borte fra kilde), lagt til Claude Sonnet 4.6/Opus 4.6 (GA),
  Opus 4.7 + Mistral Medium 3.5 (experimental); GPT-5 Reasoning/Auto = preview;
  A2A GA (apr 2026).
- Computer Use (CUA): Copilot Studio GA 2026-05-07; 4 modeller m/ tier/status
  (OpenAI CUA + Sonnet 4.5 GA, Sonnet 4.6 + Opus 4.6 experimental); 5 credits/
  steg standard, 15 premium; US-only region-krav FJERNET i GA-dok; Cloud PC pool
  + Hosted browser + bring-your-own-machine.
- Azure AI Search REST API-versjoner bumpet: 2025-09-01 -> 2026-04-01 (stabil),
  2025-11-01-preview -> 2026-05-01-preview (hybrid-search, rag-security-rbac,
  chunking).
- Power Automate-integrasjon: trigger "Run a flow from Copilot" -> "When an agent
  calls the flow"; App Service innebygd MCP (preview) lagt til.
- M365 Copilot-manifest v1.26 -> v1.28 (GA, mai) / v1.29 dokumentert (juni);
  "Tenant graph grounding" -> "Work IQ".
- Speech fast transcription 2t/300MB -> 5t/500MB; multilingual 14 -> 15 locales
  (+ pt-BR). Content Understanding reasoning preview -> GA (v1.0, 2025-11-01).
- Security Copilot E5 -> E5+E7. Død Databricks-URL ci-cd/best-practices ->
  ci-cd/flows. Prompt Flow retirement (2027-04-20 -> MAF) notert der den
  presenteres som go-forward. Gateway-topologi-tabell-feil rettet.
- Alle 74 Last updated -> 2026-06-19.

Discovery ikke kjørt (historisk kun Databricks-støy) -> 389-telling uendret,
ingen resync. validate 239 PASS, kb-integrity 115/115 (262 orphan-warnings
uendret), gitleaks clean.

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
This commit is contained in:
Kjell Tore Guttormsen 2026-06-19 14:02:18 +02:00
commit 070141f06b
74 changed files with 403 additions and 384 deletions

View file

@ -1,18 +1,18 @@
# Citation Tracking and Source Attribution
**Last updated:** 2026-04 | Verified: MCP 2026-04
**Status:** GA (classic RAG), Preview (agentic retrieval)
**Last updated:** 2026-06-19 | Verified: MCP 2026-06-19
**Status:** GA (classic RAG); agentic retrieval delvis GA via REST `2026-04-01` — grounding-overflaten (`references` + `activity`-log) er GA, mens LLM query planning (ikke-minimal reasoning effort) + answer synthesis + multi-turn messages forblir preview (`2026-05-01-preview`); portal/Foundry preview
**Category:** RAG Architecture & Semantic Search
---
## Introduksjon
Citation tracking er en kritisk komponent i enterprise RAG-systemer. Det handler om å spore og eksponere kildene som ligger til grunn for AI-genererte svar, slik at brukere kan verifisere informasjonen. I Azure-økosystemet støttes citation tracking gjennom to hovedmønstre: **Classic RAG** (GA) med Azure AI Search og Azure OpenAI, og **Agentic Retrieval** (Preview) med strukturerte grounding data.
Citation tracking er en kritisk komponent i enterprise RAG-systemer. Det handler om å spore og eksponere kildene som ligger til grunn for AI-genererte svar, slik at brukere kan verifisere informasjonen. I Azure-økosystemet støttes citation tracking gjennom to hovedmønstre: **Classic RAG** (GA) med Azure AI Search og Azure OpenAI, og **Agentic Retrieval** (grounding-overflaten med `references` + `activity` er GA via REST `2026-04-01`; LLM query planning/answer synthesis/multi-turn = preview; portal/Foundry preview) med strukturerte grounding data.
God citation tracking reduserer hallusinering ved å tvinge LLM-en til å basere seg på hentet kontekst, gir brukerne tillit til svarene, og oppfyller compliance-krav i offentlig sektor der sporbarhet er lovpålagt. Azure AI Search returnerer automatisk kildemetadata med søkeresultater, og Azure OpenAI "On Your Data"-mønsteret inkluderer citation annotations i responser.
Agentic Retrieval (preview 2025/2026) representerer neste evolusjon med LLM-assistert query planning, parallelle subqueries, og strukturerte citation-responser med full provenance tracking.
Agentic Retrieval representerer neste evolusjon med LLM-assistert query planning, parallelle subqueries, og strukturerte citation-responser med full provenance tracking. Citation-overflaten (`references` + `activity`-log) er GA via REST `2026-04-01`; LLM-assistert query planning (ikke-minimal reasoning effort) og answer synthesis forblir preview (`2026-05-01-preview`), og Azure-/Foundry-portalen gir kun preview-tilgang.
## Kjernekomponenter
@ -127,9 +127,9 @@ Context: {context}
- LLM planlegger optimale søk for bedre dekning
**Ulemper:**
- Preview-funksjon, ikke GA ennå
- Høyere kompleksitet og token-kostnad
- Ranking tokens gratis kun under initial preview-fase
- Grounding-overflaten (`references` + `activity`) er GA via REST `2026-04-01`; LLM query planning (ikke-minimal reasoning effort) + answer synthesis + multi-turn forblir preview, og portal/Foundry gir fortsatt kun preview-tilgang
- Høyere kompleksitet og token-kostnad (faktureres token-basert, ikke per query)
- Token-forbruk over månedlig gratis-kvote faktureres pay-as-you-go (Azure AI Search + Azure OpenAI separat)
### Mønster 3: Fakta-verifisering med LLM-judge
@ -243,9 +243,9 @@ result = groundedness_eval(
| Komponent | Kostnadsdriver |
|-----------|---------------|
| Azure AI Search | Standard spørringskostnad (ingen ekstra for metadata) |
| Semantic Ranker | Per 1000 requests (1000 gratis/mnd) |
| Semantic Ranker | Free plan (månedlig gratis request-kvote) + standard pay-as-you-go etter kvoten |
| Azure OpenAI | Token-kostnad for citation-generering i LLM-respons |
| Agentic Retrieval | Ranking tokens (gratis under preview), Azure OpenAI for query planning |
| Agentic Retrieval | Retrieval-tokens (månedlig gratis-kvote, deretter pay-as-you-go), Azure OpenAI for query planning/answer synthesis |
| Groundedness Pro | Per evaluerings-kall (Azure AI Content Safety) |
### Kostnadsoptimering
@ -294,12 +294,12 @@ result = groundedness_eval(
- Modenhetsnivå-tabellen
### Agentic Retrieval — Citation Tracking (oppdatert 2026-04)
### Agentic Retrieval — Citation Tracking (oppdatert 2026-06-19)
Azure AI Search agentic retrieval (preview) returnerer et tre-delt svar som gjør citation tracking robust:
Azure AI Search agentic retrieval (grounding-overflaten GA via REST `2026-04-01`; LLM query planning/answer synthesis/multi-turn = preview; portal/Foundry preview) returnerer et svar som gjør citation tracking robust:
1. **Merged content** — samlet grounding data for LLM
2. **Source references** — kildereferanser for inspeksjon og citation
3. **Activity plan** — query execution-detaljer (subqueries, sources, parameters)
1. **Merged content** — samlet grounding data for LLM (returneres alltid)
2. **Source references** — kildereferanser for inspeksjon og citation (valgfritt)
3. **Activity log** — query execution-detaljer (subqueries, sources, parameters) (valgfritt)
Agentic retrieval bruker LLM til å rive ned komplekse queries til subqueries som kjøres parallelt, med semantisk reranking av hvert delresultat. Dette gir bedre grounding data enn klassisk RAG for komplekse spørsmål. Source references med full provenance tracking støtter transparenskrav i norsk offentlig sektor.