chore(ms-ai-architect): refresh KB medium-bucket — 74 files [skip-docs]

KB-currency refresh (medium priority, 2026-06-19) via /architect:kb-update.
74 medium-prioritets filer re-verifisert mot Microsoft Learn (MCP) — delegert
til 15 parallelle Opus-subagenter (3 bølger) gruppert etter delt kilde, med
disjunkte fil-sett. Verifisert i hovedkontekst (scope-sjekk + diff-review av
de faktatunge gruppene + tester).

Hovedendringer (faktuelle korreksjoner + currency):
- Azure AI Search semantic ranker: TILGJENGELIG PÅ ALLE TIERS (også Free/Basic
  m/ gratis månedlig kvote) — gammel KB sa feilaktig "kun S1+". Korrigert i
  tier-tabell, anti-patterns og beslutningstabell (azure-ai-search-setup).
- APIM score-threshold = DISTANSE (lavere = strengere): tuning-tabellen i
  rag-caching-optimization hadde retningen baklengs — invertert til korrekt.
- Agentic retrieval GA/preview-nyanse presisert (hovedkontekst-korreksjon mot
  agentic-retrieval-how-to-migrate): GA via REST 2026-04-01 returnerer EKSTRAKTIV
  grounding (references + activity), IKKE syntetiserte svar. Answer synthesis,
  ikke-minimal reasoning effort (LLM query planning) og multi-turn messages
  forblir preview (2026-05-01-preview). Subagent hadde overforenklet til "hele
  kjernepipelinen GA"; rettet i agentic-rag-patterns + citation-tracking.
- Copilot Studio modell-tabeller (platforms/copilot-studio): fjernet Claude Opus
  4.5 + GPT-5.2 (borte fra kilde), lagt til Claude Sonnet 4.6/Opus 4.6 (GA),
  Opus 4.7 + Mistral Medium 3.5 (experimental); GPT-5 Reasoning/Auto = preview;
  A2A GA (apr 2026).
- Computer Use (CUA): Copilot Studio GA 2026-05-07; 4 modeller m/ tier/status
  (OpenAI CUA + Sonnet 4.5 GA, Sonnet 4.6 + Opus 4.6 experimental); 5 credits/
  steg standard, 15 premium; US-only region-krav FJERNET i GA-dok; Cloud PC pool
  + Hosted browser + bring-your-own-machine.
- Azure AI Search REST API-versjoner bumpet: 2025-09-01 -> 2026-04-01 (stabil),
  2025-11-01-preview -> 2026-05-01-preview (hybrid-search, rag-security-rbac,
  chunking).
- Power Automate-integrasjon: trigger "Run a flow from Copilot" -> "When an agent
  calls the flow"; App Service innebygd MCP (preview) lagt til.
- M365 Copilot-manifest v1.26 -> v1.28 (GA, mai) / v1.29 dokumentert (juni);
  "Tenant graph grounding" -> "Work IQ".
- Speech fast transcription 2t/300MB -> 5t/500MB; multilingual 14 -> 15 locales
  (+ pt-BR). Content Understanding reasoning preview -> GA (v1.0, 2025-11-01).
- Security Copilot E5 -> E5+E7. Død Databricks-URL ci-cd/best-practices ->
  ci-cd/flows. Prompt Flow retirement (2027-04-20 -> MAF) notert der den
  presenteres som go-forward. Gateway-topologi-tabell-feil rettet.
- Alle 74 Last updated -> 2026-06-19.

Discovery ikke kjørt (historisk kun Databricks-støy) -> 389-telling uendret,
ingen resync. validate 239 PASS, kb-integrity 115/115 (262 orphan-warnings
uendret), gitleaks clean.

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01REiKFhP4w6xGXXqWKpPCJJ
This commit is contained in:
Kjell Tore Guttormsen 2026-06-19 14:02:18 +02:00
commit 070141f06b
74 changed files with 403 additions and 384 deletions

View file

@ -1,6 +1,6 @@
# Azure AI Search - Configuration and Deployment
**Last updated:** 2026-04 | Verified: MCP 2026-04
**Last updated:** 2026-06-19 | Verified: MCP 2026-06-19
**Status:** GA
**Category:** RAG Architecture & Semantic Search
@ -20,23 +20,23 @@ For offentlig sektor er Azure AI Search spesielt relevant fordi den støtter dat
| Tier | Bruksområde | Maks dokumenter | Maks indekser | Semantic Ranker | Vector Search | Estimert kostnad (NOK/mnd) |
|------|-------------|-----------------|---------------|-----------------|---------------|----------------------------|
| **Free** | Prototyping | 10 000 | 3 | Nei | Begrenset | Gratis (0) |
| **Basic** | Små prod-miljøer | 15M | 15 | Nei | Ja | ~800 |
| **Free** | Prototyping | 10 000 | 3 | Ja (gratis kvote, ikke anbefalt for store workloads) | Begrenset | Gratis (0) |
| **Basic** | Små prod-miljøer | 15M | 15 | Ja | Ja | ~800 |
| **Standard (S1)** | Mid-tier prod | 60M per partition | 50 | Ja | Ja | ~4 000 |
| **Standard (S2)** | Høy-volum prod | 120M per partition | 200 | Ja | Ja | ~8 000 |
| **Standard (S3)** | Enterprise-scale | 240M per partition | 200 | Ja | Ja | ~16 000 |
| **Storage Optimized (L1/L2)** | Arkivering, cold search | 120M/240M per partition | 10 | Nei | Ja | ~11 000 / ~22 000 |
| **Storage Optimized (L1/L2)** | Arkivering, cold search | 120M/240M per partition | 10 | Ja | Ja | ~11 000 / ~22 000 |
**Viktige egenskaper:**
- **Partitions:** Øker lagringskapasitet og parallellitet (horizontal scaling)
- **Replicas:** Øker throughput og tilgjengelighet (query load balancing)
- **SLA:** 99.9% for 2+ replicas (query), 99.9% for 3+ replicas (indexing + query)
- **Semantic Ranker:** Kun Standard og høyere (S1+)
- **Private Link:** Standard (S1+), Storage Optimized
- **SLA:** 99.9% for 2+ replicas (query), 99.9% for 3+ replicas (indexing + query). Basic kan møte SLA-krav med opptil 3 replicas.
- **Semantic Ranker:** Tilgjengelig på alle tiers (også Free) — gratis månedlig kvote (default) + standard pay-as-you-go-plan ved bruk utover kvoten. Premium-feature billet per bruk; ikke anbefalt på Free for store workloads.
- **Private Link (inbound):** Ikke på Free. Indexer-utgående tilkoblinger med skillsets støttes ikke på Free, Basic, S1 eller S3 HD.
> **SKU-oppdatering 2026-04:** Search services opprettet etter 3. april 2024 har større partisjoner og høyere vector kvoter på nesten alle tiers. Basic støtter 3 replicas for SLA. Standard (S1-S3) er standard valg. S3 HD er hosting mode for mange små indekser (multitenancy). Storage Optimized (L1/L2) gir lavere pris/TB for sjeldent oppdaterte, store indekser — med høyere query latency. Tier-bytte er nå mulig mellom Basic og Standard (S1/S2/S3) uten å gjenoppbygge indeksen fra scratch i mange tilfeller.
> **SKU-oppdatering 2026-06:** Search services opprettet etter april 2024 (med en andre bølge i mai 2024) i utvalgte regioner har større partisjoner og høyere vector-kvoter på samme billing-rate. Basic støtter opptil 3 replicas for SLA. Standard (S1-S3) er default-valget. S3 HD er en hosting mode for mange små indekser (multitenancy), med samme per-enhet-kostnad som S3. Storage Optimized (L1/L2) gir lavere pris/TB for sjeldent oppdaterte, store indekser — med høyere query latency. Tier-bytte (in-place) støttes mellom Basic og Standard (S1/S2/S3), forutsatt at gjeldende konfigurasjon ikke overstiger målet-tierens grenser og regionen ikke har kapasitetsbegrensninger. Bytte til/fra andre tiers (Free, L1/L2, S3 HD) krever ny service + migrering av innhold. **Serverless (Developer)** er en ny consumption-basert prismodell i Public Preview (CU/h + GB/mnd), kun i utvalgte regioner — støtter ikke migrering til/fra andre tiers.
### Indekseringsstrategier
@ -188,7 +188,7 @@ Azure AI Search støtter tre indekseringsmodeller:
|------|------------|-------------------|
| "Vi trenger S3 for å være sikre" | 4x kostnad vs. S1 uten reell gevinst | Start med S1, skaler opp ved faktisk behov |
| Bruke 1 replica i prod | Ingen SLA, downtime ved maintenance | Alltid 2+ replicas for prod (query SLA) |
| Bruke Basic tier for RAG | Ingen semantic ranker → dårlig relevance | S1 minimum for RAG med semantic ranker |
| Anta at Basic mangler semantic ranker | Feilaktig nedprioritering av relevans | Basic støtter semantic ranker; velg S1+ for prod-skala/SLA, ikke for å få selve feature-en |
| Ignorere partition-grense | Query-timeout ved >60M docs på S1 | Øk partitions, ikke bare replicas |
| Push API uten rate limiting | Throttling (429 errors) | Bruk batch indexing eller indexer-pipeline |
@ -198,7 +198,7 @@ Azure AI Search støtter tre indekseringsmodeller:
2. **"Vi skal indeksere 500M dokumenter":** S3 HD (high density) eller vurder sharding til flere services.
3. **"Vi vil ha vector search uten full-text":** Mulig, men dårlig idé — hybrid search er nesten alltid bedre.
4. **"Vi trenger real-time sync (<1 sek)":** Push API mulig, men komplekst. Vurder om eventual consistency (5-10 sek) er akseptabelt.
5. **"Kan vi bruke Free tier i prod?":** Nei. Ingen SLA, maksimalt 10K docs, ingen semantic ranker.
5. **"Kan vi bruke Free tier i prod?":** Nei. Ingen SLA, maksimalt 10K docs, delte ressurser (semantic ranker kjører, men ikke anbefalt for store workloads), kun én Free-service per subscription.
## Integrasjon med Microsoft-stakken
@ -417,9 +417,9 @@ Azure AI Search prises per **search unit** (SU = 1 partition × 1 replica).
- 1 replica = ingen SLA (maintenance = downtime)
- Prod krever minimum 2 replicas (query) eller 3 replicas (indexing + query)
3. **Bruke Basic tier med semantic ranker-forventning:**
- Basic støtter ikke semantic ranker
- S1 er minimum for RAG med god relevance
3. **Velge tier kun ut fra semantic ranker-tilgang:**
- Semantic ranker er tilgjengelig på alle tiers (også Basic og Free)
- Velg S1+ ut fra dokumentvolum, query-throughput og SLA — ikke for å låse opp semantic ranker
4. **Push API uten retry logic:**
- AI Search throttler ved >1000 docs/batch
@ -470,7 +470,7 @@ Azure AI Search prises per **search unit** (SU = 1 partition × 1 replica).
**For Cosmo:** Denne referansen brukes når kunden snakker om "RAG-implementasjon", "søkeløsning", "Azure AI Search setup", eller spør om SKU-valg. Kombiner med **RAG Core Patterns** for arkitekturveiledning og **Hybrid Search - Full-Text and Vector Combined** for query-optimalisering.
### Hybrid Search (oppdatert 2026-04)
### Hybrid Search (oppdatert 2026-06)
Hybrid search kombinerer full-text search og vector search i én enkelt forespørsel mot en søkeindeks med både tekstlig og vektorisert innhold:
- Kjører full-text og vector search **parallelt**