docs(architect): weekly KB update — 66 files refreshed (2026-04)
Updated 66 stale knowledge base reference files (10 critical, 56 high) across all 5 skills using Microsoft Learn MCP research. Key factual updates: - Groundedness Detection API: `correction` → `mitigating` param, `correctedText` → `correctionText` (breaking change) - Copilot Studio: GPT-4.1 mini now default (was GPT-4o mini); Claude Sonnet 4.5 + Opus 4.5 added (experimental, 200K ctx) - Agentic Retrieval: still public preview; 50M free tokens/month - Azure security baselines: "Cognitive Services" → "Foundry Tools" - Databricks: Delta Live Tables → Lakeflow Spark Declarative Pipelines - MLflow 3 GenAI: new Feedback/Expectation data model - Token tracking doc: "Azure OpenAI in Foundry Models through a gateway" - Agent Registry: Risks column (M365 E7), Graph API (preview) - Copilot DLP: new Entra AI Admin + Purview Data Security AI Admin roles - ISO/IEC 42001: scope expanded to M365 Copilot, Foundry, Security Copilot - Zero Trust: CAE now via Conditional Access, Strict Location Enforcement - Purview: new Fabric Copilots/agents governance section - AG-UI HITL: ApprovalRequiredAIFunction (C#), @tool approval_mode (Python) All files: Last updated → 2026-04, *(Verified MCP 2026-04)* markers added. Build registry: 1341 URLs from 387 files (+2 new URLs). Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
This commit is contained in:
parent
f72592ebf3
commit
565043dbde
73 changed files with 727 additions and 301 deletions
|
|
@ -1,7 +1,7 @@
|
|||
# AI Prompt Shield — Nettverksnivå Prompt Injection-beskyttelse
|
||||
|
||||
**Kategori:** AI Security Engineering
|
||||
**Sist oppdatert:** 2026-02
|
||||
**Sist oppdatert:** 2026-04
|
||||
**Målgruppe:** Arkitekter som skal beskytte AI-systemer mot prompt injection og jailbreak-angrep
|
||||
**Status:** To separate produkter — Content Safety Prompt Shields (GA), AI Gateway Prompt Shield (Preview)
|
||||
|
||||
|
|
@ -233,10 +233,18 @@ Azure API Management kan fungere som AI-gateway med innebygd Content Safety-inte
|
|||
</policies>
|
||||
```
|
||||
|
||||
*(Verified MCP 2026-04)*
|
||||
- `shield-prompt="true"` aktiverer prompt injection-deteksjon
|
||||
- `threshold` (0-7): Alvorlighetsgrense — requests med score ≥ threshold blokkeres
|
||||
- Blokkerte requests returnerer `403 Forbidden`
|
||||
- `enforce-on-completions="true"` (ny): Bruk i inbound-seksjonen for å også sjekke LLM-responser (chat completions), ikke bare requests
|
||||
- `window-size` (ny): Konfigurer størrelse på tekstvinduer (tegn) for responssjekk — default 10 000 tegn (Azure AI Content Safety-grensen)
|
||||
- `window-overlap-size` (ny): Overlapp mellom tekstvinduene ved splitting av lange svar
|
||||
- `threshold` (0-7): Alvorlighetsgrense — requests med score ≥ threshold blokkeres (0=mest restriktiv, 7=minst restriktiv)
|
||||
- `output-type`: `FourSeverityLevels` (0,2,4,6) eller `EightSeverityLevels` (0-7)
|
||||
- Blokkerte requests returnerer `403 Forbidden`; ved streaming-responser stoppes eventsending uten 403
|
||||
- Krever et APIM backend-objekt konfigurert mot Content Safety-endepunktet med Managed Identity (`Cognitive Services User`-rolle)
|
||||
- Kan settes i både `inbound`- og `outbound`-seksjonen — bruk `outbound` for å validere LLM-svar
|
||||
- Støttede kategorier: `Hate`, `SelfHarm`, `Sexual`, `Violence`
|
||||
- Støtter også `<blocklists>` med Content Safety-blocklist-IDer for custom blokkeringslister *(Verified MCP 2026-04)*
|
||||
|
||||
**Arkitektur:**
|
||||
|
||||
|
|
@ -266,12 +274,14 @@ Groundedness Detection er en separat funksjon i Azure AI Content Safety som adre
|
|||
| **Prompt Shields** | Ondsinnet input | Innkommende request |
|
||||
| **Groundedness Detection** | Ugrunnede/hallusinerte svar | Utgående response |
|
||||
|
||||
**Groundedness Detection:**
|
||||
**Groundedness Detection:** *(Verified MCP 2026-04)*
|
||||
- Verifiserer at LLM-responsen er forankret i de kildedokumentene brukeren har oppgitt
|
||||
- Detekterer responser som inneholder informasjon som ikke finnes i kildematerialet
|
||||
- Støtter QnA-oppgaver og oppsummering
|
||||
- Inkluderer `correctionFeature` som automatisk korrigerer ugrunnede påstander
|
||||
- Støtter QnA-oppgaver og oppsummering; `domain`-valg: `MEDICAL` eller `GENERIC`
|
||||
- **To deteksjonsmodi:** Non-Reasoning (rask, binært grundet/ugrundet) og Reasoning (detaljerte forklaringer — bruk under utvikling/debugging)
|
||||
- **Groundedness Correction (preview):** Automatisk korrigering av ugrunnede påstander basert på grounding sources — returnerer `correctedText`-felt
|
||||
- Krever at kildemateriale sendes inn som `groundingSources` i API-kallet
|
||||
- **Begrensning:** Kun engelsk tekst støttes (accuracy-optimalisering); for norsk tekst reduseres presisjon *(Verified MCP 2026-04)*
|
||||
|
||||
**Eksempel API-kall:**
|
||||
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue