feat(ms-ai-architect): Spor 1 — Port-1-substrat migrert på 4 ikke-advisor-skills (243 Source + 327 Type + 325 TOC + stale-verified poison fjernet) [skip-docs]
Steg 9 (R4): unified migrate-corpus.mjs --write over engineering/governance/ infrastructure/security. 327 filer mutert, verified=null, prosa byte-identisk (fra første ## seksjon), advisor urørt (0 endringer). To applier-fixes oppdaget under kjøring (TDD, RED→GREEN): - insertHeaderFields: anker faller nå tilbake når en meta-linje selv passerer 500B (2 filer pakket et avsnitt i **Status:** → Type/Source landet utenfor scan-vinduet, applierens post-write-assertion fanget + restaurerte). - normalizeStaleVerified: fjerner nå ALLE stale non-date **Verified:** i 500B-vinduet, inkl. stray body-dup rett under --- (9 mlops-genaiops-filer var ellers falskt "verified"/fresh, droppet fra worklist). Operatør-godkjent utvidelse av carve-out; kun stray metadata-linjer, aldri prosa. test-transform-criterion: precondition oppdatert til post-migrasjons-sannhet (fila bærer nå Source). Suite 728/728 grønn.
This commit is contained in:
parent
ed92d65385
commit
ddce43d8b2
330 changed files with 4643 additions and 83 deletions
|
|
@ -3,9 +3,21 @@
|
|||
**Sist oppdatert:** 2026-02 (v1.0)
|
||||
**Status:** Gjeldende
|
||||
**Category:** Norwegian Public Sector AI Governance
|
||||
**Type:** reference
|
||||
|
||||
---
|
||||
|
||||
## Innhold
|
||||
|
||||
- [Introduksjon](#introduksjon)
|
||||
- [1. Embedding-modell-sammenligning for norsk](#1-embedding-modell-sammenligning-for-norsk)
|
||||
- [2. Benchmark-referanser for norsk NLP](#2-benchmark-referanser-for-norsk-nlp)
|
||||
- [3. LLM norsk-kvalitet med fagterminologi](#3-llm-norsk-kvalitet-med-fagterminologi)
|
||||
- [4. Chunking for norsk morfologi](#4-chunking-for-norsk-morfologi)
|
||||
- [5. Pilottest-anbefaling](#5-pilottest-anbefaling)
|
||||
- [Norske NLP-ressurser og forskningsmiljøer](#norske-nlp-ressurser-og-forskningsmiljøer)
|
||||
- [For Cosmo Skyberg](#for-cosmo-skyberg)
|
||||
|
||||
## Introduksjon
|
||||
|
||||
Når en arkitekturvurdering hevder at "GPT-4o håndterer norsk godt", trenger vi et evidensrammeverk for å validere påstanden. Denne filen dokumenterer tilgjengelige benchmarks, embedding-modeller og kvalitetsvurderinger for norsk NLP, med fokus på modeller tilgjengelige via Azure OpenAI og Microsoft-stakken.
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue