portfolio-optimiser/docs
Kjell Tore Guttormsen c2d150495c docs(deck): begge deck bærer det MÅLTE 1b-utfallet — ærlighet, ikke seier
Den publiserte slide 12 sa ordrett «aldri kjørt mot en levende språkmodell».
Det er usant siden 14.08 (økt 40, betalt kjøring). Rettet i to deck.

Sant nå, og målt: rammeverket HAR kjørt mot en levende modell; hvert
genererings-svar kom tilbake i den bestilte formen; kjøringen KONKLUDERTE.
Fortsatt usant, og BLIR STÅENDE som usant: at et forslag fra en levende
modell har passert regneporten. Den ene kjøringen ble avvist, og
avvisnings-grunnen står ordrett i decket.

Funnet fra §6 er med, fordi det er verdt mer enn den grønne testen:
modellen fant opp en kostkode som ikke finnes i kunnskapsbasen, og porten
stoppet den på BELØPET (30 %-cap-en), ikke på at koden var oppdiktet —
bygg-energi-mikro shipper ingen cost-baseline.json, så S4.0-forankringen
er inaktiv der.

Tre selvrefererende feller unngått:
- kort-decket sa «kjøringstallene i denne presentasjonen er byte-låst
  fasit». Å legge live-tall på siden gjorde den påstanden usann om seg
  selv (Fase 3-klassen) — fotnoten skiller nå demo-tall fra live-tall.
- fagdeckets «Tre forbehold» + «disse tre» er håndskrevne tellinger. Et
  FJERDE kort ville brutt begge (P4s «én av de TO»-klasse) — endringen
  skjer INNI de tre, og statusen ligger i rad-lista som ikke teller.
- fagdeckets «810 tester» er bevisst pinnet til den versjonen tallene
  DER kommer fra, og er urørt. kort-deckets 846/4 delte dato-anker med
  den nye påstanden og MÅTTE flyttes: `uv run pytest` → 869 passed,
  5 skipped (målt før OG etter endringen).

MÅLT I NETTLESER over lokal HTTP, begge temaer via data-theme:
kort slide 12 = 873 px (under 900-taket), fagdeck slide 44/45 = 675/725 px.
Kontrollen økt 27 ba om: 12 av 12 og 44 av 51 DISTINKTE høyder, null
nuller — et sveip som ga like verdier ville bevist ingenting. Slide 21 i
fagdecket måler 901 px, men er URØRT av denne endringen (diffen ligger
i 1057/1081/1083) — pre-eksisterende, ikke innført her.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01EkL7xFeBgYMwDiT8gGgdLm
2026-08-14 20:28:35 +02:00
..
fase1-spikes fix(fase1): spike B fan-out measures real conversation bleed, not a counter 2026-06-24 11:09:55 +02:00
plan docs(P4.5): §0s to målte felt fylt ut — frosset commit X og generalprøve-tidspunkt 2026-08-12 20:16:23 +02:00
rapport docs(i7): reproduserbar grep i statusrapport rad #10/#11 (--exclude selv-referanse) 2026-07-04 23:34:26 +02:00
research docs(research): MAF 1.9.0 capability map — feature-utilization for Fase 2 [skip-docs] 2026-06-24 11:36:26 +02:00
2026-06-24-two-approaches-brief.md docs: plain-text brief — goal + two approaches (MAF vs Claude Agent SDK) + learning goal 2026-06-24 09:21:31 +02:00
2026-06-26-fot-i-bakken.md docs(fot-i-bakken): ground-truth-verifisert levert-vs-lovet — agentiske lag inerte 2026-06-26 15:25:03 +02:00
2026-07-15-foundry-auth-recipe.md docs(1b): Claude på Foundry er en TREDJE klientflate — FoundryChatClient kan ikke binde den 2026-08-13 20:31:36 +02:00
2026-08-13-demo-presentasjon.html docs(deck): begge deck bærer det MÅLTE 1b-utfallet — ærlighet, ikke seier 2026-08-14 20:28:35 +02:00
2026-08-13-fase1a-lokal-ende-til-ende.md docs(fase1a): «uansett modell» hvilte på en måling jeg aldri leste ferdig 2026-08-13 20:19:31 +02:00
2026-08-13-fase4-azure-yaml-valg.md feat(4b): AZURE-profilen leser miljøet sitt, ikke operatørens laptop 2026-08-13 22:27:21 +02:00
2026-08-13-fase4-research-spike.md docs(4·): containeren er bygget — og wheelen er ikke installerbar alene 2026-08-13 21:57:40 +02:00
2026-08-13-presentasjon-ledelse.html docs: presentasjonsmateriellet fra demoen 2026-08-13 2026-08-13 18:45:06 +02:00
2026-08-14-fase1b-forste-levende-kjoring.md fix(1b): regelen gjelder HVER betalt arm - fan-out-testen var fortsatt ugatet [skip-docs] 2026-08-14 20:12:47 +02:00
bestille-en-kjoring.md feat(provenance): a run records which external service it actually called 2026-08-05 21:37:29 +02:00
ekspert-svar.md feat(outbox): every evaluated approach becomes something an expert can judge 2026-08-05 21:12:09 +02:00
extending.md feat(mcp): concrete MCP servers become tools the agents can call during a run 2026-08-05 16:53:07 +02:00
knowledge-base-recipe.md docs(s53): knowledge-base recipe (D-H item 1) — team process, honest 1-2 week expectation, no wizard 2026-07-23 21:53:53 +02:00
kort-presentasjon.html docs(deck): begge deck bærer det MÅLTE 1b-utfallet — ærlighet, ikke seier 2026-08-14 20:28:35 +02:00
review-2026-07.md docs(review): kryssmodell-review 2026-07 (14 funn, 11 detach-bevis) + revidert roadmap + sesjonsplan Fase 2-6 2026-07-10 06:28:11 +02:00