Ny testet primitiv transform.insertMetaField (anker + 500B-back-off som insertHeaderFields, idempotent på eksakt label, body byte-identisk; 6 tester) + backfill-category.mjs (deterministisk folder->category-regel, hard per-fil-invariant, insert-only, aborterer for skriving ved avvik). Fordeling: 14 Solution Architecture & Advisory (architecture/), 6 Microsoft AI Platforms (platforms/+development/), 4 Responsible AI & Governance, 1 MLOps & GenAIOps. Label = engelsk Category (322 vs 42 Kategori). Eksisterende recommended-mcp-servers/rag-maturity-model urort. Roadmap: R20 done + R21 (Status/Last-updated not-due) encoded. Verifisering: 0 kategorislose filer (var 25); diff +25/-0; idempotent re-run; suite 764/764 exit 0.
26 KiB
Azure AI Modellkatalog 2026 — Oversikt og valgveiledning
Last updated: 2026-06-18 (live-verifisert mot Microsoft Learn region-tabeller) Status: Aktiv — dekker modeller i Microsoft Foundry per 2026-06; Norway East-tilgjengelighet verifisert per deployment-type mot «Region availability for Foundry Models sold by Azure» Category: Microsoft AI Platforms
Oversikt
Microsoft Foundry (tidligere Azure AI Foundry) har per 2026 (Microsoft-oppgitte tall):
- 1 900+ frontier-modeller solgt direkte av Azure
- 11 000+ totalt i katalogen (inkl. partner og community)
- 40+ Azure-regioner
Modellkatalogen er delt i to kategorier:
- Foundry Models sold directly by Azure (azure-openai) — OpenAI-serien (GPT-5, GPT-4.1, o-serien)
- Foundry Models sold directly by Azure (azure-direct-others) — DeepSeek, Meta, Mistral, xAI, Cohere mfl.
1. GPT-5-serien (GA august 2025)
OpenAIs flaggskip reasoning-modeller. Alle versjonene støtter Chat Completions API, Responses API, structured outputs, text/image input og parallel tool calling.
Tilgangsmodell:
gpt-5,gpt-5-codex,gpt-5-pro— åpen tilgang (tilgang ikke lenger begrenset; verifisert mot Microsoft Learn 2026-06)gpt-5-mini,gpt-5-nano,gpt-5-chat— åpen tilgang, ingen registreringgpt-5.5— enkelte quota-tiers krever quota-forespørsel (Tier 5/6 har quota by default)
| Modell | GA-dato | Kontekstvindu | Max output | Merknad |
|---|---|---|---|---|
gpt-5 |
2025-08-07 | 400K (input 272K, output 128K) | 128K | Flagship, sterkest reasoning. PTU: 4 750 input TPM/PTU |
gpt-5-mini |
2025-08-07 | 400K (input 272K, output 128K) | 128K | Kostnadsoptimalisert. PTU: 23 750 input TPM/PTU |
gpt-5-nano |
2025-08-07 | 400K (input 272K, output 128K) | 128K | On-device/edge, lavest pris |
gpt-5-chat |
2025-08-07 (Preview) | 128K | 16 384 | Conversation-optimalisert, emosjonell intelligens |
gpt-5-codex |
2025-09-11 | 400K (input 272K, output 128K) | 128K | Kodeoptimalisert (Codex CLI/VS Code) |
gpt-5-pro |
2025-10-06 | 400K (input 272K, output 128K) | 128K | Høyeste kapabilitet |
gpt-5.1 |
2025-11-13 | 400K (input 272K, output 128K) | 128K | + gpt-5.1-codex, gpt-5.1-codex-mini |
gpt-5.2 |
2025-12-11 | 400K (input 272K, output 128K) | 128K | + gpt-5.2-codex, gpt-5.2-chat (preview) |
gpt-5.3-codex |
2026-02-24 | 400K (input 272K, output 128K) | 128K | Kun -codex/-chat-varianter — ingen bar gpt-5.3 finnes |
gpt-5.3-chat |
2026-03-03 (Preview) | 128K (input 111K) | 16 384 | Conversation-variant |
gpt-5.4 |
2026-03-05 | 1 050 000 | 128K | Kontekstsprang til ~1M; computer use. + -mini/-nano (2026-03-17) |
gpt-5.4-pro |
2026-03-05 | 1 050 000 | 128K | Høyeste kapabilitet (ikke lenger restricted) |
gpt-5.5 |
2026-04-24 | 1 050 000 (input 922K) | 128K | Treningsdata des. 2025; Data Zone i Norway East (sammen med gpt-5.4) |
gpt-chat-latest |
2026-05-28 (Preview) | 128K (input 111K) | 16 384 | «GPT-5.5 Instant» (OpenAI chat-latest); kun Global Standard |
PTU-ratio for GPT-5: 1 output token teller som 8 input tokens mot utnyttelsesgrensen.
Merk kontekstsprang:
gpt-5/5.1/5.2har 400K kontekst (272K input).gpt-5.4/5.5hopper til ~1,05M kontekst.gpt-5.5har 922K input.
Styrker:
- Dyp reasoning og multi-step logikk
- Bedre enn GPT-4.1 på komplekse oppgaver, vitenskap, koding og matematikk
- Høyere latens enn GPT-4.1 (pga. dypere resonneringsprosess)
2. GPT-4.1-serien (GA april 2025)
Optimalisert for høy hastighet, høy throughput og enterprise-skalering. Ingen reasoning-overhead — rask og forutsigbar.
| Modell | GA-dato | Kontekstvindu | Max output | Merknad |
|---|---|---|---|---|
gpt-4.1 |
2025-04-14 | 1 047 576 (standard), 128K (PTU), 300K (batch) | 32 768 | Lengst kontekst, 4:1 input/output PTU-ratio |
gpt-4.1-mini |
2025-04-14 | 1 047 576 | 32 768 | Balansert pris/ytelse |
gpt-4.1-nano |
2025-04-14 | 1 047 576 | 32 768 | Lavest pris, 59 400 input TPM/PTU |
PTU-ratio for GPT-4.1: 1 output token teller som 4 input tokens.
Styrker:
- Ekstremt lang kontekst (1M tokens)
- Lav latens, høy throughput
- Ideell for real-time chat, kundesupport, høyvolum summarisering
- Code og instruction following — bedre enn GPT-4o
Sammenligning GPT-5 vs GPT-4.1:
| Dimensjon | GPT-5 | GPT-4.1 |
|---|---|---|
| Modelltype | Reasoning | Non-reasoning, rask |
| Best for | Kompleks reasoning, flersteg logikk | Real-time chat, faktaspørsmål, høyvolum |
| Latens | Høyere | Lavere |
| Throughput | Moderat | Høy |
| Kontekst | 272K input, 128K output | Opp til 1M tokens |
3. o-serien — Reasoning Models
Spesialiserte reasoning-modeller som bruker mer tid på å forstå brukerens forespørsel. Sterkest på vitenskap, koding og matematikk.
| Modell | GA-dato | Kontekstvindu | Max output | Merknad |
|---|---|---|---|---|
o4-mini |
2025-04-16 | 200K input | 100K output | Kostnadseffektiv reasoning, image-støtte. PTU: 5 400 input TPM/PTU |
o3 |
2025-04-16 | 200K input | 100K output | Sterk reasoning + image. PTU: 3 000 input TPM/PTU |
o3-pro |
2025-06-10 | 200K input | 100K output | Maksimal reasoning, anbefales background mode |
o3-mini |
2025-01-31 | 200K input | 100K output | Text-only, raskere enn o3 |
o1 |
2024-12-17 | 200K input | 100K output | Etablert reasoning + image |
codex-mini |
2025-05-16 | 200K input | 100K output | Fine-tunet o4-mini for koding |
API-karakteristikker:
- Bruker
max_completion_tokens(Chat Completions API) ellermax_output_tokens(Responses API) - Støtter IKKE
temperature,top_p,presence_penalty,frequency_penalty - Streaming for
o3er begrenset tilgang
4. DeepSeek-modeller
Open source-modeller tilgjengelig som "Foundry Models sold directly by Azure". Alle støtter Global Standard deployment i alle regioner.
| Modell | Type | Kontekst | Tool calling | Merknad |
|---|---|---|---|---|
DeepSeek-R1 |
Reasoning | 163 840 tokens | Nei | Sterk på reasoning + koding |
DeepSeek-R1-0528 |
Reasoning | 163 840 tokens | Nei | Oppdatert versjon |
DeepSeek-V3-0324 |
MoE chat | 131 072 tokens | Ja | Mixture-of-Experts |
DeepSeek-V3.1 |
MoE chat | 131 072 tokens | Ja | Oppdatert MoE |
DeepSeek-V3.2 |
MoE reasoning | 128 000 tokens | Nei | Nyeste versjon |
MAI-DS-R1 |
Reasoning | 163 840 tokens | Nei | Microsofts variant av DeepSeek-R1 |
PTU for DeepSeek: 4 000 input TPM/PTU (DeepSeek-R1, V3-0324, R1-0528).
Norway East: Alle DeepSeek-modeller er tilgjengelig i Norway East via Global Standard deployment.
Viktig: DeepSeek-R1 støtter ikke tool calling — bytt til V3-0324 eller V3.1 hvis tool use trengs.
5. Phi-serien (Small Language Models)
Microsofts egne SLM-er (Small Language Models), optimalisert for effektiv inferens med begrenset ressursbruk.
| Modell | Kontekst | Modalitet | Tool calling | Merknad |
|---|---|---|---|---|
Phi-4 |
16 384 tokens | Text | Nei | Generell SLM, bred språkdekning (46 språk) |
Phi-4-mini-instruct |
131 072 tokens | Text | Nei | Liten og rask, brukt i MS Edge |
Phi-4-multimodal-instruct |
131 072 tokens | Text + bilde + lyd | Nei | Multimodal SLM |
Phi-4-reasoning |
32 768 tokens | Text | Nei | Reasoning-variant |
Phi-4-mini-reasoning |
128 000 tokens | Text | Nei | Kompakt reasoning |
Bruksscenarioer:
- On-device / Foundry Local inference (Phi-4-mini-instruct er optimalisert for ONNX)
- Lav kostnad, høy throughput
- Edge og offline-scenarioer
- Ikke egnet for komplekse multi-step reasoning
6. Andre bemerkelsesverdige modeller
Meta Llama
| Modell | Kontekst | Merknad |
|---|---|---|
Llama-4-Maverick-17B-128E-Instruct-FP8 |
1M tokens | Multimodal (text + bilde), 17B aktive parametere (128 eksperter MoE) |
Llama-3.3-70B-Instruct |
128 000 tokens (output: 8 192) | Solid general-purpose, åpen kildekode. PTU: 8 450 input TPM/PTU |
Mistral
| Modell | Type | Merknad |
|---|---|---|
Mistral-Large-3 |
Chat (text + bilde) | Tool calling støttet, kun West US 3 |
mistral-document-ai-2505/2512 |
Image-to-Text | PDF/bilde til strukturert tekst, alle regioner |
Cohere
| Modell | Merknad |
|---|---|
Cohere-command-a |
Sterk på RAG og enterprise-søk |
Cohere-rerank-v4.0-pro/fast |
Re-ranking for søkepipeliner |
embed-v-4-0 |
Embedding-modell |
xAI Grok
| Modell | Merknad |
|---|---|
grok-4 |
Frontiermodell, alle regioner inkl. Norway East |
grok-3, grok-3-mini |
Eldre versjon |
OpenAI spesialmodeller (open-weight, video, bilde)
| Modell | Type | Kontekst | Tilgjengelighet | Merknad |
|---|---|---|---|---|
gpt-oss-120b |
Open-weight reasoning | 131 072 | Global Standard (krever Foundry-prosjekt) + managed compute | Kun tekst; quota 5M TPM / 5K RPM |
gpt-oss-20b |
Open-weight | 131 072 | Managed compute + Foundry Local | Kun tekst; for edge/lokal kjøring |
sora-2 (2025-10-06) |
Video | — | Global Standard — kun Sweden Central (EU) + East US 2 | Ikke i Norway East |
gpt-image-2 (2026-04-21) |
Bilde | — | Global Standard — Poland Central + Sweden Central (EU) | Ikke i Norway East; gpt-image-1.5 (2025-12-16) finnes også |
7. Modellsammenligningstabell
| Modell | Kontekst (input) | Max output | PTU: input TPM/PTU | Latency target (99%) | Norway East — residens | Tilgang |
|---|---|---|---|---|---|---|
gpt-5 |
272K | 128K | 4 750 | >50 TPS | Kun Global | Åpen |
gpt-5-mini |
272K | 128K | 23 750 | >80 TPS | Kun Global | Åpen |
gpt-5-nano |
272K | 128K | Høy | >100 TPS | Kun Global Std | Åpen |
gpt-5.5 |
922K | 128K | — | — | Data Zone (EU) + Global Prov | Quota-tier |
gpt-4.1 |
1M | 32 768 | 3 000 | >40 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
gpt-4.1-mini |
1M | 32 768 | 14 900 | >50 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
gpt-4.1-nano |
1M | 32 768 | 59 400 | >60 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
gpt-4o |
128K | 16 384 | — | — | ✅ Norge-resident (Standard + Regional PTU) | Åpen |
gpt-4o-mini |
128K | 16 384 | — | — | ✅ Norge-resident (Regional PTU) | Åpen |
o4-mini |
200K | 100K | 5 400 | >66 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
o3 |
200K | 100K | 3 000 | >40 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
o3-mini |
200K | 100K | 2 500 | >66 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
o1 |
200K | 100K | 230 | >25 TPS | ⚠️ Kun Global (ikke resident) | Åpen |
DeepSeek-R1 |
163K | 163K | 4 000 | >50 TPS | Kun Global Std | Åpen |
DeepSeek-V3-0324 |
131K | 131K | 4 000 | >50 TPS | Kun Global Std | Åpen |
Llama-3.3-70B-Instruct |
128K | 8 192 | 8 450 | >50 TPS | Kun Global Std | Åpen |
Phi-4-mini-instruct |
131K | 4 096 | — | — | Foundry Local / managed | Åpen |
Phi-4 |
16K | 16K | — | — | Foundry Local / managed | Åpen |
Merk: PTU-tall er fra Microsoft Learn og kan endres. Se Foundry PTU-kalkulator for oppdaterte tall.
«Norway East — residens»-kolonnen angir om data kan holdes Norge-resident. Kun
gpt-4o/gpt-4o-minikan kjøres Norge-resident (Standard/Regional PTU). «Kun Global» = modellen finnes i Norway East, men kun via Global-deployment (data prosesseres globalt). Full deployment-type-matrise i seksjon 9.
8. Prismodeller
Tre hovedmodeller for deployment
| Deploymenttype | Betaling | Dataresidens | SLA | Egnet for |
|---|---|---|---|---|
| Global Standard | Per token (PAYG) | Ingen garanti, data kan rutes globalt | Ja | Testing, variabel last |
| Data Zone Standard | Per token (PAYG) | Innenfor US eller EU | Ja | GDPR-krav, variabel last |
| Regional Provisioned (PTU) | Per PTU per time | Garantert til valgt region | Ja | Produksjon, forutsigbar last |
Pay-as-you-go (PAYG)
Token-basert fakturering. Offisiell prising:
https://azure.microsoft.com/pricing/details/cognitive-services/openai-service/
Generelle prisleier (relativ, ikke eksakt):
| Prisnivå | Modeller | Merknad |
|---|---|---|
| Lavest (nano) | gpt-5-nano, gpt-4.1-nano, Phi-4-mini |
On-device, enkle oppgaver |
| Lav | gpt-4.1-mini, gpt-5-mini, o4-mini, o3-mini |
Høyvolum, enkle til moderate |
| Middels | gpt-4.1, DeepSeek-V3, Llama-3.3-70B |
Generelle enterprise-workloads |
| Høy | gpt-5, o3, o1 |
Komplekse reasoning-oppgaver |
| Høyest | gpt-5-pro, o3-pro, gpt-5.2 |
Maksimal kapabilitet |
Provisioned Throughput (PTU)
Garantert kapasitet med forutsigbar latens. Egnet for:
- Produksjonsworkloads med stabil trafikk
- Latency-sensitive applikasjoner
- Høyvolum pipelines der PAYG-variasjon er et problem
Viktige PTU-parametere:
- Minimum deployment: 15 PTU (global/data zone) eller 25–50 PTU (regional)
- Skaleringsinkrement: 5 PTU (global/data zone) eller 25–50 PTU (regional)
- PTU er modell-agnostisk quota — kan brukes til ulike modeller innen regionen
- PTU kjøpes time-basert. Azure Reservations gir vesentlig rabatt ved langsiktig bruk
Input/output-ratio per modell:
| Modell | 1 output token = N input tokens |
|---|---|
| GPT-5-serien | 8 input tokens |
| GPT-4.1-serien | 4 input tokens |
| DeepSeek-R1/V3 | 4 input tokens |
| Llama-3.3-70B | 4 input tokens (unntak fra standard) |
Fine-tuning-kostnader
Ved bruk av fine-tuned modeller:
- Standard: PAYG + $1,70/time hosting
- Global Standard: PAYG + $1,70/time hosting
- PTU: Per PTU/time (ingen ekstra hosting)
- Developer Tier: PAYG uten hosting, ingen garanti, slettes etter 24 timer
9. Regional tilgjengelighet
Verifisert 2026-06-18 mot Microsoft Learn «Region availability for Foundry Models sold by Azure» (Standard- + Provisioned-pivoter). Avgjørende skille for offentlig sektor: hvor prosesseres data?
- Standard/Regional og Regional Provisioned (PTU) = data prosesseres i regionen (Norge-resident).
- Data Zone (Standard/Provisioned) = data prosesseres innen EU (EU-resident, ikke garantert Norge).
- Global (Standard/Provisioned) = data kan prosesseres i en hvilken som helst Azure-region (ikke resident).
Norway East — tilgjengelighet per deployment-type
| Modell | Norge-resident¹ | EU-sone (Data Zone Std) | Global Std | Global Prov |
|---|---|---|---|---|
gpt-4o (2024-11-20) |
✅ Standard | – | ✅ | ✅ |
gpt-4o (2024-05-13 / 08-06) |
✅ Regional PTU | – | ✅ | ✅ |
gpt-4o-mini |
✅ Regional PTU | – | ✅ | ✅ |
gpt-4.1 / -mini / -nano |
– | – | ✅ | ✅ |
o3, o3-mini, o4-mini, o1 |
– | – | ✅ | ✅ |
o3-deep-research |
– | – | ✅² | – |
gpt-5, gpt-5-mini |
– | – | ✅ | ✅ |
gpt-5-nano |
– | – | ✅ | – |
gpt-5.1 |
– | – | ✅ | ✅ |
gpt-5.2 (+ -codex) |
– | – | ✅ | ✅ |
gpt-5.3-codex |
– | – | ✅ | ✅ |
gpt-5.3-chat |
– | – | ✅ | – |
gpt-5.4 |
– | ✅³ | ✅ | ✅ |
gpt-5.4-mini / -nano |
– | – | ✅ | – |
gpt-5.4-pro |
– | – | – | – |
gpt-5.5 |
– | ✅³ | – | ✅ |
gpt-chat-latest |
– | – | – | – |
sora-2, gpt-image-2, computer-use-preview |
– | – | – | – |
¹ Norge-resident = Standard/Regional eller Regional Provisioned (PTU) i Norway East — prosessering forblir i Norge.
² o3-deep-research finnes i Norway East kun via Global Standard (Norway East + West US er de eneste to regionene globalt) — data prosesseres globalt, ikke resident.
³ gpt-5.4 og gpt-5.5 er de eneste modellene med Data Zone Standard (EU-residens) i Norway East (verifisert 2026-06-29 mot Learn region-tabell, Data Zone standard-pivot, Europa).
Konsekvens (viktig korreksjon 2026-06-18): De eneste generative modellene som kan kjøres Norge-resident i Norway East er gpt-4o og gpt-4o-mini. gpt-4.1, hele o-serien (o3/o4-mini/o3-mini/o1) og hele GPT-5-familien har ingen Standard/Regional- eller Regional-PTU-deployment i Norway East — de kjører kun Global (data globalt), eller for gpt-5.4/gpt-5.5 via Data Zone (EU). I tillegg er text-embedding-3-large, text-embedding-ada-002 og whisper Norge-resident (Standard) i Norway East.
Foundry Models sold directly by Azure (DeepSeek, Llama, Mistral, Grok): tilgjengelig i Norway East kun via Global Standard (data prosesseres globalt) — ikke egnet for dataresidens-krav. Omfatter DeepSeek-R1/R1-0528/V3-0324/V3.1/V3.2, Llama-4-Maverick/Llama-3.3-70B, Grok-4, MAI-DS-R1, mistral-document-ai.
Sweden Central — referanse (full feature-dekning)
Sweden Central har bredest feature-dekning i Norden og er anbefalt for pilot med nyeste modeller. Avgjørende: flere modeller er Sverige-resident (Standard/Regional) i Sweden Central som IKKE er regionale i Norway East — bl.a. gpt-4.1, gpt-4.1-mini, gpt-4o-familien, o1, o4-mini, gpt-5.1. I tillegg (via Global): hele GPT-5-familien, o3/o3-pro, computer-use-preview, sora-2, gpt-image-2, codex-mini, samt DeepSeek/Grok/Llama/Mistral. Merk: gpt-5.5 (Data Zone) og o3-deep-research finnes derimot i Norway East, ikke Sweden Central.
West Europe
Bred dekning via Global Standard/Provisioned (GPT-5-familien, GPT-4.1, o-serien, DeepSeek m.fl.). Som Standard/Regional er kun utvalgte modeller tilgjengelig. For EU-residens: bruk Data Zone-deployments.
Oppsummering: Nordiske regioner — Norge-resident vs. tilgjengelig via Global
| Modell/feature | Norway East | Sweden Central |
|---|---|---|
gpt-4o / gpt-4o-mini — resident |
✅ | ✅ |
gpt-4.1-serien — resident |
❌ (kun Global) | ✅ |
o4-mini — resident |
❌ (kun Global) | ✅ |
o3 — resident |
❌ (kun Global) | ❌ (kun Global) |
| GPT-5-familien — resident | ❌ | delvis (gpt-5.1 Standard) |
gpt-5.4/gpt-5.5 — Data Zone (EU-resident) |
✅ | ❌ |
o3-deep-research (Global) |
✅ | ❌ |
computer-use-preview / sora-2 / gpt-image-2 |
❌ | ✅ (Global) |
| Dataresidens for resident-modeller | Norsk | Svensk |
10. For Cosmo: Modellvalgveiledning
Beslutningsflyt
Er oppgaven enkel (chat, Q&A, summarisering)?
├── Ja, høyvolum og kostnad er kritisk → gpt-4.1-nano / gpt-5-nano
├── Ja, balansert → gpt-4.1-mini / gpt-5-mini / o4-mini
└── Nei, kompleks
Er oppgaven kompleks (reasoning, kode, analyse)?
├── Trenger dyp reasoning + tid til svaret → gpt-5 / o3 / o3-pro
├── Rask reasoning + bilde-input → o4-mini
└── Kode-spesifikk → gpt-5-codex / codex-mini
Har kunden Norway East-krav (dataresidens)?
├── Ja, STRENGT (data må forbli i Norge) → Standard / Regional Provisioned i Norway East
│ Velg: KUN gpt-4o / gpt-4o-mini (+ embeddings, whisper) — eneste Norge-residente generative modeller
│ IKKE Norge-resident: gpt-4.1, o3/o4-mini/o3-mini/o1, HELE GPT-5-familien (kun Global her)
│ Trenger du nyere modell enn gpt-4o? → løs residens i Sweden Central, eller aksepter EU-sone
├── Ja, men EU-sone-residens er akseptabelt (data innen EU, ikke garantert Norge)
│ → gpt-5.4/gpt-5.5 via Data Zone Standard i Norway East (eneste GPT-5-modeller med Data Zone her)
│ eller Sweden Central Standard for gpt-4.1 / o4-mini / gpt-5.1 (Sverige-resident)
│ DeepSeek/øvrige har ingen Data Zone i Norway East → Global Standard (data globalt)
└── Nei (global prosessering OK) → hele GPT-5-familien (5/5.1/5.2/5.3/5.4) via Global Standard/Provisioned,
eller Sweden Central for full feature coverage (computer-use, sora-2, gpt-image-2)
Er kunden offentlig sektor (Schrems II / GDPR)?
├── Ja, strenge krav (Norge-residens) → Standard / Regional Provisioned i Norway East
│ Velg: gpt-4o / gpt-4o-mini — eneste modeller der data forblir i Norge
│ Unngå: Global Standard/Provisioned (data rutes globalt) — gjelder gpt-4.1, o-serien OG hele GPT-5-familien
├── Ja, men EU-residens akseptabelt → gpt-5.5 (Data Zone Norway East) eller Sweden Central-resident modeller
└── Nei → Global Standard er akseptabelt
Trenger kunden open-source/selvhostet-alternativ?
├── Ja, reasoning → DeepSeek-R1 / MAI-DS-R1
├── Ja, chat + tool use → DeepSeek-V3-0324 / Llama-3.3-70B
└── Ja, liten modell (edge/on-device) → Phi-4-mini-instruct / Foundry Local
Hurtigguide per scenario
| Scenario | Anbefalt modell | Begrunnelse |
|---|---|---|
| Intern chatbot, Teams | gpt-4.1-mini | Raskt, billig, godt nok |
| RAG over store dokumenter | gpt-4.1 (1M kontekst) eller gpt-5 | Lang kontekst, god instruction following |
| Juridisk/medisinsk analyse | gpt-5 eller o3 | Dyp reasoning, nøyaktighet |
| Kodegjennomgang / copilot | gpt-5-codex / gpt-4.1 | Kodeoptimalisert |
| Kostnadseffektiv høyvolum | gpt-4.1-nano / gpt-5-nano | Lavest pris, høy throughput |
| Multi-agent orkestrering | gpt-5 / gpt-4.1 (som orkestratormodell) | Sterk instruction following |
| On-device / edge / offline | Phi-4-mini-instruct (Foundry Local) | Kjører lokalt, ingen sky |
| Open-source med reasoning | DeepSeek-R1 / MAI-DS-R1 | Åpen kildekode, sterk reasoning |
| Sammenligning av alternativer | Model Router | Automatisk routing, opp til 60% kostnadsbesparelse |
| DPIA-kritisk (data forblir i Norge) | gpt-4o / gpt-4o-mini + Standard/Regional PTU Norway East | Eneste Norge-residente generative modeller (ikke gpt-4.1/o3/GPT-5) |
| EU-residens OK, vil ha GPT-5 | gpt-5.5 + Data Zone Standard Norway East | Data forblir i EU (ikke garantert Norge) |
Spørsmål å stille kunden
- "Hva er primæroppgaven — chat/søk, analyse, koding eller kreativt innhold?"
- "Hvilke volumforventninger har dere (tokens/måned)?"
- "Er dataresidens et krav, eller er Global Standard akseptabelt?"
- "Trenger dere open-source/selvhostet alternativ av compliance-hensyn?"
- "Er latens kritisk (real-time UI) eller kan modellen tenke seg om (batch/agent)?"
- "Skal modellen kjøre på edge/on-device?"
Norway East-spesifikke råd
- Norge-residens er begrenset til
gpt-4o-familien.gpt-4o(Standard) oggpt-4o/gpt-4o-mini(Regional PTU) er de eneste generative modellene som kan kjøres med data resident i Norge. Bruk Regional PTU for produksjonskritiske residens-workloads. gpt-4.1-serien er IKKE Norge-resident i Norway East — kun Global (data globalt) eller Global PTU. Tidligere antakelse om regional gpt-4.1 her var feil (korrigert 2026-06-18 mot Learn region-tabeller).- o-serien (
o3/o4-mini/o3-mini/o1) er IKKE Norge-resident i Norway East — kun Global. (o4-minifinnes som Standard/Regional i Sweden Central, men ikke Norway East.) - Hele GPT-5-familien er IKKE Norge-resident i Norway East.
gpt-5.5er eneste med Data Zone Standard (EU-residens); resten (gpt-5/5.1/5.2/5.3/5.4) kun Global Standard/Provisioned. - Trenger du nyere modell enn gpt-4o med residens? Aksepter EU-sone (gpt-5.5 Data Zone i Norway East) eller flytt til Sweden Central (Sverige-resident gpt-4.1/o4-mini/gpt-5.1).
- Deep Research (
o3-deep-research) finnes i Norway East, men kun via Global Standard (Norway East + West US er de eneste to regionene) — data prosesseres globalt, ikke resident. - DeepSeek/Llama/Grok i Norway East er kun Global Standard — ikke egnet for strenge dataresidens-krav.
Kilder og verifisering
Adapted from Microsoft Learn documentation (CC BY 4.0):
- Foundry Models sold directly by Azure (azure-openai)
- Region availability for Foundry Models sold by Azure — autoritativ deployment-type × region-matrise (live-verifisert 2026-06-18; grunnlag for seksjon 9)
- Foundry Models sold directly by Azure (azure-direct-others)
- Azure OpenAI in Foundry Models — model overview
- GPT-5 vs GPT-4.1: choosing the right model
- Azure OpenAI reasoning models
- PTU costs and billing
- Foundry Models from partners and community (Phi)
- Azure OpenAI models and regions for Foundry Agent Service
- Azure OpenAI quotas and limits
Content translated to Norwegian, reorganized, and augmented with decision guidance for Norwegian public sector.
Research date: 2026-02; region- og deployment-type-tabeller live-verifisert 2026-06-18