ms-ai-architect/skills/ms-ai-advisor/references/platforms/model-catalog-2026.md
Kjell Tore Guttormsen a583599ab1 feat(ms-ai-architect): R20 — Category-backfill på 25 kategorisløse ref-filer via insertMetaField [skip-docs]
Ny testet primitiv transform.insertMetaField (anker + 500B-back-off som insertHeaderFields, idempotent på eksakt label, body byte-identisk; 6 tester) + backfill-category.mjs (deterministisk folder->category-regel, hard per-fil-invariant, insert-only, aborterer for skriving ved avvik).

Fordeling: 14 Solution Architecture & Advisory (architecture/), 6 Microsoft AI Platforms (platforms/+development/), 4 Responsible AI & Governance, 1 MLOps & GenAIOps. Label = engelsk Category (322 vs 42 Kategori). Eksisterende recommended-mcp-servers/rag-maturity-model urort.

Roadmap: R20 done + R21 (Status/Last-updated not-due) encoded. Verifisering: 0 kategorislose filer (var 25); diff +25/-0; idempotent re-run; suite 764/764 exit 0.
2026-07-06 07:39:54 +02:00

26 KiB
Raw Blame History

Azure AI Modellkatalog 2026 — Oversikt og valgveiledning

Last updated: 2026-06-18 (live-verifisert mot Microsoft Learn region-tabeller) Status: Aktiv — dekker modeller i Microsoft Foundry per 2026-06; Norway East-tilgjengelighet verifisert per deployment-type mot «Region availability for Foundry Models sold by Azure» Category: Microsoft AI Platforms


Oversikt

Microsoft Foundry (tidligere Azure AI Foundry) har per 2026 (Microsoft-oppgitte tall):

  • 1 900+ frontier-modeller solgt direkte av Azure
  • 11 000+ totalt i katalogen (inkl. partner og community)
  • 40+ Azure-regioner

Modellkatalogen er delt i to kategorier:

  1. Foundry Models sold directly by Azure (azure-openai) — OpenAI-serien (GPT-5, GPT-4.1, o-serien)
  2. Foundry Models sold directly by Azure (azure-direct-others) — DeepSeek, Meta, Mistral, xAI, Cohere mfl.

1. GPT-5-serien (GA august 2025)

OpenAIs flaggskip reasoning-modeller. Alle versjonene støtter Chat Completions API, Responses API, structured outputs, text/image input og parallel tool calling.

Tilgangsmodell:

  • gpt-5, gpt-5-codex, gpt-5-pro — åpen tilgang (tilgang ikke lenger begrenset; verifisert mot Microsoft Learn 2026-06)
  • gpt-5-mini, gpt-5-nano, gpt-5-chat — åpen tilgang, ingen registrering
  • gpt-5.5 — enkelte quota-tiers krever quota-forespørsel (Tier 5/6 har quota by default)
Modell GA-dato Kontekstvindu Max output Merknad
gpt-5 2025-08-07 400K (input 272K, output 128K) 128K Flagship, sterkest reasoning. PTU: 4 750 input TPM/PTU
gpt-5-mini 2025-08-07 400K (input 272K, output 128K) 128K Kostnadsoptimalisert. PTU: 23 750 input TPM/PTU
gpt-5-nano 2025-08-07 400K (input 272K, output 128K) 128K On-device/edge, lavest pris
gpt-5-chat 2025-08-07 (Preview) 128K 16 384 Conversation-optimalisert, emosjonell intelligens
gpt-5-codex 2025-09-11 400K (input 272K, output 128K) 128K Kodeoptimalisert (Codex CLI/VS Code)
gpt-5-pro 2025-10-06 400K (input 272K, output 128K) 128K Høyeste kapabilitet
gpt-5.1 2025-11-13 400K (input 272K, output 128K) 128K + gpt-5.1-codex, gpt-5.1-codex-mini
gpt-5.2 2025-12-11 400K (input 272K, output 128K) 128K + gpt-5.2-codex, gpt-5.2-chat (preview)
gpt-5.3-codex 2026-02-24 400K (input 272K, output 128K) 128K Kun -codex/-chat-varianter — ingen bar gpt-5.3 finnes
gpt-5.3-chat 2026-03-03 (Preview) 128K (input 111K) 16 384 Conversation-variant
gpt-5.4 2026-03-05 1 050 000 128K Kontekstsprang til ~1M; computer use. + -mini/-nano (2026-03-17)
gpt-5.4-pro 2026-03-05 1 050 000 128K Høyeste kapabilitet (ikke lenger restricted)
gpt-5.5 2026-04-24 1 050 000 (input 922K) 128K Treningsdata des. 2025; Data Zone i Norway East (sammen med gpt-5.4)
gpt-chat-latest 2026-05-28 (Preview) 128K (input 111K) 16 384 «GPT-5.5 Instant» (OpenAI chat-latest); kun Global Standard

PTU-ratio for GPT-5: 1 output token teller som 8 input tokens mot utnyttelsesgrensen.

Merk kontekstsprang: gpt-5/5.1/5.2 har 400K kontekst (272K input). gpt-5.4/5.5 hopper til ~1,05M kontekst. gpt-5.5 har 922K input.

Styrker:

  • Dyp reasoning og multi-step logikk
  • Bedre enn GPT-4.1 på komplekse oppgaver, vitenskap, koding og matematikk
  • Høyere latens enn GPT-4.1 (pga. dypere resonneringsprosess)

2. GPT-4.1-serien (GA april 2025)

Optimalisert for høy hastighet, høy throughput og enterprise-skalering. Ingen reasoning-overhead — rask og forutsigbar.

Modell GA-dato Kontekstvindu Max output Merknad
gpt-4.1 2025-04-14 1 047 576 (standard), 128K (PTU), 300K (batch) 32 768 Lengst kontekst, 4:1 input/output PTU-ratio
gpt-4.1-mini 2025-04-14 1 047 576 32 768 Balansert pris/ytelse
gpt-4.1-nano 2025-04-14 1 047 576 32 768 Lavest pris, 59 400 input TPM/PTU

PTU-ratio for GPT-4.1: 1 output token teller som 4 input tokens.

Styrker:

  • Ekstremt lang kontekst (1M tokens)
  • Lav latens, høy throughput
  • Ideell for real-time chat, kundesupport, høyvolum summarisering
  • Code og instruction following — bedre enn GPT-4o

Sammenligning GPT-5 vs GPT-4.1:

Dimensjon GPT-5 GPT-4.1
Modelltype Reasoning Non-reasoning, rask
Best for Kompleks reasoning, flersteg logikk Real-time chat, faktaspørsmål, høyvolum
Latens Høyere Lavere
Throughput Moderat Høy
Kontekst 272K input, 128K output Opp til 1M tokens

3. o-serien — Reasoning Models

Spesialiserte reasoning-modeller som bruker mer tid på å forstå brukerens forespørsel. Sterkest på vitenskap, koding og matematikk.

Modell GA-dato Kontekstvindu Max output Merknad
o4-mini 2025-04-16 200K input 100K output Kostnadseffektiv reasoning, image-støtte. PTU: 5 400 input TPM/PTU
o3 2025-04-16 200K input 100K output Sterk reasoning + image. PTU: 3 000 input TPM/PTU
o3-pro 2025-06-10 200K input 100K output Maksimal reasoning, anbefales background mode
o3-mini 2025-01-31 200K input 100K output Text-only, raskere enn o3
o1 2024-12-17 200K input 100K output Etablert reasoning + image
codex-mini 2025-05-16 200K input 100K output Fine-tunet o4-mini for koding

API-karakteristikker:

  • Bruker max_completion_tokens (Chat Completions API) eller max_output_tokens (Responses API)
  • Støtter IKKE temperature, top_p, presence_penalty, frequency_penalty
  • Streaming for o3 er begrenset tilgang

4. DeepSeek-modeller

Open source-modeller tilgjengelig som "Foundry Models sold directly by Azure". Alle støtter Global Standard deployment i alle regioner.

Modell Type Kontekst Tool calling Merknad
DeepSeek-R1 Reasoning 163 840 tokens Nei Sterk på reasoning + koding
DeepSeek-R1-0528 Reasoning 163 840 tokens Nei Oppdatert versjon
DeepSeek-V3-0324 MoE chat 131 072 tokens Ja Mixture-of-Experts
DeepSeek-V3.1 MoE chat 131 072 tokens Ja Oppdatert MoE
DeepSeek-V3.2 MoE reasoning 128 000 tokens Nei Nyeste versjon
MAI-DS-R1 Reasoning 163 840 tokens Nei Microsofts variant av DeepSeek-R1

PTU for DeepSeek: 4 000 input TPM/PTU (DeepSeek-R1, V3-0324, R1-0528).

Norway East: Alle DeepSeek-modeller er tilgjengelig i Norway East via Global Standard deployment.

Viktig: DeepSeek-R1 støtter ikke tool calling — bytt til V3-0324 eller V3.1 hvis tool use trengs.


5. Phi-serien (Small Language Models)

Microsofts egne SLM-er (Small Language Models), optimalisert for effektiv inferens med begrenset ressursbruk.

Modell Kontekst Modalitet Tool calling Merknad
Phi-4 16 384 tokens Text Nei Generell SLM, bred språkdekning (46 språk)
Phi-4-mini-instruct 131 072 tokens Text Nei Liten og rask, brukt i MS Edge
Phi-4-multimodal-instruct 131 072 tokens Text + bilde + lyd Nei Multimodal SLM
Phi-4-reasoning 32 768 tokens Text Nei Reasoning-variant
Phi-4-mini-reasoning 128 000 tokens Text Nei Kompakt reasoning

Bruksscenarioer:

  • On-device / Foundry Local inference (Phi-4-mini-instruct er optimalisert for ONNX)
  • Lav kostnad, høy throughput
  • Edge og offline-scenarioer
  • Ikke egnet for komplekse multi-step reasoning

6. Andre bemerkelsesverdige modeller

Meta Llama

Modell Kontekst Merknad
Llama-4-Maverick-17B-128E-Instruct-FP8 1M tokens Multimodal (text + bilde), 17B aktive parametere (128 eksperter MoE)
Llama-3.3-70B-Instruct 128 000 tokens (output: 8 192) Solid general-purpose, åpen kildekode. PTU: 8 450 input TPM/PTU

Mistral

Modell Type Merknad
Mistral-Large-3 Chat (text + bilde) Tool calling støttet, kun West US 3
mistral-document-ai-2505/2512 Image-to-Text PDF/bilde til strukturert tekst, alle regioner

Cohere

Modell Merknad
Cohere-command-a Sterk på RAG og enterprise-søk
Cohere-rerank-v4.0-pro/fast Re-ranking for søkepipeliner
embed-v-4-0 Embedding-modell

xAI Grok

Modell Merknad
grok-4 Frontiermodell, alle regioner inkl. Norway East
grok-3, grok-3-mini Eldre versjon

OpenAI spesialmodeller (open-weight, video, bilde)

Modell Type Kontekst Tilgjengelighet Merknad
gpt-oss-120b Open-weight reasoning 131 072 Global Standard (krever Foundry-prosjekt) + managed compute Kun tekst; quota 5M TPM / 5K RPM
gpt-oss-20b Open-weight 131 072 Managed compute + Foundry Local Kun tekst; for edge/lokal kjøring
sora-2 (2025-10-06) Video Global Standard — kun Sweden Central (EU) + East US 2 Ikke i Norway East
gpt-image-2 (2026-04-21) Bilde Global Standard — Poland Central + Sweden Central (EU) Ikke i Norway East; gpt-image-1.5 (2025-12-16) finnes også

7. Modellsammenligningstabell

Modell Kontekst (input) Max output PTU: input TPM/PTU Latency target (99%) Norway East — residens Tilgang
gpt-5 272K 128K 4 750 >50 TPS Kun Global Åpen
gpt-5-mini 272K 128K 23 750 >80 TPS Kun Global Åpen
gpt-5-nano 272K 128K Høy >100 TPS Kun Global Std Åpen
gpt-5.5 922K 128K Data Zone (EU) + Global Prov Quota-tier
gpt-4.1 1M 32 768 3 000 >40 TPS ⚠️ Kun Global (ikke resident) Åpen
gpt-4.1-mini 1M 32 768 14 900 >50 TPS ⚠️ Kun Global (ikke resident) Åpen
gpt-4.1-nano 1M 32 768 59 400 >60 TPS ⚠️ Kun Global (ikke resident) Åpen
gpt-4o 128K 16 384 Norge-resident (Standard + Regional PTU) Åpen
gpt-4o-mini 128K 16 384 Norge-resident (Regional PTU) Åpen
o4-mini 200K 100K 5 400 >66 TPS ⚠️ Kun Global (ikke resident) Åpen
o3 200K 100K 3 000 >40 TPS ⚠️ Kun Global (ikke resident) Åpen
o3-mini 200K 100K 2 500 >66 TPS ⚠️ Kun Global (ikke resident) Åpen
o1 200K 100K 230 >25 TPS ⚠️ Kun Global (ikke resident) Åpen
DeepSeek-R1 163K 163K 4 000 >50 TPS Kun Global Std Åpen
DeepSeek-V3-0324 131K 131K 4 000 >50 TPS Kun Global Std Åpen
Llama-3.3-70B-Instruct 128K 8 192 8 450 >50 TPS Kun Global Std Åpen
Phi-4-mini-instruct 131K 4 096 Foundry Local / managed Åpen
Phi-4 16K 16K Foundry Local / managed Åpen

Merk: PTU-tall er fra Microsoft Learn og kan endres. Se Foundry PTU-kalkulator for oppdaterte tall.

«Norway East — residens»-kolonnen angir om data kan holdes Norge-resident. Kun gpt-4o/gpt-4o-mini kan kjøres Norge-resident (Standard/Regional PTU). «Kun Global» = modellen finnes i Norway East, men kun via Global-deployment (data prosesseres globalt). Full deployment-type-matrise i seksjon 9.


8. Prismodeller

Tre hovedmodeller for deployment

Deploymenttype Betaling Dataresidens SLA Egnet for
Global Standard Per token (PAYG) Ingen garanti, data kan rutes globalt Ja Testing, variabel last
Data Zone Standard Per token (PAYG) Innenfor US eller EU Ja GDPR-krav, variabel last
Regional Provisioned (PTU) Per PTU per time Garantert til valgt region Ja Produksjon, forutsigbar last

Pay-as-you-go (PAYG)

Token-basert fakturering. Offisiell prising: https://azure.microsoft.com/pricing/details/cognitive-services/openai-service/

Generelle prisleier (relativ, ikke eksakt):

Prisnivå Modeller Merknad
Lavest (nano) gpt-5-nano, gpt-4.1-nano, Phi-4-mini On-device, enkle oppgaver
Lav gpt-4.1-mini, gpt-5-mini, o4-mini, o3-mini Høyvolum, enkle til moderate
Middels gpt-4.1, DeepSeek-V3, Llama-3.3-70B Generelle enterprise-workloads
Høy gpt-5, o3, o1 Komplekse reasoning-oppgaver
Høyest gpt-5-pro, o3-pro, gpt-5.2 Maksimal kapabilitet

Provisioned Throughput (PTU)

Garantert kapasitet med forutsigbar latens. Egnet for:

  • Produksjonsworkloads med stabil trafikk
  • Latency-sensitive applikasjoner
  • Høyvolum pipelines der PAYG-variasjon er et problem

Viktige PTU-parametere:

  • Minimum deployment: 15 PTU (global/data zone) eller 2550 PTU (regional)
  • Skaleringsinkrement: 5 PTU (global/data zone) eller 2550 PTU (regional)
  • PTU er modell-agnostisk quota — kan brukes til ulike modeller innen regionen
  • PTU kjøpes time-basert. Azure Reservations gir vesentlig rabatt ved langsiktig bruk

Input/output-ratio per modell:

Modell 1 output token = N input tokens
GPT-5-serien 8 input tokens
GPT-4.1-serien 4 input tokens
DeepSeek-R1/V3 4 input tokens
Llama-3.3-70B 4 input tokens (unntak fra standard)

Fine-tuning-kostnader

Ved bruk av fine-tuned modeller:

  • Standard: PAYG + $1,70/time hosting
  • Global Standard: PAYG + $1,70/time hosting
  • PTU: Per PTU/time (ingen ekstra hosting)
  • Developer Tier: PAYG uten hosting, ingen garanti, slettes etter 24 timer

9. Regional tilgjengelighet

Verifisert 2026-06-18 mot Microsoft Learn «Region availability for Foundry Models sold by Azure» (Standard- + Provisioned-pivoter). Avgjørende skille for offentlig sektor: hvor prosesseres data?

  • Standard/Regional og Regional Provisioned (PTU) = data prosesseres i regionen (Norge-resident).
  • Data Zone (Standard/Provisioned) = data prosesseres innen EU (EU-resident, ikke garantert Norge).
  • Global (Standard/Provisioned) = data kan prosesseres i en hvilken som helst Azure-region (ikke resident).

Norway East — tilgjengelighet per deployment-type

Modell Norge-resident¹ EU-sone (Data Zone Std) Global Std Global Prov
gpt-4o (2024-11-20) Standard
gpt-4o (2024-05-13 / 08-06) Regional PTU
gpt-4o-mini Regional PTU
gpt-4.1 / -mini / -nano
o3, o3-mini, o4-mini, o1
o3-deep-research ²
gpt-5, gpt-5-mini
gpt-5-nano
gpt-5.1
gpt-5.2 (+ -codex)
gpt-5.3-codex
gpt-5.3-chat
gpt-5.4 ³
gpt-5.4-mini / -nano
gpt-5.4-pro
gpt-5.5 ³
gpt-chat-latest
sora-2, gpt-image-2, computer-use-preview

¹ Norge-resident = Standard/Regional eller Regional Provisioned (PTU) i Norway East — prosessering forblir i Norge. ² o3-deep-research finnes i Norway East kun via Global Standard (Norway East + West US er de eneste to regionene globalt) — data prosesseres globalt, ikke resident. ³ gpt-5.4 og gpt-5.5 er de eneste modellene med Data Zone Standard (EU-residens) i Norway East (verifisert 2026-06-29 mot Learn region-tabell, Data Zone standard-pivot, Europa).

Konsekvens (viktig korreksjon 2026-06-18): De eneste generative modellene som kan kjøres Norge-resident i Norway East er gpt-4o og gpt-4o-mini. gpt-4.1, hele o-serien (o3/o4-mini/o3-mini/o1) og hele GPT-5-familien har ingen Standard/Regional- eller Regional-PTU-deployment i Norway East — de kjører kun Global (data globalt), eller for gpt-5.4/gpt-5.5 via Data Zone (EU). I tillegg er text-embedding-3-large, text-embedding-ada-002 og whisper Norge-resident (Standard) i Norway East.

Foundry Models sold directly by Azure (DeepSeek, Llama, Mistral, Grok): tilgjengelig i Norway East kun via Global Standard (data prosesseres globalt) — ikke egnet for dataresidens-krav. Omfatter DeepSeek-R1/R1-0528/V3-0324/V3.1/V3.2, Llama-4-Maverick/Llama-3.3-70B, Grok-4, MAI-DS-R1, mistral-document-ai.

Sweden Central — referanse (full feature-dekning)

Sweden Central har bredest feature-dekning i Norden og er anbefalt for pilot med nyeste modeller. Avgjørende: flere modeller er Sverige-resident (Standard/Regional) i Sweden Central som IKKE er regionale i Norway East — bl.a. gpt-4.1, gpt-4.1-mini, gpt-4o-familien, o1, o4-mini, gpt-5.1. I tillegg (via Global): hele GPT-5-familien, o3/o3-pro, computer-use-preview, sora-2, gpt-image-2, codex-mini, samt DeepSeek/Grok/Llama/Mistral. Merk: gpt-5.5 (Data Zone) og o3-deep-research finnes derimot i Norway East, ikke Sweden Central.

West Europe

Bred dekning via Global Standard/Provisioned (GPT-5-familien, GPT-4.1, o-serien, DeepSeek m.fl.). Som Standard/Regional er kun utvalgte modeller tilgjengelig. For EU-residens: bruk Data Zone-deployments.

Oppsummering: Nordiske regioner — Norge-resident vs. tilgjengelig via Global

Modell/feature Norway East Sweden Central
gpt-4o / gpt-4o-mini — resident
gpt-4.1-serien — resident (kun Global)
o4-mini — resident (kun Global)
o3 — resident (kun Global) (kun Global)
GPT-5-familien — resident delvis (gpt-5.1 Standard)
gpt-5.4/gpt-5.5 — Data Zone (EU-resident)
o3-deep-research (Global)
computer-use-preview / sora-2 / gpt-image-2 (Global)
Dataresidens for resident-modeller Norsk Svensk

10. For Cosmo: Modellvalgveiledning

Beslutningsflyt

Er oppgaven enkel (chat, Q&A, summarisering)?
├── Ja, høyvolum og kostnad er kritisk → gpt-4.1-nano / gpt-5-nano
├── Ja, balansert → gpt-4.1-mini / gpt-5-mini / o4-mini
└── Nei, kompleks

Er oppgaven kompleks (reasoning, kode, analyse)?
├── Trenger dyp reasoning + tid til svaret → gpt-5 / o3 / o3-pro
├── Rask reasoning + bilde-input → o4-mini
└── Kode-spesifikk → gpt-5-codex / codex-mini

Har kunden Norway East-krav (dataresidens)?
├── Ja, STRENGT (data må forbli i Norge) → Standard / Regional Provisioned i Norway East
│         Velg: KUN gpt-4o / gpt-4o-mini (+ embeddings, whisper) — eneste Norge-residente generative modeller
│         IKKE Norge-resident: gpt-4.1, o3/o4-mini/o3-mini/o1, HELE GPT-5-familien (kun Global her)
│         Trenger du nyere modell enn gpt-4o? → løs residens i Sweden Central, eller aksepter EU-sone
├── Ja, men EU-sone-residens er akseptabelt (data innen EU, ikke garantert Norge)
│         → gpt-5.4/gpt-5.5 via Data Zone Standard i Norway East (eneste GPT-5-modeller med Data Zone her)
│         eller Sweden Central Standard for gpt-4.1 / o4-mini / gpt-5.1 (Sverige-resident)
│         DeepSeek/øvrige har ingen Data Zone i Norway East → Global Standard (data globalt)
└── Nei (global prosessering OK) → hele GPT-5-familien (5/5.1/5.2/5.3/5.4) via Global Standard/Provisioned,
          eller Sweden Central for full feature coverage (computer-use, sora-2, gpt-image-2)

Er kunden offentlig sektor (Schrems II / GDPR)?
├── Ja, strenge krav (Norge-residens) → Standard / Regional Provisioned i Norway East
│         Velg: gpt-4o / gpt-4o-mini — eneste modeller der data forblir i Norge
│         Unngå: Global Standard/Provisioned (data rutes globalt) — gjelder gpt-4.1, o-serien OG hele GPT-5-familien
├── Ja, men EU-residens akseptabelt → gpt-5.5 (Data Zone Norway East) eller Sweden Central-resident modeller
└── Nei → Global Standard er akseptabelt

Trenger kunden open-source/selvhostet-alternativ?
├── Ja, reasoning → DeepSeek-R1 / MAI-DS-R1
├── Ja, chat + tool use → DeepSeek-V3-0324 / Llama-3.3-70B
└── Ja, liten modell (edge/on-device) → Phi-4-mini-instruct / Foundry Local

Hurtigguide per scenario

Scenario Anbefalt modell Begrunnelse
Intern chatbot, Teams gpt-4.1-mini Raskt, billig, godt nok
RAG over store dokumenter gpt-4.1 (1M kontekst) eller gpt-5 Lang kontekst, god instruction following
Juridisk/medisinsk analyse gpt-5 eller o3 Dyp reasoning, nøyaktighet
Kodegjennomgang / copilot gpt-5-codex / gpt-4.1 Kodeoptimalisert
Kostnadseffektiv høyvolum gpt-4.1-nano / gpt-5-nano Lavest pris, høy throughput
Multi-agent orkestrering gpt-5 / gpt-4.1 (som orkestratormodell) Sterk instruction following
On-device / edge / offline Phi-4-mini-instruct (Foundry Local) Kjører lokalt, ingen sky
Open-source med reasoning DeepSeek-R1 / MAI-DS-R1 Åpen kildekode, sterk reasoning
Sammenligning av alternativer Model Router Automatisk routing, opp til 60% kostnadsbesparelse
DPIA-kritisk (data forblir i Norge) gpt-4o / gpt-4o-mini + Standard/Regional PTU Norway East Eneste Norge-residente generative modeller (ikke gpt-4.1/o3/GPT-5)
EU-residens OK, vil ha GPT-5 gpt-5.5 + Data Zone Standard Norway East Data forblir i EU (ikke garantert Norge)

Spørsmål å stille kunden

  1. "Hva er primæroppgaven — chat/søk, analyse, koding eller kreativt innhold?"
  2. "Hvilke volumforventninger har dere (tokens/måned)?"
  3. "Er dataresidens et krav, eller er Global Standard akseptabelt?"
  4. "Trenger dere open-source/selvhostet alternativ av compliance-hensyn?"
  5. "Er latens kritisk (real-time UI) eller kan modellen tenke seg om (batch/agent)?"
  6. "Skal modellen kjøre på edge/on-device?"

Norway East-spesifikke råd

  • Norge-residens er begrenset til gpt-4o-familien. gpt-4o (Standard) og gpt-4o/gpt-4o-mini (Regional PTU) er de eneste generative modellene som kan kjøres med data resident i Norge. Bruk Regional PTU for produksjonskritiske residens-workloads.
  • gpt-4.1-serien er IKKE Norge-resident i Norway East — kun Global (data globalt) eller Global PTU. Tidligere antakelse om regional gpt-4.1 her var feil (korrigert 2026-06-18 mot Learn region-tabeller).
  • o-serien (o3/o4-mini/o3-mini/o1) er IKKE Norge-resident i Norway East — kun Global. (o4-mini finnes som Standard/Regional i Sweden Central, men ikke Norway East.)
  • Hele GPT-5-familien er IKKE Norge-resident i Norway East. gpt-5.5 er eneste med Data Zone Standard (EU-residens); resten (gpt-5/5.1/5.2/5.3/5.4) kun Global Standard/Provisioned.
  • Trenger du nyere modell enn gpt-4o med residens? Aksepter EU-sone (gpt-5.5 Data Zone i Norway East) eller flytt til Sweden Central (Sverige-resident gpt-4.1/o4-mini/gpt-5.1).
  • Deep Research (o3-deep-research) finnes i Norway East, men kun via Global Standard (Norway East + West US er de eneste to regionene) — data prosesseres globalt, ikke resident.
  • DeepSeek/Llama/Grok i Norway East er kun Global Standard — ikke egnet for strenge dataresidens-krav.

Kilder og verifisering

Adapted from Microsoft Learn documentation (CC BY 4.0):

Content translated to Norwegian, reorganized, and augmented with decision guidance for Norwegian public sector.

Research date: 2026-02; region- og deployment-type-tabeller live-verifisert 2026-06-18