# Azure AI Modellkatalog 2026 — Oversikt og valgveiledning **Last updated:** 2026-06-18 (live-verifisert mot Microsoft Learn region-tabeller) **Status:** Aktiv — dekker modeller i Microsoft Foundry per 2026-06; Norway East-tilgjengelighet verifisert per deployment-type mot «Region availability for Foundry Models sold by Azure» **Category:** Microsoft AI Platforms --- ## Oversikt Microsoft Foundry (tidligere Azure AI Foundry) har per 2026 (Microsoft-oppgitte tall): - **1 900+** frontier-modeller solgt direkte av Azure - **11 000+** totalt i katalogen (inkl. partner og community) - **40+** Azure-regioner Modellkatalogen er delt i to kategorier: 1. **Foundry Models sold directly by Azure (azure-openai)** — OpenAI-serien (GPT-5, GPT-4.1, o-serien) 2. **Foundry Models sold directly by Azure (azure-direct-others)** — DeepSeek, Meta, Mistral, xAI, Cohere mfl. --- ## 1. GPT-5-serien (GA august 2025) OpenAIs flaggskip reasoning-modeller. Alle versjonene støtter Chat Completions API, Responses API, structured outputs, text/image input og parallel tool calling. **Tilgangsmodell:** - `gpt-5`, `gpt-5-codex`, `gpt-5-pro` — åpen tilgang (tilgang ikke lenger begrenset; verifisert mot Microsoft Learn 2026-06) - `gpt-5-mini`, `gpt-5-nano`, `gpt-5-chat` — åpen tilgang, ingen registrering - `gpt-5.5` — enkelte quota-tiers krever quota-forespørsel (Tier 5/6 har quota by default) | Modell | GA-dato | Kontekstvindu | Max output | Merknad | |--------|---------|---------------|------------|---------| | `gpt-5` | 2025-08-07 | 400K (input 272K, output 128K) | 128K | Flagship, sterkest reasoning. PTU: 4 750 input TPM/PTU | | `gpt-5-mini` | 2025-08-07 | 400K (input 272K, output 128K) | 128K | Kostnadsoptimalisert. PTU: 23 750 input TPM/PTU | | `gpt-5-nano` | 2025-08-07 | 400K (input 272K, output 128K) | 128K | On-device/edge, lavest pris | | `gpt-5-chat` | 2025-08-07 (Preview) | 128K | 16 384 | Conversation-optimalisert, emosjonell intelligens | | `gpt-5-codex` | 2025-09-11 | 400K (input 272K, output 128K) | 128K | Kodeoptimalisert (Codex CLI/VS Code) | | `gpt-5-pro` | 2025-10-06 | 400K (input 272K, output 128K) | 128K | Høyeste kapabilitet | | `gpt-5.1` | 2025-11-13 | 400K (input 272K, output 128K) | 128K | + `gpt-5.1-codex`, `gpt-5.1-codex-mini` | | `gpt-5.2` | 2025-12-11 | 400K (input 272K, output 128K) | 128K | + `gpt-5.2-codex`, `gpt-5.2-chat` (preview) | | `gpt-5.3-codex` | 2026-02-24 | 400K (input 272K, output 128K) | 128K | Kun `-codex`/`-chat`-varianter — **ingen bar `gpt-5.3`** finnes | | `gpt-5.3-chat` | 2026-03-03 (Preview) | 128K (input 111K) | 16 384 | Conversation-variant | | `gpt-5.4` | 2026-03-05 | **1 050 000** | 128K | Kontekstsprang til ~1M; computer use. + `-mini`/`-nano` (2026-03-17) | | `gpt-5.4-pro` | 2026-03-05 | 1 050 000 | 128K | Høyeste kapabilitet (ikke lenger restricted) | | `gpt-5.5` | 2026-04-24 | 1 050 000 (input 922K) | 128K | Treningsdata des. 2025; **Data Zone i Norway East (sammen med gpt-5.4)** | | `gpt-chat-latest` | 2026-05-28 (Preview) | 128K (input 111K) | 16 384 | «GPT-5.5 Instant» (OpenAI `chat-latest`); kun Global Standard | **PTU-ratio for GPT-5:** 1 output token teller som 8 input tokens mot utnyttelsesgrensen. > **Merk kontekstsprang:** `gpt-5`/`5.1`/`5.2` har 400K kontekst (272K input). `gpt-5.4`/`5.5` hopper til ~1,05M kontekst. `gpt-5.5` har 922K input. **Styrker:** - Dyp reasoning og multi-step logikk - Bedre enn GPT-4.1 på komplekse oppgaver, vitenskap, koding og matematikk - Høyere latens enn GPT-4.1 (pga. dypere resonneringsprosess) --- ## 2. GPT-4.1-serien (GA april 2025) Optimalisert for høy hastighet, høy throughput og enterprise-skalering. Ingen reasoning-overhead — rask og forutsigbar. | Modell | GA-dato | Kontekstvindu | Max output | Merknad | |--------|---------|---------------|------------|---------| | `gpt-4.1` | 2025-04-14 | 1 047 576 (standard), 128K (PTU), 300K (batch) | 32 768 | Lengst kontekst, 4:1 input/output PTU-ratio | | `gpt-4.1-mini` | 2025-04-14 | 1 047 576 | 32 768 | Balansert pris/ytelse | | `gpt-4.1-nano` | 2025-04-14 | 1 047 576 | 32 768 | Lavest pris, 59 400 input TPM/PTU | **PTU-ratio for GPT-4.1:** 1 output token teller som 4 input tokens. **Styrker:** - Ekstremt lang kontekst (1M tokens) - Lav latens, høy throughput - Ideell for real-time chat, kundesupport, høyvolum summarisering - Code og instruction following — bedre enn GPT-4o **Sammenligning GPT-5 vs GPT-4.1:** | Dimensjon | GPT-5 | GPT-4.1 | |-----------|-------|---------| | Modelltype | Reasoning | Non-reasoning, rask | | Best for | Kompleks reasoning, flersteg logikk | Real-time chat, faktaspørsmål, høyvolum | | Latens | Høyere | Lavere | | Throughput | Moderat | Høy | | Kontekst | 272K input, 128K output | Opp til 1M tokens | --- ## 3. o-serien — Reasoning Models Spesialiserte reasoning-modeller som bruker mer tid på å forstå brukerens forespørsel. Sterkest på vitenskap, koding og matematikk. | Modell | GA-dato | Kontekstvindu | Max output | Merknad | |--------|---------|---------------|------------|---------| | `o4-mini` | 2025-04-16 | 200K input | 100K output | Kostnadseffektiv reasoning, image-støtte. PTU: 5 400 input TPM/PTU | | `o3` | 2025-04-16 | 200K input | 100K output | Sterk reasoning + image. PTU: 3 000 input TPM/PTU | | `o3-pro` | 2025-06-10 | 200K input | 100K output | Maksimal reasoning, anbefales background mode | | `o3-mini` | 2025-01-31 | 200K input | 100K output | Text-only, raskere enn o3 | | `o1` | 2024-12-17 | 200K input | 100K output | Etablert reasoning + image | | `codex-mini` | 2025-05-16 | 200K input | 100K output | Fine-tunet o4-mini for koding | **API-karakteristikker:** - Bruker `max_completion_tokens` (Chat Completions API) eller `max_output_tokens` (Responses API) - Støtter IKKE `temperature`, `top_p`, `presence_penalty`, `frequency_penalty` - Streaming for `o3` er begrenset tilgang --- ## 4. DeepSeek-modeller Open source-modeller tilgjengelig som "Foundry Models sold directly by Azure". Alle støtter Global Standard deployment i alle regioner. | Modell | Type | Kontekst | Tool calling | Merknad | |--------|------|----------|-------------|---------| | `DeepSeek-R1` | Reasoning | 163 840 tokens | Nei | Sterk på reasoning + koding | | `DeepSeek-R1-0528` | Reasoning | 163 840 tokens | Nei | Oppdatert versjon | | `DeepSeek-V3-0324` | MoE chat | 131 072 tokens | Ja | Mixture-of-Experts | | `DeepSeek-V3.1` | MoE chat | 131 072 tokens | Ja | Oppdatert MoE | | `DeepSeek-V3.2` | MoE reasoning | 128 000 tokens | Nei | Nyeste versjon | | `MAI-DS-R1` | Reasoning | 163 840 tokens | Nei | Microsofts variant av DeepSeek-R1 | **PTU for DeepSeek:** 4 000 input TPM/PTU (DeepSeek-R1, V3-0324, R1-0528). **Norway East:** Alle DeepSeek-modeller er tilgjengelig i Norway East via Global Standard deployment. **Viktig:** DeepSeek-R1 støtter ikke tool calling — bytt til V3-0324 eller V3.1 hvis tool use trengs. --- ## 5. Phi-serien (Small Language Models) Microsofts egne SLM-er (Small Language Models), optimalisert for effektiv inferens med begrenset ressursbruk. | Modell | Kontekst | Modalitet | Tool calling | Merknad | |--------|----------|-----------|-------------|---------| | `Phi-4` | 16 384 tokens | Text | Nei | Generell SLM, bred språkdekning (46 språk) | | `Phi-4-mini-instruct` | 131 072 tokens | Text | Nei | Liten og rask, brukt i MS Edge | | `Phi-4-multimodal-instruct` | 131 072 tokens | Text + bilde + lyd | Nei | Multimodal SLM | | `Phi-4-reasoning` | 32 768 tokens | Text | Nei | Reasoning-variant | | `Phi-4-mini-reasoning` | 128 000 tokens | Text | Nei | Kompakt reasoning | **Bruksscenarioer:** - On-device / Foundry Local inference (Phi-4-mini-instruct er optimalisert for ONNX) - Lav kostnad, høy throughput - Edge og offline-scenarioer - Ikke egnet for komplekse multi-step reasoning --- ## 6. Andre bemerkelsesverdige modeller ### Meta Llama | Modell | Kontekst | Merknad | |--------|----------|---------| | `Llama-4-Maverick-17B-128E-Instruct-FP8` | 1M tokens | Multimodal (text + bilde), 17B aktive parametere (128 eksperter MoE) | | `Llama-3.3-70B-Instruct` | 128 000 tokens (output: 8 192) | Solid general-purpose, åpen kildekode. PTU: 8 450 input TPM/PTU | ### Mistral | Modell | Type | Merknad | |--------|------|---------| | `Mistral-Large-3` | Chat (text + bilde) | Tool calling støttet, kun West US 3 | | `mistral-document-ai-2505/2512` | Image-to-Text | PDF/bilde til strukturert tekst, alle regioner | ### Cohere | Modell | Merknad | |--------|---------| | `Cohere-command-a` | Sterk på RAG og enterprise-søk | | `Cohere-rerank-v4.0-pro/fast` | Re-ranking for søkepipeliner | | `embed-v-4-0` | Embedding-modell | ### xAI Grok | Modell | Merknad | |--------|---------| | `grok-4` | Frontiermodell, alle regioner inkl. Norway East | | `grok-3`, `grok-3-mini` | Eldre versjon | ### OpenAI spesialmodeller (open-weight, video, bilde) | Modell | Type | Kontekst | Tilgjengelighet | Merknad | |--------|------|----------|-----------------|---------| | `gpt-oss-120b` | Open-weight reasoning | 131 072 | Global Standard (krever Foundry-prosjekt) + managed compute | Kun tekst; quota 5M TPM / 5K RPM | | `gpt-oss-20b` | Open-weight | 131 072 | Managed compute + Foundry Local | Kun tekst; for edge/lokal kjøring | | `sora-2` (2025-10-06) | Video | — | Global Standard — kun Sweden Central (EU) + East US 2 | **Ikke i Norway East** | | `gpt-image-2` (2026-04-21) | Bilde | — | Global Standard — Poland Central + Sweden Central (EU) | **Ikke i Norway East**; `gpt-image-1.5` (2025-12-16) finnes også | --- ## 7. Modellsammenligningstabell | Modell | Kontekst (input) | Max output | PTU: input TPM/PTU | Latency target (99%) | Norway East — residens | Tilgang | |--------|-----------------|------------|---------------------|---------------------|------------------------|---------| | `gpt-5` | 272K | 128K | 4 750 | >50 TPS | Kun Global | Åpen | | `gpt-5-mini` | 272K | 128K | 23 750 | >80 TPS | Kun Global | Åpen | | `gpt-5-nano` | 272K | 128K | Høy | >100 TPS | Kun Global Std | Åpen | | `gpt-5.5` | 922K | 128K | — | — | Data Zone (EU) + Global Prov | Quota-tier | | `gpt-4.1` | 1M | 32 768 | 3 000 | >40 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `gpt-4.1-mini` | 1M | 32 768 | 14 900 | >50 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `gpt-4.1-nano` | 1M | 32 768 | 59 400 | >60 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `gpt-4o` | 128K | 16 384 | — | — | ✅ Norge-resident (Standard + Regional PTU) | Åpen | | `gpt-4o-mini` | 128K | 16 384 | — | — | ✅ Norge-resident (Regional PTU) | Åpen | | `o4-mini` | 200K | 100K | 5 400 | >66 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `o3` | 200K | 100K | 3 000 | >40 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `o3-mini` | 200K | 100K | 2 500 | >66 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `o1` | 200K | 100K | 230 | >25 TPS | ⚠️ Kun Global (ikke resident) | Åpen | | `DeepSeek-R1` | 163K | 163K | 4 000 | >50 TPS | Kun Global Std | Åpen | | `DeepSeek-V3-0324` | 131K | 131K | 4 000 | >50 TPS | Kun Global Std | Åpen | | `Llama-3.3-70B-Instruct` | 128K | 8 192 | 8 450 | >50 TPS | Kun Global Std | Åpen | | `Phi-4-mini-instruct` | 131K | 4 096 | — | — | Foundry Local / managed | Åpen | | `Phi-4` | 16K | 16K | — | — | Foundry Local / managed | Åpen | **Merk:** PTU-tall er fra Microsoft Learn og kan endres. Se [Foundry PTU-kalkulator](https://ai.azure.com/resource/calculator) for oppdaterte tall. > **«Norway East — residens»-kolonnen** angir om data kan holdes Norge-resident. **Kun `gpt-4o`/`gpt-4o-mini`** kan kjøres Norge-resident (Standard/Regional PTU). «Kun Global» = modellen finnes i Norway East, men kun via Global-deployment (data prosesseres globalt). Full deployment-type-matrise i seksjon 9. --- ## 8. Prismodeller ### Tre hovedmodeller for deployment | Deploymenttype | Betaling | Dataresidens | SLA | Egnet for | |----------------|---------|--------------|-----|-----------| | **Global Standard** | Per token (PAYG) | Ingen garanti, data kan rutes globalt | Ja | Testing, variabel last | | **Data Zone Standard** | Per token (PAYG) | Innenfor US eller EU | Ja | GDPR-krav, variabel last | | **Regional Provisioned (PTU)** | Per PTU per time | Garantert til valgt region | Ja | Produksjon, forutsigbar last | ### Pay-as-you-go (PAYG) Token-basert fakturering. Offisiell prising: `https://azure.microsoft.com/pricing/details/cognitive-services/openai-service/` **Generelle prisleier (relativ, ikke eksakt):** | Prisnivå | Modeller | Merknad | |---------|---------|---------| | Lavest (nano) | `gpt-5-nano`, `gpt-4.1-nano`, `Phi-4-mini` | On-device, enkle oppgaver | | Lav | `gpt-4.1-mini`, `gpt-5-mini`, `o4-mini`, `o3-mini` | Høyvolum, enkle til moderate | | Middels | `gpt-4.1`, `DeepSeek-V3`, `Llama-3.3-70B` | Generelle enterprise-workloads | | Høy | `gpt-5`, `o3`, `o1` | Komplekse reasoning-oppgaver | | Høyest | `gpt-5-pro`, `o3-pro`, `gpt-5.2` | Maksimal kapabilitet | ### Provisioned Throughput (PTU) Garantert kapasitet med forutsigbar latens. Egnet for: - Produksjonsworkloads med stabil trafikk - Latency-sensitive applikasjoner - Høyvolum pipelines der PAYG-variasjon er et problem **Viktige PTU-parametere:** - Minimum deployment: 15 PTU (global/data zone) eller 25–50 PTU (regional) - Skaleringsinkrement: 5 PTU (global/data zone) eller 25–50 PTU (regional) - PTU er modell-agnostisk quota — kan brukes til ulike modeller innen regionen - PTU kjøpes time-basert. Azure Reservations gir vesentlig rabatt ved langsiktig bruk **Input/output-ratio per modell:** | Modell | 1 output token = N input tokens | |--------|--------------------------------| | GPT-5-serien | 8 input tokens | | GPT-4.1-serien | 4 input tokens | | DeepSeek-R1/V3 | 4 input tokens | | Llama-3.3-70B | 4 input tokens (unntak fra standard) | ### Fine-tuning-kostnader Ved bruk av fine-tuned modeller: - **Standard:** PAYG + $1,70/time hosting - **Global Standard:** PAYG + $1,70/time hosting - **PTU:** Per PTU/time (ingen ekstra hosting) - **Developer Tier:** PAYG uten hosting, ingen garanti, slettes etter 24 timer --- ## 9. Regional tilgjengelighet > **Verifisert 2026-06-18** mot Microsoft Learn «Region availability for Foundry Models sold by Azure» (Standard- + Provisioned-pivoter). Avgjørende skille for offentlig sektor: **hvor prosesseres data?** > - **Standard/Regional** og **Regional Provisioned (PTU)** = data prosesseres i regionen (Norge-resident). > - **Data Zone** (Standard/Provisioned) = data prosesseres innen EU (EU-resident, ikke garantert Norge). > - **Global** (Standard/Provisioned) = data kan prosesseres i en hvilken som helst Azure-region (ikke resident). ### Norway East — tilgjengelighet per deployment-type | Modell | Norge-resident¹ | EU-sone (Data Zone Std) | Global Std | Global Prov | |--------|:---:|:---:|:---:|:---:| | `gpt-4o` (2024-11-20) | ✅ Standard | – | ✅ | ✅ | | `gpt-4o` (2024-05-13 / 08-06) | ✅ Regional PTU | – | ✅ | ✅ | | `gpt-4o-mini` | ✅ Regional PTU | – | ✅ | ✅ | | `gpt-4.1` / `-mini` / `-nano` | – | – | ✅ | ✅ | | `o3`, `o3-mini`, `o4-mini`, `o1` | – | – | ✅ | ✅ | | `o3-deep-research` | – | – | ✅² | – | | `gpt-5`, `gpt-5-mini` | – | – | ✅ | ✅ | | `gpt-5-nano` | – | – | ✅ | – | | `gpt-5.1` | – | – | ✅ | ✅ | | `gpt-5.2` (+ `-codex`) | – | – | ✅ | ✅ | | `gpt-5.3-codex` | – | – | ✅ | ✅ | | `gpt-5.3-chat` | – | – | ✅ | – | | `gpt-5.4` | – | ✅³ | ✅ | ✅ | | `gpt-5.4-mini` / `-nano` | – | – | ✅ | – | | `gpt-5.4-pro` | – | – | – | – | | `gpt-5.5` | – | ✅³ | – | ✅ | | `gpt-chat-latest` | – | – | – | – | | `sora-2`, `gpt-image-2`, `computer-use-preview` | – | – | – | – | ¹ Norge-resident = Standard/Regional **eller** Regional Provisioned (PTU) i Norway East — prosessering forblir i Norge. ² `o3-deep-research` finnes i Norway East kun via **Global Standard** (Norway East + West US er de eneste to regionene globalt) — data prosesseres globalt, ikke resident. ³ `gpt-5.4` og `gpt-5.5` er de eneste modellene med Data Zone Standard (EU-residens) i Norway East (verifisert 2026-06-29 mot Learn region-tabell, Data Zone standard-pivot, Europa). **Konsekvens (viktig korreksjon 2026-06-18):** De **eneste generative modellene som kan kjøres Norge-resident** i Norway East er **`gpt-4o` og `gpt-4o-mini`**. `gpt-4.1`, hele o-serien (`o3`/`o4-mini`/`o3-mini`/`o1`) og hele GPT-5-familien har **ingen** Standard/Regional- eller Regional-PTU-deployment i Norway East — de kjører kun Global (data globalt), eller for `gpt-5.4`/`gpt-5.5` via Data Zone (EU). I tillegg er `text-embedding-3-large`, `text-embedding-ada-002` og `whisper` Norge-resident (Standard) i Norway East. **Foundry Models sold directly by Azure (DeepSeek, Llama, Mistral, Grok):** tilgjengelig i Norway East kun via **Global Standard** (data prosesseres globalt) — ikke egnet for dataresidens-krav. Omfatter DeepSeek-R1/R1-0528/V3-0324/V3.1/V3.2, Llama-4-Maverick/Llama-3.3-70B, Grok-4, MAI-DS-R1, mistral-document-ai. ### Sweden Central — referanse (full feature-dekning) Sweden Central har bredest feature-dekning i Norden og er anbefalt for pilot med nyeste modeller. Avgjørende: flere modeller er **Sverige-resident** (Standard/Regional) i Sweden Central som IKKE er regionale i Norway East — bl.a. `gpt-4.1`, `gpt-4.1-mini`, `gpt-4o`-familien, `o1`, `o4-mini`, `gpt-5.1`. I tillegg (via Global): hele GPT-5-familien, `o3`/`o3-pro`, `computer-use-preview`, `sora-2`, `gpt-image-2`, `codex-mini`, samt DeepSeek/Grok/Llama/Mistral. Merk: `gpt-5.5` (Data Zone) og `o3-deep-research` finnes derimot i Norway East, ikke Sweden Central. ### West Europe Bred dekning via Global Standard/Provisioned (GPT-5-familien, GPT-4.1, o-serien, DeepSeek m.fl.). Som Standard/Regional er kun utvalgte modeller tilgjengelig. For EU-residens: bruk Data Zone-deployments. ### Oppsummering: Nordiske regioner — Norge-resident vs. tilgjengelig via Global | Modell/feature | Norway East | Sweden Central | |---------------|:---:|:---:| | `gpt-4o` / `gpt-4o-mini` — resident | ✅ | ✅ | | `gpt-4.1`-serien — resident | ❌ (kun Global) | ✅ | | `o4-mini` — resident | ❌ (kun Global) | ✅ | | `o3` — resident | ❌ (kun Global) | ❌ (kun Global) | | GPT-5-familien — resident | ❌ | delvis (`gpt-5.1` Standard) | | `gpt-5.4`/`gpt-5.5` — Data Zone (EU-resident) | ✅ | ❌ | | `o3-deep-research` (Global) | ✅ | ❌ | | `computer-use-preview` / `sora-2` / `gpt-image-2` | ❌ | ✅ (Global) | | Dataresidens for resident-modeller | Norsk | Svensk | --- ## 10. For Cosmo: Modellvalgveiledning ### Beslutningsflyt ``` Er oppgaven enkel (chat, Q&A, summarisering)? ├── Ja, høyvolum og kostnad er kritisk → gpt-4.1-nano / gpt-5-nano ├── Ja, balansert → gpt-4.1-mini / gpt-5-mini / o4-mini └── Nei, kompleks Er oppgaven kompleks (reasoning, kode, analyse)? ├── Trenger dyp reasoning + tid til svaret → gpt-5 / o3 / o3-pro ├── Rask reasoning + bilde-input → o4-mini └── Kode-spesifikk → gpt-5-codex / codex-mini Har kunden Norway East-krav (dataresidens)? ├── Ja, STRENGT (data må forbli i Norge) → Standard / Regional Provisioned i Norway East │ Velg: KUN gpt-4o / gpt-4o-mini (+ embeddings, whisper) — eneste Norge-residente generative modeller │ IKKE Norge-resident: gpt-4.1, o3/o4-mini/o3-mini/o1, HELE GPT-5-familien (kun Global her) │ Trenger du nyere modell enn gpt-4o? → løs residens i Sweden Central, eller aksepter EU-sone ├── Ja, men EU-sone-residens er akseptabelt (data innen EU, ikke garantert Norge) │ → gpt-5.4/gpt-5.5 via Data Zone Standard i Norway East (eneste GPT-5-modeller med Data Zone her) │ eller Sweden Central Standard for gpt-4.1 / o4-mini / gpt-5.1 (Sverige-resident) │ DeepSeek/øvrige har ingen Data Zone i Norway East → Global Standard (data globalt) └── Nei (global prosessering OK) → hele GPT-5-familien (5/5.1/5.2/5.3/5.4) via Global Standard/Provisioned, eller Sweden Central for full feature coverage (computer-use, sora-2, gpt-image-2) Er kunden offentlig sektor (Schrems II / GDPR)? ├── Ja, strenge krav (Norge-residens) → Standard / Regional Provisioned i Norway East │ Velg: gpt-4o / gpt-4o-mini — eneste modeller der data forblir i Norge │ Unngå: Global Standard/Provisioned (data rutes globalt) — gjelder gpt-4.1, o-serien OG hele GPT-5-familien ├── Ja, men EU-residens akseptabelt → gpt-5.5 (Data Zone Norway East) eller Sweden Central-resident modeller └── Nei → Global Standard er akseptabelt Trenger kunden open-source/selvhostet-alternativ? ├── Ja, reasoning → DeepSeek-R1 / MAI-DS-R1 ├── Ja, chat + tool use → DeepSeek-V3-0324 / Llama-3.3-70B └── Ja, liten modell (edge/on-device) → Phi-4-mini-instruct / Foundry Local ``` ### Hurtigguide per scenario | Scenario | Anbefalt modell | Begrunnelse | |---------|----------------|-------------| | Intern chatbot, Teams | gpt-4.1-mini | Raskt, billig, godt nok | | RAG over store dokumenter | gpt-4.1 (1M kontekst) eller gpt-5 | Lang kontekst, god instruction following | | Juridisk/medisinsk analyse | gpt-5 eller o3 | Dyp reasoning, nøyaktighet | | Kodegjennomgang / copilot | gpt-5-codex / gpt-4.1 | Kodeoptimalisert | | Kostnadseffektiv høyvolum | gpt-4.1-nano / gpt-5-nano | Lavest pris, høy throughput | | Multi-agent orkestrering | gpt-5 / gpt-4.1 (som orkestratormodell) | Sterk instruction following | | On-device / edge / offline | Phi-4-mini-instruct (Foundry Local) | Kjører lokalt, ingen sky | | Open-source med reasoning | DeepSeek-R1 / MAI-DS-R1 | Åpen kildekode, sterk reasoning | | Sammenligning av alternativer | Model Router | Automatisk routing, opp til 60% kostnadsbesparelse | | DPIA-kritisk (data forblir i Norge) | gpt-4o / gpt-4o-mini + Standard/Regional PTU Norway East | Eneste Norge-residente generative modeller (ikke gpt-4.1/o3/GPT-5) | | EU-residens OK, vil ha GPT-5 | gpt-5.5 + Data Zone Standard Norway East | Data forblir i EU (ikke garantert Norge) | ### Spørsmål å stille kunden 1. "Hva er primæroppgaven — chat/søk, analyse, koding eller kreativt innhold?" 2. "Hvilke volumforventninger har dere (tokens/måned)?" 3. "Er dataresidens et krav, eller er Global Standard akseptabelt?" 4. "Trenger dere open-source/selvhostet alternativ av compliance-hensyn?" 5. "Er latens kritisk (real-time UI) eller kan modellen tenke seg om (batch/agent)?" 6. "Skal modellen kjøre på edge/on-device?" ### Norway East-spesifikke råd - **Norge-residens er begrenset til `gpt-4o`-familien.** `gpt-4o` (Standard) og `gpt-4o`/`gpt-4o-mini` (Regional PTU) er de eneste generative modellene som kan kjøres med data resident i Norge. Bruk **Regional PTU** for produksjonskritiske residens-workloads. - **`gpt-4.1`-serien er IKKE Norge-resident** i Norway East — kun Global (data globalt) eller Global PTU. Tidligere antakelse om regional gpt-4.1 her var **feil** (korrigert 2026-06-18 mot Learn region-tabeller). - **o-serien (`o3`/`o4-mini`/`o3-mini`/`o1`) er IKKE Norge-resident** i Norway East — kun Global. (`o4-mini` finnes som Standard/Regional i Sweden Central, men ikke Norway East.) - **Hele GPT-5-familien er IKKE Norge-resident** i Norway East. `gpt-5.5` er eneste med **Data Zone Standard (EU-residens)**; resten (gpt-5/5.1/5.2/5.3/5.4) kun Global Standard/Provisioned. - **Trenger du nyere modell enn gpt-4o med residens?** Aksepter **EU-sone** (gpt-5.5 Data Zone i Norway East) eller flytt til **Sweden Central** (Sverige-resident gpt-4.1/o4-mini/gpt-5.1). - **Deep Research** (`o3-deep-research`) finnes i Norway East, men kun via **Global Standard** (Norway East + West US er de eneste to regionene) — data prosesseres globalt, ikke resident. - **DeepSeek/Llama/Grok** i Norway East er kun Global Standard — ikke egnet for strenge dataresidens-krav. --- ## Kilder og verifisering Adapted from Microsoft Learn documentation ([CC BY 4.0](https://creativecommons.org/licenses/by/4.0/)): - [Foundry Models sold directly by Azure (azure-openai)](https://learn.microsoft.com/azure/foundry/foundry-models/concepts/models-sold-directly-by-azure?view=foundry-classic) - [Region availability for Foundry Models sold by Azure](https://learn.microsoft.com/azure/foundry/foundry-models/concepts/models-sold-directly-by-azure-region-availability) — **autoritativ deployment-type × region-matrise (live-verifisert 2026-06-18; grunnlag for seksjon 9)** - [Foundry Models sold directly by Azure (azure-direct-others)](https://learn.microsoft.com/azure/foundry/foundry-models/concepts/models-sold-directly-by-azure?view=foundry-classic&pivots=azure-direct-others) - [Azure OpenAI in Foundry Models — model overview](https://learn.microsoft.com/azure/foundry/foundry-models/concepts/models-sold-directly-by-azure) - [GPT-5 vs GPT-4.1: choosing the right model](https://learn.microsoft.com/azure/foundry/foundry-models/how-to/model-choice-guide?view=foundry-classic) - [Azure OpenAI reasoning models](https://learn.microsoft.com/azure/foundry/openai/how-to/reasoning?view=foundry-classic) - [PTU costs and billing](https://learn.microsoft.com/azure/foundry/openai/concepts/provisioned-throughput-billing?view=foundry-classic) - [Foundry Models from partners and community (Phi)](https://learn.microsoft.com/azure/foundry/foundry-models/concepts/models-from-partners?view=foundry-classic) - [Azure OpenAI models and regions for Foundry Agent Service](https://learn.microsoft.com/azure/foundry-classic/agents/concepts/model-region-support?view=foundry-classic) - [Azure OpenAI quotas and limits](https://learn.microsoft.com/azure/foundry/openai/quotas-limits?view=foundry-classic) Content translated to Norwegian, reorganized, and augmented with decision guidance for Norwegian public sector. Research date: 2026-02; region- og deployment-type-tabeller live-verifisert 2026-06-18