docs(ms-ai-architect): KB-refresh tema-b — Foundry-navnesveip «Azure AI Foundry»→«Microsoft Foundry» (233 filer)
Verifisert mot offisiell MS-doc (juni 2026): «Microsoft Foundry» er det gjeldende produkt-/portalnavnet; «Foundry (classic)» = gamle «Azure AI Foundry» (/azure/foundry/ vs /azure/foundry-classic/). Premiss bekreftet før sveip. Multi-regel, IKKE naiv s/Azure AI Foundry/Microsoft Foundry/ — MS dropper «Azure AI» (legger IKKE til «Microsoft») for to produktvarianter: - «Azure AI Foundry Agent[ Service|s]» → «Foundry Agent Service/Agents» (MS-form) - «Azure AI Foundry Models» → «Foundry Models» (i «Azure OpenAI in Foundry Models») - «Azure AI Foundry SDK» → «Microsoft Foundry SDK» (operatør-valg) - «Azure AI Foundry portal/project» + generisk → «Microsoft Foundry» - Pre-eksisterende «Microsoft Foundry Models» (4) normalisert → «Foundry Models» Bevart: «Azure OpenAI», «Azure AI Inference SDK», «Azure AI Search», «Azure AI Services», kode-IDer. Historisk ref «(tidligere Azure AI Foundry)» i model-catalog-2026.md beskyttet via lookbehind. URL /azure/ai-foundry/→ /azure/foundry/ kun i owasp-llm-top10 (KB-ref); docs/-filer deferred. Scope: skills (inkl. 3 SKILL.md) + commands + agents + README + CLAUDE. Ekskludert: docs/ (interne), playground/+tests/ fixtures (testdata), CHANGELOG.md (historisk logg), STATE.md (gitignored). 3 SKILL.md endret (advisor/engineering/security) → judge-cache teknisk invalidert for disse, men scorer uendret: advisor 91, eng/gov/infra/sec 96 (alle ≥90). validate 239/0. 0 «Azure AI Foundry» igjen (utenom bevart ref). Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
This commit is contained in:
parent
20b522ab10
commit
03d596e4ec
233 changed files with 810 additions and 810 deletions
|
|
@ -9,7 +9,7 @@
|
|||
|
||||
## Introduksjon
|
||||
|
||||
GPT-5- og GPT-4.1-seriene er de to nyeste flaggskipmodellene fra OpenAI tilgjengelig i Azure AI Foundry. De representerer to distinkte designfilosofier: GPT-5 optimalisert for dyp resonnering og komplekse oppgaver, GPT-4.1 optimalisert for hastighet, gjennomstrømming og kostnadseffektivitet.
|
||||
GPT-5- og GPT-4.1-seriene er de to nyeste flaggskipmodellene fra OpenAI tilgjengelig i Microsoft Foundry. De representerer to distinkte designfilosofier: GPT-5 optimalisert for dyp resonnering og komplekse oppgaver, GPT-4.1 optimalisert for hastighet, gjennomstrømming og kostnadseffektivitet.
|
||||
|
||||
**Confidence:** Høy (GPT-4.1- og GPT-5-priser verifisert juni 2026 via WebSearch + OpenAI/Azure pricing)
|
||||
|
||||
|
|
@ -28,7 +28,7 @@ Denne referansen dekker:
|
|||
|
||||
### 1. GPT-4.1-serien — Bekreftet prising
|
||||
|
||||
**Kilde:** Azure Content Understanding-dokumentasjon, Azure AI Foundry provisioned throughput-dokumentasjon (bekreftet 1:4 input/output-ratio)
|
||||
**Kilde:** Azure Content Understanding-dokumentasjon, Microsoft Foundry provisioned throughput-dokumentasjon (bekreftet 1:4 input/output-ratio)
|
||||
|
||||
| Modell | Input (per 1M tokens) | Output (per 1M tokens) | Cached Input | Kontekst |
|
||||
|--------|-----------------------|------------------------|--------------|----------|
|
||||
|
|
@ -252,12 +252,12 @@ Tier 3 — Full (komplekse oppgaver):
|
|||
|
||||
**Besparelsespotensial:** 60–80% vs. alltid bruke gpt-4.1
|
||||
|
||||
#### Strategi 2: Model Router (Azure AI Foundry)
|
||||
#### Strategi 2: Model Router (Microsoft Foundry)
|
||||
|
||||
Azure AI Foundry Model Router analyserer prompt-kompleksitet og velger automatisk den mest kostnadseffektive modellen.
|
||||
Microsoft Foundry Model Router analyserer prompt-kompleksitet og velger automatisk den mest kostnadseffektive modellen.
|
||||
|
||||
- **Potensiell besparelse:** Opptil 60% vs. å alltid bruke GPT-5-familien (dokumentert av Microsoft)
|
||||
- **Implementering:** Deploy Model Router i Azure AI Foundry, konfigurer underliggende modeller
|
||||
- **Implementering:** Deploy Model Router i Microsoft Foundry, konfigurer underliggende modeller
|
||||
- **Ingen kodeendringer:** Transparente for applikasjonen
|
||||
|
||||
**Confidence:** Høy (Model Router er GA-funksjonalitet, besparelsestallet er dokumentert av Microsoft)
|
||||
|
|
@ -295,7 +295,7 @@ PTU: 1 PTU = 3 000 input TPM = ~130M tokens/mnd kapasitet
|
|||
Break-even: Når pay-per-token overstiger PTU-timeprisen × 730 timer/mnd
|
||||
```
|
||||
|
||||
Bruk [Azure AI Foundry PTU-kalkulator](https://ai.azure.com/resource/calculator) for presis beregning.
|
||||
Bruk [Microsoft Foundry PTU-kalkulator](https://ai.azure.com/resource/calculator) for presis beregning.
|
||||
|
||||
**Confidence:** Høy (PTU TPM-verdier er offisielt dokumentert. Break-even avhenger av PTU-timepris som ikke er publisert)
|
||||
|
||||
|
|
@ -395,9 +395,9 @@ Norsk offentlig sektor:
|
|||
|
||||
## Integrasjon med Microsoft-stakken
|
||||
|
||||
### Azure AI Foundry: Model Catalog og Router
|
||||
### Microsoft Foundry: Model Catalog og Router
|
||||
|
||||
- Alle GPT-4.1- og GPT-5-modeller tilgjengelig i [Azure AI Foundry](https://ai.azure.com)
|
||||
- Alle GPT-4.1- og GPT-5-modeller tilgjengelig i [Microsoft Foundry](https://ai.azure.com)
|
||||
- Model Router automatiserer modellvalg — opptil 60% kostnadssparing (dokumentert)
|
||||
- Foundry PTU-kalkulator: [ai.azure.com/resource/calculator](https://ai.azure.com/resource/calculator)
|
||||
|
||||
|
|
@ -493,7 +493,7 @@ GPT-4o mini og GPT-4o brukes fortsatt i US Government regions (offer comparable
|
|||
|
||||
**4. Valider med offisiell kilde:**
|
||||
- Alltid linke til [Azure OpenAI Pricing](https://azure.microsoft.com/pricing/details/cognitive-services/openai-service/)
|
||||
- For PTU: [Azure AI Foundry Calculator](https://ai.azure.com/resource/calculator)
|
||||
- For PTU: [Microsoft Foundry Calculator](https://ai.azure.com/resource/calculator)
|
||||
|
||||
### Confidence-markers i rådgivning
|
||||
|
||||
|
|
@ -516,7 +516,7 @@ GPT-4o mini og GPT-4o brukes fortsatt i US Government regions (offer comparable
|
|||
**A:** Start med gpt-4.1-mini (Basic rate, laveste Credits-forbruk). Bytt til gpt-4.1 kun for oppgaver som krever mer kompleks resonnering eller høyere kvalitet — test og mål først.
|
||||
|
||||
**Q: "Hva er break-even for PTU vs. pay-per-token?"**
|
||||
**A:** Bruk [Azure AI Foundry PTU-kalkulator](https://ai.azure.com/resource/calculator). Som tommelfingerregel: PTU er lønnsomt ved >70% gjennomsnittlig utnyttelse og stabilt volum over 3+ måneder.
|
||||
**A:** Bruk [Microsoft Foundry PTU-kalkulator](https://ai.azure.com/resource/calculator). Som tommelfingerregel: PTU er lønnsomt ved >70% gjennomsnittlig utnyttelse og stabilt volum over 3+ måneder.
|
||||
|
||||
**Q: "Påvirker ny GPT-5-tilgjengelighet Copilot Credits-forbruket vårt?"**
|
||||
**A:** Ja. Hvis brukere i Copilot Studio velger gpt-5-reasoning (Preview, Premium rate) i stedet for gpt-4.1-mini (Basic), kan Credits-forbruket øke 5–10x. Overvåk forbruk via Power Platform admin center og sett budsjetter.
|
||||
|
|
@ -557,7 +557,7 @@ GPT-4o mini og GPT-4o brukes fortsatt i US Government regions (offer comparable
|
|||
Hentet: 2026-02
|
||||
Innhold: Priseksempler med gpt-4.1 Global ($2/$8) og gpt-4.1-mini Global ($0.40/$1.60) bekreftet
|
||||
|
||||
5. **Azure OpenAI in Microsoft Foundry Models quotas and limits**
|
||||
5. **Azure OpenAI in Foundry Models quotas and limits**
|
||||
URL: https://learn.microsoft.com/azure/foundry/openai/quotas-limits?view=foundry-classic
|
||||
Hentet: 2026-02
|
||||
Innhold: GPT-5- og GPT-4.1-seriens kvotestruktur, usage tiers, deployment-typer
|
||||
|
|
@ -583,7 +583,7 @@ GPT-4o mini og GPT-4o brukes fortsatt i US Government regions (offer comparable
|
|||
URL: https://azure.microsoft.com/pricing/details/cognitive-services/openai-service/
|
||||
Note: Dynamisk side (krever JavaScript). Sjekk manuelt for eksakte GPT-5-priser når de publiseres.
|
||||
|
||||
10. **Azure AI Foundry PTU Calculator**
|
||||
10. **Microsoft Foundry PTU Calculator**
|
||||
URL: https://ai.azure.com/resource/calculator
|
||||
Note: Beregn PTU break-even for spesifikke workloads
|
||||
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue