fix(ms-ai-architect): Spor 0 — 37 kilde-verifiserte KB-feil fikset (25 ref-filer), 1 avvist [skip-docs]
Per-kilde verifiserings-agenter (Opus xhigh, live microsoft_docs_fetch) bekreftet hver verdi mot kilden FOER endring; alle forekomster av samme gale fakta fikset fil-vidt (ikke bare sitert linje). - 37/38 confirm-fix anvendt; #8 (model-selection «Model Router GA») AVVIST: fila var allerede korrekt (Model Router GA siden 2025-11-18); den siterte model-choice-guide har utdatert «(preview)»-etikett. AA «fikse» ville innfoert en feil. - Tverteklynger reconciled til kilde-sann verdi: AI Search storage (S1 160/S2 512/S3 1024/L1 2048/L2 4096 GB; vektor 5/35/150/300), Quota Tiers (erstatter Default/Enterprise + «1 Unit Capacity»). - Hoey-innsats: realtime Schrems II omskrevet (global deployment != EU-residens, selv-verifisert mot kilde); Data Zone Norway East = gpt-5.4 OG gpt-5.5 (ikke kun 5.5); computer-use = gpt-5.4 + computer-tool (region flagget for verifisering). - Suite 552/552 groenn. Manifest oppdatert (fixed/verdict/verified per fiks). Spor 1-froe (cross-fil-gjentakelser i UBEROERTE filer): «DDoS Protection Standard» i ros-ai-threat-library.md + zero-trust-ai-services.md. Tilstoetende funn (ikke i de 38): se docs / STATE.
This commit is contained in:
parent
2b6fb62f53
commit
2c54f0d5a0
26 changed files with 327 additions and 207 deletions
|
|
@ -62,7 +62,7 @@ PTU er en kapasitetsbasert prismodell for Azure OpenAI, primært for produksjons
|
|||
**Fakturering:**
|
||||
- **Timepris:** Beregnes per PTU per time ($/PTU/hr)
|
||||
- **Pro-rata:** Delvis time faktureres proporsjonalt (15 min = 1/4 timepris)
|
||||
- **Reservasjonsrabatt:** 1-års eller 3-års Azure Reservations gir betydelige rabatter (opptil 50 % besparelse)
|
||||
- **Reservasjonsrabatt:** 1-måneds eller 1-års Azure Reservations gir betydelige rabatter (ingen 3-årstermin for Foundry PTU; faktisk rabatt varierer per modellfamilie og term)
|
||||
|
||||
**Kapasitetsplanlegging:**
|
||||
- Bruk **Foundry PTU Calculator** (tilgjengelig i Microsoft Foundry portal)
|
||||
|
|
@ -109,7 +109,7 @@ PTU er en kapasitetsbasert prismodell for Azure OpenAI, primært for produksjons
|
|||
- Vurder PTU for Azure OpenAI med SLA-krav
|
||||
|
||||
**Fase 3 (Optimalisering):** Reservasjoner + Tagging
|
||||
- Kjøp 1-års eller 3-års PTU-reservasjon
|
||||
- Kjøp 1-måneds eller 1-års PTU-reservasjon
|
||||
- Bruk tags for kostnadsallokering per prosjekt/team
|
||||
|
||||
**Verified** – Microsoft Learn: Plan and Manage Costs for Azure OpenAI.
|
||||
|
|
@ -156,7 +156,7 @@ PTU er en kapasitetsbasert prismodell for Azure OpenAI, primært for produksjons
|
|||
- Azure OpenAI i produksjon
|
||||
- SLA-krav (latency, throughput)
|
||||
- Høy, forutsigbar trafikk (> 100K tokens/dag)
|
||||
- Langsiktig forpliktelse (1-3 år reservasjon gir best ROI)
|
||||
- Langsiktig forpliktelse (1-års reservasjon gir best ROI; 3-årstermin finnes ikke for Foundry PTU)
|
||||
|
||||
❌ **Ikke bruk når:**
|
||||
- Lav trafikk eller pilot-fase
|
||||
|
|
@ -307,7 +307,7 @@ PTU er en kapasitetsbasert prismodell for Azure OpenAI, primært for produksjons
|
|||
1. "Er dette Azure OpenAI i produksjon?"
|
||||
2. "Har dere latency/throughput-krav i SLA?"
|
||||
3. "Er trafikken forutsigbar (> 100K tokens/dag)?"
|
||||
4. "Kan dere forplikte deg til 1-3 år?"
|
||||
4. "Kan dere forplikte deg til 1 år?"
|
||||
|
||||
**Anbefaling:**
|
||||
- Hvis JA på alle → **Anbefal PTU med 1-års reservasjon**
|
||||
|
|
|
|||
|
|
@ -106,7 +106,7 @@ Microsoft tilbyr flere nivåer av AI-tjenester under paraplynavnet "Azure AI Ser
|
|||
**Nøkkelkapabiliteter:**
|
||||
|
||||
- **Agent Service:** Managed runtime for agentic AI (conversation state, tool orchestration, safety enforcement)
|
||||
- **Model Catalog:** 100+ modeller fra Microsoft, OpenAI, Anthropic, Meta, Mistral, Cohere
|
||||
- **Model Catalog:** over 1 900 modeller fra Microsoft, OpenAI, Anthropic, Meta, Mistral, Cohere
|
||||
- **Connected agents:** Integrasjon med Azure AI Search, SharePoint, Bing, Azure Functions, Logic Apps
|
||||
- **Workflows:** YAML-basert multi-agent orkestrering med visual designer
|
||||
- **Observability:** Built-in tracing via Application Insights (traces, evaluations, conversation-level visibility)
|
||||
|
|
@ -124,17 +124,16 @@ Microsoft tilbyr flere nivåer av AI-tjenester under paraplynavnet "Azure AI Ser
|
|||
|
||||
**Definisjon:** Spesialisert tjeneste for å få tilgang til OpenAI-modeller (GPT, DALL-E, Whisper, Embeddings) med Azure enterprise-fordeler (sikkerhet, compliance, SLA).
|
||||
|
||||
#### Modellserie (2026-02)
|
||||
#### Modellserie (2026-06)
|
||||
|
||||
| Modell | Bruksområde | Deployment-typer |
|
||||
|--------|-------------|------------------|
|
||||
| **o4-mini** | Reasoning, kompleks problemløsning | Standard, Global Standard |
|
||||
| **o3, o3-mini** | Avansert reasoning | Standard, Provisioned Throughput |
|
||||
| **GPT-5-generasjonen** (GPT-5/5.1/5.2/5.4/5.5 + -mini/-nano/-codex) | Ledende reasoning og chat (flaggskip; GPT-5.5 nyest) | Se region-verifisert `model-catalog-2026.md` |
|
||||
| **GPT-4.1, GPT-4.1-mini, GPT-4.1-nano** | Lang kontekst (~1M tokens), kostnadsspekter | Standard, Global Standard, Provisioned |
|
||||
| **o4-mini, o3, o3-mini** | Eldre o-serie reasoning (erstattet av GPT-5-gen for nye design) | Standard, Provisioned |
|
||||
| **GPT-4o, GPT-4o-mini** | Chat, multimodal (tekst/bilde) | Standard, Global Standard, Provisioned |
|
||||
| **GPT-4 Turbo** | Long-context tasks (128k tokens) | Standard, Provisioned |
|
||||
| **GPT-3.5-Turbo** | Kostnadseffektiv chat | Standard, Global Standard |
|
||||
| **DALL-E 3** | Bildegenerering | Standard |
|
||||
| **Whisper** | Speech-to-text | Standard |
|
||||
| **Bildegenerering (GPT-image / DALL-E 3)** | Bildegenerering | Standard |
|
||||
| **Whisper / gpt-4o-transcribe** | Tale-til-tekst | Standard |
|
||||
| **Embeddings** (text-embedding-3) | Vektorisering for RAG | Standard |
|
||||
|
||||
#### Deployment-typer
|
||||
|
|
@ -529,7 +528,7 @@ START: Hvilken AI-kapabilitet trenger du?
|
|||
**Faktorer som påvirker kostnad:**
|
||||
|
||||
1. **Volum:** Antall API-kall, tokens, bilder, minutter audio
|
||||
2. **Modellvalg:** GPT-4o > GPT-4o-mini > GPT-3.5-Turbo (kostnad)
|
||||
2. **Modellvalg:** GPT-4o > GPT-4o-mini > GPT-4.1-nano (kostnad)
|
||||
3. **Deployment-type:** PTU > Standard > Global Standard
|
||||
4. **Region:** Noen regioner er dyrere (f.eks. EU vs. US East)
|
||||
5. **Features:** Content Safety, fine-tuning, hosting (Azure OpenAI)
|
||||
|
|
|
|||
Loading…
Add table
Add a link
Reference in a new issue