From 14c71ff7a00b7cf44635af7b24a1c3f548e7b32f Mon Sep 17 00:00:00 2001 From: Kjell Tore Guttormsen Date: Wed, 24 Jun 2026 11:38:23 +0200 Subject: [PATCH] =?UTF-8?q?docs(ms-ai-architect):=20KB-refresh=20MEDIUM=20?= =?UTF-8?q?6/33=20=E2=80=94=20multi-turn:=20RPM/TPM-forhold=20varierer=20p?= =?UTF-8?q?er=20modell=20(6=20RPM/1K=20kun=20eldre=20chat)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- .../prompt-engineering/multi-turn-conversation-management.md | 4 ++-- 1 file changed, 2 insertions(+), 2 deletions(-) diff --git a/skills/ms-ai-advisor/references/prompt-engineering/multi-turn-conversation-management.md b/skills/ms-ai-advisor/references/prompt-engineering/multi-turn-conversation-management.md index 5529e12..e87045a 100644 --- a/skills/ms-ai-advisor/references/prompt-engineering/multi-turn-conversation-management.md +++ b/skills/ms-ai-advisor/references/prompt-engineering/multi-turn-conversation-management.md @@ -1,6 +1,6 @@ # Multi-Turn Conversation and Context Management -**Last updated:** 2026-02 +**Last updated:** 2026-06-24 **Status:** GA **Category:** Prompt Engineering & LLM Optimization @@ -312,7 +312,7 @@ AgentSession resumedSession = await agent.DeserializeSessionAsync(serializedSess - Prompt tokens + `max_tokens` parameter + `best_of` parameter - **Ikke** identisk med billing token count -**RPM (Requests-Per-Minute)** er koblet til TPM: **6 RPM per 1K TPM**. +**RPM (Requests-Per-Minute)** er koblet til TPM, men **forholdet varierer per modell**. For eldre chat-modeller (gpt-4o-klassen) er det **6 RPM per 1K TPM**; reasoning-modeller bruker andre forhold (f.eks. o3 og o4-mini: 1 RPM/1K TPM; o3-mini, o1-mini og o3-pro: 1 RPM/10K TPM; o1: 1 RPM/6K TPM). **Best practices:** - Implementer exponential backoff ved 429-errors