Copilot Studio Friction
Agent stoppt mit GenAIToolPlannerRateLimitReached oder einem anderen Rate-Limit-Fehler
Zuletzt verifiziert
Details & Verwandtes
Einschätzung
- Vertrauensstufe
- Offiziell bestätigtDurch Microsoft-Dokumentation oder eine offizielle Aussage bestätigt.
- Schweregrad
- Blockierend
- Typischer Zeitverlust
- Stunden
Identifikation
Verifikation & Änderungen
Verifiziert
Doku-Check durch Mensch: Throttling troubleshooting page and quotas page re-read during seed migration; all three error codes and the RPM tiers are still documented.
Änderung
Vorläufig durch die Product Ownerin freigegeben; externe LLM-Qualitätsprüfung ausstehend.
Änderung
Erster Eintrag aus dem Seed-Dossier erstellt (Migrationswelle 1).
Automatisch übersetzte Fassung — massgeblich ist das englische Original.
Sind Sie hier richtig?
- Ihr Agent antwortet nicht mehr und meldet den Fehlercode
GenAIToolPlannerRateLimitReached. - Oder Sie sehen
GenAISearchandSummarizeRateLimitReachedoderOpenAIRateLimitReached. - Die Fehler treten unter Last oder in Schüben auf und verschwinden später wieder.
- Klassische Themen funktionieren möglicherweise weiter, während generative Features fehlschlagen.
- An der Konfiguration des Agents hat sich nichts geändert.
Falls der Agent stattdessen meldet «This agent is currently unavailable. It has reached its usage limit.» → siehe Agent nach Erreichen des Nutzungslimits nicht verfügbar.
Falls stattdessen jede Nachricht in Teams mit SystemError fehlschlägt → siehe SystemError in Teams.
Falls stattdessen Ihre Credits schneller aufgebraucht werden als geplant → siehe Credits schneller als erwartet verbraucht.
Was passiert
Diese drei Codes ergeben ein einziges Fehlerbild: eine Drosselung auf Feature-Ebene. Copilot Studio begrenzt generative Features getrennt vom einfachen Nachrichtenverkehr. Die Limits gelten pro Umgebung, und jedes generative Feature hat seinen eigenen Zähler. Ihr Agent kann bei der Orchestrierung gedrosselt werden, während klassische Themen im selben Agent weiterlaufen. Dieser Kontrast lässt das Problem wie zufälliges Fehlverhalten aussehen. Stellen Sie sich eine Autobahn mit dosierter Auffahrt vor: Die Ampel an der Auffahrt kann Sie anhalten, während der reguläre Verkehr weiterfliesst. Das Rate-Limit der generativen KI ist nach Kapazität gestaffelt (dokumentiert per 2026-07-08). Test- und Entwicklungsumgebungen erhalten 10 Anfragen pro Minute. Ein bis zehn Nachrichtenpakete (message packs) erhöhen es auf 50. Nutzungsbasierte Bezahlung und Microsoft 365 Copilot-Nutzer erhalten 100.
Für Technikerinnen und Techniker
Die Drosselungsseite ordnet die Codes den Features zu.
GenAIToolPlannerRateLimitReached betrifft die Planung durch die generative Orchestrierung.
Dokumentierter Text: "The usage limit for generative orchestration has been reached."
GenAISearchandSummarizeRateLimitReached betrifft die generativen Antworten.
OpenAIRateLimitReached betrifft die dahinterliegenden Modellaufrufe.
Kontingente sind an die Dataverse-Umgebung gebunden, nicht an den Agent.
Das separate Limit für einfache Nachrichten liegt bei 8'000 Anfragen pro Minute und Umgebung (dokumentiert per 2026-07-08).
EnforcementMessage ist ein anderer Mechanismus: eine Überschreitung der Credits, keine Feature-Drosselung.
So beheben Sie es
Lösung 1
Offizieller WorkaroundErmitteln, welchen Zähler Sie erreicht haben
- Notieren Sie den genauen Fehlercode aus der fehlgeschlagenen Konversation.
- Ordnen Sie ihn seinem Feature zu: Planner, Search-and-Summarize oder Modellaufruf.
- Prüfen Sie, wann sich die Fehler häufen — Tageszeit, Kampagne, Batch-Job.
- Vergleichen Sie diesen Schub mit dem Anfragen-pro-Minute-Limit Ihrer Stufe.
✅ Sie sollten jetzt sehen: welches Feature welches Limit überschreitet und wann.
Lösung 2
Offizieller WorkaroundDie Last verteilen
- Listen Sie alle Agents auf, die in der betroffenen Umgebung laufen.
- Verschieben Sie Agents mit hohem Datenverkehr in eine separate Umgebung — die Drosselung zählt pro Umgebung.
- Verteilen Sie geplanten oder Batch-Verkehr zeitlich, statt ihn auf einmal auszulösen.
- Testen Sie während Ihres früheren Spitzenfensters erneut.
✅ Sie sollten jetzt sehen: dass die Rate-Limit-Fehler während der neu verteilten Spitze verschwinden.
Lösung 3
Offizieller WorkaroundIhre Kapazitätsstufe erhöhen
- Prüfen Sie Ihre aktuelle Stufe: Testversion, Nachrichtenpakete oder nutzungsbasierte Bezahlung.
- Überprüfen Sie die Kapazität im Power Platform Admin Center.
- Lesen Sie die dokumentierte Stufentabelle erneut, bevor Sie kaufen (dokumentiert per 2026-07-08).
- Fügen Sie Nachrichtenpakete hinzu oder aktivieren Sie die nutzungsbasierte Bezahlung, um eine höhere Anfragen-pro-Minute-Stufe zu erreichen.
✅ Sie sollten jetzt sehen: ein höheres Rate-Limit der generativen KI für die Umgebung.
Prüfen, ob es funktioniert hat
Spielen Sie die Last erneut ab, die die Drosselung ausgelöst hat — gleiches Volumen, gleiches Zeitfenster, im veröffentlichten Kanal. Erwartet: Es treten keine Rate-Limit-Codes auf, und generative Features antworten während des gesamten Schubs.
Falls es nicht funktioniert hat
- Der Schub ist grösser als jede Stufe. Über jeder Stufe liegt ein Budget pro Umgebung. Stellen Sie den Verkehr in eine Warteschlange oder verteilen Sie ihn auf mehrere Umgebungen.
- Sie haben den falschen Zähler behoben. Drei Codes, drei Features. Lesen Sie den Code erneut; eine Planner-Korrektur erhöht nicht das Search-and-Summarize-Limit.
- Etwas anderes verbraucht das Budget der Umgebung. Andere Agents und Maker in derselben Umgebung teilen sich das Kontingent. Prüfen Sie, wer sonst noch dort läuft.
- Stattdessen sind die Credits aufgebraucht.
EnforcementMessageund das Banner zum Nutzungslimit sind ein anderes Problem. Siehe Agent nach Erreichen des Nutzungslimits nicht verfügbar.
So verhindern Sie es künftig
- Nehmen Sie die Anfragen-pro-Minute-Stufen vor dem Start in Ihre Kapazitätsplanung auf, nicht erst nach der ersten Drosselung.
- Geben Sie Agents mit hohem Datenverkehr von Tag eins an eine eigene Umgebung.
Belege
Offizielle Dokumentationlearn.microsoft.com
Die Troubleshooting-Seite zur Drosselung dokumentiert GenAIToolPlannerRateLimitReached, GenAISearchandSummarizeRateLimitReached und OpenAIRateLimitReached als Drosselungen auf Feature-Ebene pro Umgebung.
Offizielle Dokumentationlearn.microsoft.com
Die Kontingent-Seite staffelt das Rate-Limit für Nachrichten der generativen KI nach Kapazität, von 10 RPM in der Testversion bis 100 RPM für Nutzer mit nutzungsbasierter Bezahlung oder M365 Copilot.