Referenz

Grenzwerte und Quoten

Konsolidierte Übersicht über alle Limits der knowmind-Plattform. Werte zum Stand 11. Juni 2026 — Änderungen werden im Änderungsprotokoll vermerkt.

BereichLimitQuelle
Anzahl Erinnerungen, Tarif Privat2.500Tarif-Matrix
Anzahl Erinnerungen, Tarif Pro und höherunbegrenztTarif-Matrix
Soft-Warnung Erinnerungenab 80 % des Tarif-Limits (warnAt80 in stats und store-Antworten)Quota-Gate
API-Rate-Limit, Tarif Privat30 Anfragen pro Minute pro TokenTarif-Matrix
API-Rate-Limit, Tarif Pro60 Anfragen pro Minute pro TokenTarif-Matrix
API-Rate-Limit, Tarif Team120 Anfragen pro Minute pro TokenTarif-Matrix
API-Rate-Limit, Tarif Business120 Anfragen pro Minute pro TokenTarif-Matrix
API-Rate-Limit, Tarif Enterprise600 Anfragen pro Minute pro TokenTarif-Matrix
Maximale Dokument-Größe (Upload)10 MBMemory-Service
Maximale Erinnerungs-Größe (store_memory)100 KBMemory-Service
Recall — Anzahl Treffer (k)1 bis 25MCP-Tool-Schema
Recall — Graph-Hops0 bis 3MCP-Tool-Schema
Chunk-Größe beim Uploadca. 500 Tokens mit 50 Tokens ÜberlappungRecall-Pipeline
Embedding-Dimension1024 (multilingual-e5-large)Recall-Pipeline
Webhook-Body-Größe1 MBWebhook-Worker
Webhook-Timeout15 SekundenWebhook-Worker
Webhook-Retries6 Versuche (sofort, 1 min, 5 min, 30 min, 2 h, 12 h)Webhook-Worker
Dead-Letter-SchwelleSubscription wird nach 20 aufeinanderfolgenden Fehlern deaktiviertWebhook-Worker
Audit-Log-Retention, Privat30 TageTarif-Matrix
Audit-Log-Retention, Pro90 TageTarif-Matrix
Audit-Log-Retention, Team12 Monate (365 Tage)Tarif-Matrix
Audit-Log-Retention, Business24 Monate (730 Tage)Tarif-Matrix
Audit-Log-Retention, Enterprise5 Jahre (1825 Tage)Tarif-Matrix
OAuth-Code-Gültigkeit10 MinutenOAuth-Server
Magic-Link-Gültigkeit24 StundenAuth-Service
API-Token-Formatkmt_ + 43 base64url-Zeichen (256 bit Entropie)Token-Modul
Maximale Anzahl Tokens pro Arbeitsbereich50 aktive (höhere Anzahl auf Anfrage im Enterprise-Tarif)Token-Modul

Verhalten bei Überschreitung

  • Rate-Limit (429): Antwort enthält Header Retry-After in Sekunden. Client soll warten und erneut versuchen, idealerweise mit Jitter.
  • Erinnerungs-Limit — Soft-Warnung ab 80 %: knowmind_stats und die Erfolgsantworten von store_memory/upload_document enthalten die Felder memoryLimit, memoriesUsed und warnAt80 plus einen Klartext-Hinweis. Gezählt werden die gespeicherten Dokumente/Erinnerungen des Arbeitsbereichs — NICHT die automatisch extrahierten Graph-Knoten.
  • Erinnerungs-Limit erreicht (402): Schreib-Aufruf wird abgewiesen, Antwort enthält plan_upgrade_required mit Hinweis auf den nötigen Tarif (REST: HTTP 402; MCP: JSON-RPC-Fehler mit derselben Meldung). Bestehende Inhalte und alle Lese-Funktionen (Recall, Export) bleiben unverändert nutzbar.
  • Dokument zu groß (413): Aufruf wird abgewiesen. Inhalt aufteilen und in mehreren Aufrufen ingesten.
  • Webhook-Dead-Letter: Lieferung wird als dead markiert. Bei 20 aufeinanderfolgenden Fehlern wird die gesamte Subscription deaktiviert; manuelle Reaktivierung im Dashboard.

Verfügbarkeits-Monitoring: GET /health

Für Uptime-Checks steht GET https://knowmind.de/health bereit — öffentlich, ohne Authentifizierung und ohne Rate-Limit. Antwort: HTTP 200 mit Klartext-Body ok.

  • Beantwortet der Edge-Proxy direkt — der Check belegt keine Anwendungs- oder Datenbank-Ressourcen und eignet sich auch für kurze Intervalle (z. B. alle 60 Sekunden).
  • Geprüft wird die Erreichbarkeit der Plattform, NICHT der Zustand einzelner Dienste dahinter (Datenbank, Memory-Service).
  • Der Endpoint ist auch in der OpenAPI-Spezifikation dokumentiert.

Weiterführend