Referenz
Grenzwerte und Quoten
Konsolidierte Übersicht über alle Limits der knowmind-Plattform. Werte zum Stand 11. Juni 2026 — Änderungen werden im Änderungsprotokoll vermerkt.
| Bereich | Limit | Quelle |
|---|---|---|
| Anzahl Erinnerungen, Tarif Privat | 2.500 | Tarif-Matrix |
| Anzahl Erinnerungen, Tarif Pro und höher | unbegrenzt | Tarif-Matrix |
| Soft-Warnung Erinnerungen | ab 80 % des Tarif-Limits (warnAt80 in stats und store-Antworten) | Quota-Gate |
| API-Rate-Limit, Tarif Privat | 30 Anfragen pro Minute pro Token | Tarif-Matrix |
| API-Rate-Limit, Tarif Pro | 60 Anfragen pro Minute pro Token | Tarif-Matrix |
| API-Rate-Limit, Tarif Team | 120 Anfragen pro Minute pro Token | Tarif-Matrix |
| API-Rate-Limit, Tarif Business | 120 Anfragen pro Minute pro Token | Tarif-Matrix |
| API-Rate-Limit, Tarif Enterprise | 600 Anfragen pro Minute pro Token | Tarif-Matrix |
| Maximale Dokument-Größe (Upload) | 10 MB | Memory-Service |
| Maximale Erinnerungs-Größe (store_memory) | 100 KB | Memory-Service |
| Recall — Anzahl Treffer (k) | 1 bis 25 | MCP-Tool-Schema |
| Recall — Graph-Hops | 0 bis 3 | MCP-Tool-Schema |
| Chunk-Größe beim Upload | ca. 500 Tokens mit 50 Tokens Überlappung | Recall-Pipeline |
| Embedding-Dimension | 1024 (multilingual-e5-large) | Recall-Pipeline |
| Webhook-Body-Größe | 1 MB | Webhook-Worker |
| Webhook-Timeout | 15 Sekunden | Webhook-Worker |
| Webhook-Retries | 6 Versuche (sofort, 1 min, 5 min, 30 min, 2 h, 12 h) | Webhook-Worker |
| Dead-Letter-Schwelle | Subscription wird nach 20 aufeinanderfolgenden Fehlern deaktiviert | Webhook-Worker |
| Audit-Log-Retention, Privat | 30 Tage | Tarif-Matrix |
| Audit-Log-Retention, Pro | 90 Tage | Tarif-Matrix |
| Audit-Log-Retention, Team | 12 Monate (365 Tage) | Tarif-Matrix |
| Audit-Log-Retention, Business | 24 Monate (730 Tage) | Tarif-Matrix |
| Audit-Log-Retention, Enterprise | 5 Jahre (1825 Tage) | Tarif-Matrix |
| OAuth-Code-Gültigkeit | 10 Minuten | OAuth-Server |
| Magic-Link-Gültigkeit | 24 Stunden | Auth-Service |
| API-Token-Format | kmt_ + 43 base64url-Zeichen (256 bit Entropie) | Token-Modul |
| Maximale Anzahl Tokens pro Arbeitsbereich | 50 aktive (höhere Anzahl auf Anfrage im Enterprise-Tarif) | Token-Modul |
Verhalten bei Überschreitung
- Rate-Limit (429): Antwort enthält Header
Retry-Afterin Sekunden. Client soll warten und erneut versuchen, idealerweise mit Jitter. - Erinnerungs-Limit — Soft-Warnung ab 80 %:
knowmind_statsund die Erfolgsantworten vonstore_memory/upload_documententhalten die FeldermemoryLimit,memoriesUsedundwarnAt80plus einen Klartext-Hinweis. Gezählt werden die gespeicherten Dokumente/Erinnerungen des Arbeitsbereichs — NICHT die automatisch extrahierten Graph-Knoten. - Erinnerungs-Limit erreicht (402): Schreib-Aufruf wird abgewiesen, Antwort enthält
plan_upgrade_requiredmit Hinweis auf den nötigen Tarif (REST: HTTP 402; MCP: JSON-RPC-Fehler mit derselben Meldung). Bestehende Inhalte und alle Lese-Funktionen (Recall, Export) bleiben unverändert nutzbar. - Dokument zu groß (413): Aufruf wird abgewiesen. Inhalt aufteilen und in mehreren Aufrufen ingesten.
- Webhook-Dead-Letter: Lieferung wird als dead markiert. Bei 20 aufeinanderfolgenden Fehlern wird die gesamte Subscription deaktiviert; manuelle Reaktivierung im Dashboard.
Verfügbarkeits-Monitoring: GET /health
Für Uptime-Checks steht GET https://knowmind.de/health bereit — öffentlich, ohne Authentifizierung und ohne Rate-Limit. Antwort: HTTP 200 mit Klartext-Body ok.
- Beantwortet der Edge-Proxy direkt — der Check belegt keine Anwendungs- oder Datenbank-Ressourcen und eignet sich auch für kurze Intervalle (z. B. alle 60 Sekunden).
- Geprüft wird die Erreichbarkeit der Plattform, NICHT der Zustand einzelner Dienste dahinter (Datenbank, Memory-Service).
- Der Endpoint ist auch in der OpenAPI-Spezifikation dokumentiert.