- analyze returns 202 immediately; frontend polls group status (3s interval, 30min cap) - quota system: atomic check-and-consume, trial/team/enterprise plans, 402 on exceed - persona generation split into tier batches (Cloudflare 120s limit safe) - LLM client: 105s timeout, thinking param for reasoning models - tests: quota suite (4), persona cardinality/initiation updates