Skip to content
Berktug Berke Ates

Software Engineer

Contact

Blog

Feldnotizen zu Softwarearchitektur, KI-Produkten, plattformübergreifender Entwicklung, Zuverlässigkeit und technischer Führung.

Berechtigungsmodelle für Multi-Tenant-AI-CopilotsEin Multi-Tenant-AI-Copilot der Chat-Permissions erbt aber Data-ACLs ignoriert, zitiert selbstbewusst den falschen Tenant. Tool-Calls brauchen denselben Authorization-Pfad wie Ihre APIs—scoped pro Tenant, Rolle und Resource. · 7 Min. LesezeitCache-Invalidierung für personalisierte AI-UIsPersonalisierte AI-Surfaces cachen Embeddings, Completions und UI-Fragmente für Speed—und servieren dann dem falschen User die falsche Antwort. Invalidierung muss Identity, Entitlements und Prompt-Versionen tracken, nicht nur TTL. · 7 Min. LesezeitHuman-Escalation-Queues für Agents designenAgents die nie eskalieren wirken autonom—bis sie Nutzer still scheitern lassen. Escalation-Queues brauchen Triage-Regeln, Context-Packs, SLAs und Feedback-Loops—keinen generischen 'mit Mensch sprechen'-Button am Chat. · 7 Min. LesezeitKostenzuordnung für shared LLM GatewaysEin shared LLM Gateway ohne Kostenzuordnung wird zum schwarzen Loch: Teams optimieren Prompts lokal, Finance sieht eine undurchsichtige Rechnung. Taggen Sie jeden Token auf Tenant, Produkt und Caller—sonst kein Chargeback, Throttle oder Spend-Debug. · 7 Min. LesezeitOffline-First-Sync-Konflikte in Mobile AppsOffline-First-UX verspricht Kontinuität; Sync verspricht eventual consistency. Ohne explizite Konfliktmodelle sehen Nutzer doppelte Aktionen, verlorene Edits und Support-Tickets die nur im Flugzeug reproduzieren. · 7 Min. LesezeitFeature Store vs Prompt Store: Trade-offsFeature Stores optimieren deterministische Signale für Modelle; Prompt Stores optimieren Sprache, Tools und Policy für LLMs. Verwechslung erzeugt doppelte Wahrheit und veralteten Kontext. · 7 Min. LesezeitContract Testing für AI Tool CallingWenn Modelle Argumente erfinden oder Pflichtfelder auslassen, reichen Unit Tests am Prompt nicht. Contract Tests machen Tool-Schemas zu durchsetzbaren Grenzen zwischen Modell und Systemen. · 7 Min. LesezeitProgressive Delivery für Multi-Tenant-SaaSDasselbe Binary an alle Tenants gleichzeitig zu shippen ist eine Blast-Radius-Entscheidung. Progressive Delivery beweist Change zuerst auf den richtigen Kohorten. · 7 Min. LesezeitRetrieval-Qualität ohne Vanity Metrics messenEmbedding-Ähnlichkeit und Demo-Klicks beweisen nicht, dass Retrieval Nutzern hilft. Messen Sie Task-Erfolg, Grounded-Answer-Raten und Hard Negatives die nichts zurückgeben sollten. · 7 Min. LesezeitOwnership-Modelle für geteilten Platform-CodeGeteilte Libraries ohne klare Owner werden jedermanns Dependency und niemandes Incident. Wählen Sie ein Ownership-Modell das zu Blast Radius, Änderungsrate und Paging passt. · 7 Min. Lesezeit