Skip to content
Berktug Berke Ates

Ingénieur logiciel

Contact

Blog

Notes de terrain sur l'architecture logicielle, les produits d'IA, l'ingénierie multiplateforme, la fiabilité et le leadership technique.

Modèles de permissions pour copilotes IA multi-tenantUn copilote IA multi-tenant qui hérite des permissions de chat mais ignore les ACL données citera avec assurance le mauvais tenant. Les appels d'outils doivent suivre le même chemin d'autorisation que vos API—scoped par tenant, rôle et ressource. · 7 min de lectureInvalidation de cache pour les UI IA personnaliséesLes surfaces IA personnalisées mettent en cache embeddings, completions et fragments d'UI pour la vitesse—puis servent la mauvaise réponse au mauvais utilisateur. L'invalidation doit suivre identité, entitlements et versions de prompt, pas seulement le TTL. · 7 min de lectureConcevoir des files d'escalade humaine pour les agentsLes agents qui n'escaladent jamais semblent autonomes—jusqu'à faire échouer les utilisateurs en silence. Les files d'escalade exigent règles de triage, context packs, SLA et boucles de feedback—pas un bouton générique 'parler à un humain' collé au chat. · 7 min de lectureAttribution des coûts pour les passerelles LLM partagéesUne passerelle LLM partagée sans attribution des coûts devient un trou noir : les équipes optimisent les prompts localement tandis que la finance voit une facture opaque. Étiquetez chaque token à tenant, produit et caller—sinon pas de chargeback, throttle ni debug de dépense. · 7 min de lectureConflits de sync offline-first dans les apps mobilesL'UX offline-first promet la continuité ; la sync promet la cohérence éventuelle. Sans modèles de conflit explicites, les utilisateurs voient des actions dupliquées, des edits perdus et des tickets qui ne se reproduisent qu'en avion. · 7 min de lectureFeature store vs prompt store : arbitragesLes feature stores optimisent des signaux déterministes pour les modèles ; les prompt stores optimisent langage, outils et politique pour les LLM. Les confondre crée une double vérité et un contexte périmé. · 7 min de lectureContract testing pour l'appel d'outils IAQuand le modèle invente des arguments ou saute des champs requis, les tests unitaires du prompt ne suffisent pas. Les contract tests font des schémas d'outils des frontières exécutoires. · 7 min de lectureProgressive delivery pour le SaaS multi-tenantEnvoyer le même binaire à tous les tenants d'un coup est un choix de blast radius. La progressive delivery prouve le changement sur les bonnes cohortes avant que toute la flotte le sente. · 7 min de lectureMesurer la qualité de retrieval sans vanity metricsLa similarité d'embedding et le clic en démo ne prouvent pas que le retrieval aide les utilisateurs. Mesurez le succès de tâche, les taux de réponses ancrées et les hard negatives qui ne doivent rien renvoyer. · 7 min de lectureModèles d'ownership pour le code plateforme partagéLes libraries partagées sans owners clairs deviennent la dépendance de tous et l'incident de personne. Choisissez un modèle d'ownership aligné sur le blast radius, le rythme de change et qui est pagé. · 7 min de lecture