Berktug Berke Ates
Contact软件工程师
博客
关于软件架构、AI 产品、跨平台工程、可靠性与技术领导力的一线笔记。
多租户 AI 副驾驶的权限模型继承聊天权限却忽略数据 ACL 的多租户 AI 副驾驶会自信地引用错误租户。工具调用需要与你们的 API 走同一条授权路径——按租户、角色与资源限定范围。 · 7 分钟阅读个性化 AI 界面的缓存失效个性化 AI 界面为速度缓存嵌入、补全与 UI 片段——然后把错误答案送给错误用户。失效必须跟踪身份、权益与提示版本,而不仅是 TTL。 · 7 分钟阅读为智能体设计人工升级队列从不升级的智能体看似自主——直到默默让用户失败。升级队列需要分诊规则、上下文包、SLA 与反馈闭环——而不是贴在聊天上的通用「找人工」按钮。 · 7 分钟阅读共享 LLM 网关的成本归因没有成本归因的共享 LLM 网关会变成黑洞:团队在本地优化提示,财务只看到一张不透明账单。把每个 token 打到租户、产品与调用方——否则无法计费、限流或调试支出。 · 7 分钟阅读移动应用中的离线优先同步冲突离线优先 UX 承诺连续性;同步承诺最终一致性。没有明确的冲突模型,用户会看到重复操作、丢失编辑,以及只在飞机上才能复现的工单。 · 7 分钟阅读Feature Store 与 Prompt Store 的权衡Feature store 为模型优化确定性信号;prompt store 为 LLM 优化语言、工具与策略。混为一谈会产生双重真相与陈旧上下文。 · 7 分钟阅读面向 AI 工具调用的契约测试当模型编造参数或跳过必填字段时,针对提示词的单元测试不够。契约测试把工具 schema 变成模型与系统之间可强制执行的边界。 · 7 分钟阅读面向多租户 SaaS 的渐进式交付把同一二进制一次发给所有租户是爆炸半径的选择。渐进式交付让你在整支舰队感知之前,先在正确人群上证明变更。 · 7 分钟阅读不用虚荣指标衡量检索质量向量相似度与演示点击不能证明检索对用户有帮助。衡量任务成功、有依据回答率,以及本应返回空的 hard negative。 · 7 分钟阅读共享平台代码的归属模型没有明确负责人的共享库会成为所有人的依赖、无人的事故。选择与爆炸半径、变更速率以及谁被呼叫相匹配的归属模型。 · 7 分钟阅读