供应商数据策略

共 27 题
#

1. ZDR 的适用范围和例外应如何进入技术设计,为什么它不自动覆盖工具、日志和第三方网关

A 自动覆盖所有环节
B 与网关无关
C 只覆盖日志
D 只覆盖发送给模型 API 的数据,需延伸到工具遥测、日志与第三方网关,并限定例外最小必要 ✓ 正确答案
#

2. 不同 Provider(OpenAI、Anthropic、Google、Azure、AWS Bedrock)的数据使用与保留条款差异应如何核验,并映射到采购决策?

A 只看价格
B 按训练/保留/地域/子处理方/合规维度核验并记录,映射到数据敏感度与合规要求的采购决策 ✓ 正确答案
C 全用同一家
D 不核验
#

3. EU/US/Asia 地域限定如何通过 DNS、端点、密钥、网关与遥测配置验证

A 只设 DNS
B 只配密钥
C 在端点、密钥、网关、遥测、存储全链路限定区域,并用实际请求验证落点 ✓ 正确答案
D 不验证
#

4. Provider 政策变化时,如何做影响分析、通知、配置切换和历史数据处置

A 忽略变化
B 影响分析→通知→配置切换→历史数据处置,并记录复审 ✓ 正确答案
C 立即删除所有数据
D 只看价格
#

5. 多 Provider Fallback 怎样避免在故障时把受限数据发送到不合规区域或无合同供应商

A 故障时任意 fallback
B 按数据分级绑定合规目标白名单,违规宁可降级也不发往不合规区域/无合同供应商 ✓ 正确答案
C 只限一个 Provider
D 不审计
#

6. 供应商的子处理方(Sub-processor)清单、第三方插件(Plugins/GPTs)如何纳入数据流审计与合同义务核对?

A 不跟踪
B 只审计主 Provider
C 跟踪子处理方清单与插件调用,用数据流图核对每个接收方的合同义务与合规 ✓ 正确答案
D 禁用所有插件
#

7. 供应商事故通知(SLA)的接收、影响评估、客户告知和监管报告的流程

A 只接收不处理
B 忽略事故
C 可靠接收→影响评估→客户告知→监管报告,全程记录并演练 ✓ 正确答案
D 只报告一次
#

8. 为什么所有供应商政策与能力结论都应标注核查日期并定期复审

A 只标一次
B 结论永远有效
C 供应商政策会变,旧结论会失效,需标注时效并定期复核更新 ✓ 正确答案
D 无需复审
#

9. 供应商声明、合同条款与实际 API 配置不一致时,应以何证据进行上线审查(合同 vs 技术验证)

A 以技术验证的实际行为为准,不符合合规则拒绝上线并推动修正 ✓ 正确答案
B 只看合同
C 只看供应商声明
D 三样都忽略
#

10. 自有部署(Self-hosted)与托管 API 的数据控制、审计、退出成本对比

A 运维成本更低
B 永远更便宜
C 无任何运维
D 数据控制与审计更强,退出成本低,但需自建推理运维 ✓ 正确答案
#

11. 点赞、点踩、用户编辑、偏好修正和人工标注分别能提供什么信号,怎样识别噪声与操纵

A 点赞是最强信号
B 用户编辑是强修正信号,需结合点赞/标注等多信号,并用频率与分布检测操纵与噪声 ✓ 正确答案
C 所有反馈都可靠
D 无需去噪
#

12. 如何从生产数据合规采样,构造 hard negatives、对抗样本和分层评估集

A 随机堆数据
B 合规采样+hard negatives/对抗样本+分层覆盖,并记录来源版本 ✓ 正确答案
C 只用正样本
D 不脱敏
#

13. 离线指标与线上留存、解决率、人工接管率不一致时,如何诊断“代理指标失效”(Proxy Metric Failure)

A 以离线为准
B 对比相关性、追溯线上失败案例、检查分布漂移与代理指标本身,再校准 ✓ 正确答案
C 以线上为准不做分析
D 忽略不一致
#

14. 如何防止反馈飞轮强化多数偏好、虚假信息或对少数群体的系统性偏差(Bias Amplification)

A 完全依赖多数反馈
B 不校验证
C 忽略少数群体
D 监测各群体反馈分布、对少数群体加权、校验虚假信息、约束多样性并人工校准 ✓ 正确答案
#

15. 反馈数据的标注一致性(Inter-annotator Agreement)应如何度量,低于阈值时如何重新标注或剔除样本?

A 用 Kappa 度量,低一致时重新标注、剔除歧义样本并改进标注规范 ✓ 正确答案
B 直接使用
C 只重标一次
D 忽略阈值
#

16. Feedback 系统的“游戏化”——用户为了奖励而刷反馈的检测与防御

A 按反馈次数给奖励
B 奖励绑定真实使用、频控限额、质量校验与异常模式检测 ✓ 正确答案
C 不设限
D 只看数量
#

17. Fallback Chain 如何比较候选模型的结构化输出、工具、多模态和安全能力,而不是只改模型名

A 结构化输出、工具、多模态、安全能力矩阵,按任务需求匹配并归一化输出 ✓ 正确答案
B 只改模型名
C 只看价格
D 只看速度
#

18. 带抖动的有界退避、断路器、幂等键和请求去重如何防止故障期间重复扣费或副作用

A 无限重试
B 有界抖动退避+断路器+幂等键+请求去重,保证重试幂等并止损 ✓ 正确答案
C 不做幂等
D 只依赖退避
#

19. 固定回答、模板回答、历史已验证答案和人工接管分别适合哪些降级等级

A 最低级用历史答案
B 历史已验证答案适合高可用降级,模板/固定用于更深降级,必要时人工接管 ✓ 正确答案
C 一律用固定回答
D 不降级
#

20. 云模型切到自托管模型时,容量、数据格式、内容安全和观测差异如何预先演练

A 容量压测、数据格式兼容、内容安全补齐、观测自建,并用影子流量/灰度验证 ✓ 正确答案
B 只换端点
C 不演练
D 只测格式
#

21. 降级响应如何明确告知用户“能力受限”和“数据新鲜度”,避免误以为仍是完整智能服务

A 不提示
B 与完整版相同呈现
C 用可见标识说明能力受限、数据新鲜度与原因,避免误以为完整服务 ✓ 正确答案
D 只写一个错误
#

22. Provider 事故复盘(Postmortem)的根因分析(5 Why)

A 归咎个人
B 换供应商了事
C 找到表层原因即可
D 逐层追问到系统/流程根因,形成可执行行动项并验证预防 ✓ 正确答案
#

23. Fallback Chain 的“链路过长”——多次 Fallback 后的延迟累计和最终用户体验保障

A 无限重试
B 只重试一次
C 不设预算
D 限制最大链长与总延迟预算,快速失败并尽早用高可用手段兜底 ✓ 正确答案
#

24. HIPAA、BAA、GDPR、PIPL、企业合同条款如何映射到模型端点、日志、支持工单和事故通知

A 只写进合同
B 只映射端点
C 不映射
D 建立合规矩阵,映射到端点加密驻留、日志脱敏保留、工单脱敏、事故通知时限等具体落点并验证 ✓ 正确答案
#

25. 影子流量(Shadow Traffic)、A/B、Interleaving、Canary 分别适合验证哪些假设(排序、回答、系统可靠性)

A Interleaving(同请求内交替比较,敏感且样本效率高) ✓ 正确答案
B Canary
C 影子流量
D A/B
#

26. 冷启动、热启动和预热如何平衡资源浪费与故障切换时间

A 永远禁止预热
B 无条件时刻保持全量热备
C 全部接受冷启动
D 按流量与故障容忍度设置最小就绪池,关键服务预热、非关键服务弹性伸缩 ✓ 正确答案
#

27. 怎样通过定期 GameDay 验证配额耗尽、区域故障、网关故障和人工接管链路真正可用

A 只做文档演练
B 演练一次即可
C 只验证配额
D 在受控环境真实注入故障,验证配额耗尽、区域/网关故障与人工接管链路真正可用并复盘改进 ✓ 正确答案