# 1. 翻译式 RAG 中 query 翻译与语料翻译的质量与成本如何取舍,什么语料规模与更新频率下各自更合适 A 语料规模小、更新频率低时语料翻译更划算;规模大、更新频繁时 query 翻译更合适 ✓ 正确答案 B 语料翻译永远优于 query 翻译 C query 翻译不需要任何成本 D 两者质量完全一样
# 2. 多语言大模型(如 Qwen/BLOOM)在低资源语言的性能衰减 A 所有语言性能一致 B 低资源语言因训练数据稀疏而性能衰减,需评测量化并针对性补偿 ✓ 正确答案 C 低资源语言性能总是优于高资源语言 D 多语言模型不需要考虑语言差异
# 3. 小语种 RAG 缺乏本地语料时的数据增强与翻译回灌策略 A 把高资源语言语料翻译成小语种回灌,并用回译校验与抽样审核保证质量 ✓ 正确答案 B 小语种 RAG 不需要本地语料 C 翻译回灌会完全消除数据问题 D 翻译回灌越多越好,无需校验
# 4. query 翻译的质量如何验证(回译校验、双语检索对比),防止翻译错误放大检索失败 A 翻译错误绝对不会影响检索 B 翻译一次即可,无需验证 C 用回译校验与双语检索对比验证翻译质量,低置信度时回退到原语种检索 ✓ 正确答案 D 双语检索对比毫无意义
# 5. 同一向量空间内中英文混合检索的归一化与距离度量选择 A 对向量做 L2 归一化后用余弦相似度,使不同语言向量可比,并验证跨语言对齐质量 ✓ 正确答案 B 无需归一化,直接用贪心距离即可 C 中文和英文向量永远无法比较 D 距离度量对检索结果无影响
# 6. 多语言生成时的语言识别与用户偏好语言路由 A 模型会自己猜测用户语言,无需配置 B 输出语言与用户输入无关 C 结合语言识别与用户偏好(UI/地域/历史)决定输出语言,并支持显式覆盖 ✓ 正确答案 D 语言路由只影响 UI 不影响生成
# 7. 翻译与原文双语双路检索的混合策略中,结果去重与引用来源对齐如何做 A 双语结果互不相关,无需去重 B 引用来源无需对齐 C 去重会丢失重要信息 D 以文档唯一 ID 为去重键合并多语言版本,并维护唯一 ID 与多语言版本的映射表对齐引用来源 ✓ 正确答案
# 8. AI 应用出海时的文案/语气/单位本地化如何工程化(i18n 框架) A 单位/时区本地化与 AI 无关 B 出海只需翻译文案即可 C 用 i18n 框架集中管理文案/语气/单位/日期/货币等 locale 资源,并让 AI 生成全程携带 locale ✓ 正确答案 D 语气本地化不需要配置
# 9. 生成内容的文化敏感性(宗教/习俗)如何做区域化护栏 A 全球用同一套文化管制标准即可 B 拦截机制只需关键词匹配 C 文化敏感性与生成内容无关 D 按区域配置敏感规则集,结合检测与拦截,并避免过度管制误伤正常表达 ✓ 正确答案
# 10. 不同地区对"同一问题"的合规口径差异如何在 Prompt 中配置 A 全地区用同一合规口径即可 B 合规口径与 Prompt 无关 C 把区域合规口径作为按地域路由的 Prompt 片段并做版本管理、可审计 ✓ 正确答案 D 合规配置无法版本化
# 11. 本地化评测,如何招募母语者做生成质量验收 A 任何会说该语言的人都能评测 B 评测不需要覆盖不同场景 C 需筛选母语者、用结构化评分表评测、多人打分并做一致性控制 ✓ 正确答案 D 母语者评测只能看流畅度
# 12. EU AI Act / 中国生成式 AI 办法对多区域部署的差异化要求 A 出海不需要遵守任何法规 B 两套法规要求完全一致 C 欧盟侧重风险分级、透明与数据治理,中国侧重备案与内容安全治理,需按区域配置合规能力 ✓ 正确答案 D 合规要求只需在总部实现一次
# 13. 跨境内容标识(C2PA/水印)在不同司法辖区的互认问题 A 所有国家使用同一套强制内容标识 B 内容标识与跨境无关 C 因技术标准与信任体系不一致,跨境标识互认困难,应采用开放标准与可信签发方并关注可验证性 ✓ 正确答案 D 水印无需抗篡改
# 14. 多区域推理服务的就近接入与延迟优化 A 所有请求统一路由到单一区域即可 B 延迟优化只与模型大小有关 C 通过就近路由减少网络往返,并用缓存、推理加速优化 TTFT/P95,同时做区域容灾 ✓ 正确答案 D 就近接入与推理延迟无关
# 15. 全球化产品如何用单一代码库管理多区域 Prompt 版本 A 每个区域必须用完全独立的代码库 B Prompt 不需要版本化 C 把 Prompt 作为版本化+区域化配置管理,共用模板但支持区域覆盖,可审计可回滚 ✓ 正确答案 D 多区域 Prompt 无法统一管理
# 16. 海外社媒/应用商店的 AI 应用审核政策差异应对 A 建立平台-政策合规清单,用能力开关逐平台适配,并准备审核资料 ✓ 正确答案 B 所有平台审核政策一致 C 平台审核无需关注 D 只需通过一次审核即可全球上架
# 17. 多语言 Embedding 模型(bge-m3 等)的跨语言检索对齐质量 A 所有多语言模型对齐质量都完美 B 跨语言对齐无法评估 C 需用跨语言检索评测集量化对齐质量,必要时用微调或翻译双路检索提升 ✓ 正确答案 D 多语言模型不需要对齐
# 18. 多语言 UI 与 AI 生成内容的布局适配(RTL 语言等) A 用 dir 与逻辑属性实现 RTL 自动镜像,并考虑字符宽度、断行、字体等差异 ✓ 正确答案 B 布局与语言无关 C RTL 语言只需翻译文本即可 D 所有语言布局完全一致
# 19. 多区域 A/B 实验与评测结果如何避免相互污染 A 跨区域共享缓存不影响实验结果 B 实验标识、缓存键、评测集与发布都要带区域维度隔离,避免跨区域串扰 ✓ 正确答案 C 多区域实验可以共用一套评测集 D A/B 实验不需要隔离
# 20. 出海 AI 应用的区域数据驻留(数据不出境)架构方案 A 所有数据都存在单一区域即可 B 按区域部署存储与处理,请求路由到本地,控制跨区域数据流动并做出境审计 ✓ 正确答案 C 数据驻留与 AI 应用无关 D 数据可以自由往返任何区域
# 21. 海外支付(Stripe/Creem)与国内业务账目的合规隔离 A 国内外可以共用一套账目 B 海外与国内使用独立支付渠道、独立对账与独立税务处理,实现资金/账目/税务三隔离 ✓ 正确答案 C 支付隔离与合规无关 D 跨境资金无需单独核算