# 1. 国产闭源旗舰(Qwen3-Max、DeepSeek-V3.1、Kimi K2、GLM-4.5、Hunyuan-3.0、Baichuan 4)的工程定位差异,能力、价格、API 稳定性、合规性、生态? A 选能力最强的即可 B 国产模型生态完全相同 C 只看价格选最便宜的 D 应从能力、价格、API 稳定性、合规性、生态多维度评估,用统一评测集实测并以合规为硬约束 ✓ 正确答案
# 2. 国产开源模型在私有化部署的主流选择,DeepSeek(MoE + 推理强)、Qwen3(多模态 + 工具强)、GLM-4.5(中文强)、LLaMA-3.1-405B(生态全)的工程取舍? A 所有场景都适合部署同一个模型 B 应按任务类型、语言、硬件预算与生态依赖匹配:中文+工具选 Qwen/GLM,推理密集选 DeepSeek,英文生态选 LLaMA ✓ 正确答案 C 模型号越大越好,越大越强 D 开源模型无需考虑商用条款
# 3. 国产大模型选型矩阵,DeepSeek/Qwen/GLM/Kimi/豆包等在中文、推理、工具调用与价格上的差异如何评估? A 选一个模型用到底即可 B 价格无需纳入矩阵 C 所有国产模型能力相同 D 应构建中文、推理、工具调用、价格等维度的模型×维度矩阵,用统一评测集实测打分并支持按任务路由 ✓ 正确答案
# 4. 国产模型的工具调用生态,MCP/Function Calling 支持度与周边生态成熟度如何评估,迁移成本多大? A 应实测 MCP/Function Calling 支持度与稳定性、评估周边生态成熟度,并估算迁移成本(兼容层与回归) ✓ 正确答案 B 国产模型工具调用生态与 OpenAI 完全相同 C 工具调用无需实测,看文档即可 D 迁移成本恒为零
# 5. 出海与跨境部署,国产模型服务海外用户时的数据本地化、跨境传输与当地监管如何满足? A 出海只需保证模型可用即可 B 数据可随意回传国内 C 应通过离岸本地化部署、跨境传输合规手续与当地监管适配,落地数据本地化、最小化与留痕 ✓ 正确答案 D 当地监管与国内相同
# 6. 国产模型 API 与 OpenAI/Anthropic API 的兼容层(如 OneAPI、新版 OpenAI SDK)对存量代码的迁移成本? A 换 base_url 即可零成本迁移 B 兼容层降低改造成本,但参数与行为差异需回归测试与适配,应配合灰度并行迁移 ✓ 正确答案 C 国产模型与 OpenAI 行为完全一致 D 兼容层无需测试稳定性
# 7. 大模型备案与生成内容标识(显式/隐式)对应用上线流程的具体影响? A 备案只影响模型厂商,不影响应用 B 显式标识是可选的,可省 C 备案是上线准入门槛,需实现显式/隐式标识并留痕,纳入上线 Checklist 与门禁 ✓ 正确答案 D 备案与上线流程无关
# 8. 国产算力(昇腾/寒武纪)私有化部署时,推理框架兼容层与应用代码的适配成本、性能损耗应如何评估 A 应通过 POC 基准测试评估推理框架兼容层的适配成本与性能损耗,核算适配工时与能否满足 SLA ✓ 正确答案 B 国产算力与主流 GPU 性能完全相同 C 推理框架无需适配即可在国产芯片上运行 D 应用层代码永远不用改
# 9. 国产模型(Qwen/DeepSeek/GLM)在工具调用、长文本与中文场景的能力差异应如何用自有评估集验证后再选型? A 应用贴近业务的自有评估集实测工具调用、长文本与中文各维度,用可复现分数支持选型与按任务路由 ✓ 正确答案 B 看公开榜单即可选型 C 自有评估集无需含业务场景 D 各模型在工具调用上能力相同
# 10. 国产模型的调用链路合规,数据出境安全评估/标准合同、备案号展示与生成内容标识(显式/隐式)的实施? A 合规只需在合同里声明 B 生成内容标识可省 C 数据可随意出境 D 应完成数据出境评估/标准合同、展示备案号、注入显式/隐式标识并留痕,把合规嵌入调用链路 ✓ 正确答案
# 11. 多模型切换的兼容层测试,从 OpenAI 兼容 API 切换到国产模型时,流式、工具调用与 JSON 输出的行为差异如何回归验证? A 兼容层可保证行为完全一致 B 工具调用差异无需测试 C 只需验证接口字段一致 D 应对流式、工具调用、JSON 输出做行为回归测试,逐项对比旧/新模型并对差异适配,纳入自动化门禁 ✓ 正确答案
# 12. 信创环境(国产芯片、国产 OS、国产模型)私有化部署的验收标准,硬件兼容性、性能达标与合规审计由谁负责,验收流程如何设计? A 只要能部署即可通过验收 B 合规审计由平台团队负责即可 C 性能验收不属于信创范围 D 应覆盖硬件兼容性、性能达标、合规审计三方面,明确责任分工,用 POC→清单→压测→审计→报告的流程验收 ✓ 正确答案
# 13. 多国产模型切换时如何用统一网关做能力差异对冲与灰度? A 应用统一网关归一化差异参数、按任务路由兜底能力差距,并用小流量灰度 + 质量指标对比 + 自动回滚 ✓ 正确答案 B 切换模型直接改全量即可 C 网关无需处理模型差异 D 灰度切换无需质量监控
# 14. 国产算力(昇腾/寒武纪)私有化部署时,应用层应如何做兼容性验证与性能验收,避免厂商锁定? A 直接依赖某芯片私有 API 最高效 B 绑定某一芯片可提升可移植性 C 应用层应通过统一接口调用、做基准性能验收,并用可替换推理层与配置化选算力避免厂商锁定 ✓ 正确答案 D 性能验收无需基准对比
# 15. 数据合规,企业知识库数据与用户个人数据的边界应如何划分,RAG 摄取与记忆存储的合规义务有何不同 A 两类数据合规要求相同 B 用户个人数据可随意入库 C 知识库数据管授权与脱敏,用户个人数据管同意、最小化与可删除,RAG 摄取与记忆存储义务不同 ✓ 正确答案 D 记忆存储无需留存期限
# 16. 国产模型的开源生态,许可证与商业使用? A 开源模型可任意商用 B 微调后可脱离原许可约束 C 所有开源模型都是 Apache 2.0 D 应看清许可证类型与商用条款(月活/规模/再分发限制),把许可纳入选型与合规审计 ✓ 正确答案
# 17. 国产模型生态的工具链适配,国产向量库、网关、评测平台与监控体系的选择现状? A 国产工具链已完全成熟完善 B 国产向量库、网关、评测、监控已较完整但生态仍有差距,应优先选 OpenAI 兼容工具并对缺失能力自建适配 ✓ 正确答案 C 国产生态没有可用工具 D 工具链选择与模型无关
# 18. 国产模型统一网关接入时,模型别名、能力矩阵与备案状态应如何维护,防止误路由到未备案模型 A 网关直接按模型名路由即可 B 应维护稳定别名、能力矩阵与备案状态,路由前置校验备案,防止误路由到未备案或不匹配能力的模型 ✓ 正确答案 C 备案状态不影响路由 D 能力矩阵无需维护
# 19. 中文基准与自有评测,SuperCLUE 等榜单分数如何解读,与自有评测集如何互补? A 榜单分数可直接决定选型 B 榜单分数与业务表现完全一致 C 应用榜单做初筛与趋势参考,用贴近业务的自有评测集做最终选型,两者互补 ✓ 正确答案 D 自有评测集无必要