StarRocks 核心原理

共 17 题
#

1. StarRocks 的主键模型(Merge-on-Write 标记删除)相比其他模型在实时更新上的优势?

A 主键模型查询时需要合并所有历史版本
B 主键模型不支持 upsert
C 主键模型写时定位旧数据标记删除,查询无需实时合并版本,实时更新后立即可见 ✓ 正确答案
D 主键模型写入没有任何额外开销
#

2. StarRocks 的 CBO 优化器与物化视图(异步/同步)如何支撑高并发查询?

A 同步物化视图不会影响写入性能
B 物化视图不能被查询改写命中
C 异步物化视图的数据实时性最强
D CBO 基于统计信息优化计划,物化视图通过预聚合与查询改写降低查询成本,共同支撑高并发 ✓ 正确答案
#

3. StarRocks 四种数据模型(Duplicate/Aggregate/Unique/Primary)的适用场景与更新语义

A Primary 模型与 Unique 模型在查询性能上完全相同
B Unique 模型不支持更新
C Duplicate 模型会按主键去重
D Aggregate 模型按聚合键预聚合,Primary 模型写时标记删除,适合高频实时更新 ✓ 正确答案
#

4. StarRocks 与 Doris 在架构与适用场景上的核心差异?

A StarRocks 与 Doris 架构完全不同
B Doris 的 Unique 模型查询无需合并版本
C 核心差异在主键模型实现与优化器:StarRocks 主键模型写时标记删除查询更稳定,CBO 支持更强 ✓ 正确答案
D 两者生态完全一致
#

5. StarRocks 的湖仓一体(External Catalog)如何查询 Hive/Iceberg 数据?

A External Catalog 需要先把数据全部导入 StarRocks
B External Catalog 只能访问 MySQL 数据
C 外部数据查询无法并行执行
D External Catalog 直接映射外部元数据与文件,支持谓词与分区下推,也可将结果导入内部表 ✓ 正确答案
#

6. StarRocks 的 Short Key Index、Zone Map 与物化视图在查询加速中的协同,与 Doris 的差异?

A StarRocks 没有前缀索引
B 物化视图只能同步刷新
C Zone Map 能精确定位到行
D 前缀索引定位起点、Zone Map 裁剪块、物化视图预聚合改写,协同加速;与 Doris 的差异主要在物化视图能力与主键模型 ✓ 正确答案
#

7. StarRocks 的主键模型(持久化索引)与 Unique 模型的差异,实时更新场景的写入放大与查询性能?

A Unique 模型查询无需合并版本
B 持久化主键索引只能存放在内存中
C 主键模型不支持部分列更新
D 主键模型写时标记删除、查询免合并,实时更新查询性能稳定,但写入有定位与标记开销 ✓ 正确答案
#

8. StarRocks 的查询引擎,MPP、CBO 与向量化执行的配合?

A CBO 与向量化执行互斥
B CBO 优化计划、MPP 并行分布、向量化批量执行,配合 Runtime Filter 与 Pipeline 共同提升查询性能 ✓ 正确答案
C MPP 只做单机执行
D 向量化执行逐行处理
#

9. StarRocks 的导入与实时更新,Stream Load/Routine Load 与主键 upsert?

A Stream Load 适合高频实时导入,主键表导入按主键 upsert,支持部分列更新与 Exactly-Once 事务语义 ✓ 正确答案
B Routine Load 是一次性导入本地文件
C 主键导入不支持幂等
D Broker Load 用于消费 Kafka 消息
#

10. StarRocks 的分区与分桶设计(分桶数、分区裁剪)对查询与导入的影响

A 分区裁剪减少扫描范围,分桶决定并行度与 Join 本地化,分桶键应选高基数列 ✓ 正确答案
B 分桶数越多查询一定越快
C 分区只影响写入不影响查询
D 分桶键应选低基数列
#

11. StarRocks 的向量化执行与 SIMD 优化对性能的影响?

A 向量化执行是逐行解释执行的
B SIMD 只影响存储不影响计算
C 向量化执行按列批处理并利用 SIMD 指令并行计算,显著提升 CPU 效率,但 IO 瓶颈场景收益有限 ✓ 正确答案
D 向量化执行需要行式存储
#

12. StarRocks 的 CBO 与统计信息,与 Doris 相比在复杂 Join 场景的优化器差异?

A StarRocks CBO 基于 Cascades 与丰富统计信息,复杂 Join 计划空间更大,统计信息需定期收集保持准确 ✓ 正确答案
B 统计信息过时不会影响执行计划
C 直方图用于加速数据写入
D CBO 与统计信息无关
#

13. StarRocks 与 Doris 的差异,主键模型与查询优化器?

A StarRocks 主键模型查询免合并,CBO 对复杂查询优化更强,适合高频更新与复杂分析,但选型还需考虑生态 ✓ 正确答案
B 两者主键模型实现完全相同
C Doris 没有 CBO 优化器
D StarRocks 不支持物化视图
#

14. StarRocks 的资源组与多租户,查询隔离与配额?

A 资源组只能隔离 CPU
B 资源组按标签路由查询并限制 CPU、内存与并发,实现多租户隔离与高峰保护 ✓ 正确答案
C 资源组无法限制并发
D 所有查询必须共享同一资源组
#

15. StarRocks 的物化视图,同步/异步物化与查询改写?

A 同步物化视图实时一致但增加写入开销,异步物化视图后台刷新适合复杂聚合,查询自动改写命中 ✓ 正确答案
B 同步物化视图不会增加写入开销
C 异步物化视图数据永远实时
D 物化视图无法被查询复用
#

16. StarRocks 的查询缓存与结果缓存?

A 查询/结果缓存复用相同查询的结果,基于分区失效保证一致性,适合高频固定报表 ✓ 正确答案
B 查询缓存会导致结果永远错误
C 缓存只能用于写入场景
D 结果缓存无法失效
#

17. StarRocks 物化视图的选择(同步 vs 异步)与查询改写场景

A 多表 Join 的物化视图只能同步创建
B 查询改写不需要任何命中条件
C 物化视图选择与写入开销无关
D 同步物化实时一致但增加写入开销,异步物化适合复杂聚合与多表场景,按新鲜度 SLA 选择 ✓ 正确答案