Velox不是数据库执行引擎,而是可嵌入的C++查询执行库,需自行集成SQL解析、优化器、存储等组件;最简执行需构造RowVector、PlanNode树并调用Task::start(),且须手动注册connector。

Velox 是什么,它真能直接用来搭数据库执行引擎?
不能。Velox 本身不是数据库执行引擎,而是一个**可嵌入的、模块化的 C++ 查询执行库**——它不带 SQL 解析、优化器、元数据管理、存储层或查询调度。你得自己接 Calcite 或 Spark SQL 做逻辑计划生成,用 velox::exec::Task 跑物理算子,再配 velox::connector::Connector 拉数据。想靠 Velox “开箱即用”建个 Postgres 替代品,会卡在第一天连 SELECT 1 都跑不起来。
从零启动一个 Velox 执行任务:最简可行路径
绕过所有上层框架,只验证 Velox 算子能否跑通,核心是三步:
- 构造
velox::RowVector输入(比如用velox::test::makeRowVector) - 写
velox::exec::PlanNode树(哪怕只有ValuesNode+ProjectNode) - 用
velox::exec::Task::start()提交,并轮询task->isFinished()
注意:velox::exec::LocalExchangeSource 和 velox::exec::Driver 不暴露给用户直接调用;必须走 Task 接口。漏掉 task->noMoreSplits() 会导致死等输入,这是新手最常卡住的地方。
为什么 velox::exec::TableWriteNode 总报 Connector not found?
因为 Velox 默认不注册任何 connector——即使你编译时链接了 velox::connector::hive::HiveConnector,也得手动调用 velox::connector::registerHiveConnector()。常见错误包括:
立即学习“C++免费学习笔记(深入)”;
- 忘了在
main()开头调用注册函数(顺序很重要,必须在创建core::QueryCtx之前) - 用的是
velox::connector::hive::HiveConnector,但传给TableWriteNode的connectorId写成"hive"(正确)而非"hdfs"或空字符串 - 没设置
core::QueryConfig中的query::kHiveStorageFormat,导致 Parquet 写入失败但报错不明确
建议先用 velox::connector::tpch::TpchConnector 测试,它纯内存、无依赖,注册后立刻可用。
C++ 编译 Velox 项目时链接失败或符号未定义
Velox 强依赖 ABI 兼容性,尤其对 folly、double-conversion、re2 版本敏感。典型现象是 undefined reference to 'folly::dynamic::operator=(folly::dynamic&&)' 这类错误。
- 必须用 Velox 官方
third-party子模块(即build/fbthrift/下的 folly),不能用系统包管理器装的libfolly-dev -
CMAKE_BUILD_TYPE=RelWithDebInfo是推荐模式;用Debug会触发大量断言,且某些算子(如HashJoin)在 Debug 下性能极差,容易误判为 hang - 如果你用 Bazel,务必确认
//velox/exec:exectarget 已显式声明依赖//velox/connector:hive,否则链接时不会拉入 hive connector 符号
真正麻烦的从来不是写 PlanNode,而是让所有第三方符号在链接期对齐——多一个版本号不匹配,就卡半天。



















