AWS收购DuckLabs,但这家云巨头究竟看中了DuckDB背后的团队什么?
AWS可以将DuckLabs的专业能力更深入地融入其数据堆栈,但分析师指出,该项目的重心可能将逐渐向云提供商倾斜。
开源软件为云提供商提供了一条采用热门技术的路径,而无需拥有其背后的公司。然而,AWS显然认为,仅仅在其产品和服务中使用DuckDB还不够。
这家云提供商周三宣布,已签署最终协议收购总部位于阿姆斯特丹的DuckLabs——该公司是DuckDB生态系统的核心推动者,同时DuckDB开源项目将继续保留在独立的DuckDB基金会之下。
这意味着,收购完成后,DuckLabs约30人的团队将加入AWS,而DuckDB及相关产品将继续在MIT许可下提供,开发人员和企业仍可像以往一样自由使用该数据库。
不过,AWS并未明确说明,将团队及其专业知识引入内部后希望获得什么,也未阐明这些知识最终将如何影响新的或现有数据与分析服务的发展,进而可能塑造开发者构建、CIO部署的技术和平台。
AWS可将DuckDB置于其数据堆栈的核心
然而,分析师指出,即使数据库本身仍处于公司掌控之外,AWS通过将构建DuckDB的工程师纳入自身团队,也能为其产品增加战略价值。
HFS Research执行研究负责人Ashish Chaturvedi表示:“任何期待AWS推出独立‘Amazon DuckDB’产品的人都过于乐观,因为AWS已经拥有Redshift和大量其他数据库服务。AWS和DuckLabs已在S3 Tables和SageMaker Lakehouse上展开合作,这表明DuckDB对AWS的更大价值在于作为其现有分析服务中的嵌入式查询引擎,而非客户单独购买的独立产品。”
Chaturvedi补充道:“DuckDB的吸引力在于它能在进程内运行分析查询,无需用户配置或管理单独的集群。因此我猜测,最可能率先出现的是无服务器查询层——直接对S3和Iceberg表中的数据运行快速、低成本的查询,无需客户配置数据仓库,这正是DuckDB的能力所在。”
此外,分析师指出,此次收购可为AWS在竞争日益激烈的开放表格式市场中提供专业知识——该市场决定了企业如何在云对象存储中组织和管理数据。Chaturvedi提到:“DuckLabs于2026年4月发布了DuckLake 1.0,将其团队纳入AWS可以为云提供商提供另一种选择,以应对Apache Iceberg日益增长的影响力。”
尽管Iceberg等开放表格式越来越受欢迎——因为它们允许不同分析引擎查询和管理数据湖中的数据,减少对单一数据仓库或专有平台的依赖——但DuckLake代表了DuckDB的一次尝试:通过将数据保留在Parquet文件中,同时用传统数据库管理表元数据来简化架构,这有可能让企业更轻松地构建和运维数据湖部署。
开源,但重心已然转移
尽管存在这些潜在益处,即使AWS的资源加速了DuckDB生态系统的发展,并改善了对不断增长的用户群的支持,这笔交易仍可能给开发人员和企业带来新的担忧。
Chaturvedi说:“开发人员不应将许可证不变误解为项目方向不变。无论治理章程如何,编写DuckDB大部分核心代码的人现在领取的是AWS的工资,工资支票会影响路线图。”
他补充道:“与AWS服务相关的功能会被优先构建,而主要服务于竞争对手云用例的功能则要等待更长时间——这并不是因为任何人的恶意行为,而是当专业知识集中在一个雇主手中时,重心自然会向该雇主倾斜。”
分析师进一步指出,对于在多云架构中使用DuckDB的首席信息官来说,这种差异可能更为重要。
Chaturvedi表示:“MIT许可证可以保护您免受硬锁定的困扰,DuckDB引擎在任何地方都能继续工作,所以这并不是放弃DuckDB的理由。但现在如果还不把AWS视为DuckDB事实上的所有者,那就太天真了,我会在制定任何真实战略的架构中把这一点考虑进去。”
“DuckDB引擎依然是一个安全、开放的选择,”Chaturvedi补充道,“但不要假装它是中立的。”
然而,对于已经在AWS上运行数据和分析工作负载的企业来说,同样的重心转移反而可能成为优势。
Chaturvedi说:“这意味着DuckDB在数据已经存在的堆栈中获得了更深入的集成、更好的支持和更紧密的优化。加上基金会和MotherDuck的支持也在不断扩大,你比一周前有更多的地方可以求助。”
AWS未披露收购的财务条款,也未透露交易预计何时完成。