Databend 是一款现代云数仓。专为弹性和高效设计,为您的大规模分析需求保驾护航。自由且开源。即刻体验云服务:https://app.databend.cn 。
What's On In Databend
探索 Databend 本周新进展,遇到更贴近你心意的 Databend 。
支持从 Stage 加载 UDF 脚本
Databend 支持从 Stage 中加载 UDF 脚本,大大简化了脚本的管理和部署流程。
现在你可以将 UDF 脚本存储在 Databend 支持的一揽子外部存储服务中,并通过简单的 SQL 语句加载到 Databend 中。对于云环境,还可以结合预签名 URL 以更好地管理脚本的上传。
下面是一个 JavaScript UDF 的示例:
CREATE OR REPLACE FUNCTION gcd_js (INT, INT) RETURNS BIGINT
LANGUAGE javascript HANDLER = 'gcd_js'
AS 'data/udf/gcd.js'
SELECT number, gcd_js(number * 3, number * 6)
FROM numbers(5)
WHERE number > 0
ORDER BY 1
如果您想了解更多信息,欢迎联系 Databend 团队,或查看下面列出的资源。
Code Corner
一起来探索 Databend 和周边生态中的代码片段或项目。
Databend Cloud 上的 Databend 发布流程
- 在GitHub上发布新版本:Releases · datafuselabs/databend · GitHub
- 选择稳定版本以确保部署的可靠性。
- 经历开发、预备、冒烟测试和生产阶段,以确保质量。
- 完成所有阶段后,自动更新所有客户仓库。
欢迎访问 https://databend.cn 或 https://databend.com 体验 Databend Cloud 。
Highlights
以下是一些值得注意的事件,也许您可以找到感兴趣的内容。
- 支持在 CREATE TABLE 时创建倒排索引。
- 支持剖析多表插入语句。
- 支持使用 WITH CONSUME 子句消费流。
- 为磁盘缓存增加 fuzzy 重载模式。
What's Up Next
我们始终对前沿技术和创新理念持开放态度,欢迎您加入社区,为 Databend 注入活力。
时间聚合索引
在 Speeding up Temporal Aggregation in DataFusion by 60-60000x 这篇博客中 µWheel 展现了其加速时间聚合查询的潜力。这可能有助于 Databend 构建时间聚合索引(Temporal Aggregating Index),通过预物化(pre-materialize)时间上的聚合结果,从而提高查询效率。
µWheel 是一个可嵌入的流和查询聚合管理系统。它具有高度优化的空间效率,支持在低延迟下执行时间聚合查询,其优化器可以根据 SIMD、代数属性和时间等上下文找到最优计划。
Issue #15553 | Feature: Temporal Aggregating Inde
如果你对这个主题感兴趣,可以尝试解决其中的部分问题或者参与讨论和 PR review 。或者,你可以点击 make use of sled metrics feature for collect sled metrics · Issue #7233 · datafuselabs/databend · GitHub 来挑选一个随机问题,祝好运!
New Contributors
一起认识社区中的新伙伴,Databend 因你们而变得更加美好。
- @maxjustus 更新 arrow-udf 以增强 JavaScript UDF 的类型支持,#15529 。
- @ziwenzhou96 移除文档中令人困惑的代码示例,databend-docs#784 。
Changelog
前往查看 Databend 每日构建的变更日志,以了解开发的最新动态。
地址:Releases · datafuselabs/databend · GitHub
Contributors
非常感谢贡献者们在本周的卓越工作。
Connect With Us
Databend 是一款开源、弹性、低成本,基于对象存储也可以做实时分析的新式数仓。期待您的关注,一起探索云原生数仓解决方案,打造新一代开源 Data Cloud。