Lakeflow Spark Declarative Pipelines 的 sink API 正式 GA,支持将管道转换后的数据写入 Unity Catalog 外部表、Apache Kafka、Azure Event Hubs 以及自定义 Python 数据源等外部目标。此前管道输出默认仅限 Delta 表。
Knowledge Catalog(原 Dataplex)的列级血缘能力正式 GA,覆盖 Dataproc 集群和 Serverless for Apache Spark 处理的 BigQuery、BigLake 外部表及 Cloud Storage 数据流。同步更新的 Data Lineage API 支持多源多目标搜索和 Dataflow 来源标记。
Snowpark Container Services 新增 ARM 实例(GEN_ARM_G1)正式 GA,提供 1-28 vCPU 规格的通用 ARM 算力;同日 Cortex AI Guardrails 对 Snowflake Intelligence 和 Cortex Agents 全面 GA,为 AI 生成内容提供平台级安全护栏。
Supervisor Agent 现可将 Vector Search indexes 注册为子 Agent 工具,多 Agent 协同系统可直接利用向量检索能力完成语义搜索任务,无需手动搭建 retrieval 逻辑。
Databricks SQL Alerts 最新版本正式 GA,新增 Markdown 编辑器自定义通知模板;Lakeflow Jobs 中的 SQL Alert Task 进入 Public Preview,可将 SQL 告警评估嵌入工作流并根据结果分支执行下游任务。
Snowflake 内置 AI 函数 AI_CLASSIFY 新增文档分类能力(Public Preview),可直接在 SQL 查询中对非结构化文档进行分类处理。
为什么值得继续看:Iceberg 1.11 是 Iceberg v3 格式的首个完整特性版本——新增实验性 Variant type、纳秒精度时间戳、行级血缘等能力,对 Trino 481 已实现的 v3 写入支持形成完整生态闭环。
需要等待什么信号确认:正式 release 公告(PMC 已有足够 binding +1,预计数日内发布)。
为什么值得继续看:GX Core 是最广泛使用的开源数据质量框架之一,Fivetran 接管意味着数据质量验证将更紧密地嵌入 Fivetran+dbt 的数据基础设施栈。这延续了 Fivetran/dbt 合并后"Open Data Infrastructure"战略的执行。
需要等待什么信号确认:协议正式完成后的治理结构和路线图变化。
为什么值得继续看:所有 Lakebase Provisioned 实例将在 6 月起自动升级至 Autoscaling 平台,获得弹性伸缩、缩容到零、数据库分支等能力。这标志着 Databricks OLTP 层从固定资源模式全面转向 Serverless 弹性模式。
需要等待什么信号确认:6 月正式升级通知和定价影响。