━━━━━ 正文从此处全选复制 ━━━━━

FutureX · Database

本期要点

· Rubrik 上线 Apache Iceberg 数据保护,本月内 GA

· RavenDB 发布 Quill,AI agent 免迁移直连 SQL 库

· OceanBase 居 Omdia 报告亚太分布式库份额 15.5% 第一

· Percona 报告:31% 受访者称云支出上涨最伤

· pgBackRest 曾断供一年,暴露开源基建单点依赖

· LibreDB Studio 发布,一体 IDE 支持 16 种引擎

▎ 版本与产品发布

LibreDB Studio 发布:浏览器一体化 SQL IDE,16 种引擎 + AI Agent

有一个叫 LibreDB Studio 的新项目开源了,用的是 MIT 协议,可以容器化自托管,只要打开浏览器一个标签页,就能同时管理 PostgreSQL、MySQL、Oracle、SQL Server、MongoDB、Redis、SQLite、ClickHouse、Apache Druid、DuckDB16 种数据库引擎。它的编辑器底层用的是跟 VS Code 一脉相承的 Monaco 内核,能做到模式感知的自动补全,还带可视化的 EXPLAIN 执行计划、交互式的 ER 图,以及 schema 差异对比功能;此外还能接上 Gemini、OpenAI、Ollama 这些模型,目前它的 Agent 模式已经在 PostgreSQL、SQLite、DuckDB 三个引擎上跑通了,其余引擎那边先做的是 schema 接地工作。对那些习惯了按引擎数量或者座席数付费的商业 IDE 用户来说,这种不设"企业墙"的一体化开源工具,可能是个值得留意的替代信号。[1]

再看看别的版本动态:ClickHouse 出了 v26.3.33.24-lts;TiDB 一口气连发了 v26.3.11/12/13 三个补丁版本;YugabyteDB 也发了不少 backport 小版本,包括 2025.2.7.0-b57/b58、2026.1.2.0-b117-119 以及 2.31.0.0-b435-437;Materialize 更新到了 v26.41.0;Polars 来到 1.44.2;DataFusion 出了 55.1.0-rc1;LanceDB 发布了 v0.39.0-beta.5/.6,延续着此前那一轮 breaking change(这个之前已经报过);Delta Lake 的内核构建号则是照例滚动了一下。

▎ 数据库 × AI

RavenDB 发布 Quill:AI agent 免迁移直连企业 SQL 数据库 agent

号称服务了超过 1.2 万家客户的 NoSQL 文档数据库厂商 RavenDB,这次推出了一个叫 Quill 的新东西:在原有的 PostgreSQL、SQL Server、MySQL 之上,再叠一层持续同步的"AI 语境层",靠变更数据捕获(也就是常说的 CDC,一种数据库增量同步机制)来保持实时一致,这样企业既不用把系统记录的数据迁走,也不必另起炉灶搭一套 AI 数据栈。这个设计背后的前提是:模型不该无限制地碰源数据。所以 Quill 卡在模型和数据库中间,可以脱离底层的权限体系,单独去定义 agent 能读到哪些内容,而且它对模型没有偏好,Anthropic、OpenAI、Google 的模型都能接,自托管模型也支持,云端和本地合规部署两条路都走得通。RavenDB 方面说,这么做能把 agent 从开发到生产上线的周期,从传统的 18-24 个月压缩到只要几周。这套"在现成 SQL 库外面套一层 agent 安全层"的打法,跟本期 TimescaleDB、Google Cloud 的动作是一个方向,说明整个行业正盯着同一个痛点:AI agent 直连生产库带来的权限和审计问题,正在长出一条新赛道。[2]

Snowflake Cortex AI 上线 OpenAI GPT-6 Astra ai-native

本周 OpenAI 放出了新旗舰模型 GPT-6 Astra,号称这标志着"迈入 AGI 时代",紧接着 Snowflake 就宣布把它接进了 Cortex AI,企业客户以后可以在数据仓库里直接调用这个模型。这其实属于 Snowflake 对新模型的一次常规追加接入(此前它已经上线过 Grok 4.6 之类的模型),算不上什么架构上的突破,但也能看出数仓厂商越来越把"库内能选哪个模型"当成留住客户的一张牌。[3]

Databricks 发布 Adaptive Instructed-Retriever vector ⚠️ 厂商口径

Databricks 推出了一款新的检索模型,叫 Adaptive Instructed-Retriever,官方说法是在召回质量不变的情况下,能把搜索延迟压到原来方案的 1/2,主要瞄准的是 RAG 和 agent 场景里检索这一环的调优。不过这个延迟减半的数字是厂商自己测出来的,目前还没看到第三方复现验证。[4]

Google Cloud 发布 Data Agent Kit agent

Google Cloud 面向开发者推出了 Data Agent Kit,把构建"能理解并操作企业数据"的 agent 所需要的一整套工具链都打包了进去。这个定位其实和 RavenDB 的 Quill、Snowflake 的 agent 化数据访问思路相当接近,也再一次印证了一件事:给 agent 配一层数据访问中间件,正在变成各大数据平台的标配动作。[5]

Supabase 接入 Gemini Enterprise ai-native

现在用户不用离开 Gemini Enterprise 平台,就能直接在里面用自然语言查询 Supabase 项目了,这算是生态集成层面的一次更新,还谈不上是什么独立的产品发布。[6]

TimescaleDB:给 AI agent 生产库权限,怎样才安全 agent

TimescaleDB 写了篇文章,给出一套判断标准:访问范围要限定住、要只读、还得在数据库这一层强制执行,这样才算安全;反过来,无限制的访问就是不安全的,文章里也给了具体的防护做法。这和本期另外几条同类话题(Quill、Data Agent Kit)以及此前曝出的 R2R 两处 SQL 注入漏洞(此前已报)连在一起看,能看出 AI agent 在数据层面临的权限和注入风险,正在成为整个行业共同关心的事。[7]

▎ 湖仓 · 开放表格式 · HTAP

Rubrik 上线 Apache Iceberg 数据保护,本月内 GA lakehouse

做备份的厂商 Rubrik 宣布推出 Apache Iceberg Protection,能覆盖 AWS Glue Data Catalog 和 Amazon S3 Tables 这两种目录形态,正式版本月内就会上线。这个功能要解决的问题是:Iceberg 原生的快照其实只是指向数据文件的元数据指针,并不是真正意义上的备份,一旦表被勒索软件破坏、被误删,或者被"出了错的 AI agent"覆写掉,这个指针也就跟着失效了;而 Rubrik 的做法是把数据本身和定义表结构的元数据一起备份下来,恢复的时候重新接上目录,这样表就能直接在 Amazon Athena、Apache Spark、Trino 这些引擎里恢复成可查询的状态,而且备份还能放在客户自己的 AWS 账户里,满足数据主权方面的要求。这条产品线能落地,从某种程度上说明 Iceberg 在企业里的用量已经大到需要专门的数据保护层来兜底了。[8]

▎ 技术 · 架构 · 性能基准

Neon 详解 Lakebase Postgres 计算缓存改造 oltp

Neon 发文披露了他们对大规格固定容量 Lakebase Postgres 计算节点做的一次缓存架构调整:把机器内存里的大部分份额划给 Postgres 的共享缓冲区(也就是 shared buffers),再用磁盘给它做后备存储,这样在不牺牲内存命中率的前提下,把有效的缓存容量扩大了。这是继此前披露的"生产库月均自调 3.2 万次"(此前已报)之后,Neon 又一次把 Lakebase 计算层的工程细节公开出来,走的路子还是那个老套路——把 Postgres 经典的内核参数,按照云原生计算的特点重新调一遍。[9]

学界 · 研究前沿

· Concord:面向跨模态查询优化的视频关系代数(arXiv 2609.05756):这篇论文把语义视频查询(也就是用自然语言加多模态大模型来抽取视频内容)纳入了一个统一的关系代数框架里,给视频数据上的查询优化打了个理论底子。[10]

· Factorized and Vectorized Execution(arXiv 2609.09002):针对欺诈检测、网络分析这类场景里大量出现的多对多 join,这篇论文提出了一种因子化加向量化的混合执行方式,能同时把分析型查询和语义型查询都优化到。[11]

· MemForest:分层时序索引的高效 agent 记忆系统(arXiv 2605.23986):这篇论文给长上下文的 LLM agent 设计了一套分层时间索引的记忆结构,能支持跨会话的状态保持,跟本期讲的 agent 数据基建话题正好对得上。[12]

· SQLMorph:面向 Text-to-SQL 评测的查询变异与细粒度指标(arXiv 2609.08950):这篇论文指出,现在的 Text-to-SQL 评测对那些语义相同但写法不一样的 SQL 判断得不准,为此提出了变异测试的方法,还给出了更细粒度的评测指标。[13]

▎ 云厂商 · 生态 · 监管

Percona:31% 受访 DBA 称云支出上涨最伤,23% 苦于许可成本

Percona 出了第二届《2026 开源数据库管理状况报告》,这次是委托 Censuswide 在 2026 年 7 月做的定向调研,找了 300 名美国的数据库和平台工程师,受访者手头用的都是 PostgreSQL、MySQL、MongoDB、Redis 或 Valkey 里的某一种。调查结果显示,成本、性能可靠性、安全合规,还有 AI 就绪度,是最让大家焦虑的四件事,其中云支出上涨排在最前面,占 31%,许可成本上涨紧随其后,占 23%,这两项被列为最突出的痛点。这份报告的主题定的是"控制、选择与数据基础设施的未来",也算是呼应了最近几起厂商许可变更引发开源社区反弹的事件。[14]

pgBackRest 资金危机曝光:核心备份工具曾断供一年

PostgreSQL 生态里用得最多的备份恢复工具 pgBackRest,过去一年里其实一直没了企业资金支持:原本赞助它的 Crunchy Data,在 2025 年 6 月被 Snowflake 收购之后就不再提供支持了,之后差不多整整一年,都是主维护者 David Steele 一个人在硬撑着维护这个项目。要知道,数以千计的生产数据库都依赖着这个工具,大多数 PostgreSQL 咨询公司和云厂商也都把它列为默认推荐。这场危机直到今年 5 月,Percona 等几家公司联合出资赞助之后才算暂时缓过来,也算是搭起了一个不依赖单一厂商的中立资助安排。这件事再次说明了开源基础设施的一个老毛病:关键项目常年就靠一两个维护者和一个金主撑着,金主一撤,资金链立马就断了。[15]

OceanBase 据 Omdia 报告:亚太分布式事务数据库份额 15.5% 居首

Omdia 最新出的报告《Distributed Transactional Database in Asia & Oceania - 2026》里显示,按 2025 年营收算,OceanBase 拿下了 15.5% 的份额,在亚太及大洋洲的分布式事务数据库市场里排到了第一,超过了好几家云厂商的自研数据库。报告还给出了这个市场的规模数字:2025 年是 9.024 亿美元,预计 2026 年会涨到 11 亿美元,再往后到 2029 年,会以 19.3% 的年复合增长率一路涨到 18 亿美元。这个排名结论是第三方研究机构给出的,不是厂商自己报的数,不过具体的统计口径——比如算不算托管服务在内——通稿里并没有细说,看看就好。[16]

文中 [N] 为来源编号,全部来源链接请点文末「阅读原文」查看。

FutureX · 记录未来如何发生

素材来源多方媒体/网络新闻