选择 打开 改范围 完整检索页

pgsql.cc 提供对 postgresql.org 官网内容的中文翻译,由 Pigsty 团队维护。

PostgreSQL 博览 RSS 订阅

当天收录 26 条。

PostgreSQL 简中消息校准覆盖六个大版本

冯若航vonng.com

PostgreSQL 简体中文消息长期存在未译条目、术语不一和格式占位符错误。冯若航公布了针对 PostgreSQL 14–19 的校准工作,项目统计覆盖 162 个目录文件、67,487 条消息。流程先固定术语与翻译规范,再逐项对照英文审校,并跨组件、跨版本检查一致性,使用 msgfmt 校验格式。本轮还修正了遗漏系统错误原因、引用多余格式参数等问题。上游开发期仍会新增或调整消息,后续通过跟踪仓库持续补齐。

并行查询预算受会话设置与工作进程池共同约束

Christophe Pettusthebuild.com

并行查询的参数上限不等于实际启动的工作进程数。Christophe Pettus 通过执行计划和并发实验说明,单个 Gather 的规划上限只是请求许可,多个 Gather 还可分别申请进程。集群虽统一统计已运行数量,max_parallel_workers 却可由普通会话修改;真正的硬上限来自 max_worker_processes。运维应同时核对计划与实际启动数,为逻辑复制和扩展预留槽位,防止报表查询耗尽共享进程池。

Lakebase 向量与 BM25 搜索正式可用

DatabricksDatabricks

Databricks 将此前处于测试阶段的 Lakebase Search 推进到正式可用。两个 PostgreSQL 扩展分别提供兼容 pgvector 类型与查询语法的近似向量索引,以及面向标准 tsvector 的 BM25 排序和前 K 项下推,应用可在同一数据库组合语义与关键词检索。索引保存在存储层,计算实例缩到零后再次启动无需重新预热索引。使用前需在项目设置启用功能并安装扩展,具体账号仍按分阶段发布节奏获得更新。

Oracle 到 Aurora 的 CDC 实测揭示类型与运行时陷阱

DBAglobeDBAglobe

DBAglobe 实测了用 Debezium、LogMiner 和 MSK 将 Oracle 复制到 Aurora PostgreSQL 的链路,覆盖初始快照与后续增删改。类型映射是关键:NUMBER(19,0) 在所用配置下转为 Decimal,目标应选 numeric,不能直接当作 bigint。托管接收端还出现 Jackson 类路径冲突,实验改用自管接收端完成复制。所选日志解析策略不跟踪在线 DDL,迁移前须单独评估模式变化。

美联航用目录联邦连接 Redshift 与 Unity Catalog

Ankit Aggarwal、Raja Kalluri 等AWS Big Data Blog

美联航将湖仓数据保存在 S3,用 Unity Catalog 管理,同时使用 Redshift 分析。其工程案例通过 Glue 目录联邦和 Iceberg REST 接口连接两者,再创建资源链接供外部模式访问。Lake Formation 在查询时提供受限的临时凭据,省去另一条数据同步管线。配置时须分别授权资源链接与目标表;Delta 表还要启用 UniForm,才能提供兼容元数据,不能仅连通目录就假定所有表均可查询。

objgit 重做 packfile 以减少对象存储往返

Xe IasoTigris

把 Git 文件访问直接映射为对象存储请求,会让细碎读写累积成网络延迟。Tigris 的 objgit 实验重做了 packfile:用数据文件与独立索引记录对象偏移及压缩前后的长度,使服务端可通过 HTTP Range 精确读取对象,并在后台预取整个包。作者比较了三类仓库的请求次数和推送、克隆耗时,显示减少往返比简单替换存储接口更关键。这一进展仍是存储布局实验,鉴权与包合并机制尚未实现。