AB
AiBoss
project

jev4pg - 为 PostgreSQL 带来自然语言查询与语义算子的 JEV 工具链

jev4pg 是维护者 Sheltercosmo 发布的 PostgreSQL 语义分析工具链,据项目自述提供 41 个 JEV 算子,支持英文与简体中文自然语言查询、可解释嵌入与证据缓存。仓库采用 Apache-2.0 许可,最新 release 为 v0.7.0。

jev4pg 是一个面向 PostgreSQL 的语义分析工具链。按项目自述,它把「语义智能」引入 PostgreSQL,提供 41 个 JEV 算子,覆盖过滤、抽取、排序、匹配与验证等场景,让使用者在既有数据上构建语义搜索、文档处理流程和分析师工具,并用英文或简体中文的自然语言发起查询。它适合已经运行 PostgreSQL、希望在不动数据的前提下增加语义查询能力的团队,也适合需要把自然语言问题转成可审阅 SQL 的分析场景。

维护者与状态

项目由 Sheltercosmo 维护,仓库创建于 2026-09-23,最后提交时间为 2026-10-07。最新 release 为 v0.7.0,发布于 2026-10-04。截至 2026-10-11,仓库获得 223 个星标。项目另有官网 jev4pg.com。

从时间线看,这是一个非常年轻的项目:创建到最新 release 之间只有十余天,release 之后仍在持续提交。使用者应当把它当作早期阶段的工具来评估,而不是已经长期稳定的基础设施。

主要能力

以下能力均来自项目自述,未经独立验证。

  • 自然语言到 SQL 与语义算子。据项目说明,它提供 41 个 JEV 算子,用于过滤、抽取、排序、匹配和验证,支持英文与简体中文的自然语言查询。
  • 可解释嵌入。项目自述用「命名问题 + 答案概率」来表示数据,使相似度变得可检查,而不是一个不可解释的向量距离。
  • 并行执行与输入去重。README 中称,独立工作会并发执行;相同上下文与问题下的重复取值会共享判断结果,同时保留每一行源数据。
  • 证据缓存。据项目说明,缓存会为兼容的查询与阈值变更保留原始观测,并校验来源与评估者身份。
  • 受控重试与可审阅回退。项目自述会把错误、不确定性和被跳过的工作显式暴露出来,并保留合法的 SQL 提案供修正。
  • 自发展的语义层。README 中称,经过审阅的定义与修正会沉淀为团队可复用的语义层,用于报表和应用。

项目自述强调分工:PostgreSQL 负责连接、窗口函数和精确算术,JEV 负责语义判断。查询结果中的决策状态与完整性会被显式呈现,不确定和未评估的行不会被悄悄吞掉。

使用入口

仓库地址为 Sheltercosmo/jev4pg,官网为 jev4pg.com。

据项目说明,仓库内同时提供两种形态:Python 应用(v0.7.0)与原生 PostgreSQL 扩展(0.2.0 预览)。Python 应用提供 Web 工作台、文件导入、NL2SQL、查询历史、后台任务与经审阅的语义特性;原生扩展用 Rust 在 PostgreSQL 内执行 jev_native.* 函数,直接 SQL 使用无需 Python 服务。

Python 应用的前置条件为 Python 3.11+ 与 Docker Compose v2。README 给出的安装流程为:

git clone --branch v0.7.0 https://github.com/Sheltercosmo/jev4pg.git
cd jev4pg
python deploy/configure.py
docker compose build
docker compose up -d --wait
python deploy/configure.py --show-token

数据接入方面,项目自述支持三种方式:直接挂载已有表或视图(按 PostgreSQL 权限与行级安全策略读取);通过工作台导入 CSV/TSV,浏览器导入上限为 5 MB 与 10,000 行;更大数据集建议先用既有管道或 psql 的 \copy 载入 PostgreSQL 再挂载。查询可在工作台的 SQL 模式中直接书写,例如对已注册的 tickets 数据集使用 SEMANTIC(body, '...') 作为 WHERE 条件,由 PostgreSQL 完成分组与计数。

原生扩展的安装则使用 python deploy/configure.py --native 配合 compose.yaml 与 compose.native.yaml 两个 Compose 文件构建。README 提醒,原生栈有独立的数据库卷并与 Python 栈共用默认端口,需要二选一或另行配置端口。

许可与限制

项目采用 Apache-2.0 许可证。

据项目说明,存在以下边界与前置条件:原生扩展目前为 0.2.0 预览版,原生维护特性刷新与语义写入审阅仍在路线图上,这些工作流需要使用 Python 引擎;原生栈首次构建会编译 Rust;使用已有 PostgreSQL 数据库时,迁移前应备份目标库,且业务表所有权不变、挂载的数据源在工作台中为只读;JEV 负责自然语言规划与语义分析,混合模式还需要配置 LLM,普通 SQL 则不需要模型密钥。此外,浏览器导入有 5 MB 与 10,000 行的上限。

需要说明的是,上述能力描述均来自项目自述,本文未对项目进行实际运行验证,性能与效果请以自行测试为准。