Databricks 博客:在 SQL 中运行开放权重决策模型
Databricks 发布博客,介绍如何借助无服务器 GPU 与 ai_query,在受治理数据上直接调用开放权重决策模型,并以酒店评论分类为例演示流程。
核心事实
Databricks 在其官方博客发布文章,介绍如何在 Databricks 平台上运行开放权重的决策类模型。据该博客描述,用户可以通过无服务器 GPU 与托管式 Model Serving 部署此类模型,并借助 ai_query 直接从 SQL 控制台或 Lakeflow 生产作业中调用自定义模型端点,返回结构化的决策结果与概率分数。博客以 SemIf-OpenJev 模型为例,演示将酒店评论分类为好评或差评的流程,并称该流程已打包为可导入的 Notebook,大致步骤为选择模型名称与 schema、选择无服务器 GPU、点击全部运行。
背景与影响
博客提到,近期出现了一类被称为“System One”的决策模型(如 Jev),这类基础模型能够从一组离散选项中给出校准较好的决策,通常速度较快、成本较低,因而适合在大规模数据上应用,潜在场景包括分析客户支持对话记录等。开源社区也陆续发布了开放权重版本,博客中列举了 Smelf-open-jev、Laya、Kev 等名称。文章认为,这类模型的价值只有在能够接触大量数据时才会释放,因此将其与受治理数据打通、并支持从 SQL 直接调用,是较为实用的方向。此外,博客称 AI Runtime 等产品可用于对模型进行定制或后训练,以适配企业自身场景。
限制与来源
需要说明的是,上述内容来自 Databricks 官方博客的叙述,本文未对其性能、速度、成本或准确性做任何独立验证。博客中提到的模型名称、产品能力与可用范围,可能随版本与地区变化,具体功能、定价与支持情况请以 Databricks 官网当前信息为准。文中涉及的开放权重模型多由第三方社区发布,其许可与使用条件需另行确认。原文链接:Running open-Jev in SQL on Databricks。