快讯
LightOn 开源 LightOnOCR-3,扩展文档结构与图表提取
LightOn 发布 0.8B 与 4B 两档 LightOnOCR-3 模型,采用 Apache 2.0 许可;除识别文字外,还可定位版面元素、描述图片并提取图表数据。
LightOn 发布 LightOnOCR-3 文档理解模型系列。官方资料列出 0.8B 与 4B 两种规模,均以 Apache 2.0 许可开放;模型可输出文字、版面结构、图片描述及图表数据,面向检索和文档处理工作流。
LightOn 报告其模型在若干 OCR 与文档理解基准上取得竞争性成绩,但这些结果来自指定测试设置,不能直接推断所有文档场景下的效果。
参考:LightOn 技术说明