10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 小程序 标签云

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI开源项目

Light OCR:跑在本地的轻量 OCR 引擎,Node.js + C++ 原生支持

1月前 AI开源项目 318 0

Light OCR 是一个运行在本地的 OCR 工具,面向 Node.js 和 C++ 开发者。不需要联网,安装后即可直接识别图片中的文字,返回识别内容、置信度和位置坐标。

图片 1

核心特性

  • 本地处理:图片和 OCR 结果始终留在本机,数据不外传。
  • 一键安装:模型和当前平台的预编译组件随 npm 包一起安装,无需额外配置。
  • 结构化结果:每一行包含识别文字、置信度和原图位置坐标,直接可用。
  • 硬件加速:macOS 15+ Apple Silicon 优先使用 Core ML,Linux 和 Windows 版本优先使用 WebGPU。
  • 非阻塞执行:识别任务在 JavaScript 主线程之外执行,支持队列、取消和资源释放。
  • Tiled 模式:可选的 tiled 模式可保留高分辨率图片中的小字和密集文字识别能力。

快速开始

支持 Node.js 22 和 24:

npm install @arcships/light-ocr
import { createEngine } from "@arcships/light-ocr";
import { readFile } from "node:fs/promises";

const engine = await createEngine();
const result = await engine.recognizeEncoded(
  await readFile("image.jpg"),
);

for (const line of result.lines) {
  console.log(line.text, line.confidence, line.box);
}

await engine.close();

createEngine() 会根据当前平台自动选择合适的执行方式。

如果应用已经完成图片解码,recognize() 也可以直接接收 GRAY8、RGB8、BGR8 和 RGBA8 像素数据。

Github地址

https://github.com/arcships/light-ocr

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:Light OCR:跑在本地的轻量 OCR 引擎,Node.js + C++ 原生支持
#OCR #Node.js #C++ #本地部署 
收藏 1
Qwen-Image-3.0:落字成画,字字如印——千问新一代图像生成模型
Macaron-V1:基于 GLM-5.2 的 MoL 架构个人智能体,2M 上下文 + 四大专家 LoRA
推荐阅读
  • OpenClaw 101:系统化学习路径如何解决 AI 助手入门难题
  • 4个开源 Skill 把 AI 写作腔调治没了
  • AI 知识库架构实战:Garry Tan 的「第二大脑」系统设计详解
  • HandDraw Story Video:手绘插图一键生成竖屏动画视频,支持线稿推进和渐变色彩
  • DiceBear:开源头像生成库,52种风格一行代码搞定用户头像
评论 (0)
请登录后发表评论
分类精选
WeKnora:终于等到了腾讯ima的开源知识库框架,用 API 轻松打造本地智能文档检索
12057 12月前
OpenSpec:比 Cursor Plan 更聪明?试试这款让 AI 编码更靠谱的规范驱动工具
10597 10月前
CapCut API:一个剪映API开源项目,让AI自动剪辑视频
9976 8月前
AIRI:你的开源AI女友,让你随时拥有属于自己的 AI VTuber
8979 12月前
Antigravity-Manager:这个开源神器让你白嫖ClaudeOpus 4.5,Gemini 3!还能接Claude Code等任意平台
8898 8月前
CompressO:开源免费的视频压缩神器,让你的硬盘瞬间轻松 10 倍
8502 11月前
就要创作:从提示词到创作团队,开源 AI 网文写作平台
8382 10月前
awesome-openclaw-skills:700+ Skills 一条命令装配完成,如何让本地 AI Agent 真正落地可用
7887 7月前
baoyu-skills:又一个宝藏Skill,面向内容创作者的技能集,支持图文生成、发布与处理
7668 7月前
Claude Code 生成专业图表的 15 个 Skills:覆盖 7 种渲染引擎的完整指南
7609 4月前

文章目录

关注「苏米客」公众号

订阅推送更及时,手机查看更方便
分类排行
1 开源单色海报工具 mono-color-skill:用一句话生成印刷级海报/封面/包装
2 Superlearn开源Skill:一句话生成交互式学习网站,支持六种视图与记忆卡片
3 浙大联合北大开源 Easel:社媒运营全链路 Agent,从热点发现到多平台一键发布
4 开源旅行海报工具 Yingzao · 营造:20 张废片对比实测,多模型协作把照片变杂志级海报
5 Anthropic 开源 Claude 电商 Agent:Shopping + Merchant 双端架构,Shopify 率先接入
6 一个HTML文件撑起整个3D世界:Kage 开源项目实测
7 GitHub Trending 精选:OpenCut、Meetily、TokenSaver 三个实用开源项目
8 headlong:AI Agent微框架开源,自动执行任务并主动汇报结果
9 GitHub热门3D人体器官网站:AI生成交互式人体器官模型
10 飞鼠格式:支持80+格式的本地文件转换工具,开源免费无广告
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联