跳到主内容
智客 ZICQ

技能库 智客分类:其他 ocr-local OpenClaw

Ocr Local

使用 Testeract.js OCR 从图像中取出文本(当地100%,不需要 API 密钥) 。 支持汉语(简化/传统)和英语.

654 安装量 · 20 星标

官方网址:作者主页

技能介绍

先看中文介绍;官方 description 原文单独保留,不改写 SKILL.md。

做什么

使用 Testeract.js OCR 从图像中取出文本(当地100%,不需要 API 密钥) 。 支持汉语(简化/传统)和英语.

何时用

官方 description 未单独写出 Use when。按规范,代理会在用户任务与这段 description 的关键词匹配时激活本技能。

代理如何加载

按 Agent Skills 渐进披露:启动时只加载 name 与 description(约 100 token);任务匹配后才读入整份 SKILL.md 正文;scripts/、references/、assets/ 仅在需要时再读。 本文件正文结构:OCR - Image Text Recognition (Local)、Quick start、Options、Examples、Recognize Chinese screenshot、Recognize English document。 其中含规范建议的小节:输入输出示例。

文件分析

文件分析:除 SKILL.md 外,正文引用了 scripts/ocr.js,属于带资源的技能包,这些文件按需再读。

官方 description(原文)

Extract text from images using Tesseract.js OCR (100% local, no API key required). Supports Chinese (simplified/traditional) and English.

OCR - Image Text Recognition (Local)Quick startOptionsExamplesRecognize Chinese screenshotRecognize English documentMixed Chinese + EnglishNotes

来源分类:ClawHub OCR

SKILL.md 与 Agent 调用

官方规范 ↗
name
ocr-local
description
Extract text from images using Tesseract.js OCR (100% local, no API key required). Supports Chinese (simplified/traditional) and English.
  1. 发现技能客户端向 Agent 提供名称与描述目录。
  2. 匹配与调用用户指定或任务匹配后,载入 SKILL.md 指令。
  3. 按需加载按步骤读取参考文档、使用脚本与素材。
指令中引用的文件 · 1
  • scripts/ocr.js

以下路径提取自原文;文件是否齐全请以来源仓库中的完整目录为准。

具体调用语法与可用工具以目标 Agent 客户端为准。 查看调用机制说明 ↗

安装这个技能

Skills CLI ↗

先选择目标 Agent 和安装范围,保留技能包的附属文件,安装后检查客户端能否发现该技能。

该技能引用了附属文件,请从来源获取完整目录;仅复制 SKILL.md 可能缺少依赖。

交给 Agent 安装

复制安装指令给支持 Agent Skills 的代理,确认其中的目标目录与客户端匹配。

把 Agent Skill「ocr-local」安装到我的项目:SKILL.md 原文与官方 description 见 https://zicq.com/zh/skills/skl-6f081dc2b915077f-Ocr-Local.html
请存为 .cursor/skills/ocr-local/SKILL.md 或 .claude/skills/ocr-local/SKILL.md,frontmatter 的 name 与 description 保持原样,不要改写。
该技能还带 scripts/、references/、assets/ 等文件,请从 https://clawhub.ai/skills/ocr-local 取完整目录,不要只建一个 SKILL.md。

当前没有明确的 GitHub 技能包地址,请按来源页面的安装器说明操作。

ClawHub ↗

阅读排版
--- name: ocr-local description: Extract text from images using Tesseract.js OCR (100% local, no API key required). Supports Chinese (simplified/traditional) and English. homepage: https://github.com/naptha/tesseract.js metadata: {"openclaw":{"emoji":"📝","requires":{"bins":["node"]},"install":[{"id":"npm","kind":"npm","packages":["tesseract.js"],"label":"Install tesseract.js"}]}} --- # OCR - Image Text Recognition (Local) Extract text from images using Tesseract.js. **100% local run, no API key required.** Supports Chinese and English. ## Quick start ```bash node {baseDir}/scripts/ocr.js /path/to/image.jpg node {baseDir}/scripts/ocr.js /path/to/image.png --lang chi_sim node {baseDir}/scripts/ocr.js /path/to/image.jpg --lang chi_tra+eng ``` ## Options - `--lang `: Language codes (default: chi_sim+eng) - `chi_sim` - Simplified Chinese - `chi_tra` - Traditional Chinese - `eng` - English - Combine with `+`: `chi_sim+eng` - `--json`: Output as JSON instead of plain text ## Examples ```bash # Recognize Chinese screenshot node {baseDir}/scripts/ocr.js screenshot.png # Recognize English document node {baseDir}/scripts/ocr.js document.jpg --lang eng # Mixed Chinese + English node {baseDir}/scripts/ocr.js mixed.png --lang chi_sim+eng ``` ## Notes - First run downloads language data (~20MB per language) - Subsequent runs are cached locally - Works best with clear, high-contrast images - For handwritten text, accuracy may vary

相关技能

其他

Self Improving Agent

掌握学习、错误和校正,以便不断改进。 使用时间:(1) 命令或操作意外失败, (2) 用户更正 Claude ('No, that's wrong...', 'Actually...'), (3)用户请求具备不存在的能力,(4)外部API或工具失败,(5)克洛德意识到其知识已经过…

其他

Self Improving + Proactive Agent

自我反省+自我批评+自我学习+自我组织记忆. 特工评估自己的工作,发现错误,并永久改进. 当 (1) 命令,工具, API, 或操作失败时使用; (2) 用户纠正或拒绝您的工作; (3) 您意识到您的知识已经过时或不正确; (4) 您发现更好的方法; (5) 用户明确安装或引用当…

其他

Proactive Agent

将AI代理人从任务跟踪者转变为预先预测需要并不断改进的主动伙伴. 现在WAL协议,工作缓冲,自主克龙, 和战斗测试模式。 哈尔·斯塔克的一部分

其他

Multi Search Engine

多搜索引擎集成16个引擎(7个CN+9 Global). 支持高级搜索操作员,时间过滤器,站点搜索,隐私引擎,和WolframAlpha知识查询. 不需要 API 密钥 .