Search: #OCR

  1. Karakeep: AI 驱动的自托管全能书签管理平台• 支持保存链接、笔记、图片、PDF 等多种内容,提供全文搜索、页面归档、OCR 与 RSS 自动收藏,构建统一知识库• 集成 AI 自动标签、内容摘要与本地 Ollama 模型支持,结合规则引擎实现智能分类和高效管理• 提供 Chrome、Firefox、Safari 浏览器扩展、iOS 与 Android 应用,以及 REST API、MCP、CLI 等丰富生态,适合个人和团队协作使用

    Karakeep: AI 驱动的自托管全能书签管理平台

    • 支持保存链接、笔记、图片、PDF 等多种内容,提供全文搜索、页面归档、OCR 与 RSS 自动收藏,构建统一知识库

    • 集成 AI 自动标签、内容摘要与本地 Ollama 模型支持,结合规则引擎实现智能分类和高效管理

    • 提供 Chrome、Firefox、Safari 浏览器扩展、iOS 与 Android 应用,以及 REST API、MCP、CLI 等丰富生态,适合个人和团队协作使用

    https://github.com/karakeep-app/karakeep

    合集 群组 恰饭 联系推广

    #开源项目 #自托管 #书签管理 #知识管理 #AI #OCR #RSS #Ollama #GitHub

    • ❤️4
  2. SnapTra Translator: macOS 菜单栏 OCR 悬浮翻译工具• 基于屏幕 OCR 实时识别光标附近单词,悬浮气泡展示翻译、音标、词典释义,并支持发音播放• 提供持续翻译、单次查询、短按保留气泡等多种交互模式,兼顾阅读、查词与学习体验• 支持多语言翻译、自定义快捷键、Anki / CSV / TXT 单词导出,充分融入 macOS 原生工作流

    SnapTra Translator: macOS 菜单栏 OCR 悬浮翻译工具

    • 基于屏幕 OCR 实时识别光标附近单词,悬浮气泡展示翻译、音标、词典释义,并支持发音播放

    • 提供持续翻译、单次查询、短按保留气泡等多种交互模式,兼顾阅读、查词与学习体验

    • 支持多语言翻译、自定义快捷键、Anki / CSV / TXT 单词导出,充分融入 macOS 原生工作流

    https://github.com/yelog/SnapTraTranslator

    https://apps.apple.com/cn/app/snaptra-translator/id6757981764

    合集 群组 恰饭 联系推广

    #macOS #OCR #翻译工具 #效率工具 #Swift #SwiftUI #GitHub

    • ❤️2
    • 👍1
  3. auge: 本地视觉工具,一键 OCR 与图像分析• 支持 OCR、图像分类、条码与人脸检测,全部在 macOS 本地运行 • 完全零网络、零 API Key,直接通过终端调用,适配管道与脚本 • Homebrew 一键安装,Swift 代码轻量编译,兼容 macOS 10.15+

    auge: 本地视觉工具,一键 OCR 与图像分析

    • 支持 OCR、图像分类、条码与人脸检测,全部在 macOS 本地运行

    • 完全零网络、零 API Key,直接通过终端调用,适配管道与脚本

    • Homebrew 一键安装,Swift 代码轻量编译,兼容 macOS 10.15+

    https://github.com/Arthur-Ficial/auge

    合集 群组 恰饭 联系推广

    #视觉 #OCR #macOS #CLI #AppleVision #开源 #GitHub

  4. HideMyData: 面向 macOS 的本地化 PII 脱敏工具• 基于 Apple Vision 和 OpenAI privacy-filter 在设备端识别姓名、邮箱、电话、地址、日期、证件号等敏感信息• 支持 PDF 与图片统一脱敏流程,覆盖扫描件 OCR、嵌入字体文本提取和上下文识别• 提供黑框与毛玻璃两种脱敏样式,支持手动增删遮罩区域,导出后永久重建页面内容

    HideMyData: 面向 macOS 的本地化 PII 脱敏工具

    • 基于 Apple Vision 和 OpenAI privacy-filter 在设备端识别姓名、邮箱、电话、地址、日期、证件号等敏感信息

    • 支持 PDF 与图片统一脱敏流程,覆盖扫描件 OCR、嵌入字体文本提取和上下文识别

    • 提供黑框与毛玻璃两种脱敏样式,支持手动增删遮罩区域,导出后永久重建页面内容

    https://github.com/mkbula/HideMyData

    合集 群组 恰饭 联系推广

    #隐私保护 #数据脱敏 #本地 #AI #OCR #macOS #Swift #AppleVision #PDF

    • ❤️1
  5. macshot: 原生 macOS 截图与录屏一体化效率工具• 集成截图 标注 录屏与视频编辑,支持 MP4 与 GIF 导出,适合开发演示与问题反馈• 内置 OCR 与翻译、PII 自动打码、滚动截图、二维码识别,信息提取和隐私处理一步完成• 基于 Swift 与 AppKit 构建,支持多显示器、快捷键、历史记录与 S3 兼容上传,日常使用轻量顺手

    macshot: 原生 macOS 截图与录屏一体化效率工具

    • 集成截图 标注 录屏与视频编辑,支持 MP4 与 GIF 导出,适合开发演示与问题反馈

    • 内置 OCR 与翻译、PII 自动打码、滚动截图、二维码识别,信息提取和隐私处理一步完成

    • 基于 Swift 与 AppKit 构建,支持多显示器、快捷键、历史记录与 S3 兼容上传,日常使用轻量顺手

    https://github.com/sw33tLie/macshot


    合集 群组 恰饭 联系推广

    #macOS工具 #截图工具 #录屏工具 #OCR #隐私脱敏 #Swift #AppKit #GitHub

    • ❤️2
  6. Capso: 开源的 macOS 截图与录屏工具,适合日常创作与技术分享场景• 支持区域、全屏、窗口截图,以及 MP4 和 GIF 录屏,覆盖高频屏幕采集需求• 内置标注编辑器、截图美化、OCR 识别和钉图功能,截图后处理流程完整顺畅• 基于 Swift 6 和 SwiftUI 构建,采用模块化 SPM 架构,核心能力可复用到自己的 macOS 项目中

    Capso: 开源的 macOS 截图与录屏工具,适合日常创作与技术分享场景

    • 支持区域、全屏、窗口截图,以及 MP4 和 GIF 录屏,覆盖高频屏幕采集需求

    • 内置标注编辑器、截图美化、OCR 识别和钉图功能,截图后处理流程完整顺畅

    • 基于 Swift 6 和 SwiftUI 构建,采用模块化 SPM 架构,核心能力可复用到自己的 macOS 项目中

    https://github.com/lzhgus/Capso

    合集 群组 恰饭 联系推广

    #macOS #截图工具 #录屏工具 #开源项目 #Swift #SwiftUI #OCR #GitHub

    • ❤️2
  7. Koharu: 基于 Rust 构建的本地优先漫画翻译工作台• 集成文本区域检测、OCR、去字修复与 LLM 翻译,覆盖漫画翻译的完整处理链路• 支持本地与远程模型后端,兼容 llama.cpp、OpenAI 兼容接口,以及 OpenAI、Gemini、Claude、DeepSeek 等服务• 提供竖排 CJK、RTL 文本渲染、可编辑 PSD 导出、Local HTTP API 与 MCP Server,方便接入自动化工作流

    Koharu: 基于 Rust 构建的本地优先漫画翻译工作台

    • 集成文本区域检测、OCR、去字修复与 LLM 翻译,覆盖漫画翻译的完整处理链路

    • 支持本地与远程模型后端,兼容 llama.cpp、OpenAI 兼容接口,以及 OpenAI、Gemini、Claude、DeepSeek 等服务

    • 提供竖排 CJK、RTL 文本渲染、可编辑 PSD 导出、Local HTTP API 与 MCP Server,方便接入自动化工作流

    https://github.com/mayocream/koharu

    合集 群组 恰饭 联系推广

    #漫画翻译 #OCR #机器学习 #Rust #LLM #本地优先 #图像处理 #MCP #GitHub

  8. Kreuzberg: 面向多语言生态的高性能文档解析与 OCR 引擎• 支持 88+ 文件格式解析,覆盖 PDF、Office、图片、HTML、XML、邮件、压缩包与学术文档,适合构建统一的数据提取管线• 基于 Rust 内核与原生绑定,提供 Python、Node.js、Go、Java、C#、PHP 等多语言支持,并可作为库、CLI、REST API 或 MCP Server 部署• 内置可扩展插件架构,支持 Tesseract、PaddleOCR、EasyOCR 等 OCR 后端,同时可选生成 Embeddings,无需 GPU 也能获得原生级处理速度

    Kreuzberg: 面向多语言生态的高性能文档解析与 OCR 引擎

    • 支持 88+ 文件格式解析,覆盖 PDF、Office、图片、HTML、XML、邮件、压缩包与学术文档,适合构建统一的数据提取管线

    • 基于 Rust 内核与原生绑定,提供 Python、Node.js、Go、Java、C#、PHP 等多语言支持,并可作为库、CLI、REST API 或 MCP Server 部署

    • 内置可扩展插件架构,支持 Tesseract、PaddleOCR、EasyOCR 等 OCR 后端,同时可选生成 Embeddings,无需 GPU 也能获得原生级处理速度

    https://github.com/kreuzberg-dev/kreuzberg

    #文档解析 #OCR #Rust #Embeddings #多语言开发 #文件处理 #开发工具 #GitHub #MCP #API GitHub - xberg-io/xberg: A polyglot document intelligence framework with a Rust core. Extract text, metadata, images, and structured…

  9. TRex: 随手截图即识别文字• 菜单栏轻量应用,快捷键选区 OCR,文本直接写入剪贴板 • 支持多语言识别、二维码与条码解析,全部离线运行 • 可通过 URL scheme 与 Alfred、Raycast 等工具深度集成,实现自动化工作流

    TRex: 随手截图即识别文字

    • 菜单栏轻量应用,快捷键选区 OCR,文本直接写入剪贴板

    • 支持多语言识别、二维码与条码解析,全部离线运行

    • 可通过 URL scheme 与 Alfred、Raycast 等工具深度集成,实现自动化工作流

    https://github.com/amebalabs/TRex

    #文字识别 #OCR #macOS #Automation #Apple #GitHub

  10. userecho: 面向产品团队的开源用户反馈管理与 AI 洞察平台• 支持多渠道用户反馈收集、批量导入与智能去重,能够快速合并重复需求,降低整理成本• 内置截图 OCR 与 AI 语义识别,可直接解析微信截图中的用户昵称和反馈内容,减少手动录入• 基于 FastAPI + Vue 3 + PostgreSQL + pgvector 构建,提供多租户工作空间、智能回复助手与周报洞察,适合 SaaS 团队落地反馈闭环

    userecho: 面向产品团队的开源用户反馈管理与 AI 洞察平台

    • 支持多渠道用户反馈收集、批量导入与智能去重,能够快速合并重复需求,降低整理成本

    • 内置截图 OCR 与 AI 语义识别,可直接解析微信截图中的用户昵称和反馈内容,减少手动录入

    • 基于 FastAPI + Vue 3 + PostgreSQL + pgvector 构建,提供多租户工作空间、智能回复助手与周报洞察,适合 SaaS 团队落地反馈闭环

    https://github.com/yisizhu520/userecho

    #开源项目 #用户反馈 #产品管理 #数据洞察 #多租户 #FastAPI #Vue3 #PostgreSQL #pgvector #AI #OCR #GitHub

  11. Viz: 屏幕 OCR/二维码/条形码解析 Mac App从屏幕截图中识别和提取文本、二维码(QR Codes)和条形码(Barcodes) alienator88/Viz 频道资源合集 恰饭推荐 群组 #GitHub #工具 #OCR #QR #二维码 #mac #条形码

    Viz: 屏幕 OCR/二维码/条形码解析 Mac App

    从屏幕截图中识别和提取文本、二维码(QR Codes)和条形码(Barcodes)

    alienator88/Viz

    频道资源合集 恰饭推荐 群组

    #GitHub #工具 #OCR #QR #二维码 #mac #条形码

    • ❤️1