跳至主要内容
造物矩阵

GitHub Repo

dwqs/ollama-ocr

基于 Ollama 和视觉语言模型的 OCR 工具,支持 LLaVA、Llama 3.2 Vision 等模型,将图像文本提取为 Markdown、Text 或 JSON。

knowledge workflowmodel deploymentocrollamatext extractionvision language model

推荐理由

创造者可以快速部署本地 OCR 服务,用于文档数字化、自动化工作流,或作为教程分享如何使用 VLMs 实现高精度文本识别。

二创切入点

  • 围绕项目能力写工具教程、场景拆解或对比评测。
  • 复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。
  • 生成分享卡片可以用于私域传播、收藏夹或选题库归档。

项目事实

语言
Vue
协议
mit
Issues
0
首次收录
2026/07/07