推文
@bkdgiffug · 2026-10-10 06:05
百度开源了一个 OCR 项目 Unlimited-OCR,主打长文档处理和本地运行,适合论文、合同等资料识别。 ① 长文档处理:据项目介绍,可一次处理最多 100 页 PDF ② 轻量模型:约 3B 参数,支持多语言 ③ 本地部署:文档无需上传云端,降低隐私风险 ④ 多种推理框架:兼容 Transformers、vLLM、Ollama 和 llama.cpp 相比按页收费的云端 OCR,本地运行可以减少使用成本。识别效果和速度仍建议按自己的文档测试。 🔗 https://github.com/baidu/Unlimited-OCR
曝光 444 · 评论 2 · 点赞 7 · 书签 1 · 曝光/时 61.35282430879049