如何本地部署paddleocr 并接入到 dify 中? #18260
Replies: 1 comment
|
可以,建议拆成两层:PaddleOCR/PaddleX 提供本地 HTTP 服务,Dify 只负责调用。不要在 Dify 的每次节点执行中重新加载模型。 1. 先把文档解析服务跑通如果目标是 PDF/复杂版面转 Markdown,优先用 python -m pip install paddleocr
paddlex --install serving
# 文档版面解析
paddlex --serve --pipeline PP-StructureV3 --host 0.0.0.0 --port 8080
# 如果只要普通 OCR,则改为:
# paddlex --serve --pipeline OCR --host 0.0.0.0 --port 8080先不要接 Dify,直接做一次 smoke test: import base64
from pathlib import Path
import requests
payload = {
"file": base64.b64encode(Path("test.pdf").read_bytes()).decode(),
"fileType": 0, # PDF=0,图片=1
"useDocOrientationClassify": False,
"useDocUnwarping": False,
"useTextlineOrientation": False,
"visualize": False,
}
r = requests.post(
"http://127.0.0.1:8080/layout-parsing",
json=payload,
timeout=300,
)
r.raise_for_status()
data = r.json()
print(data["result"]["layoutParsingResults"][0]["markdown"]["text"])普通 OCR 对应的地址是 2. 在 Dify 中调用Workflow 中使用“文件输入 → HTTP Request → Code/Template → 后续 LLM/知识库”即可:
如果 Dify 与 PaddleOCR 都在 Docker 中, 如果使用 Dify Cloud,它访问不到你局域网里的 最后,如果 Dify 的文件变量给出的是内部临时 URL,必须确认 PaddleOCR 容器也能访问该 URL;否则加一个很薄的 adapter,把 Dify 上传的文件转换为 Base64 后再转发给 |
Uh oh!
There was an error while loading. Please reload this page.
如何本地部署paddleocr 文档解析服务并接入到 dify 中?
All reactions