7.0
热点
AI SCORE
开源项目2025-08-18 05:40
Llama-Scan:用本地 LLM 高效处理 PDF
Hacker News · github.com#本地LLM#工具
Editor brief · 编辑速览
本地大模型 PDF 转文本方案,避免敏感数据上云。解决程序员文档处理的常见痛点。
本地大模型 PDF 转文本方案,避免敏感数据上云。解决程序员文档处理的常见痛点。
必须登录才能更改通知设置
仓库文件导航
一个使用 Ollama 将 PDF 转换为文本文件的工具。
在本地将 PDF 转换为文本文件,无需支付 token 费用。
使用 Ollama 支持的最新多模态模型。
将图片和图表转换为详细的文字描述。
需要在本地安装并运行 Ollama。
拉取默认模型:
ollama run qwen2.5vl:latest
pip install llama-scan
uv tool install llama-scan
llama-scan path/to/your/file.pdf
--output, -o:输出目录(默认值:"output")
--model, -m:要使用的 Ollama 模型(默认值:"qwen2.5vl:latest")
--start, -s:起始页码(默认值:0)
--end, -e:结束页码(默认值:0)
--custom-instructions, -c:可选,包含附加指令的文本文件路径(默认值:None)
--server-url, -u:Ollama 服务器 URL(默认值:"http://localhost:11434")
--width, -w:调整后图片的宽度(设为 0 时不调整大小;默认值:0)
--keep-images, -k:保留中间生成的图片文件(默认值:False)
--stdout, -s:将合并后的输出写入 stdout(默认值:False)
处理指定页面:
llama-scan document.pdf --start 1 --end 5
使用其他 Ollama 模型:
llama-scan document.pdf --model qwen2.5vl:3b
使用本地 LLM 转录 PDF