patent-pdf-to-md
Convert Chinese patent PDFs/DOCX/DOCs to structured Markdown. Supports patent publications (A/B/U) and office action documents (审查意见通知书/驳回决定/复审决定书/无效宣告请求审查决定书). Uses MinerU for high-quality OCR text e
项目介绍
Convert Chinese patent PDFs/DOCX/DOCs to structured Markdown. Supports patent publications (A/B/U) and office action documents (审查意见通知书/驳回决定/复审决定书/无效宣告请求审查决定书). Uses MinerU for high-quality OCR text e
来源目录记录的工作方式
将中国专利PDF/DOCX/DOC转为结构化Markdown:自动检测文档类型(专利公开A/B/U或审查文件四种)分流到对应解析流程,MinerU高质量OCR(降级Tesseract),提取著录项目/权利要求/说明书/附图,多文件经SubAgent并行处理并附故障恢复。输出结构化md与JSON。
收录说明:本条由 Legal SkillHub 公开索引批量收录,尚未逐项人工核验。请在安装前阅读源代码、权限、依赖和许可证。
适合哪些工作
文档处理
使用方式
通常由支持 Skills 的 AI 智能体读取项目说明,并按 Skill 定义的步骤协助完成任务。 当前目录记录的支持平台为:通用 Agent。 运行位置:本地运行。
数据与权限
可能涉及的数据操作:memo、json;材料是否出域:取决于智能体平台与配置。安装或连接前,应以源代码和官方文档为准,确认所需目录、网络、账号及读写权限。
Key 与费用
API Key / 账号:现有来源资料未注明是否需要 API Key 或账号,安装前应查看官方文档确认。
免费或收费:费用信息尚未核实;项目本身、API、会员服务、AI 模型或运行平台均可能分别收费,请以官方页面为准。
已知限制
批量目录收录,尚未逐项人工核验;上游风险标记:low;依赖:python3 运行时;MinerU OCR 引擎(可选降级 Tesseract)
交给 AI 智能体的审查提示词,审查后再确认安装
默认只审查、不安装;确认结论后再单独授权。
请先阅读并审查这个 Skill 的源代码与 SKILL.md:https://github.com/CSlawyer1985/legal-skillhub/tree/main/skills/patent-pdf-to-md
确认许可证、所需权限、外部网络请求和脚本行为;不要读取或上传我的密钥、客户材料和案件文件。
先只输出审查结论、风险和拟执行步骤,不要安装。只有在我明确回复确认后,才可按官方文档安装到当前智能体的用户级 Skills 目录。安装后只运行最小无敏感数据测试。