ssa-pdf-catalog从 PDF 产品目录(模具图纸)中自动提取产品信息,生成结构化知识库和 Excel 填充数据。
Install via ClawdBot CLI:
clawdbot install cjboy007/ssa-pdf-catalogGrade Fair — based on market validation, documentation quality, package completeness, maintenance status, and authenticity signals.
Calls external URL not in known-safe list
https://ds4sd.github.io/docling/Audited Apr 16, 2026 · audit v1.0
Generated Oct 6, 2026
模具工厂积累了大量历史产品图纸PDF,需要将图纸中的模具号、客户品名、包装规范等信息批量提取为结构化数据库。通过该技能可自动处理数百个PDF文件,建立可检索的产品知识库,取代人工逐页录入。
HDMI等线缆产品有多个客户SKU对应同一模具,产品目录PDF中SKU和模具号分散在不同字段。该技能能提取SKU→模具号映射关系并自动填充到Excel报价表或ERP系统,减少人工匹配错误。
外贸企业需要按客户要求整理产品品名、包装规范(如BJ0599系列)和长度规格,用于报关和客户对账。该技能批量解析PDF图纸生成标准化JSON和Markdown索引,便于交付给海外客户。
企业希望将散落的PDF图纸转化为可搜索的知识库,支持按模具系列(AD、OP、AP、DP等)和客户品名快速定位产品。该技能输出的Markdown词条和JSON数据可直接导入内部Wiki或搜索系统。
工厂上线新ERP或MES系统时需要初始化产品主数据,包括模具号、品名、长度、包装规范等。该技能从PDF目录中提取数据并映射到Excel模板,可批量导入系统,避免手工录入错误。
质量部门需要审计现有产品目录中模具号是否与包装规范混淆、是否有客户品名误填为模具号等问题。该技能内置的排除规则可自动标记可疑数据,提升主数据准确性。
针对企业已有的PDF产品目录,提供一次性的数据提取与知识库建设服务,按文件数量或项目规模收费。适合数据量固定、需求明确的存量数字化项目。
将提取能力封装为云端API或在线工具,客户上传PDF即可获得结构化数据,按月或按处理量订阅。适合需要持续处理新产品的制造和贸易企业。
作为产品主数据初始化模块,与ERP、PLM、MES等系统厂商合作集成,作为实施服务的一部分交付。适合系统集成商和工业软件公司。
💬 Integration Tip
建议先在小批量PDF样本上验证模具号正则和OCR阈值,再接入ERP/Excel批量流程;同时维护一份已知映射表作为无法提取时的fallback,避免脏数据进入主数据系统。
Scored Oct 6, 2026
PDF智能处理工具 v2.1 | PDF Smart Tool. 支持PDF转换、OCR识别、合并拆分、数字签名、批量处理、水印添加、加密解密。触发词:PDF、转换、识别。
Generate hand-drawn style diagrams, flowcharts, and architecture diagrams as PNG images from Excalidraw JSON
Convert public web pages into clean Markdown with markdown.new for AI workflows. Use when tasks require URL-to-Markdown conversion for summarization, RAG ing...
PDF扫描件转Word文档。支持中文OCR识别,自动裁掉页眉页脚,保留插图,彩色章节封面页保留为图片。使用百度OCR API(免费额度1000次/月)。当用户要求把扫描PDF转成文字/Word时触发。
Word文档处理工具套件,提供Word文档的创建、读取、内容提取和基本处理功能。
Microsoft SharePoint and OneDrive integration with managed OAuth. Manage sites, lists, libraries, files, folders, permissions, content types, and SharePoint...