DOCX

Extract text from Microsoft Word documents

gabrielmoreira Updated 17 repo stars

File contents

DOCX Skill

Extracts paragraph text from .docx files using python-docx.

Setup

pip install python-docx

Standalone usage

import asyncio
from synthadoc.skills.docx.scripts.main import DocxSkill

skill = DocxSkill()

async def main():
    result = await skill.extract("/path/to/document.docx")
    print(result.text)      # all paragraphs joined as plain text

asyncio.run(main())

When this skill is used

  • Source path ends with .docx
  • User intent contains: word document, docx

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/axoviq-ai@synthadoc/synthadoc/skills/docx commit cfa4d6b37b

Frequently asked questions

npx skillmds@latest add gabrielmoreira/docx-2