← スキル一覧に戻る

docx
by enoch-robinson
⭐ 0🍴 0📅 2026年1月10日
SKILL.md
name: docx description: Word 文档处理工具包。用于创建新文档、编辑现有文档、处理修订追踪、添加批注、提取文本。当需要处理 .docx 文件进行文档创建、修改或分析时使用此技能。
DOCX Processing Guide
工作流决策树
| 任务 | 推荐方法 |
|---|---|
| 读取/分析内容 | pandoc 转Markdown |
| 创建新文档 | docx-js (JavaScript) |
| 编辑现有文档 | python-docx 或OOXML |
| 修订追踪 | Redlining 工作流 |
读取文档
转换为 Markdown
# 基础转换
pandoc document.docx -o output.md
# 保留修订追踪
pandoc --track-changes=all document.docx -o output.md
创建新文档 (JavaScript)
const { Document, Packer, Paragraph, TextRun } = require('docx');
const doc = new Document({
sections: [{
children: [
new Paragraph({
children: [
new TextRun({ text: "标题", bold: true, size: 32 }),],
}),
new Paragraph({
children: [
new TextRun("正文内容"),
],
}),
],
}],
});
// 导出
Packer.toBuffer(doc).then(buffer => {
fs.writeFileSync("output.docx", buffer);
});
编辑文档 (Python)
from docx import Document
# 打开文档
doc = Document('existing.docx')
# 添加段落
doc.add_paragraph('新段落内容')
# 添加标题
doc.add_heading('新标题', level=1)
# 添加表格
table = doc.add_table(rows=2, cols=2)
table.cell(0, 0).text = '单元格内容'
# 保存
doc.save('modified.docx')
提取文本
from docx import Document
doc = Document('document.docx')
full_text = []
for para in doc.paragraphs:
full_text.append(para.text)
print('\n'.join(full_text))
修订追踪工作流
- 转换查看:
pandoc --track-changes=all file.docx -o current.md - 识别变更:标记需要修改的位置
- 实施变更:使用 OOXML 添加
<w:ins>和<w:del>标签 - 验证结果:再次转换确认修改正确
文档转图片
# DOCX → PDF
soffice --headless --convert-to pdf document.docx
# PDF → 图片
pdftoppm -jpeg -r 150 document.pdf page
依赖安装
# Python
pip install python-docx
# JavaScript
npm install docx
# 命令行工具
sudo apt-get install pandoc libreoffice poppler-utils
スコア
総合スコア
50/100
リポジトリの品質指標に基づく評価
✓SKILL.md
SKILL.mdファイルが含まれている
+20
○LICENSE
ライセンスが設定されている
0/10
○説明文
100文字以上の説明がある
0/10
○人気
GitHub Stars 100以上
0/15
○最近の活動
3ヶ月以内に更新がある
0/10
○フォーク
10回以上フォークされている
0/5
✓Issue管理
オープンIssueが50未満
+5
✓言語
プログラミング言語が設定されている
+5
○タグ
1つ以上のタグが設定されている
0/5
レビュー
💬
レビュー機能は近日公開予定です