解析用户上传的文件(PDF/Word/图片),提取文本内容和图片并保存到本地,使用图像识别能力理解图片内容,根据文件内容和用户需求判断文章类型(品牌动向/产品动态/政策规则/营销战役/客户证言/行业资讯),使用不同prompt生成Markdown格式的文章,使用Markdown语法引用图片,确保配图与文章内容契合,并对生成结果进行质量打分。适用于需要从现有文档生成各类品牌和产品内容的场景,如品牌报道、产品发布、政策公告、营销宣传、客户案例等。
PyMuPDF==1.23.8 # PDF文件解析和图片提取
python-docx==0.8.11 # Word文件解析和图片提取
Pillow==10.0.0 # 图片处理和格式转换
mkdir -p output/images
使用 [INVOKE:parse_file] 调用脚本处理用户上传的文件:
{"file_path": "文件路径"}/home/gem/output/images/(脚本会自动创建)调用方式: 在回复中包含以下格式来触发脚本执行:
[INVOKE:parse_file({"file_path": "/home/gem/uploads/文件名.pdf"})]
图片保存说明:
/home/gem/output/images/ 目录image_001.png, image_002.png 等向用户询问生成文章的具体需求:
如果解析结果包含图片,对每个图片进行内容理解:
根据解析的文件内容、图片内容和用户需求,判断文章类型:
根据确定的文章类型,使用对应的prompt模板生成内容:
{ORIGINAL_TEXT}: 原文件提取的文本内容{USER_REQUIREMENTS}: 用户的具体需求描述{TARGET_AUDIENCE}: 目标受众{IMAGES_INFO}: 图片信息列表(包含图片内容理解结果和本地路径)根据 references/evaluation-prompts.md 中的评估Prompt对生成的文章进行质量评估:
按照 assets/output-template.md 的格式输出最终结果:
注意:评估结果必须附加在文章内容的最后,作为文章质量的重要参考。
下载说明:
./output/article.md./images/ 目录(相对于文章位置)./output/ 目录,包含文章和所有图片./images/xxx.png,避免随意配图npx skills add twwch/file-to-article-generator下载完整 Skill 目录,包含 SKILL.md 及所有相关文件
Generate or edit images via Gemini 3 Pro Image (Nano Banana Pro).
Batch-generate images via OpenAI Images API. Random prompt sampler + `index.html` gallery.
Generate spectrograms and feature-panel visualizations from audio with the songsee CLI.
Extract frames or short clips from videos using ffmpeg.
Search GIF providers with CLI/TUI, download results, and extract stills/sheets.
Category:media-generate