PyTorch library for audio generation including text-to-music (MusicGen) and text-to-sound (AudioGen). Use when you need to generate music from text descriptions, create sound effects, or perform melody-conditioned music generation.
PyTorch library for audio generation including text-to-music (MusicGen) and text-to-sound (AudioGen). Use when you need to generate music from text descriptions, create sound effects, or perform melody-conditioned music generation.
用于音频生成的PyTorch库,包括文本到音乐(MusicGen)和文本到声音(AudioGen)。当您需要从文本描述生成音乐、创建音效或执行旋律条件的音乐生成时使用。
Category: media-generate (媒体生成) · Author: davila7 · Version: @main · License: MIT
Tags: Multimodal, Audio Generation, Text-to-Music, Text-to-Audio, MusicGen
该 Skill 暂无文档文件。
npx skills add davila7/audiocraft-audio-generation下载完整 Skill 目录,包含 SKILL.md 及所有相关文件
Generate or edit images via Gemini 3 Pro Image (Nano Banana Pro).
Batch-generate images via OpenAI Images API. Random prompt sampler + `index.html` gallery.
Generate spectrograms and feature-panel visualizations from audio with the songsee CLI.
Extract frames or short clips from videos using ffmpeg.
Search GIF providers with CLI/TUI, download results, and extract stills/sheets.
Category:media-generate
Tags:Multimodal, Audio Generation, Text-to-Music, Text-to-Audio, MusicGen