Agent skill

AI Music

by ZJU-REAL in ZJU-REAL/Easel

AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方 API)文生音乐,异步提交→轮询→下载,产物可再裁剪/归一化或加到视频。当用户说“AI 音乐”“AI 配乐”“生成 BGM”“背景音乐”“原创音乐”“AI 作曲”“纯音乐”“给视频配乐”“做首曲子”时使用。与…

Apache-2.0Auto-check: notesMedia & Creative

Install AI Music

skills CLI
$ npx skills add ZJU-REAL/Easel --skill ai-music -a claude-code

Project install by default; add -g for ~/.claude/skills/.

GitHub CLI
$ gh skill install ZJU-REAL/Easel ai-music --agent claude-code

Project scope by default; add --scope user for a personal install. Needs GitHub CLI 2.90.0 or later (public preview).

Manual copy
$ git clone --depth 1 https://github.com/ZJU-REAL/Easel.git skills-src && mkdir -p .claude/skills && cp -r skills-src/skills/openclaw/ai-music .claude/skills/ai-music && rm -rf skills-src

Use ~/.claude/skills/ instead of .claude/skills for a personal install. The folder must contain SKILL.md.

Claude Code skills documentation · loads skills from .claude/skills/

Facts

Skill name
ai-music
GitHub stars
3.4k
Token cost
~896 tokens
SKILL.md length
175 words
Files
2
Skills in repo
114
Repo updated
First seen
Licence
Apache-2.0

At a glance

AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方 API)文生音乐,异步提交→轮询→下载,产物可再裁剪/归一化或加到视频。当用户说“AI 音乐”“AI 配乐”“生成 BGM”“背景音乐”“原创音乐”“AI 作曲”“纯音乐”“给视频配乐”“做首曲子”时使用。与…

  • Works in 3 steps: 先自检配置 check(不发请求) → 生成音乐 generate → 后处理(可选,复用已有共享脚本,不在本 SKILL 重造)
  • Tasks that involve Text to speech and voice
  • SKILL.md covers 输入, 输出, 配置(需设的环境变量) and 执行步骤, plus 1 more section
  • Calls python; reaches dashscope.aliyuncs.com; needs DASHSCOPE_API_KEY and DASHSCOPE_KEY

What it does

AI Music is an agent skill from ZJU-REAL/Easel. AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方 API)文生音乐,异步提交→轮询→下载,产物可再裁剪/归一化或加到视频。当用户说“AI 音乐”“AI 配乐”“生成 BGM”“背景音乐”“原创音乐”“AI 作曲”“纯音乐”“给视频配乐”“做首曲子”时使用。与 tts-voiceover 的区别:tts-voiceover 生成人声口播/旁白,ai-music 生成背景音乐/配乐(无人声或带演唱)。

Its SKILL.md is about 900 tokens, which your agent loads only when the skill is triggered. The skill folder holds 1 other file (for example `EASEL-META.md`).

It sits in Media & Creative, covering Text to speech and voice. It works with Suno. The repository describes itself as: An open-source AI agent for social media — discover trends, create content, publish everywhere, and learn what works across Xiaohongshu, Douyin, Zhihu, Bilibili, and more.🎨一个开源的… The licence is Apache-2.0.

When your agent uses it

  • Tasks that involve Text to speech and voice

Example prompts

  • “生成 BGM”
  • “/ai-music”

Requirements

  • Python 3
  • A credential in DASHSCOPE_API_KEY
  • A credential in DASHSCOPE_KEY

Workflow steps

3 steps, taken from the step headings in SKILL.md.

  1. 先自检配置 check(不发请求)
  2. 生成音乐 generate
  3. 后处理(可选,复用已有共享脚本,不在本 SKILL 重造)

What it can do on your machine

Read from SKILL.md and the folder at commit 278f420. It shows what the files ask for, not the result of running them.

  • Tool permissions

    Pre-approves nothing: there is no allowed-tools line, so your agent's usual permission prompts apply.

    From allowed-tools in the SKILL.md frontmatter.

  • Runs code

    Shell commands in SKILL.md call:

    • python

    From the folder's file list and the shell code blocks in SKILL.md.

  • Network

    Hosts in commands or code, which the agent is likely to contact:

    • dashscope.aliyuncs.com

    From URLs in SKILL.md, links to its own repository left out.

  • Credentials

    Names these keys or tokens, usually read from environment variables:

    • DASHSCOPE_API_KEY
    • DASHSCOPE_KEY
    • ALIYUN_API_KEY
    • MUSIC_API_KEY

    From names ending in _API_KEY, _TOKEN, _SECRET, _KEY or _PASSWORD in SKILL.md.

Context cost

AI Music loads about 896 tokens when it runs. Until then it costs about 67 tokens; SKILL.md has 175 words of instructions outside code blocks.

Always · name and description, kept in context so the agent knows when to use it
~67
When it runs · the whole SKILL.md, loaded when a task matches
~896

Estimates: characters ÷ 4, the usual rule of thumb; real counts depend on the model's tokenizer. Scripts and assets cost tokens only if the agent reads them.

Safety

Auto-check: notes

The automated check noted patterns worth knowing about, such as sudo or a known installer.

  • NoteMentions a .env fileSKILL.md:34
    ` 到 `AGENTS.md` 末尾给出的 Easel 项目根,确认当前目录有 `.env` 和 `skills/shared/scripts/`,再运行注册表、`check` 或生成命令。不得改用 workspace 的 `./share
  • NoteMentions a .env fileSKILL.md:36
    在项目根 `.env` 或环境变量中设置(脚本自动向上查找 `.env`)。用户自己填 key。
  • NoteMentions a .env fileSKILL.md:62
    y.py configured --group music --env-file .env`。只有一个可用时直接显式传 `--provider`;多个可用且用户没点名时,先列出选项询问,不按 `MUSIC_PROVIDER` 擅自选择。

Automated static check — not a guarantee. Review scripts before installing. It scans the text of SKILL.md for risky patterns (piping downloads into a shell, reading credential files, hidden Unicode, destructive commands); files beside SKILL.md are not scanned.

SKILL.md

The full file from ZJU-REAL/Easel at commit 278f420, republished under its Apache-2.0 licence (© ZJU-REAL). 175 words, ~896 tokens.

Download SKILL.mdSave it as .claude/skills/ai-music/SKILL.md (or your agent's skills folder). This skill also uses 1 other file; get the full folder from GitHub.
name
ai-music
description
AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方 API)文生音乐,异步提交→轮询→下载,产物可再裁剪/归一化或加到视频。当用户说“AI 音乐”“AI 配乐”“生成 BGM”“背景音乐”“原创音乐”“AI 作曲”“纯音乐”“给视频配乐”“做首曲子”时使用。与 tts-voiceover 的区别:tts-voiceover 生成人声口播/旁白,ai-music 生成背景音乐/配乐(无人声或带演唱)。
layer
produce

AI 音乐 / BGM 生成(AI Music)

给短视频、Vlog、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。全程通过共享脚本 skills/shared/scripts/ai_music.py 封装音乐生成 API(可插拔 provider), 异步提交 → 轮询 → 下载。生成的音乐可再交给 audio_ops.py / video_ops.py 做裁剪、归一化或加到视频。

边界:本 SKILL 只做背景音乐 / 配乐。要人声口播 / 旁白 / 朗读用 tts-voiceover。

输入

字段必填说明
prompt是风格 / 情绪 / 乐器描述(如“轻快 lo-fi,钢琴+鼓点,vlog 片头”)
provider否dashscope 或 suno-compatible,也可用 env MUSIC_PROVIDER
lyrics否歌词(提供后走带演唱模式,不再是纯音乐)
duration否时长(秒),部分 provider 支持
instrumental否纯音乐(无人声 BGM)
output否默认 outputs/主题名/{name}.mp3

输出

  • 音乐音频文件(mp3,放入 outputs/主题名/)
  • 打印实际提交的 provider / model、任务轮询过程、最终输出路径

配置(需设的环境变量)

配置检查路径铁律:先 cd 到 AGENTS.md 末尾给出的 Easel 项目根,确认当前目录有 .env 和 skills/shared/scripts/,再运行注册表、check 或生成命令。不得改用 workspace 的 ./shared/scripts/...,也不得以 env / printenv 没显示变量为由判断未配置。

在项目根 .env 或环境变量中设置(脚本自动向上查找 .env)。用户自己填 key。

通用

bash
MUSIC_PROVIDER=dashscope        # 或 suno-compatible;也可用 --provider 覆盖

provider = dashscope(阿里云 DashScope / 百炼)

bash
DASHSCOPE_API_KEY=...           # 必填(别名 DASHSCOPE_KEY / ALIYUN_API_KEY)
DASHSCOPE_MUSIC_MODEL=audio-generation  # 可选(兼容旧名 DASHSCOPE_MODEL)
DASHSCOPE_BASE_URL=https://dashscope.aliyuncs.com/api/v1   # 可选

provider = suno-compatible(Suno 类第三方 API 网关)

bash
MUSIC_API_KEY=...               # 必填
MUSIC_BASE_URL=https://api.example.com/v1   # 必填,你的 API 根地址
MUSIC_MODEL=music-1             # 可选,按服务商模型名调整

执行步骤

先跑 python skills/shared/scripts/model_registry.py configured --group music --env-file .env。只有一个可用时直接显式传 --provider;多个可用且用户没点名时,先列出选项询问,不按 MUSIC_PROVIDER 擅自选择。

脚本路径(相对项目根):skills/shared/scripts/ai_music.py。每个子命令支持 -h。

1. 先自检配置 check(不发请求)
bash
python skills/shared/scripts/ai_music.py check --provider dashscope

缺 key 会明确列出缺哪个 env(含别名提示)。配置齐了再往下。

2. 生成音乐 generate
bash
# 纯音乐 BGM(dashscope)
python skills/shared/scripts/ai_music.py generate --provider dashscope \
  --prompt "轻快的 lo-fi 嘻哈,钢琴 + 柔和鼓点,适合 vlog 片头" \
  --duration 30 --instrumental \
  -o outputs/主题名/vlog-bgm.mp3

# 带演唱(suno-compatible,给了歌词)
python skills/shared/scripts/ai_music.py generate --provider suno-compatible \
  --prompt "温暖的民谣,吉他弹唱" \
  --lyrics "$(cat lyrics.txt)" \
  -o outputs/主题名/song.mp3

--poll-interval(轮询间隔,默认 5s)、--timeout(超时,默认 300s)可按需调。

3. 后处理(可选,复用已有共享脚本,不在本 SKILL 重造)
bash
# ① 裁剪到片头需要的长度
python skills/shared/scripts/audio_ops.py trim outputs/主题名/vlog-bgm.mp3 \
  -o outputs/主题名/bgm-8s.mp3 --duration 8

# ② 归一化到社媒响度(-14 LUFS)
python skills/shared/scripts/audio_ops.py normalize outputs/主题名/vlog-bgm.mp3 \
  -o outputs/主题名/bgm-norm.mp3

# ③ 把 BGM 加到视频(可调原声/BGM 音量比,自动循环并截断)
python skills/shared/scripts/video_ops.py bgm -i clip.mp4 -o clip_bgm.mp4 \
  --music outputs/主题名/vlog-bgm.mp3 --voice-volume 1.0 --music-volume 0.3

规则

  1. 先 check 再 generate — 缺 key 时 check 给出清晰中文提示,不浪费一次失败请求。
  2. 绝不覆盖原始素材 — 只写新文件到 outputs/主题名/。
  3. 不重造能力 — 裁剪 / 归一化 / 加视频 BGM 复用 audio_ops.py / video_ops.py。
  4. provider 可插拔 — 换服务商只改 --provider + env,SKILL 流程不变。
  5. 与 tts-voiceover 分工 — 背景音乐/配乐找 ai-music,人声配音找 tts-voiceover。 两者可组合:ai-music 出 BGM + tts-voiceover 出旁白 → video_ops.py bgm 混音。

© ZJU-REAL, Apache-2.0. Rendered from Markdown: HTML in the file is shown as text, images as links, and headings moved down two levels. Raw file

Files

SKILL.md and 1 other file in skills/openclaw/ai-music of ZJU-REAL/Easel.

  • SKILL.md
  • EASEL-META.md

Open the folder on GitHubat commit 278f420

Compare with similar skills

AI Music next to the 5 skills that share the most tags, products or categories with it. Stars are the repository's; “used in” counts other GitHub owners with a copy.

AI Music compared with similar skills
SkillStarsUsed inTokensAuto-checkLicenceRepo updated
AI Music this skillZJU-REAL/Easel3.4k—~896Automated safety check: NotesApache-2.0
Audio StudioWrongStack/WrongStack371—~910Automated safety check: PassMIT
AI Music And Soundsocial-media-skills/skills134—~1.9kAutomated safety check: PassMIT
Audio Jinglesanqiufong/slides-from-anything1321 repos~1.1kAutomated safety check: PassApache-2.0
Sunosocial-media-skills/skills134—~2.1kAutomated safety check: PassMIT
Musictadaspetra/loop2962 repos~827Automated safety check: PassMIT

Similar skills

  • Audio Studio

    WrongStack/WrongStack

    Compose music, lyrics, soundscapes and voiceovers, or implement browser audio feedback.

    371 GitHub stars~910 tokensUpdated yesterday
    Media & CreativeAuto-check passed
  • AI Music And Sound

    social-media-skills/skills

    The AI music + sound-design skill for social -- original/licensed audio beds and sound design for Reels/TikToks/Shorts/videos.

    134 GitHub stars~1.9k tokensUpdated 9 days ago
    Media & CreativeAuto-check passed
  • Audio Jingle

    sanqiufong/slides-from-anything

    Audio generation skill — jingles, beds, voiceover, and sound effects.

    132 GitHub starsUsed in 1 repo~1.1k tokens
    Media & CreativeAuto-check passed
  • Suno

    social-media-skills/skills

    The Suno craft skill — generate full songs, brand music, and audio (vocals, lyrics, stems) with the right tier, honest rights, and structure control.

    134 GitHub stars~2.1k tokensUpdated 9 days ago
    Media & CreativeAuto-check passed
  • Music

    tadaspetra/loop

    Generate music using ElevenLabs Music API. An agent skill from tadaspetra/loop.

    296 GitHub starsUsed in 2 repos~827 tokens
    Media & CreativeAuto-check passed
  • Sound Effects

    tadaspetra/loop

    Generate sound effects from text descriptions using ElevenLabs.

    296 GitHub starsUsed in 2 repos~1.1k tokens
    Media & CreativeAuto-check passed

More from ZJU-REAL/Easel

All 114 skills in this repo
  • Gzh Design

    ZJU-REAL/Easel

    微信公众号文章排版引擎:把 Markdown / Word(.docx) / PDF / 纯文本转成可直接粘贴进公众号编辑器的 HTML,自动章节编号、关键词标记、引言卡、目录、代码块、图片/GIF、作者签名;主题从 references/theme-index.md…

    3.4k GitHub stars~2.1k tokensUpdated today
    Auto-check passed
  • 微信公众号文章自动创作与发布工具。给定参考文章、文字或文档,自动搜索整理全网相关信息、生成图文并茂的公众号文章,并发布到微信公众号草稿箱。特别强调反 AI 检测写作。

    3.4k GitHub stars~1.8k tokensUpdated today
    Auto-check passed
  • Card Design

    ZJU-REAL/Easel

    社媒卡片视觉设计系统:提供配色、中文字体层级、满画幅布局、品类骨架和死空白/密度质检,避免模板化 PPT 与廉价 AI 感。

    3.4k GitHub stars~657 tokensUpdated today
    Auto-check passed
  • Ecom Details Image

    ZJU-REAL/Easel

    生成电商商品视觉方案:主图概念、场景图、详情页视觉方向和 AI 生图 Prompt. An agent skill from ZJU-REAL/Easel.

    3.4k GitHub stars~1.1k tokensUpdated today
    Auto-check: notes
  • Infographic

    ZJU-REAL/Easel

    将数据或文字内容转化为可视化信息图,支持静态(AntV)和动画 GIF 两种模式。当用户需要制作信息图、数据可视化、流程图、对比图、动画图表、GIF 图表、思维导图、SWOT 分析图时调用。本地渲染信息图/GIF 动画;要单张静态图片 URL 用 chart-visualization,要 CSV/JSON→整页报告用 data-report

    3.4k GitHub stars~643 tokensUpdated today
    Auto-check passed
  • Novel Writer

    ZJU-REAL/Easel

    长篇小说/网文连载创作:从世界观、人设和三级大纲写到逐章正文,并用文件化状态维护伏笔、前情和跨章一致性. An agent skill from ZJU-REAL/Easel.

    3.4k GitHub stars~1k tokensUpdated today
    Auto-check passed

Works with

Questions about AI Music

What does AI Music do?

AI 音乐 / BGM 生成:给短视频、社媒内容生成原创背景音乐 / 配乐 / 纯音乐。通过可插拔 provider(阿里 DashScope / Suno 类第三方 API)文生音乐,异步提交→轮询→下载,产物可再裁剪/归一化或加到视频。当用户说“AI 音乐”“AI 配乐”“生成 BGM”“背景音乐”“原创音乐”“AI 作曲”“纯音乐”“给视频配乐”“做首曲子”时使用。与…. AI Music is an agent skill from ZJU-REAL/Easel.

When should I use AI Music?

AI Music fits situations like: tasks that involve Text to speech and voice.

How do I install AI Music in Claude Code?

Run `npx skills add ZJU-REAL/Easel --skill ai-music -a claude-code`. Or copy the skill folder (skills/openclaw/ai-music in ZJU-REAL/Easel) into .claude/skills/ai-music in your project. Claude Code loads it when a task matches its description.

How do I install AI Music in Codex?

Run `npx skills add ZJU-REAL/Easel --skill ai-music -a codex`. Or copy the skill folder (skills/openclaw/ai-music in ZJU-REAL/Easel) into .agents/skills/ai-music in your project. Codex loads it when a task matches its description.

Can I use AI Music in Cursor, Gemini CLI or GitHub Copilot?

Cursor, Gemini CLI, GitHub Copilot and OpenCode also load SKILL.md folders. With the skills CLI, run `npx skills add ZJU-REAL/Easel --skill ai-music -a cursor` (or -a gemini-cli, github-copilot or opencode for the others). To copy it by hand, put the folder in .cursor/skills/ai-music, .gemini/skills/ai-music, .github/skills/ai-music and .opencode/skills/ai-music in your project.

What does AI Music need to run?

Going by SKILL.md and its folder, AI Music needs the command-line tools its instructions call (python) and credentials named DASHSCOPE_API_KEY, DASHSCOPE_KEY, ALIYUN_API_KEY and MUSIC_API_KEY. Our summary lists: Python 3; A credential in DASHSCOPE_API_KEY; A credential in DASHSCOPE_KEY.

Does AI Music access the network?

SKILL.md names 1 domain. In commands or code: dashscope.aliyuncs.com; the agent is likely to contact it when it follows the instructions. This is read from the text; nothing was executed.

Is AI Music safe to install?

Our automated static check of SKILL.md found notes only (mentions a .env file), nothing it rates as a warning. It is not a guarantee. Review the folder before installing.

What licence does AI Music use?

AI Music is published under the Apache-2.0 licence (the repository's licence). It allows redistribution, so the full SKILL.md is shown on this page.

How many tokens does AI Music use?

About 896 tokens (SKILL.md is roughly 3.6k characters). Agents keep only the skill's name and description in context until a task matches; then they load SKILL.md in full.

What are the alternatives to AI Music?

Skills that share tags, products or a category with AI Music: Audio Studio (WrongStack/WrongStack, 371 stars), AI Music And Sound (social-media-skills/skills, 134 stars), Audio Jingle (sanqiufong/slides-from-anything, 132 stars) and Suno (social-media-skills/skills, 134 stars). The comparison table on this page puts their stars, adoption, token cost, safety result and licence side by side.

Who maintains AI Music?

ZJU-REAL (a GitHub organization) maintains it in ZJU-REAL/Easel, which has 3,376 GitHub stars. The repository holds 114 skills in this directory. The repository was last updated on October 9, 2026.

Source: ZJU-REAL/Easel on GitHub. Facts on this page come from the repository at the commit we read; the author's words are quoted as theirs.