声动视觉引擎SonicMotion
使用教程 · 从一张图到 VJ 视觉大片
声动视觉引擎 · SonicMotion

从一张图 + 一首歌
一键生成 VJ 视觉大片

声动解决的是整个 VJ 舞台视觉行业的视觉难题——从电音现场的声光电,到演出视频的视觉呈现。上传一张图、一首歌,自研音乐算法引擎(首个专为电子音乐 EDM 打造)毫秒级解析节拍与爆点,配合视觉理解能力,一键生成卡点精准、效果顶尖的视觉提示词与资源包。非线性、带导演思维的创作方式,几分钟完成过去 1-2 天的工作——高质、高效、更省钱。

价值主张为什么用声动?

核心

自研音乐算法引擎

全网首个专为电子音乐 EDM 打造的音频分析算法,BPM / 节拍 / Drop / 爆点毫秒级解析,精度远超人工手搓。

核心

读懂你脑海中的画面

各种算法与视觉大模型理解你脑海中对画面与节奏的要求,把抽象想法转成可执行、可落地的高质量提示词。

方式

导演式非线性创作

像剪辑软件一样的时间轴操作,带导演思维自由支配每个镜头的起承转合,省去三维软件与手搓提示词的繁琐。

灵感

顶级视觉基因

深度研究 Anyma、Eric Prydz 等世界顶级 VJ 的视觉语言与编排逻辑,内置到引擎训练与动作库,效果可对标一线舞台。

门槛

零门槛上手

平台像后期软件一样直观,新手几分钟即可上手。不用研究 AI、不需要专业背景,拖入素材就能开始创作。

避坑

拒绝卖课入坑

不必花钱买各种 AI 课、VJ 入坑教程。引擎内沉淀大量提示词与工具,你学到的是最底层、最优质的方法。

资源

海量资源库

内置近 10 万条高质量提示词与大量专业工具,覆盖镜头、灯光、特效、场景——这些在市面上完全没有。

关键

减少抽卡省钱

自行掌控生成效果,大幅减少抽卡时间与高额抽卡费用——这是最关键的。

行业首创:目前市面上唯一把「一张图 → VJ 视觉大片」做成完整流程化工作流的平台,直击整个 VJ 舞台视觉行业最核心的痛点——不止 VJ,演出视觉、声光电、舞台背景视频等视觉呈现场景都能受益。

视觉基因 · 对标世界顶级 VJ

声动的视觉内核,来自对全球一线 VJ 艺术家视觉语言的长期拆解与研究——我们把他们的画面构成、节奏逻辑、情绪铺陈,沉淀为可复用的算法与动作库,让你的每一次生成,都站在顶级视觉语言之上。

Anyma

极简未来主义 · 全息人脸与末世美学,用克制构建震撼。

Eric Prydz

HOLO 全息舞台 · 巨型几何体与空间叙事,技术与艺术的顶点。

Excision

Bass 场景 · 机械生物与能量爆裂,重拍之下的力量美学。

Afterlife

Melodic Techno · 情绪化视觉与光影层次,氛围的极致表达。

你的作品,直接站在这些顶级视觉语言之上。

本教程会带你走完整个创作链路:先理解三条创作路径该怎么选,再按步骤实操每个模块。每处「需要截图」的位置都放了占位框,方便你后续补图。

适用对象:首次使用的新手、想精调画面的进阶用户、以及需要批量出片的活动策划与 VJ 从业者。整体预计阅读 10 分钟。

平台定位(请先记住):声动专注「从一张图片到一套 VJ 视觉提示词」的创作工作流,交付的是完整提示词 + 分类资源包,不是最终视频。图生视频需要消耗较多算力成本,本平台暂不内置,由你自行前往第三方平台(即梦 / MiniMax H3 / 本地 ComfyUI)用参考图 + 音乐生成——这样更省钱、也更灵活。

01 · 开始前想清楚

三大创作路径,选哪条?

平台不是单一入口,而是围绕「音乐 → 视觉」设计的三条路径。它们数据互通,可随时切换、中途跳转,成果最终都汇入同一套提示词生成流程。

路径 A · 最快

一键自动生成

上传图片 + 音乐 → 引擎自动听歌分析(BPM / 节拍 / Drop / 爆点)→ 全自动生成视觉提示词资源包。适合赶时间、想快速拿到标准流程。

路径 B · 最精细

视觉创作(DIY)

进入手动时间轴,亲手放置爆点、区域、自定义标记,精确到每一层每一秒,再提交 AI 分析生成。适合追求节奏完全对齐的演出。

路径 C · 最稳

音频分析 → 视觉创作

先用音频分析把整首歌的音乐结构摸清楚(BPM / 段落 / 爆点分布),再带着「地图」去视觉创作精雕细琢。

什么时候该用哪条:刚入门 / 赶交付用路径 A;给知名曲目做演出视觉用路径 B;甲方给了指定音乐、要求镜头跟着结构走,用路径 C。

02 · 3 分钟出片

3 分钟快速上手

不想看细节?先走一遍最小闭环,感受「上传 → 拿到提示词资源包」的全过程。

1
打开「一键自动生成」
在左侧菜单点击 一键自动生成,进入创作向导。
2
上传图片与音乐
上传至少一张视觉底图(支持多张轮换)和一首音乐(mp3 / wav)。图片决定画面主体风格,音乐决定节奏与爆点。
3
填参数,选「自动分析」
设置生成段数与每段时长,选择 自动分析 模式,点击生成。引擎会先分析音乐结构,再生成每段对应的视觉提示词。
4
等待生成,拿到资源包
生成完成后,在结果页获取分段提示词、试听分段音频,并下载完整资源包(zip),即可拿到第三方平台出片。
占位图
【占位】快速上手完整截图
建议:一键自动生成页从上到下的整屏截图(步骤栏 + 上传区 + 参数区),标注 1-4 步位置。
03 · 自动创作

一键自动生成

最省心的路径:素材交给引擎,节奏交给引擎,你只做「上传 + 选择」两件事。它也同时是路径 B / C 的起点——想精调时,随时切到 DIY 分支。

3.1第一步:上传素材

  • 图片:点击或拖拽上传,建议用主体突出、背景干净的图片,系统会围绕主体做延展与运镜。
  • 音乐:上传后系统会做基础解析并显示可播放状态;若提示「无播放地址」,说明该会话音乐未随会话保存,重新上传即可。
  • 多个会话:平台会为每次上传建立独立会话,历史会话可从列表恢复,数据不丢失。
占位图
【占位】上传素材界面截图
建议:上传区截图(图片 + 音乐两个上传框),并用箭头标注点击 / 拖拽两种方式。

3.2第二步:配置参数

在这里定义「产出多少、每段多长」。常见配置:整首 60 秒 → 3 段 × 20 秒;或 15 秒短片 → 1 段 × 15 秒。系统会严格按你的设置切分,并在每段开头对齐 0 秒起点。

占位图
【占位】参数配置界面截图
建议:参数表单截图,用箭头标注「段数」「每段时长」两个关键输入。

3.3第三步:选择生成模式(关键分支)

这是「一键生成」的核心分岔口,决定引擎的介入深度:

A
自动分析模式 → 直接生成
自研音乐算法引擎自动分析音乐结构(BPM、节拍、Drop、爆点),自动匹配视觉动作库,直接生成提示词。零手动干预、速度快,适合快速出标准流程;但因为是引擎自动分析,精度属于通用水平——追求极致卡点的高阶创作者,建议切到 DIY 手动精调。
B
手动 DIY 模式 → 进入视觉创作
跳转到 视觉创作 时间轴,亲手放置点标记与区域标记、自定义镜头语言。调好后点「生成」,再回到本流程提交分析生成。适合追求精确卡点
占位图
【占位】模式选择界面截图
建议:自动分析 / DIY 两张模式卡片截图,用箭头标注两个分支去向。
!

记住:从「一键自动生成」进入 DIY 后,完成创作回到的是本流程的分析生成页;而从「视觉创作」独立入口进入,完成创作则回到视觉创作。两条入口的数据始终保存在同一个会话中,不会丢。

3.4第四步:分析生成

确认后提交给 AI 分析。系统会按你设定的段数 × 时长切分音乐,逐段生成视觉提示词,产出完整的分类资源包(zip)。拿到后:把资源包中的提示词 + 你的参考图 + 音乐,送入即梦 / MiniMax H3 / 本地 ComfyUI 即可生成视频。

占位图
【占位】生成结果页截图
建议:结果页截图(分段提示词列表 + 音频试听 + 资源包下载按钮),用箭头标注「下载资源包」入口。
!

关于出片:本平台不内置高消耗的图生视频流程。拿到资源包后,请自行前往第三方平台,用参考图 + 音乐完成视频生成——这也是更省钱、更自由的方式。

04 · 读懂音乐

音频分析

音频分析是纯音乐底层的分析工具:BPM、节拍、强拍、Drop、爆点、结构一目了然,全部由自研的首个电子音乐 EDM 音乐算法引擎毫秒级计算——这是人工手搓永远达不到的精度。它只做分析、不生成视频和提示词:用它读懂音乐,再进视觉创作做精调,是路径 C 的地图。

1
上传音乐
支持 mp3 / wav,整首分析。上传后系统自动开始解析。
2
查看分析结果
得到 BPM、节拍数、强拍、Drop 位置、爆点、音乐结构 等数据,并叠加显示频谱 / 能量 / 节奏等特征曲线。
3
导出标记数据
标记数据以 JSON 呈现,可一键复制作为后续分析参考,或作为视觉创作的前置参考。
占位图
【占位】音频分析结果截图
建议:分析页整屏截图(BPM 数据卡 + 特征曲线 + 标记列表),用箭头标注关键指标。

历史记录:所有分析过的音乐都保存在「历史分析记录」里,随时可回看,不必重复上传。

05 · 精细控制

视觉创作(手动时间轴)

这是声动的「灵魂模块」:类似剪辑软件的轨道式时间轴,最多 6 层,用「点标记」与「区域标记」把视觉动作精确排布到音乐的每一拍。所见即所得,改完即可提交生成。

5.1时间轴与图层

波形图底部是时间轴:蓝色区域 = 播放区域,时间从左到右流动。视觉标记分布在 最多 6 个图层 上,系统会自动挑选空层放置,避免相互叠压看不清。

  • 播放指针:点击任意位置(包括标记块本身),播放头立即跳到该时间点,便于试听定位。
  • 自动避让:新标记会自动放到不冲突的空层;拖拽时若与其它层重叠,会弹回空位。
  • 吸附对齐:开启吸附后,标记拖到节拍或播放指针附近会自动吸齐,卡点更准;吸附阈值可调小以支持更精细的微调。
占位图
【占位】时间轴整体截图
建议:视觉创作页整屏截图,用箭头标注「图层区」「波形区」「播放指针」「标记列表」。可以放一张已排满标记的示例。

5.2点标记:只定起点

点标记 = 只告诉引擎「这里开始做什么」,不限制结束时间,引擎可按逻辑自由发挥到合理结束。典型类型:爆点、Drop、强拍频闪点、提示点、转场点 以及自定义点标记。

1
放置
在左侧标记列表 单击类型 → 再点一下波形,即可一键放置;也可直接 拖入 到目标图层。
2
调整
拖动标记可移动位置;点标记默认约 1 秒时长,拖拽两端可拉伸长度;鼠标悬停有完整信息提示。
3
编辑 / 删除
右键弹出菜单:删除标记、或编辑自定义描述;选中后按 Delete 也可删除。

点标记的线:从标记点向下延伸的指示线只显示到标记自身高度区域,不会挡住下方的区域标记,便于重叠观察。

5.3区域标记:A 到 B 的完整事件

区域标记 = 严格的 A → B 两点动作:必须从起点开始、到终点结束,引擎在这两个时间点之间完成整段事件。若你的描述里写了具体次数(如「闪 4 次」),引擎会严格照做。典型类型:前奏铺垫、蓄力爬升、静默抽离、爆发段、渐能放空、结尾收散、消散 及自定义区域标记。

1
放置
单击区域类型 → 依次点波形 起点终点,即划定区域;也可拖入目标图层。
2
缩放
鼠标放到块的前后两端出现拖拽柄,拉伸调整起止位置;放在块中间则是移动。
3
高级拖动
按住 Ctrl 拖动 = 复制一块到新位置(原块保留);按住 Shift 拖动 = 仅上下换层,时间位置不变。
占位图
【占位】点标记 + 区域标记示例截图
建议:一张混合放置了爆点、Drop 与爆发段区域的时间轴截图,用箭头标注「点标记」「区域块」「拖拽柄」。

5.4自定义标记

内置标记不够用?可以创建完全属于你的标记:

  • 在点标记 / 区域标记下点击 自定义增加,选择颜色(30+ 默认色板,与内置色不冲突)、填写名称多行长文本描述
  • 自定义标记的使用方式与内置完全一致:可拖入、可调长度、可右键编辑描述。
  • 在标记列表中,自定义项带「自定义」标签(悬停可见说明),在波形图上用专属图标/符号区分,一眼可辨。
  • 自定义标记可编辑:改名后,场景中所有同名标记的名称与描述词会同步更新;删除时可选择「只删定义」或「连场景中的标记一起删」。
占位图
【占位】自定义标记创建弹窗截图
建议:新建自定义标记的弹窗截图(颜色选择 + 名称 + 多行描述),以及列表里带「自定义」标签的样子。

5.5选择 / 框选 / 批量删除

标记多了以后,单个删除太慢——用选择过滤器批量管理:

  • 按类型选择:在顶部「选择过滤器」中按类型多选(如所有爆点、所有自定义区域),一键选中同类标记。
  • 框选:切换到框选模式,在时间轴上拖出矩形,框住的所有标记一次性选中。
  • 删除:选中后按 Delete 或右键删除,批量清理。
  • 框选是独立模式,不会与其它选择 / 编辑模式冲突。
占位图
【占位】选择过滤器 + 框选示意截图
建议:顶部选择过滤器展开截图 + 时间轴上框选虚线矩形示意。

5.6文件导入 / 导出

你的排布成果是一个完整工程(含所有标记、自定义定义、时间点)。通过文件操作可:导出 JSON 保存 / 分享,或 导入 JSON 恢复到任意会话继续编辑。建议每次大改前先导出备份。

占位图
【占位】文件操作(导入 / 导出)截图
建议:文件操作菜单截图,标注「导出 JSON」「导入 JSON」两个入口。

5.7提交 AI 分析生成

1
点击「生成输出」
会弹出确认窗「确认生成输出」,确认后进入提交环节。
2
提交给 AI 分析
点击「提交给 AI 分析」,系统读取你排布的时间轴与标记描述,重组为提示词并生成。
3
回到视觉创作
从「视觉创作」入口进入时,完成后关闭会回到视觉创作页(而非一键生成页),数据全程保留。
!

说明:引擎会优先执行你在时间轴上写明的描述(起止时间、动作次数、灯光颜色等),并对描述进行重组润色后生成符合规范的提示词——你标注的内容永远是最高的执行优先级。

06 · 辅助创作

提示词工具箱

三个独立的提示词生成工具,帮你快速产出高质量创作素材,可配合视觉创作使用。

工具用途入口
音乐提示词根据音乐风格 / 情绪生成符合规范的音频提示词侧边栏「音乐提示词」
角色提示词为画面主体角色生成形象 / 动作描述侧边栏「角色提示词」
场景提示词为 VJ 画面生成场景 / 灯光 / 氛围描述侧边栏「场景提示词」

用法一致:输入你的想法 → 选择类型 → 生成,得到的提示词可直接复制到外部视频模型或配合平台使用。

07 · 事半功倍

快捷键与手势一览

操作效果
单击标记类型 → 点波形一键放置点标记 / 区域标记
拖拽标记移动位置(按当前落点定位,不从头吸附)
拖拽标记两端拉伸 / 缩放标记时长
Ctrl + 拖拽复制一块到新位置(原块保留),并在该处生成
Shift + 拖拽仅上下平移换层,时间位置不变(触发时显示提示)
开启吸附拖到节拍 / 播放指针附近自动对齐,可调小阈值精细微调
点击标记 / 空白播放指针跳到点击位置
右键标记删除标记 / 编辑自定义描述(多行文本框)
Delete删除选中的标记
框选模式拖出矩形批量选中标记
拖放结束自动切回选择模式,避免误操作
08 · 疑难解答

常见问题

为什么我上传的音乐显示「无播放地址」?

说明该会话的音乐未随会话保存(例如从旧会话切换过来)。回到对应会话重新上传音乐即可,数据本身不会丢失。

从视觉创作提交生成后,关闭页面却跳到别处?

两条入口的返回逻辑不同:从「一键自动生成」进 DIY,完成生成回到一键生成的分析生成页;从「视觉创作」独立入口进,完成生成回到视觉创作。数据始终保存在同一会话中,跳转不会丢内容。

标记拖不动 / 一拖就变成整条时间线在动?

拖拽应从标记自身按下并保持,吸附开启时范围较小可用调整阈值解决;拖放完成后系统会自动回到选择模式,若仍出现误操作,可关闭吸附后再试。

自定义标记为什么和内置标记长得不一样?

是有意设计的:自定义标记用专属图标 / 符号、专属颜色,并在列表带「自定义」标签,方便你一眼区分自制内容与系统内置内容。

生成结果里我标注的内容没被执行?

引擎会优先执行你时间轴上的标注(时间点、次数、颜色、动作),并对描述做重组润色。若发现关键内容丢失,请检查标记是否落在有效分析时间段内——超出「段数 × 时长」范围的标记不会参与分析。

怎么批量删除一堆标记?

用顶部「选择过滤器」按类型多选,或切换到框选模式框住目标,然后按 Delete 或右键删除,一次性清理。

09 · 保持联系

联系我们

遇到问题、想提需求、或想一起把 VJ 行业做得更好——欢迎找到我们。

联系我们

商务合作、批量出片、定制服务

【占位】联系电话 / 邮箱

关注公众号

教程更新、案例分享、功能上新

【占位】公众号二维码

加入我们

平台玩法与创作思路五花八门,更多使用教程与灵感交流,欢迎加入我们的群聊,一起创作更好的 VJ 视觉大片。

【占位】加入方式 / 社群二维码

以上占位处后续替换为你的真实联系方式与二维码即可,其余文案与版式无需改动。